پرپلکسیتی از ابزار تازه‌ای به نام Hybrid Compute رونمایی کرده که یک کار واحد را بین یک مدل ابری قدرتمند و یک مدل زبانی محلی روی کامپیوتر کاربر تقسیم می‌کند. هدف اصلی، نگه‌داشتن داده‌های حساس روی دستگاه شخصی و در عین حال کاهش هزینه پردازش است.

Hybrid Compute دقیقاً چه کاری انجام می‌دهد؟

این قابلیت بخشی از خانواده محصولات Perplexity Computer است؛ مجموعه‌ای از عامل‌های هوش مصنوعی که از بهمن‌ماه معرفی شدند و می‌توانند با استفاده از وب، فایل‌ها و اپلیکیشن‌های روی سیستم، وظایف را به‌صورت خودکار انجام دهند. Hybrid Compute تازه‌ترین شاخه این مجموعه است و در کنار Personal Computer برای مک عرضه شده است.

با فعال‌سازی این ابزار، بخشی از کار به یک مدل پیشرفته ابری مثل Opus 5 یا GPT-5.6 Sol سپرده می‌شود، در حالی که بخش‌های حساس‌تر روی یک مدل زبانی محلی روی همان مک پردازش می‌شوند. برای مثال، یک وکیل که می‌خواهد پرونده موکل خود را با سوابق قضایی مشابه مقایسه کند، می‌تواند داده‌های محرمانه را هرگز از دستگاهش خارج نکند.

چرا حریم خصوصی و هزینه، دو دلیل اصلی این تصمیم‌اند

پرپلکسیتی دو انگیزه اصلی برای این معماری ترکیبی اعلام کرده است. اول، حفظ محرمانگی اطلاعات حساس کاربران و مشتریان سازمانی. دوم، صرفه‌جویی در هزینه استنتاج، چون مدل‌های ابری معمولاً گران‌تر از اجرای محلی هستند.

جان استاف، مسئول محصولات مک این شرکت، توضیح داده که این قابلیت مستقیماً درون اپلیکیشن مک ادغام شده و هر بار که کاربر بخواهد فایل یا اطلاعاتی را آپلود یا ارسال کند، سیستم به‌صورت خودکار محتوای حساس را شناسایی و از کاربر برای ارسال آن به فضای ابری تأییدیه می‌گیرد. برای این کار، یک طبقه‌بند حریم خصوصی تازه آموزش داده شده که پیشنهاد می‌دهد کدام فایل‌ها بهتر است روی دستگاه بمانند.

پیش از شروع پردازش، کاربر می‌تواند فهرست فایل‌هایی را که قرار است از فضای ابری کنار گذاشته شوند بررسی کند تا مطمئن شود چیزی مهم نادیده گرفته نشده است.

مدل‌های محلی قابل انتخاب

برای اجرای بخش محلی، کاربران در حال حاضر می‌توانند از Gemma E4B یا دو نسخه از مدل ۳۵ میلیارد پارامتری کوئن ۳.۶ استفاده کنند؛ یکی از این نسخه‌ها را خود پرپلکسیتی به‌طور اختصاصی پس‌آموزش داده است. شرکت وعده داده مدل‌های محلی بیشتری در آینده اضافه خواهد شد. نصب هیچ‌کدام از این مدل‌ها نیاز به کار با ترمینال ندارد و اپلیکیشن پرپلکسیتی خودش فرآیند نصب را انجام می‌دهد.

نظارت روی مصرف منابع و اجرای وظایف

هنگام اجرای یک وظیفه ترکیبی، کاربر می‌تواند مصرف CPU، GPU و حافظه سیستم محلی را در یک نمودار زنده ببیند و در کنار آن، تعداد توکن‌های مصرفی را دنبال کند. نکته مهم این‌جاست که برای توکن‌هایی که مدل محلی روی همان دستگاه تولید می‌کند، هزینه‌ای از کاربر کسر نمی‌شود. کاربران همچنین می‌توانند از طریق آیفون، وظایف جدیدی را در صف قرار دهند.

استاف در پاسخ به این پرسش که آیا خروجی این سیستم ترکیبی با یک سیستم کاملاً ابری مقایسه شده یا نه، گفته خروجی کاملاً ابری تقریباً همیشه از نظر کیفیت برتر است، اما گران‌تر هم هست؛ به گفته او، برخی کاربران برای کارشان به قدرتمندترین مدل نیاز ندارند و در آن موارد، حریم خصوصی و هزینه اهمیت بیشتری پیدا می‌کند.

در دسترس بودن

Hybrid Compute فعلاً فقط روی مک‌های مجهز به تراشه Apple Silicon با macOS 15 در دسترس است و پرپلکسیتی حداقل ۳۲ گیگابایت حافظه یکپارچه را توصیه می‌کند. این قابلیت برای مشترکان پلن‌های Pro و Max و همچنین مشتریان سازمانی فعال شده است.

سوالات متداول

آیا استفاده از Hybrid Compute رایگان است؟ این قابلیت برای مشترکان پلن‌های Pro و Max پرپلکسیتی و مشتریان سازمانی در دسترس است؛ توکن‌های تولیدشده توسط مدل محلی هزینه جداگانه‌ای ندارند.

آیا Hybrid Compute روی ویندوز هم کار می‌کند؟ در حال حاضر خیر؛ این قابلیت فقط روی مک‌های Apple Silicon با macOS 15 عرضه شده است.

چه مدل‌های محلی‌ای پشتیبانی می‌شوند؟ Gemma E4B و دو نسخه از مدل ۳۵ میلیارد پارامتری کوئن ۳.۶، که یکی از آن‌ها توسط خود پرپلکسیتی پس‌آموزش داده شده است.

جمع‌بندی

Hybrid Compute نشان می‌دهد که ترکیب مدل‌های ابری و محلی می‌تواند راهی عملی برای حل دوگانه قدرت پردازش و حفظ حریم خصوصی باشد. فعلاً این قابلیت محدود به مک‌های اپل است، اما اگر پرپلکسیتی آن را به پلتفرم‌های دیگر هم بیاورد، می‌تواند الگویی برای دیگر شرکت‌های هوش مصنوعی هم باشد.


منبع: Engadget