در جریان IFA ۲۰۲۶، انویدیا اعلام کرد هوش مصنوعی مرزی در حال «محلی شدن» است و ابزار تازهٔ NVIDIA PAIR (مخفف Personal AI Router) را معرفی کرد. این نرم‌افزار رایگان و متن‌باز، استنتاج مدل‌های محلی را بین چند پی‌سی روی شبکهٔ خانگی پخش می‌کند تا وقتی چند زیرعامل هم‌زمان کار می‌کنند، همهٔ درخواست‌ها پشت یک GPU گیر نمانند.

به نوشتهٔ بلاگ رسمی انویدیا، بیش از نیمی از خانوارهای آمریکا دو یا چند پی‌سی دارند و بخش زیادی از این قدرت محاسبه در طول روز بیکار می‌ماند. PAIR همان سیستم‌ها را برای هوش مصنوعی محلی به کار می‌گیرد؛ بدون اینکه لازم باشد ایجنت یا ابزار کاربر از صفر برای «کلاستر خانگی» بازنویسی شود.

PAIR چیست و چطور استنتاج را روی شبکهٔ خانگی پخش می‌کند؟

طبق اعلام انویدیا، PAIR به‌طور خودکار پی‌سی‌های سازگار روی شبکهٔ محلی را پیدا می‌کند و درخواست‌های استنتاج مستقل را به هر سیستمی که ظرفیت آزاد دارد می‌فرستد. این ابزار با Ollama و LM Studio کار می‌کند و وقتی دستگاهی به شبکه می‌پیوندد یا خارج می‌شود، خود را تطبیق می‌دهد.

نسخهٔ بتای PAIR برای ویندوز، مک‌اواس و لینوکس با رابط گرافیکی و ترمینال در دسترس است. سخت‌افزار پشتیبانی‌شده شامل GPUهای GeForce RTX سری ۲۰ و جدیدتر، GPUهای ورک‌استیشن RTX PRO (از معماری Turing به بعد)، NVIDIA DGX Spark و سیلیکون Apple M4 یا جدیدتر است.

در مثال رسمی، کاربر می‌تواند از Hermes بخواهد برنامهٔ «Sunday Reset» بسازد؛ یعنی اینباکس شلوغ را مرتب کند و کارها را اولویت‌بندی کند. Hermes کار را بین چند زیرعامل تقسیم می‌کند و PAIR آن کارها را بین پی‌سی‌های آزاد پخش می‌کند، نه اینکه همه روی یک GPU صف بکشند. نتیجهٔ اعلام‌شده: قدرت محاسبهٔ بیشتر برای ایجنت‌های محلی، اجرای موازی بیشتر، و امکان انتقال بار AI به پی‌سی دیگر وقتی سیستم اصلی در حال بازی یا تولید محتواست.

اگر در خانه دو لپ‌تاپ یا یک دسکتاپ گیمینگ دارید، تجربهٔ خودتان از اجرای مدل محلی روی چند دستگاه را در نظرات بنویسید تا بقیه هم ببینند PAIR برای چه سناریوهایی واقعاً ارزش دارد.

شتاب ۱٫۹ برابری استنتاج محلی و ایجنت‌های ساده‌تر روی RTX

در همان اعلامیهٔ IFA، انویدیا گفت بهینه‌سازی‌های تازهٔ llama.cpp و vLLM تا حدود ۱٫۹ برابر استنتاج محلی سریع‌تر ارائه می‌کنند و همین حالا مستقیم و از مسیر LM Studio و Ollama در دسترس‌اند. همچنین پشتیبانی ساده‌تر از مدل محلی روی GPUهای انویدیا برای Hermes Agent، OpenClaw و Perplexity Portable Computer در راه است.

انویدیا می‌گوید راه‌اندازی ایجنت محلی قبلاً نیازمند انتخاب مدل، پیدا کردن سرور استنتاج سازگار، تنظیم quantize و به‌روزرسانی مداوم بود؛ این اصطکاک روی سیستم‌های RTX و DGX در حال کم شدن است. سه اپ ایجنت پرکاربرد قرار است راه‌اندازی ساده‌تر مدل محلی روی ویندوز ارائه دهند؛ هر کدام بر پایهٔ llama.cpp و با بهینه‌سازی‌های استنتاج انویدیا.

در کنار PAIR، انویدیا یادآوری کرد پی‌سی‌های ویندوزی NVIDIA RTX Spark از اکتبر ۲۰۲۶ می‌آیند و در IFA طراحی‌های شرکایی مثل لنوو و ایسر دیده شد. RTX Spark با GPU قدرتمند RTX Blackwell، تا ۱۲۸ گیگابایت حافظهٔ یکپارچه و پردازندهٔ ۲۰ هسته‌ای Grace معرفی شده و برای خالقان، گیمرها و ایجنت‌های همیشه روشن روی لپ‌تاپ‌های باریک و دسکتاپ‌های جمع‌وجور طراحی شده است.

به نظر شما خوشه‌کردن پی‌سی‌های خانگی با PAIR بیشتر به توسعه‌دهنده‌ها کمک می‌کند یا به کاربر عادی که چند سیستم RTX در خانه دارد؟