در جریان IFA ۲۰۲۶، انویدیا اعلام کرد هوش مصنوعی مرزی در حال «محلی شدن» است و ابزار تازهٔ NVIDIA PAIR (مخفف Personal AI Router) را معرفی کرد. این نرمافزار رایگان و متنباز، استنتاج مدلهای محلی را بین چند پیسی روی شبکهٔ خانگی پخش میکند تا وقتی چند زیرعامل همزمان کار میکنند، همهٔ درخواستها پشت یک GPU گیر نمانند.
به نوشتهٔ بلاگ رسمی انویدیا، بیش از نیمی از خانوارهای آمریکا دو یا چند پیسی دارند و بخش زیادی از این قدرت محاسبه در طول روز بیکار میماند. PAIR همان سیستمها را برای هوش مصنوعی محلی به کار میگیرد؛ بدون اینکه لازم باشد ایجنت یا ابزار کاربر از صفر برای «کلاستر خانگی» بازنویسی شود.
PAIR چیست و چطور استنتاج را روی شبکهٔ خانگی پخش میکند؟
طبق اعلام انویدیا، PAIR بهطور خودکار پیسیهای سازگار روی شبکهٔ محلی را پیدا میکند و درخواستهای استنتاج مستقل را به هر سیستمی که ظرفیت آزاد دارد میفرستد. این ابزار با Ollama و LM Studio کار میکند و وقتی دستگاهی به شبکه میپیوندد یا خارج میشود، خود را تطبیق میدهد.
نسخهٔ بتای PAIR برای ویندوز، مکاواس و لینوکس با رابط گرافیکی و ترمینال در دسترس است. سختافزار پشتیبانیشده شامل GPUهای GeForce RTX سری ۲۰ و جدیدتر، GPUهای ورکاستیشن RTX PRO (از معماری Turing به بعد)، NVIDIA DGX Spark و سیلیکون Apple M4 یا جدیدتر است.
در مثال رسمی، کاربر میتواند از Hermes بخواهد برنامهٔ «Sunday Reset» بسازد؛ یعنی اینباکس شلوغ را مرتب کند و کارها را اولویتبندی کند. Hermes کار را بین چند زیرعامل تقسیم میکند و PAIR آن کارها را بین پیسیهای آزاد پخش میکند، نه اینکه همه روی یک GPU صف بکشند. نتیجهٔ اعلامشده: قدرت محاسبهٔ بیشتر برای ایجنتهای محلی، اجرای موازی بیشتر، و امکان انتقال بار AI به پیسی دیگر وقتی سیستم اصلی در حال بازی یا تولید محتواست.
اگر در خانه دو لپتاپ یا یک دسکتاپ گیمینگ دارید، تجربهٔ خودتان از اجرای مدل محلی روی چند دستگاه را در نظرات بنویسید تا بقیه هم ببینند PAIR برای چه سناریوهایی واقعاً ارزش دارد.
شتاب ۱٫۹ برابری استنتاج محلی و ایجنتهای سادهتر روی RTX
در همان اعلامیهٔ IFA، انویدیا گفت بهینهسازیهای تازهٔ llama.cpp و vLLM تا حدود ۱٫۹ برابر استنتاج محلی سریعتر ارائه میکنند و همین حالا مستقیم و از مسیر LM Studio و Ollama در دسترساند. همچنین پشتیبانی سادهتر از مدل محلی روی GPUهای انویدیا برای Hermes Agent، OpenClaw و Perplexity Portable Computer در راه است.
انویدیا میگوید راهاندازی ایجنت محلی قبلاً نیازمند انتخاب مدل، پیدا کردن سرور استنتاج سازگار، تنظیم quantize و بهروزرسانی مداوم بود؛ این اصطکاک روی سیستمهای RTX و DGX در حال کم شدن است. سه اپ ایجنت پرکاربرد قرار است راهاندازی سادهتر مدل محلی روی ویندوز ارائه دهند؛ هر کدام بر پایهٔ llama.cpp و با بهینهسازیهای استنتاج انویدیا.
در کنار PAIR، انویدیا یادآوری کرد پیسیهای ویندوزی NVIDIA RTX Spark از اکتبر ۲۰۲۶ میآیند و در IFA طراحیهای شرکایی مثل لنوو و ایسر دیده شد. RTX Spark با GPU قدرتمند RTX Blackwell، تا ۱۲۸ گیگابایت حافظهٔ یکپارچه و پردازندهٔ ۲۰ هستهای Grace معرفی شده و برای خالقان، گیمرها و ایجنتهای همیشه روشن روی لپتاپهای باریک و دسکتاپهای جمعوجور طراحی شده است.
به نظر شما خوشهکردن پیسیهای خانگی با PAIR بیشتر به توسعهدهندهها کمک میکند یا به کاربر عادی که چند سیستم RTX در خانه دارد؟