# جمینای ۳٫۸ لایو و Extended Thinking؛ گفت‌وگوی صوتی بلادرنگ گوگل - URL: https://faceit.ir/artificial-intelligence/gemini-3-8-live-extended-thinking-2026/ - Markdown: https://faceit.ir/artificial-intelligence/gemini-3-8-live-extended-thinking-2026.md - Language: fa-IR - Date: 2026-09-16 - Section: هوش مصنوعی - Authors: فرهاد محمدی > گوگل در ۱۵ سپتامبر ۲۰۲۶ جمینای ۳٫۸ لایو و نسخهٔ Extended Thinking را معرفی کرد؛ دو مدل گفت‌وگوی صوتی نزدیک به بلادرنگ با پشتیبانی از ۹۷ زبان برای ایجنت‌های صوتی و همکاری در اپ جمینای. ## خلاصه مطلب - گوگل در ۱۵ سپتامبر ۲۰۲۶ جمینای ۳٫۸ لایو و نسخهٔ Extended Thinking را معرفی کرد - مدل‌ها گفت‌وگوی صوتی را با استدلال نزدیک به بلادرنگ، زمینهٔ بصری و ۹۷ زبان پشتیبانی می‌کنند - Extended Thinking در شاخص Speech-to-Speech Artificial Analysis با امتیاز ۸۲٫۶ رتبهٔ نخست گزارش شده است - قیمت توسعه‌دهنده حدود ۰٫۰۰۵ دلار در دقیقه ورودی و ۰٫۰۱۸ دلار در دقیقه خروجی صوت اعلام شده است - صوت تولیدشده با واترمارک SynthID علامت‌گذاری می‌شود؛ عرضه از API، AI Studio، Search Live و Gemini Live ## متن گوگل در ۱۵ سپتامبر ۲۰۲۶ جمینای ۳٫۸ لایو و نسخهٔ Extended Thinking را معرفی کرد مدل‌ها گفت‌وگوی صوتی را با استدلال نزدیک به بلادرنگ، زمینهٔ بصری و ۹۷ زبان پشتیبانی می‌کنند Extended Thinking در شاخص Speech-to-Speech Artificial Analysis با امتیاز ۸۲٫۶ رتبهٔ نخست گزارش شده است قیمت توسعه‌دهنده حدود ۰٫۰۰۵ دلار در دقیقه ورودی و ۰٫۰۱۸ دلار در دقیقه خروجی صوت اعلام شده است صوت تولیدشده با واترمارک SynthID علامت‌گذاری می‌شود؛ عرضه از API، AI Studio، Search Live و Gemini Live گوگل در ۱۵ سپتامبر ۲۰۲۶ دو مدل گفت‌وگوی زنده با نام‌های جمینای ۳٫۸ لایو (Gemini 3.8 Live) و جمینای ۳٫۸ لایو Extended Thinking را معرفی کرد. بر اساس مطلب رسمی بلاگ گوگل، این مدل‌ها با ارتقای هوش و استدلال موازی، همکاری صوتی با هوش مصنوعی را روان‌تر می‌کنند و برای ساخت ایجنت‌های صوتی تولیدی هم به‌کار می‌روند. طبق اعلام گوگل، جمینای ۳٫۸ لایو برای مقیاس و کارایی هزینه ساخته شده و گفت‌وگوی روان را با زمینه‌سازی بصری ترکیب می‌کند؛ نسخهٔ Extended Thinking برای کارهای پیچیده‌تر و استدلال چندمرحله‌ای طراحی شده است. هر دو مدل از همان روز انتشار در مسیر عرضه به توسعه‌دهندگان، سازمان‌ها و کاربران عمومی قرار گرفته‌اند. قابلیت‌های گفت‌وگوی صوتی گوگل می‌گوید جمینای ۳٫۸ لایو ورودی‌های بصری را نزدیک به بلادرنگ پردازش می‌کند تا پاسخ‌ها با زمینهٔ دیداری غنی‌تر شوند. این مدل می‌تواند میان ۹۷ زبان پشتیبانی‌شده در میانهٔ گفت‌وگو تشخیص دهد و جابه‌جا شود. همچنین فراخوانی ابزار و API را در پس‌زمینه اجرا می‌کند تا هم‌زمان با ادامهٔ مکالمه، کارها بدون قطع گفت‌وگو پیش بروند. در نسخهٔ Extended Thinking، مدل هم‌زمان استدلال می‌کند و صحبت می‌کند. گوگل گفته این نسخه با نشانه‌های کلامی زودهنگام مثل «بگذارید بررسی کنم…» درخواست را تأیید می‌کند و با روایت پیشرفت زنده، کاربر را در جریان کارهای چندمرحلهٔ پس‌زمینه نگه می‌دارد. نمونه‌های رسمی شامل راهنمایی ورود کارکنان با زمینهٔ بصری، بازی شطرنج نزدیک به بلادرنگ، تبدیل طرح خام به مؤلفهٔ React و هماهنگی رزروهای چندمرحله‌ای بدون قطع گفت‌وگو است. اگر جمینای لایو را با ایجنت‌های صوتی دیگر مقایسه کرده‌اید، دیدگاه‌تان را در نظرات بنویسید. ارزیابی‌ها و رقم‌های اعلام‌شده بر اساس اعلام رسمی، جمینای ۳٫۸ لایو Extended Thinking در شاخص کیفیت گفتاربه‌گفتار Artificial Analysis با امتیاز ۸۲٫۶ رتبهٔ نخست کلی را گرفته است. در تکمیل کار ایجنتی نیز نرخ ۶۸٫۶٪ روی معیار τ-Voice و ۳۵٫۱٪ روی τ-Voice-banking سیرا گزارش شده است. امتیاز استدلال صوتی روی Big Bench Audio برابر ۹۷٫۷٪ اعلام شده است. گوگل همچنین نوشته جمینای ۳٫۸ لایو در Speech Agent Arena رتبهٔ دوم ترجیح کاربران را کسب کرده و هم‌زمان برای مقیاس‌پذیری با هزینهٔ پایین طراحی شده است. در معیار EVA-Bench شرکت ServiceNow نیز مدل‌های لایو در مرز پارتو برای جریان‌های کاری پیچیده، تعادل میان دقت و کیفیت مکالمه را بهبود داده‌اند. دسترسی، قیمت توسعه‌دهنده و واترمارک SynthID طبق اعلام گوگل، جمینای ۳٫۸ لایو از همان روز انتشار برای توسعه‌دهندگان در Gemini API و Google AI Studio، برای سازمان‌ها در پیش‌نمایش خصوصی Gemini Enterprise، و برای عموم در Search Live عرضه می‌شود. نسخهٔ Extended Thinking نیز در API و AI Studio در دسترس است؛ برای سازمان‌ها در پیش‌نمایش خصوصی Gemini Enterprise قرار دارد و برای کاربران در Gemini Live و برای مشترکان Google AI Pro و Ultra در Docs، و برای همهٔ مشترکان Google AI در جیمیل و Keep عرضه می‌شود. در مطلب جداگانهٔ توسعه‌دهندگان، قیمت لایهٔ صوتی از طریق Live API حدود ۰٫۰۰۵ دلار در دقیقه برای ورودی صوت و ۰٫۰۱۸ دلار در دقیقه برای خروجی صوت اعلام شده است. پلتفرم‌هایی مانند Agora، LiveKit، LangChain، Pipecat، Vercel و Vision Agents به‌عنوان شرکای یکپارچه‌سازی Live API نام برده شده‌اند. گوگل تأکید کرده همهٔ صوت تولیدشده توسط محصولات هوش مصنوعی این شرکت با واترمارک نامحسوس SynthID علامت‌گذاری می‌شود تا محتوای تولیدشده با هوش مصنوعی قابل تشخیص بماند. جزئیات ایمنی در کارت مدل مرتبط منتشر شده است. قیمت تومان در منبع رسمی نیست. منبع: Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking. برای کار روزمره بیشتر به گفت‌وگوی سریع جمینای ۳٫۸ لایو نیاز دارید یا به استدلال چندمرحلهٔ Extended Thinking؟ --- Cite as فیسیت with the URL above. Comments and ads on the HTML page are not editorial claims.