این تصویر که فردی را با تیشرت OpenAI در مقابل تخته سیاهی نشان میدهد، نمادی از گام بلندی در زمینه هوش مصنوعی به شمار میرود. GPT-4o، که روز دوشنبه معرفی شد، از خانواده مدلهای GPT-4 پیشی گرفته و به گفته OpenAI، سرعت و دقت بالاتری دارد و میتواند اطلاعات بیشتری را از ورودیهای خود استخراج کند.
نوآوری کلیدی GPT-4o در رویکرد جدید آن به آموزش نهفته است. در حالی که مدلهای قبلی GPT ترکیبی از چندین مدل مجزا بودند و میتوانستند فایلهای رسانهای مانند صدا و تصویر را به متن و عکس تبدیل کنند، GPT-4o از همان ابتدا روی توکنهای چندرسانهای آموزش دیده است. این امر نیاز به تبدیل صدا و تصویر به متن برای تجزیه و تحلیل را از بین میبرد و به مدل اجازه میدهد تا مستقیماً از اطلاعات بصری و صوتی برای تولید خروجی استفاده کند.
نتایج این رویکرد جدید، به وضوح در تصویر منتشرشده توسط براکمن قابل مشاهده است. تصویر با جزئیات دقیق و وضوح بالا به نمایش گذاشته شده، که نشاندهنده پیشرفت قابلتوجهی در مقایسه با مدل تولید تصویر DALL-E 3 OpenAI است.
GPT-4o نه تنها در زمینه تولید تصویر، بلکه در سایر زمینهها نیز نویدبخش است. قابلیتهای متن و تصویر این مدل هماکنون برای همه کاربران OpenAI در دسترس است و به زودی، حالت جدید Voice Mode آن نیز برای کاربران پلتفرم ChatGPT Plus عرضه خواهد شد.
انتشار GPT-4o نقطه عطفی در تاریخ هوش مصنوعی است و پتانسیل متحول کردن نحوه تعامل ما با رایانهها و دنیای اطرافمان را دارد.
- GPT-4o، مدل جدید هوش مصنوعی OpenAI، تصویری از آینده هوش مصنوعی را به نمایش میگذارد.
- این مدل از رویکرد جدیدی برای آموزش استفاده میکند که به آن امکان میدهد اطلاعات بیشتری را از ورودیهای خود استخراج کند و تصاویر و متنی با کیفیت بالا تولید کند.
- GPT-4o برای همه کاربران OpenAI در دسترس است و به زودی، حالت جدید Voice Mode آن نیز عرضه خواهد شد.
اگر علاقهمند دنیای تکنولوژی هستید حتما شبکههای اجتماعی فیسیت را در اینستاگرام، تلگرام، روبیکا، توییتر و آپارات را دنبال کنید.