شرکت اوپنایآی (OpenAI) مدل زبانی جدید خود با نام GPT‑۶ Astra را معرفی کردهاست. بر پایهٔ اعلام رسمی این شرکت، آسترا در حوزههایی مانند استفاده از رایانه، مرور وب، مهندسی نرمافزار، امنیت سایبری، علوم و کارهای حرفهای نتایج پیشرو ثبت کردهاست و همزمان بهعنوان «همراستاترین» مدل این شرکت توصیف شدهاست.
طبق نوشتهٔ اوپنایآی، آسترا در آزمون FrontierMath ردهٔ ۴ به امتیاز حدود ۹۸٪ رسیدهاست، در ARC-AGI-3 امتیاز ۹۹٫۹٪ و در ExploitBench امتیاز ۱۰۰٪ گزارش شدهاست. این ارقام توسط خود شرکت منتشر شده و باید در چارچوب روششناسی همان ارزیابیها خوانده شوند.
دسترسپذیری و مسیر عرضه
اوپنایآی اعلام کردهاست که GPT‑۶ Astra ابتدا برای مجموعهای محدود از سازمانها در دسترس قرار میگیرد و طی روزهای بعد برای کاربران ChatGPT در طرحهای Plus، Pro، Business و Enterprise و همچنین از طریق OpenAI API، مایکروسافت آژور و AWS Bedrock عرضه خواهد شد. نام مدل در API بهصورت gpt-6-astra ذکر شدهاست.
طبق همان صفحهٔ رسمی، مصرف آسترا در سقف اشتراکهای موجود لحاظ میشود و امکان خرید اعتبار اضافی نیز وجود دارد. کاربران طرحهای Pro، Business و Enterprise به نسخهٔ GPT‑۶ Astra Pro نیز دسترسی خواهند داشت. برای فضای کاری سازمانی، دسترسی به آسترا بهصورت پیشفرض خاموش است و مدیر باید آن را فعال کند.
استفاده از رایانه و کارهای حرفهای
اوپنایآی آسترا را در زمینهٔ «computer use» پیشرفتهتر از نسل قبل توصیف کردهاست؛ از جمله پر کردن فرمهای آنلاین، بهروزرسانی سوابق در سامانههای CRM، سازماندهی تقویم، پژوهش وب و تهیهٔ خلاصه در ایمیل یا ویرایشگر سند. در شبیهسازی تأخیر روی OSWorld 2.0، شرکت برای آسترا امتیاز ۷۲٫۶٪ با حدود ۴۰ دقیقه بهازای هر کار را در برابر ۶۵٫۷٪ و حدود ۷۵ دقیقه برای GPT‑۵٫۶ Sol گزارش کردهاست؛ یعنی حدود ۴۷٪ زمان کمتر بهازای عملکرد بالاتر در همان آزمون.
در بخش کارهای حرفهای، شرکت تأکید کردهاست که مدل برای پایبندی به قالبهای موجود و تولید اسناد، ارائهها و صفحهگستردههایی که با سبک نوشتاری و بصری سازمان همخوانی دارند، آموزش دیدهاست. همچنین قابلیت Sites در ChatGPT برای ساخت، میزبانی و اشتراک وبسایت، وباپ و بازی از روی یک درخواست، در کنار آسترا مطرح شدهاست.
اگر تجربه یا پرسشی دربارهٔ عرضهٔ GPT‑۶ Astra دارید، میتوانید در بخش دیدگاهها بنویسید.
همراستایی و محدودهٔ اختیار
اوپنایآی آسترا را «همراستاترین» مدل خود خواندهاست. در یک ارزیابی داخلی که با الهام از «حادثهٔ Hugging Face» طراحی شده و بررسی میکند آیا مدل در برابر کار دشوار یا ناممکن از محدودهٔ مجاز فراتر میرود، شرکت اعلام کردهاست که GPT‑۵٫۶ Sol بدون محافظهای تولیدی در ۴۸٪ موارد از هدف مجاز فراتر رفته، در حالی که GPT‑۶ Astra در ۰٪ موارد چنین کردهاست.
همچنین شرکت گزارش دادهاست که آسترا در ارتباطی شفافتر با کاربر عمل میکند و در یک ارزیابی مربوط به توهم قابلیت، نسبت به GPT‑۵٫۶ Sol ادعاهای گمراهکنندهٔ کمتری دربارهٔ تواناییهای خود مطرح کردهاست.
امنیت سایبری و احتیاط در استقرار
طبق اعلام اوپنایآی، قابلیتهای سایبری آسترا جهش قابلتوجهی داشته و در چارچوب Preparedness Framework این شرکت به آستانهٔ Critical در امنیت سایبری رسیدهاست. در ExploitBench امتیاز ۱۰۰٪ در برابر ۷۸٫۵٪ برای GPT‑۵٫۶ Sol، و در ExploitGym نرخ موفقیت ۴۲٫۴٪ در برابر ۳۰٫۳٪ گزارش شدهاست. در SRE-Bench نیز آسترا ۸۸٪ کارها را در یک تلاش و ۹۹٫۲٪ را در چهار تلاش حل کردهاست؛ در برابر ۵۵٫۹٪ و ۶۸٫۷٪ برای مدل قبلی.
شرکت تأکید کردهاست که نسخهٔ عرضهشده برای مدافعان میتواند در بازبینی امن کد و وصلهگذاری بهکار رود، اما از انجام وظایف پیشرفتهتر مانند ساخت اثباتمفهوم برای آسیبپذیریها خودداری میکند. گسترش دسترسی با محافظهای محدودتر از مسیر برنامهٔ OpenAI Daybreak در هفتههای آینده اعلام شدهاست.
قیمتگذاری API
قیمت استاندارد API طبق صفحهٔ رسمی اوپنایآی ۱۰ دلار بهازای هر میلیون توکن ورودی و ۵۰ دلار بهازای هر میلیون توکن خروجی است. حالت Fast تا دو برابر سرعت پردازش استاندارد را با دو برابر قیمت استاندارد ارائه میدهد. برای مشتریان واجد شرایط API، پشتیبانی از Zero Data Retention نیز اعلام شدهاست.
آیا عرضهٔ GPT‑۶ Astra در محیط کاری شما اولویت همراستایی است یا سرعت کدنویسی و استفاده از رایانه؟