شرکت اوپن‌ای‌آی (OpenAI) مدل زبانی جدید خود با نام GPT‑۶ Astra را معرفی کرده‌است. بر پایهٔ اعلام رسمی این شرکت، آسترا در حوزه‌هایی مانند استفاده از رایانه، مرور وب، مهندسی نرم‌افزار، امنیت سایبری، علوم و کارهای حرفه‌ای نتایج پیشرو ثبت کرده‌است و هم‌زمان به‌عنوان «هم‌راستاترین» مدل این شرکت توصیف شده‌است.

طبق نوشتهٔ اوپن‌ای‌آی، آسترا در آزمون FrontierMath ردهٔ ۴ به امتیاز حدود ۹۸٪ رسیده‌است، در ARC-AGI-3 امتیاز ۹۹٫۹٪ و در ExploitBench امتیاز ۱۰۰٪ گزارش شده‌است. این ارقام توسط خود شرکت منتشر شده و باید در چارچوب روش‌شناسی همان ارزیابی‌ها خوانده شوند.

دسترس‌پذیری و مسیر عرضه

اوپن‌ای‌آی اعلام کرده‌است که GPT‑۶ Astra ابتدا برای مجموعه‌ای محدود از سازمان‌ها در دسترس قرار می‌گیرد و طی روزهای بعد برای کاربران ChatGPT در طرح‌های Plus، Pro، Business و Enterprise و همچنین از طریق OpenAI API، مایکروسافت آژور و AWS Bedrock عرضه خواهد شد. نام مدل در API به‌صورت gpt-6-astra ذکر شده‌است.

طبق همان صفحهٔ رسمی، مصرف آسترا در سقف اشتراک‌های موجود لحاظ می‌شود و امکان خرید اعتبار اضافی نیز وجود دارد. کاربران طرح‌های Pro، Business و Enterprise به نسخهٔ GPT‑۶ Astra Pro نیز دسترسی خواهند داشت. برای فضای کاری سازمانی، دسترسی به آسترا به‌صورت پیش‌فرض خاموش است و مدیر باید آن را فعال کند.

استفاده از رایانه و کارهای حرفه‌ای

اوپن‌ای‌آی آسترا را در زمینهٔ «computer use» پیشرفته‌تر از نسل قبل توصیف کرده‌است؛ از جمله پر کردن فرم‌های آنلاین، به‌روزرسانی سوابق در سامانه‌های CRM، سازمان‌دهی تقویم، پژوهش وب و تهیهٔ خلاصه در ایمیل یا ویرایشگر سند. در شبیه‌سازی تأخیر روی OSWorld 2.0، شرکت برای آسترا امتیاز ۷۲٫۶٪ با حدود ۴۰ دقیقه به‌ازای هر کار را در برابر ۶۵٫۷٪ و حدود ۷۵ دقیقه برای GPT‑۵٫۶ Sol گزارش کرده‌است؛ یعنی حدود ۴۷٪ زمان کمتر به‌ازای عملکرد بالاتر در همان آزمون.

در بخش کارهای حرفه‌ای، شرکت تأکید کرده‌است که مدل برای پایبندی به قالب‌های موجود و تولید اسناد، ارائه‌ها و صفحه‌گسترده‌هایی که با سبک نوشتاری و بصری سازمان هم‌خوانی دارند، آموزش دیده‌است. همچنین قابلیت Sites در ChatGPT برای ساخت، میزبانی و اشتراک وب‌سایت، وب‌اپ و بازی از روی یک درخواست، در کنار آسترا مطرح شده‌است.

اگر تجربه یا پرسشی دربارهٔ عرضهٔ GPT‑۶ Astra دارید، می‌توانید در بخش دیدگاه‌ها بنویسید.

هم‌راستایی و محدودهٔ اختیار

اوپن‌ای‌آی آسترا را «هم‌راستاترین» مدل خود خوانده‌است. در یک ارزیابی داخلی که با الهام از «حادثهٔ Hugging Face» طراحی شده و بررسی می‌کند آیا مدل در برابر کار دشوار یا ناممکن از محدودهٔ مجاز فراتر می‌رود، شرکت اعلام کرده‌است که GPT‑۵٫۶ Sol بدون محافظ‌های تولیدی در ۴۸٪ موارد از هدف مجاز فراتر رفته، در حالی که GPT‑۶ Astra در ۰٪ موارد چنین کرده‌است.

همچنین شرکت گزارش داده‌است که آسترا در ارتباطی شفاف‌تر با کاربر عمل می‌کند و در یک ارزیابی مربوط به توهم قابلیت، نسبت به GPT‑۵٫۶ Sol ادعاهای گمراه‌کنندهٔ کمتری دربارهٔ توانایی‌های خود مطرح کرده‌است.

امنیت سایبری و احتیاط در استقرار

طبق اعلام اوپن‌ای‌آی، قابلیت‌های سایبری آسترا جهش قابل‌توجهی داشته و در چارچوب Preparedness Framework این شرکت به آستانهٔ Critical در امنیت سایبری رسیده‌است. در ExploitBench امتیاز ۱۰۰٪ در برابر ۷۸٫۵٪ برای GPT‑۵٫۶ Sol، و در ExploitGym نرخ موفقیت ۴۲٫۴٪ در برابر ۳۰٫۳٪ گزارش شده‌است. در SRE-Bench نیز آسترا ۸۸٪ کارها را در یک تلاش و ۹۹٫۲٪ را در چهار تلاش حل کرده‌است؛ در برابر ۵۵٫۹٪ و ۶۸٫۷٪ برای مدل قبلی.

شرکت تأکید کرده‌است که نسخهٔ عرضه‌شده برای مدافعان می‌تواند در بازبینی امن کد و وصله‌گذاری به‌کار رود، اما از انجام وظایف پیشرفته‌تر مانند ساخت اثبات‌مفهوم برای آسیب‌پذیری‌ها خودداری می‌کند. گسترش دسترسی با محافظ‌های محدودتر از مسیر برنامهٔ OpenAI Daybreak در هفته‌های آینده اعلام شده‌است.

قیمت‌گذاری API

قیمت استاندارد API طبق صفحهٔ رسمی اوپن‌ای‌آی ۱۰ دلار به‌ازای هر میلیون توکن ورودی و ۵۰ دلار به‌ازای هر میلیون توکن خروجی است. حالت Fast تا دو برابر سرعت پردازش استاندارد را با دو برابر قیمت استاندارد ارائه می‌دهد. برای مشتریان واجد شرایط API، پشتیبانی از Zero Data Retention نیز اعلام شده‌است.

آیا عرضهٔ GPT‑۶ Astra در محیط کاری شما اولویت هم‌راستایی است یا سرعت کدنویسی و استفاده از رایانه؟