نسل جدید هوش مصنوعی : GPT 6 ASTRA معرفی شد.

آخرین به‌روزرسانی: ۱۳ شهریور ۱۴۰۵

OpenAI روز ۱۲ شهریور ۱۴۰۵ (۳ سپتامبر ۲۰۲۶) از GPT-6 Astra رونمایی کرد. مهم‌ترین تفاوت این مدل با نسل قبل، متن بهتر نیست؛ توانایی کار مستقیم با کامپیوتر است. مدل صفحه را می‌بیند، فرم پر می‌کند، بین پنجره‌ها جابه‌جا می‌شود و کار را تا انتها می‌برد. گرگ براکمن، رئیس OpenAI، جلسه‌ی معرفی را با جمله‌ی «به عصر AGI خوش آمدید» تمام کرد؛ ادعایی که خود شرکت هم در صفحه‌ی رسمی معرفی با احتیاط بیشتری مطرح کرده است.


GPT-6 Astra چه کاری می‌کند که نسل قبل نمی‌کرد؟

کار با کامپیوتر مثل یک کاربر انسانی. تا پیش از این، مدل‌ها متن و کد تولید می‌کردند و اجرای آن با شما بود. آسترا در بنچمارک OSWorld 2.0 که همین توانایی را می‌سنجد، به نمره‌ی ۷۲٫۶ درصد رسیده و به گفته‌ی OpenAI هر کار را ۴۷ درصد سریع‌تر از GPT-5.6 Sol تمام می‌کند. در ScreenSpot-Pro، که سنجش دقت پیداکردن عناصر روی صفحه است، نمره‌ی ۹۲٫۷ درصد ثبت شده.

بقیه‌ی توانایی‌ها هم در همین مسیر حرکت کرده‌اند: ساخت وب‌سایت، سند، ارائه و صفحه‌گسترده. OpenAI می‌گوید قضاوت بصری مدل درباره‌ی ظاهر خروجی هم بهتر شده، یعنی وب‌سایتی که می‌سازد کمتر شبیه قالب خام است.

یک عدد که بیشتر از بقیه سروصدا کرد: ARC-AGI-3 با نمره‌ی ۹۹٫۹ درصد. گرگ کامرات از بنیاد ARC Prize گفته آسترا در ۹۶ درصد مراحل، از خط پایه‌ی کارایی انسانی جلو زده است.


نمره‌های بنچمارک: آسترا در برابر GPT-5.6 Sol

جدول زیر فقط شامل بنچمارک‌هایی است که عدد هر دو مدل منتشر شده. جاهایی که OpenAI عدد نسل قبل را نداده، اینجا نیامده‌اند.

بنچمارک

GPT-6 Astra

GPT-5.6 Sol

ARC-AGI-3 (استدلال انتزاعی)

۹۹٫۹٪

۷٫۸٪

FrontierMath Tier 4 (ریاضی)

۹۷٫۶٪

۸۳٫۰٪

OSWorld 2.0 (کار با کامپیوتر)

۷۲٫۶٪

۶۵٫۷٪

DeepSWE v1.1 (مهندسی نرم‌افزار)

۷۴٫۱٪

۷۲٫۷٪

ExploitBench (امنیت سایبری)

۱۰۰٪

۷۸٫۵٪

منبع نمره‌ها: صفحه‌ی رسمی OpenAI و گزارش The Decoder از ارقام مقایسه‌ای.


یک تصور اشتباه رایج

شماره‌ی نسل که بالا می‌رود، همه‌چیز به یک اندازه بهتر نمی‌شود. همین جدول نشان می‌دهد فاصله در استدلال انتزاعی از ۷٫۸ به ۹۹٫۹ درصد رسیده، اما در مهندسی نرم‌افزار (DeepSWE) اختلاف کمتر از یک‌ونیم واحد درصد است. اگر کار روزمره‌ی شما نوشتن و اصلاح کد است، جهشی که در تیترها می‌بینید لزوماً روی میز کار شما اتفاق نمی‌افتد. جایی که تفاوت واقعاً محسوس است، کارهایی است که چند مرحله دارند و مدل باید خودش آن‌ها را پشت سر هم اجرا کند.


هزینه‌ی استفاده از آسترا روی API چقدر است؟

بر اساس مستندات رسمی OpenAI (بررسی‌شده در ۱۳ شهریور ۱۴۰۵)، نرخ پایه دو برابر و نیم نسل قبل است.

مورد

GPT-6 Astra

GPT-5.6 Sol

ورودی (هر میلیون توکن)

۱۰ دلار

۴ دلار

خروجی (هر میلیون توکن)

۵۰ دلار

۲۰ دلار

چند نکته‌ی هزینه‌ای که در جدول نمی‌گنجد: ورودی کش‌شده یک دلار و نوشتن روی کش ۱۲٫۵ دلار حساب می‌شود. پرامپت‌های بالای ۲۷۲ هزار توکن، ورودی را دو برابر و خروجی را یک‌ونیم برابر گران می‌کنند. حالت Batch و Flex نصف نرخ استاندارد است و حالت Fast دو برابر آن.

پنجره‌ی متن مدل ۱٬۰۵۰٬۰۰۰ توکن و حداکثر خروجی ۱۲۸٬۰۰۰ توکن است؛ هر دو دقیقاً برابر با GPT-5.6 Sol. تاریخ قطع دانش مدل ۱۰ اردیبهشت ۱۴۰۵ (۳۰ آوریل ۲۰۲۶) اعلام شده. ورودی متن و تصویر را می‌پذیرد، خروجی فقط متن است، و فاین‌تیونینگ روی آن فعلاً در دسترس نیست.

قیمت اشتراک‌های ChatGPT (پلن‌های Plus و Pro) در زمان نگارش این مطلب روی صفحه‌ی رسمی قیمت‌گذاری بارگذاری نشد، بنابراین عددی برایشان نمی‌نویسیم. برای رقم به‌روز، مستقیم صفحه‌ی قیمت‌گذاری ChatGPT را ببینید.


چه کسانی الان به آن دسترسی دارند؟

عرضه پلکانی است. اول سازمان‌های محدودی که در برنامه‌ی Daybreak Access شرکت دارند، بعد کاربران Plus، Pro، Business و Enterprise «طی روزهای آینده»، و هم‌زمان API و AWS. مایکروسافت هم اعلام کرده مدل روی Microsoft Foundry در دسترس است.

یک جزئیات که مدیران سازمانی باید بدانند: در نسخه‌ی Enterprise دسترسی به این مدل به‌صورت پیش‌فرض خاموش است و ادمین باید آن را فعال کند.


چرا OpenAI درباره‌ی این مدل نگران است؟

آسترا نخستین مدل OpenAI است که در چارچوب آمادگی (Preparedness Framework) شرکت، به رده‌ی «بحرانی» در امنیت سایبری رسیده. معنای این رده در کارت سیستم رسمی صریح است: مدل می‌تواند نقص‌های امنیتی ناشناخته را پیدا کند و راه‌های تازه‌ای برای سوءاستفاده از آن‌ها بسازد. در جریان ارزیابی، مدل دو آسیب‌پذیری روز صفر که قبلاً شناخته نشده بودند را کشف کرد. مؤسسه‌ی ایمنی هوش مصنوعی بریتانیا (UK AISI) هم گزارش داده مدل توانسته در محیط آزمایشی، حمله‌ی زنجیره‌ی تأمین را روی مخازن متن‌باز شبیه‌سازی‌شده اجرا کند.

واکنش شرکت این بوده که در نسخه‌ی عمومی، مدل کارهای پیشرفته‌ی امنیت سایبری مثل ساخت اکسپلویت اثبات مفهوم را رد می‌کند. سازوکارهای دیگر شامل پایش ناهم‌راستایی روی تمام استنتاج‌هایی است که از ابزار خارجی استفاده می‌کنند، به‌علاوه‌ی رمزنگاری و کنترل دسترسی روی چک‌پوینت‌ها.

عددهای ایمنی هم بهتر شده‌اند. نرخ موفقیت حملات تزریق پرامپت غیرمستقیم در آزمون Gray Swan IPI Arena از ۲۷٫۰ درصد در GPT-5.6 Sol به ۸٫۵ درصد رسیده. نرخ خروجی ناهم‌راستا در شبیه‌سازی محیط کاری بدون سازوکار محافظ، از ۱۸٫۸ درصد به ۳٫۴ درصد کاهش یافته. OpenAI می‌گوید نرخ فراتررفتن مدل از محدوده‌ی مجاز به صفر رسیده، در حالی که این عدد برای نسل قبل ۴۸ درصد بوده. نمره‌ی توهم (hallucination) هم ۴٫۲ درصد اعلام شده.

اما یک یافته در جهت مخالف حرکت کرده و همان است که بحث‌برانگیز شد: قابلیت پایش زنجیره‌ی استدلال مدل به‌طور محسوسی کاهش پیدا کرده. به بیان ساده، دنبال‌کردن اینکه مدل چرا به یک تصمیم رسیده، از نسل قبل سخت‌تر شده. آملیا گلیزه، معاون پژوهش OpenAI، در همین باره گفته وقتی توانایی مستقل مدل‌ها بالا می‌رود «باید بتوانیم بیشتر به آن‌ها اعتماد کنیم».

ادعای AGI چقدر جدی است؟

ادعا از سمت شرکت آمده، نه از یک اجماع بیرونی. براکمن خودش گفته باور دارد OpenAI به AGI رسیده، اما تعریف آن را به کاربر واگذار می‌کند و اضافه کرده که AGI «تکه‌تکه» می‌آید نه در یک لحظه‌ی مشخص. تعریف AGI میان پژوهشگران هوش مصنوعی اختلافی است و هیچ آزمون واحدی وجود ندارد که بشود گفت مدل آن را پاس کرده.

چیزی که قابل اندازه‌گیری است، همان جدول بنچمارک بالا و مقیاس آموزش مدل است. به گزارش Axios، آسترا در بزرگ‌ترین دور آموزشی OpenAI و با بیش از ۱۰۰ هزار پردازنده‌ی گرافیکی در مرکز Stargate تگزاس آموزش دیده. در دموهایی که به خبرنگاران نشان داده شد، مدل قرارداد حقوقی قالب‌بندی کرد، بازی سه‌بعدی ساخت، برد مدار طراحی کرد و روی مسئله‌ی فاصله‌ی اعداد اول کار کرد.

کاربر ایرانی چه چیزی را باید بداند؟

ایران در فهرست کشورهای پشتیبانی‌شده‌ی OpenAI نیست. این یعنی چند محدودیت عملی که بهتر است از قبل بدانید:

  1. ثبت‌نام و استفاده از ChatGPT و API از داخل ایران در شرایط عادی ممکن نیست.

  2. OpenAI در مستندات پشتیبانی خود نوشته دسترسی از کشورهای پشتیبانی‌نشده ممکن است به مسدود یا معلق‌شدن حساب منجر شود.

  3. روش‌های پرداخت خارج از فهرست کشورهای پشتیبانی‌شده هم پذیرفته نمی‌شوند و کارت‌های بانکی ایرانی روی درگاه پرداخت OpenAI کار نمی‌کنند.

این محدودیت‌ها به این مدل خاص مربوط نیست و روی کل سرویس‌های OpenAI اعمال می‌شود.

پرسش‌های پرتکرار

آسترا رایگان است؟ نه. طبق اعلام OpenAI دسترسی برای کاربران Plus، Pro، Business و Enterprise باز می‌شود و پلن رایگان در فهرست نیامده است.

فرقش با GPT-5.6 Sol در عمل چیست؟ بیشترین تفاوت در کارهای چندمرحله‌ای و کار با کامپیوتر است، نه در کیفیت متن. در بنچمارک OSWorld 2.0 اختلاف حدود هفت واحد درصد است و هر کار ۴۷ درصد سریع‌تر تمام می‌شود. در مقابل، در مهندسی نرم‌افزار اختلاف زیر یک‌ونیم واحد درصد است.

چرا این‌قدر گران‌تر شده؟ نرخ ورودی از ۴ به ۱۰ دلار و خروجی از ۲۰ به ۵۰ دلار در هر میلیون توکن رفته، یعنی دو برابر و نیم. OpenAI دلیل قیمت‌گذاری را توضیح نداده. الکس مشرابوف از Higgsfield AI گفته مدل تا ۲۰ درصد توکن کمتری نسبت به مدل‌های دیگر مصرف می‌کند، که بخشی از این اختلاف را جبران می‌کند.

پنجره‌ی متن بزرگ‌تر شده؟ نه. همان ۱٬۰۵۰٬۰۰۰ توکن نسل قبل است. آنچه تغییر کرده کیفیت استفاده از این پنجره است: OpenAI در آزمون MRCR v2 نمره‌ی ۱۰۰ درصد در بازه‌ی ۲۵۶ تا ۵۱۲ هزار توکن و ۹۶٫۳ درصد در بازه‌ی ۵۱۲ هزار تا یک میلیون توکن گزارش کرده.

می‌شود روی داده‌ی خودم فاین‌تیون کرد؟ فعلاً نه. مستندات API فاین‌تیونینگ را برای این مدل در دسترس اعلام نکرده است.

اگر روی API حساب باز کرده‌اید و می‌خواهید بدانید مدل برای شما فعال شده یا نه، وضعیت دسترسی و محدودیت‌های نرخ در همان صفحه‌ی مدل روی مستندات OpenAI به‌روزرسانی می‌شود. برای تصمیم‌گیری درباره‌ی مهاجرت از نسل قبل هم منطقی‌تر این است که اول یک کار واقعی از جریان کاری خودتان را روی هر دو مدل اجرا کنید و هزینه‌ی همان کار را مقایسه کنید، نه نمره‌های بنچمارک را.