نسل جدید هوش مصنوعی : GPT 6 ASTRA معرفی شد.
آخرین بهروزرسانی: ۱۳ شهریور ۱۴۰۵
OpenAI روز ۱۲ شهریور ۱۴۰۵ (۳ سپتامبر ۲۰۲۶) از GPT-6 Astra رونمایی کرد. مهمترین تفاوت این مدل با نسل قبل، متن بهتر نیست؛ توانایی کار مستقیم با کامپیوتر است. مدل صفحه را میبیند، فرم پر میکند، بین پنجرهها جابهجا میشود و کار را تا انتها میبرد. گرگ براکمن، رئیس OpenAI، جلسهی معرفی را با جملهی «به عصر AGI خوش آمدید» تمام کرد؛ ادعایی که خود شرکت هم در صفحهی رسمی معرفی با احتیاط بیشتری مطرح کرده است.
GPT-6 Astra چه کاری میکند که نسل قبل نمیکرد؟
کار با کامپیوتر مثل یک کاربر انسانی. تا پیش از این، مدلها متن و کد تولید میکردند و اجرای آن با شما بود. آسترا در بنچمارک OSWorld 2.0 که همین توانایی را میسنجد، به نمرهی ۷۲٫۶ درصد رسیده و به گفتهی OpenAI هر کار را ۴۷ درصد سریعتر از GPT-5.6 Sol تمام میکند. در ScreenSpot-Pro، که سنجش دقت پیداکردن عناصر روی صفحه است، نمرهی ۹۲٫۷ درصد ثبت شده.
بقیهی تواناییها هم در همین مسیر حرکت کردهاند: ساخت وبسایت، سند، ارائه و صفحهگسترده. OpenAI میگوید قضاوت بصری مدل دربارهی ظاهر خروجی هم بهتر شده، یعنی وبسایتی که میسازد کمتر شبیه قالب خام است.
یک عدد که بیشتر از بقیه سروصدا کرد: ARC-AGI-3 با نمرهی ۹۹٫۹ درصد. گرگ کامرات از بنیاد ARC Prize گفته آسترا در ۹۶ درصد مراحل، از خط پایهی کارایی انسانی جلو زده است.
نمرههای بنچمارک: آسترا در برابر GPT-5.6 Sol
جدول زیر فقط شامل بنچمارکهایی است که عدد هر دو مدل منتشر شده. جاهایی که OpenAI عدد نسل قبل را نداده، اینجا نیامدهاند.
بنچمارک | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|
ARC-AGI-3 (استدلال انتزاعی) | ۹۹٫۹٪ | ۷٫۸٪ |
FrontierMath Tier 4 (ریاضی) | ۹۷٫۶٪ | ۸۳٫۰٪ |
OSWorld 2.0 (کار با کامپیوتر) | ۷۲٫۶٪ | ۶۵٫۷٪ |
DeepSWE v1.1 (مهندسی نرمافزار) | ۷۴٫۱٪ | ۷۲٫۷٪ |
ExploitBench (امنیت سایبری) | ۱۰۰٪ | ۷۸٫۵٪ |
منبع نمرهها: صفحهی رسمی OpenAI و گزارش The Decoder از ارقام مقایسهای.
یک تصور اشتباه رایج
شمارهی نسل که بالا میرود، همهچیز به یک اندازه بهتر نمیشود. همین جدول نشان میدهد فاصله در استدلال انتزاعی از ۷٫۸ به ۹۹٫۹ درصد رسیده، اما در مهندسی نرمافزار (DeepSWE) اختلاف کمتر از یکونیم واحد درصد است. اگر کار روزمرهی شما نوشتن و اصلاح کد است، جهشی که در تیترها میبینید لزوماً روی میز کار شما اتفاق نمیافتد. جایی که تفاوت واقعاً محسوس است، کارهایی است که چند مرحله دارند و مدل باید خودش آنها را پشت سر هم اجرا کند.
هزینهی استفاده از آسترا روی API چقدر است؟
بر اساس مستندات رسمی OpenAI (بررسیشده در ۱۳ شهریور ۱۴۰۵)، نرخ پایه دو برابر و نیم نسل قبل است.
مورد | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|
ورودی (هر میلیون توکن) | ۱۰ دلار | ۴ دلار |
خروجی (هر میلیون توکن) | ۵۰ دلار | ۲۰ دلار |
چند نکتهی هزینهای که در جدول نمیگنجد: ورودی کششده یک دلار و نوشتن روی کش ۱۲٫۵ دلار حساب میشود. پرامپتهای بالای ۲۷۲ هزار توکن، ورودی را دو برابر و خروجی را یکونیم برابر گران میکنند. حالت Batch و Flex نصف نرخ استاندارد است و حالت Fast دو برابر آن.
پنجرهی متن مدل ۱٬۰۵۰٬۰۰۰ توکن و حداکثر خروجی ۱۲۸٬۰۰۰ توکن است؛ هر دو دقیقاً برابر با GPT-5.6 Sol. تاریخ قطع دانش مدل ۱۰ اردیبهشت ۱۴۰۵ (۳۰ آوریل ۲۰۲۶) اعلام شده. ورودی متن و تصویر را میپذیرد، خروجی فقط متن است، و فاینتیونینگ روی آن فعلاً در دسترس نیست.
قیمت اشتراکهای ChatGPT (پلنهای Plus و Pro) در زمان نگارش این مطلب روی صفحهی رسمی قیمتگذاری بارگذاری نشد، بنابراین عددی برایشان نمینویسیم. برای رقم بهروز، مستقیم صفحهی قیمتگذاری ChatGPT را ببینید.
چه کسانی الان به آن دسترسی دارند؟
عرضه پلکانی است. اول سازمانهای محدودی که در برنامهی Daybreak Access شرکت دارند، بعد کاربران Plus، Pro، Business و Enterprise «طی روزهای آینده»، و همزمان API و AWS. مایکروسافت هم اعلام کرده مدل روی Microsoft Foundry در دسترس است.
یک جزئیات که مدیران سازمانی باید بدانند: در نسخهی Enterprise دسترسی به این مدل بهصورت پیشفرض خاموش است و ادمین باید آن را فعال کند.
چرا OpenAI دربارهی این مدل نگران است؟
آسترا نخستین مدل OpenAI است که در چارچوب آمادگی (Preparedness Framework) شرکت، به ردهی «بحرانی» در امنیت سایبری رسیده. معنای این رده در کارت سیستم رسمی صریح است: مدل میتواند نقصهای امنیتی ناشناخته را پیدا کند و راههای تازهای برای سوءاستفاده از آنها بسازد. در جریان ارزیابی، مدل دو آسیبپذیری روز صفر که قبلاً شناخته نشده بودند را کشف کرد. مؤسسهی ایمنی هوش مصنوعی بریتانیا (UK AISI) هم گزارش داده مدل توانسته در محیط آزمایشی، حملهی زنجیرهی تأمین را روی مخازن متنباز شبیهسازیشده اجرا کند.
واکنش شرکت این بوده که در نسخهی عمومی، مدل کارهای پیشرفتهی امنیت سایبری مثل ساخت اکسپلویت اثبات مفهوم را رد میکند. سازوکارهای دیگر شامل پایش ناهمراستایی روی تمام استنتاجهایی است که از ابزار خارجی استفاده میکنند، بهعلاوهی رمزنگاری و کنترل دسترسی روی چکپوینتها.
عددهای ایمنی هم بهتر شدهاند. نرخ موفقیت حملات تزریق پرامپت غیرمستقیم در آزمون Gray Swan IPI Arena از ۲۷٫۰ درصد در GPT-5.6 Sol به ۸٫۵ درصد رسیده. نرخ خروجی ناهمراستا در شبیهسازی محیط کاری بدون سازوکار محافظ، از ۱۸٫۸ درصد به ۳٫۴ درصد کاهش یافته. OpenAI میگوید نرخ فراتررفتن مدل از محدودهی مجاز به صفر رسیده، در حالی که این عدد برای نسل قبل ۴۸ درصد بوده. نمرهی توهم (hallucination) هم ۴٫۲ درصد اعلام شده.
اما یک یافته در جهت مخالف حرکت کرده و همان است که بحثبرانگیز شد: قابلیت پایش زنجیرهی استدلال مدل بهطور محسوسی کاهش پیدا کرده. به بیان ساده، دنبالکردن اینکه مدل چرا به یک تصمیم رسیده، از نسل قبل سختتر شده. آملیا گلیزه، معاون پژوهش OpenAI، در همین باره گفته وقتی توانایی مستقل مدلها بالا میرود «باید بتوانیم بیشتر به آنها اعتماد کنیم».
ادعای AGI چقدر جدی است؟
ادعا از سمت شرکت آمده، نه از یک اجماع بیرونی. براکمن خودش گفته باور دارد OpenAI به AGI رسیده، اما تعریف آن را به کاربر واگذار میکند و اضافه کرده که AGI «تکهتکه» میآید نه در یک لحظهی مشخص. تعریف AGI میان پژوهشگران هوش مصنوعی اختلافی است و هیچ آزمون واحدی وجود ندارد که بشود گفت مدل آن را پاس کرده.
چیزی که قابل اندازهگیری است، همان جدول بنچمارک بالا و مقیاس آموزش مدل است. به گزارش Axios، آسترا در بزرگترین دور آموزشی OpenAI و با بیش از ۱۰۰ هزار پردازندهی گرافیکی در مرکز Stargate تگزاس آموزش دیده. در دموهایی که به خبرنگاران نشان داده شد، مدل قرارداد حقوقی قالببندی کرد، بازی سهبعدی ساخت، برد مدار طراحی کرد و روی مسئلهی فاصلهی اعداد اول کار کرد.

کاربر ایرانی چه چیزی را باید بداند؟
ایران در فهرست کشورهای پشتیبانیشدهی OpenAI نیست. این یعنی چند محدودیت عملی که بهتر است از قبل بدانید:
ثبتنام و استفاده از ChatGPT و API از داخل ایران در شرایط عادی ممکن نیست.
OpenAI در مستندات پشتیبانی خود نوشته دسترسی از کشورهای پشتیبانینشده ممکن است به مسدود یا معلقشدن حساب منجر شود.
روشهای پرداخت خارج از فهرست کشورهای پشتیبانیشده هم پذیرفته نمیشوند و کارتهای بانکی ایرانی روی درگاه پرداخت OpenAI کار نمیکنند.
این محدودیتها به این مدل خاص مربوط نیست و روی کل سرویسهای OpenAI اعمال میشود.
پرسشهای پرتکرار
آسترا رایگان است؟ نه. طبق اعلام OpenAI دسترسی برای کاربران Plus، Pro، Business و Enterprise باز میشود و پلن رایگان در فهرست نیامده است.
فرقش با GPT-5.6 Sol در عمل چیست؟ بیشترین تفاوت در کارهای چندمرحلهای و کار با کامپیوتر است، نه در کیفیت متن. در بنچمارک OSWorld 2.0 اختلاف حدود هفت واحد درصد است و هر کار ۴۷ درصد سریعتر تمام میشود. در مقابل، در مهندسی نرمافزار اختلاف زیر یکونیم واحد درصد است.
چرا اینقدر گرانتر شده؟ نرخ ورودی از ۴ به ۱۰ دلار و خروجی از ۲۰ به ۵۰ دلار در هر میلیون توکن رفته، یعنی دو برابر و نیم. OpenAI دلیل قیمتگذاری را توضیح نداده. الکس مشرابوف از Higgsfield AI گفته مدل تا ۲۰ درصد توکن کمتری نسبت به مدلهای دیگر مصرف میکند، که بخشی از این اختلاف را جبران میکند.
پنجرهی متن بزرگتر شده؟ نه. همان ۱٬۰۵۰٬۰۰۰ توکن نسل قبل است. آنچه تغییر کرده کیفیت استفاده از این پنجره است: OpenAI در آزمون MRCR v2 نمرهی ۱۰۰ درصد در بازهی ۲۵۶ تا ۵۱۲ هزار توکن و ۹۶٫۳ درصد در بازهی ۵۱۲ هزار تا یک میلیون توکن گزارش کرده.
میشود روی دادهی خودم فاینتیون کرد؟ فعلاً نه. مستندات API فاینتیونینگ را برای این مدل در دسترس اعلام نکرده است.
اگر روی API حساب باز کردهاید و میخواهید بدانید مدل برای شما فعال شده یا نه، وضعیت دسترسی و محدودیتهای نرخ در همان صفحهی مدل روی مستندات OpenAI بهروزرسانی میشود. برای تصمیمگیری دربارهی مهاجرت از نسل قبل هم منطقیتر این است که اول یک کار واقعی از جریان کاری خودتان را روی هر دو مدل اجرا کنید و هزینهی همان کار را مقایسه کنید، نه نمرههای بنچمارک را.
گفتوگو
نظرات خوانندگان
سؤال یا تجربهٔ خود را دربارهٔ این مطلب بنویسید.
در حال بارگذاری نظرات…