کلود فیبل ۵.۱ عرضه شد؛ تفاوت با فیبل ۵، جایگاه در بنچمارکها و دسترسی از ایران
آخرین بهروزرسانی: ۱۱ شهریور ۱۴۰۵
آنتروپیک روز سهشنبه ۱۰ شهریور ۱۴۰۵ (۱ سپتامبر ۲۰۲۶) کلود فیبل ۵.۱ را منتشر کرد. مهمترین عدد این عرضه امتیاز ۶۶ در شاخص هوش مؤسسهی سنجش مستقل Artificial Analysis است؛ بالاترین امتیازی که این مؤسسه تا امروز ثبت کرده و جلوتر از Claude Opus 5 با ۶۳ و GPT-5.6 Sol با ۶۱. دومین عدد مهم به هزینه مربوط میشود: نرخ خواندن از کش ۷۵ درصد کاهش یافته است. اما همان سنجش مستقل نشان میدهد اجرای هر تسک روی نسخهی جدید حدود ۲۰ درصد گرانتر از نسخهی قبلی تمام میشود، چون مدل توکن خروجی بیشتری مصرف میکند. این تناقض ظاهری، نکتهای است که بیشتر پوششهای خبری از قلم انداختهاند.
کلود فیبل ۵.۱ چیست و چه نسبتی با میتوس ۵.۱ دارد؟
فیبل ۵.۱ و میتوس ۵.۱ یک مدل واحدند و تفاوتشان فقط در لایههای ایمنی است. آنتروپیک این را در اطلاعیهی رسمی خود صریح نوشته: نسخهی فیبل بهصورت عمومی در دسترس است و نسخهی میتوس فقط از مسیر برنامههای دسترسی تأییدشده به سازمانهای راستیآزماییشده در حوزهی امنیت سایبری و علوم زیستی داده میشود. در حال حاضر این دسترسی محدود به مجموعهای از سازمانهای آمریکایی است.
شناسهی مدل روی API عبارت است از claude-fable-5-1 و از همان روز عرضه روی Claude API، آمازون بدراک، گوگل کلاد و مایکروسافت فاندری فعال شده است. پنجرهی کانتکست یک میلیون توکن و سقف خروجی ۱۲۸ هزار توکن است. حالت تفکر تطبیقی همیشه روشن است و کلیدی برای خاموشکردنش وجود ندارد.
نسخهی قبلی، یعنی فیبل ۵، در ۱۹ خرداد ۱۴۰۵ (۹ ژوئن ۲۰۲۶) عرضه شده بود. یعنی فاصلهی دو نسخه کمتر از سه ماه است.
تفاوت فیبل ۵.۱ با فیبل ۵ در جدول
اعداد جدول زیر، هر دو ستون، از جدول مقایسهای خود آنتروپیک در اطلاعیهی ۱۰ شهریور ۱۴۰۵ گرفته شدهاند. نرخهای توکن از صفحهی قیمتگذاری رسمی Claude برداشته شده که در ۱۱ شهریور ۱۴۰۵ بررسی شد.
معیار | فیبل ۵ | فیبل ۵.۱ |
|---|---|---|
توکن ورودی (هر میلیون) | ۱۰ دلار | ۱۰ دلار |
توکن خروجی (هر میلیون) | ۵۰ دلار | ۵۰ دلار |
خواندن از کش (هر میلیون) | ۱ دلار | ۰.۲۵ دلار |
Terminal-Bench-Science 0.1 | ۲۴.۷٪ | ۵۲.۶٪ |
Terminal-Bench 4.0 | ۴۲.۰٪ | ۵۵.۸٪ |
AutomationBench | ۱۷.۱٪ | ۳۱.۴٪ |
GDPval-AA v2 (امتیاز الو) | ۱۷۲۳ | ۱۸۵۳ |
Humanity's Last Exam (بدون ابزار) | ۵۷.۸٪ | ۶۰.۹٪ |
CursorBench 3.2.0 | ۷۰.۵٪ | ۷۳.۴٪ |
OSWorld 2.0 (سختگیرانه) | ۳۶.۱٪ | ۴۱.۷٪ |
بزرگترین جهش در Terminal-Bench-Science رخ داده که پژوهش علمی خودگردان را میسنجد و امتیاز در آن بیش از دو برابر شده است. آنتروپیک خودش زیر این جدول نوشته که خطای معیار این آزمون بین ۳.۵ تا ۴.۵ واحد است، پس فاصلهی کوچک بین دو مدل در این آزمون معنادار نیست. فاصلهی ۵۲.۶ تا ۲۴.۷ اما بهقدری بزرگ است که از محدودهی خطا بیرون میزند.
نرخ ورودی و خروجی دستنخورده مانده و تنها چیزی که ارزانتر شده، خواندن از کش است. آنتروپیک تخمین میزند این تغییر برای بارهای کاری معمول حدود ۲۵ درصد و برای کارهای عاملی سنگین تا حدود ۴۵ درصد صرفهجویی ایجاد کند.
جایگاه فیبل ۵.۱ در بنچمارکهای مستقل
در شاخص هوش Artificial Analysis نسخهی ۴.۱.۱، این مدل با تنظیم حداکثری تلاش امتیاز ۶۶ گرفته و در صدر جدول نشسته است. ترتیب کامل بالای جدول به این شکل است:
مدل | امتیاز شاخص هوش |
|---|---|
Claude Fable 5.1 (حداکثر تلاش) | ۶۶ |
Claude Opus 5 (حداکثر تلاش) | ۶۳ |
Claude Fable 5 (حداکثر تلاش) | ۶۲ |
GPT-5.6 Sol (حداکثر تلاش) | ۶۱ |
Grok 4.6 (تلاش بالا) | ۶۱ |
Kimi K3 (حداکثر تلاش) | ۶۰ |
GLM-5.1 (حداکثر تلاش) | ۶۰ |
MiniMax Spark 1.2 (تلاش بالا) | ۵۷ |
دو نکته را باید کنار این جدول خواند. اول اینکه Artificial Analysis خودش اعلام کرده در ارزیابی پیش از انتشار به آنتروپیک کمک کرده است، پس این سنجش کاملاً مستقل از سازنده انجام نشده. دوم اینکه در جریان آزمون، حدود ۴ درصد از توکنهای خروجی توسط سازوکار جایگزینی سمت سرور آنتروپیک تولید شده؛ یعنی درخواستهایی که طبقهبند ایمنی آنها را علامت زده به Claude Opus 4.8 یا Claude Opus 5 هدایت شدهاند. امتیاز ۶۶ متعلق به این ترکیب است، نه به مدل خالص.
تفاوت روششناسی خودش را در اعداد نشان میدهد. آنتروپیک برای آزمون Humanity's Last Exam بدون ابزار عدد ۶۰.۹ درصد را گزارش کرده، در حالی که Artificial Analysis در سنجش خودش ۵۹.۱ درصد به دست آورده است. هر دو عدد درستاند و هیچکدام دروغ نیست؛ صرفاً دو اجرای متفاوت از یک آزموناند. وقتی جایی عددی بدون ذکر منبع میبینید، معمولاً یکی از این دو است.
آیا فیبل ۵.۱ قدرتمندترین مدل هوش مصنوعی جهان است؟
روی شاخص Artificial Analysis، امروز بله. اما این جمله سه قید دارد که بدون آنها گمراهکننده است.
قید اول: نسخهی قویتر همین مدل عمومی نیست. میتوس ۵.۱ دقیقاً همان مدل با لایههای ایمنی سبکتر است و در آزمون Terminal-Bench 4.0 امتیاز ۶۰.۹ درصد گرفته، در برابر ۵۵.۸ درصد فیبل ۵.۱. خود آنتروپیک توضیح داده این شکاف هزینهی مداخلهی طبقهبندهای ایمنی است. یعنی نسخهای که بالاترین عدد را میگیرد، آن نسخهای نیست که شما میتوانید بخرید.
قید دوم: امتیاز به تنظیم تلاش وابسته است. Artificial Analysis پنج سطح تلاش این مدل را جداگانه سنجیده و امتیاز از ۵۸ در پایینترین سطح تا ۶۶ در بالاترین سطح نوسان دارد. مصرف توکن خروجی بین این دو سر طیف یازده برابر فرق میکند. عدد ۶۶ یعنی مدل در پرخرجترین حالت ممکن اجرا شده باشد.
قید سوم، و مهمتر از دو تای قبلی: خود آنتروپیک در مستندات فنیاش نوشته که برای بیشتر بارهای کاری باید از Claude Opus 5 شروع کنید و سراغ فیبل ۵.۱ بروید فقط وقتی کار به استدلال سنگین یا عاملیت طولانیمدت نیاز دارد، یا وقتی آزمونهای خودتان روی Opus 5 با تلاش بالا هنوز جواب نداده است. سازندهی مدل، پرچمدار خودش را بهعنوان انتخاب پیشفرض معرفی نمیکند.
عدد هزینه هم همین را میگوید. طبق سنجش Artificial Analysis، اجرای یک تسک شاخص هوش روی فیبل ۵.۱ با حداکثر تلاش ۳.۷۶ دلار خرج برمیدارد؛ حدود ۲۰ درصد بیشتر از ۳.۱۴ دلار فیبل ۵ و تقریباً ۱.۶ برابر ۲.۳۴ دلار Opus 5. دلیلش این است که مدل جدید نزدیک به ۱.۷ برابر نسخهی قبلی توکن خروجی تولید میکند. کاهش ۷۵ درصدی نرخ کش این افزایش را جبران نکرده است.
تغییرات ایمنی و یک تغییر فنی که ممکن است کدتان را بشکند
سه تغییر در این نسخه برای کسی که واقعاً از API استفاده میکند اهمیت عملی دارد.
طبقهبندهای امنیت سایبری دقیقتر شدهاند. آنتروپیک میگوید کاربران Claude Code بهطور میانگین حدود ۶۰ درصد مداخلهی کمتر در هر نشست تجربه میکنند و از این پس میتوان از مدل برای شناسایی آسیبپذیری نرمافزاری استفاده کرد، هرچند نوشتن اکسپلویت برای آنها همچنان مسدود است. تست نفوذ، تولید اکسپلویت و اسکن آسیبپذیری مبتنی بر باینری هنوز به مدلهای Opus هدایت میشوند.
در حوزهی زیستشناسی، طبقهبندها برای پرسشهای سادهی زیستشناسی و پزشکی ۸۵ درصد کمتر از نسخهی اولیهی فیبل ۵ فعال میشوند. پرسشهای مربوط به پژوهش و توسعه در علوم زیستی همچنان به مدلهای Opus میروند.
تغییر سوم میتواند برای توسعهدهندگان دردسرساز شود. حسابهای API که از روز عرضه به بعد ساخته شوند دیگر نمیتوانند در گفتگوی چندمرحلهای، کانتکست قبلی کلود را دستی ویرایش کنند و همزمان رونوشت تفکر مدل را حفظ کنند. این یک اقدام ضدتقطیر است و آنتروپیک اعلام کرده حسابهای موجود فعلاً مشمول آن نیستند، اما در عرضههای بعدی به همه تعمیم پیدا میکند. اگر یکپارچهسازی سفارشی دارید که به این رفتار تکیه میکند، بهتر است پیش از مهاجرت آن را بررسی کنید.
دسترسی به فیبل ۵.۱ از ایران
ایران در فهرست کشورهای پشتیبانیشدهی آنتروپیک نیست؛ نه برای Claude.ai و نه برای API تجاری. این فهرست در صفحهی رسمی کشورهای پشتیبانیشده منتشر شده و در ۱۱ شهریور ۱۴۰۵ بررسی شد. یعنی ثبتنام مستقیم، پرداخت با کارت ایرانی و استفاده از سرویس از داخل کشور مسیر رسمی ندارد. پرداخت اشتراک هم از طریق درگاههای بینالمللی انجام میشود که کارتهای بانکی ایرانی روی آنها کار نمیکنند.
نکتهای که قبل از هر خریدی باید بدانید این است که فیبل ۵.۱ روی پلنهای مختلف رفتار یکسانی ندارد:
روی پلن رایگان اصلاً در دسترس نیست.
روی Pro و صندلیهای استاندارد Team در دسترس هست، اما با اعتبار مصرفی پرداختبهاندازهیمصرف حساب میشود، نه بهعنوان بخشی از اشتراک.
روی Max و صندلیهای ویژهی Team بخشی از خود پلن است و میتوانید تا ۵۰ درصد سقف مصرف هفتگیتان را روی مدلهای فیبل خرج کنید.
یک تفاوت فنی هم هست که کمتر گفته میشود: پنجرهی کانتکست روی پلنهای Free، Pro و Max برابر ۲۰۰ هزار توکن است، نه یک میلیون توکن. عدد یک میلیون مربوط به API است. اگر بهخاطر کانتکست بلند سراغ این مدل میروید، این تفاوت را در نظر بگیرید.
قیمتهای رسمی که در ۱۱ شهریور ۱۴۰۵ از صفحهی قیمتگذاری Claude برداشته شدهاند: پلن Pro ماهانه ۲۰ دلار، یا ۱۷ دلار در ماه با پرداخت سالانهی ۲۰۰ دلار. پلن Max از ۱۰۰ دلار در ماه شروع میشود. صندلی استاندارد Team ماهانه ۲۵ دلار و با پرداخت سالانه ۲۰ دلار، و صندلی ویژه ماهانه ۱۲۵ دلار و با پرداخت سالانه ۱۰۰ دلار است. این نرخها را آنتروپیک بدون اطلاع قبلی تغییر میدهد، پس پیش از خرید دوباره بررسی کنید.
چکلیست خرید اکانت کلود از فروشندهی داخلی
اگر قصد دارید دسترسی را از یک فروشندهی داخلی تهیه کنید، این پرسشها را پیش از پرداخت بپرسید:
اکانت اختصاصی است یا اشتراکی؟ روی اکانت اشتراکی، سقف مصرف بین چند نفر تقسیم میشود و مدلهای فیبل سقف را سریع میبلعند.
پلن دقیقاً کدام است؟ تفاوت Pro و Max برای دسترسی به فیبل جدی است؛ روی Pro هزینهی مصرف جداگانه حساب میشود.
اگر پلن Pro است، هزینهی اعتبار مصرفی را چه کسی میپردازد؟ این هزینه با نرخ استاندارد API محاسبه میشود و میتواند از خود اشتراک بیشتر شود.
اشتراک است یا دسترسی API؟ این دو یکی نیستند و پنجرهی کانتکست، سقف مصرف و نحوهی محاسبهشان فرق دارد.
اگر اکانت به هر دلیلی قفل شد، تکلیف باقیماندهی دوره چیست؟ پاسخ را کتبی بگیرید.
پشتیبانی تا چه زمانی و از چه مسیری ارائه میشود؟
اینترنت پایدار برای اجراهای طولانی
بخش زیادی از ارزش این نسل از مدلها در کارهایی است که ساعتها بدون نظارت اجرا میشوند. آنتروپیک در اطلاعیهاش نمونهای از شرکت Ramp نقل کرده که یک اجرای بیوقفهی ۳۸ ساعته روی یک مسئلهی یادگیری ماشین انجام شده است. برای این نوع کار، قطعی چنددقیقهای اینترنت یا افت پهنای باند وسط آپلود یک مخزن کد بزرگ، هزینهی واقعی دارد.
اگر کارتان به آپلود فایلهای حجیم مرجع و نشستهای طولانی وابسته است، پایداری خط بیشتر از سرعت اسمی آن اهمیت دارد. برای بررسی پوشش سرویسهای آسیاتک در تبریز و آذربایجان شرقی میتوانید با شمارهی ۰۴۱-۹۱۰۱۴۱۴۱ تماس بگیرید یا آدرس خود را استعلام کنید.
پرسشهای پرتکرار
فیبل ۵.۱ رایگان است؟ خیر. روی پلن رایگان Claude در دسترس نیست و فقط روی پلنهای Pro، Max، Team و Enterprise فعال میشود.
فیبل ۵.۱ از GPT-5.6 بهتر است؟ در شاخص هوش Artificial Analysis بله، با ۶۶ در برابر ۶۱ برای GPT-5.6 Sol. اما نتیجه به آزمون بستگی دارد و هزینهی هر تسک روی فیبل بیشتر است. برای انتخاب، آزمون خودتان روی کار واقعیتان قابل اتکاتر از جدول لیدربورد است.
تفاوت فیبل ۵.۱ و میتوس ۵.۱ چیست؟ یک مدلاند با لایههای ایمنی متفاوت. فیبل عمومی است و میتوس فقط از طریق برنامههای دسترسی تأییدشده در اختیار سازمانهای راستیآزماییشده قرار میگیرد.
پنجرهی کانتکست چقدر است؟ روی API یک میلیون توکن. روی پلنهای Pro و Max برابر ۲۰۰ هزار توکن.
قیمت API چقدر است؟ هر میلیون توکن ورودی ۱۰ دلار، هر میلیون توکن خروجی ۵۰ دلار، و خواندن از کش هر میلیون توکن ۰.۲۵ دلار. بررسیشده در ۱۱ شهریور ۱۴۰۵.
آیا آنتروپیک در ایران سرویس ارائه میدهد؟ خیر. ایران در فهرست رسمی کشورهای پشتیبانیشده برای Claude.ai و API تجاری قرار ندارد.
قبل از مهاجرت چه چیزی را بسنجید
اگر همین حالا روی Opus 5 یا فیبل ۵ کار میکنید، پیش از تعویض مدل یک آزمون کوچک روی بار کاری واقعی خودتان اجرا کنید و دو عدد را ثبت کنید: کیفیت خروجی و هزینهی هر تسک تمامشده. اختلاف سه امتیازی در لیدربورد ممکن است در کار شما اصلاً دیده نشود، در حالی که اختلاف ۱.۶ برابری هزینه در صورتحساب ماه بعد کاملاً دیده میشود. اگر بار کاریتان کانتکست ثابت و بزرگی دارد که مدام دوباره خوانده میشود، کاهش نرخ کش به نفع شماست؛ اگر کارتان خروجی طولانی تولید میکند، احتمالاً نیست.
گفتوگو
نظرات خوانندگان
سؤال یا تجربهٔ خود را دربارهٔ این مطلب بنویسید.
در حال بارگذاری نظرات…