کلود فیبل ۵.۱ عرضه شد؛ تفاوت با فیبل ۵، جایگاه در بنچمارک‌ها و دسترسی از ایران

آخرین به‌روزرسانی: ۱۱ شهریور ۱۴۰۵

آنتروپیک روز سه‌شنبه ۱۰ شهریور ۱۴۰۵ (۱ سپتامبر ۲۰۲۶) کلود فیبل ۵.۱ را منتشر کرد. مهم‌ترین عدد این عرضه امتیاز ۶۶ در شاخص هوش مؤسسه‌ی سنجش مستقل Artificial Analysis است؛ بالاترین امتیازی که این مؤسسه تا امروز ثبت کرده و جلوتر از Claude Opus 5 با ۶۳ و GPT-5.6 Sol با ۶۱. دومین عدد مهم به هزینه مربوط می‌شود: نرخ خواندن از کش ۷۵ درصد کاهش یافته است. اما همان سنجش مستقل نشان می‌دهد اجرای هر تسک روی نسخه‌ی جدید حدود ۲۰ درصد گران‌تر از نسخه‌ی قبلی تمام می‌شود، چون مدل توکن خروجی بیشتری مصرف می‌کند. این تناقض ظاهری، نکته‌ای است که بیشتر پوشش‌های خبری از قلم انداخته‌اند.


کلود فیبل ۵.۱ چیست و چه نسبتی با میتوس ۵.۱ دارد؟

فیبل ۵.۱ و میتوس ۵.۱ یک مدل واحدند و تفاوتشان فقط در لایه‌های ایمنی است. آنتروپیک این را در اطلاعیه‌ی رسمی خود صریح نوشته: نسخه‌ی فیبل به‌صورت عمومی در دسترس است و نسخه‌ی میتوس فقط از مسیر برنامه‌های دسترسی تأییدشده به سازمان‌های راستی‌آزمایی‌شده در حوزه‌ی امنیت سایبری و علوم زیستی داده می‌شود. در حال حاضر این دسترسی محدود به مجموعه‌ای از سازمان‌های آمریکایی است.

شناسه‌ی مدل روی API عبارت است از claude-fable-5-1 و از همان روز عرضه روی Claude API، آمازون بدراک، گوگل کلاد و مایکروسافت فاندری فعال شده است. پنجره‌ی کانتکست یک میلیون توکن و سقف خروجی ۱۲۸ هزار توکن است. حالت تفکر تطبیقی همیشه روشن است و کلیدی برای خاموش‌کردنش وجود ندارد.

نسخه‌ی قبلی، یعنی فیبل ۵، در ۱۹ خرداد ۱۴۰۵ (۹ ژوئن ۲۰۲۶) عرضه شده بود. یعنی فاصله‌ی دو نسخه کمتر از سه ماه است.


تفاوت فیبل ۵.۱ با فیبل ۵ در جدول

اعداد جدول زیر، هر دو ستون، از جدول مقایسه‌ای خود آنتروپیک در اطلاعیه‌ی ۱۰ شهریور ۱۴۰۵ گرفته شده‌اند. نرخ‌های توکن از صفحه‌ی قیمت‌گذاری رسمی Claude برداشته شده که در ۱۱ شهریور ۱۴۰۵ بررسی شد.

معیار

فیبل ۵

فیبل ۵.۱

توکن ورودی (هر میلیون)

۱۰ دلار

۱۰ دلار

توکن خروجی (هر میلیون)

۵۰ دلار

۵۰ دلار

خواندن از کش (هر میلیون)

۱ دلار

۰.۲۵ دلار

Terminal-Bench-Science 0.1

۲۴.۷٪

۵۲.۶٪

Terminal-Bench 4.0

۴۲.۰٪

۵۵.۸٪

AutomationBench

۱۷.۱٪

۳۱.۴٪

GDPval-AA v2 (امتیاز الو)

۱۷۲۳

۱۸۵۳

Humanity's Last Exam (بدون ابزار)

۵۷.۸٪

۶۰.۹٪

CursorBench 3.2.0

۷۰.۵٪

۷۳.۴٪

OSWorld 2.0 (سخت‌گیرانه)

۳۶.۱٪

۴۱.۷٪

بزرگ‌ترین جهش در Terminal-Bench-Science رخ داده که پژوهش علمی خودگردان را می‌سنجد و امتیاز در آن بیش از دو برابر شده است. آنتروپیک خودش زیر این جدول نوشته که خطای معیار این آزمون بین ۳.۵ تا ۴.۵ واحد است، پس فاصله‌ی کوچک بین دو مدل در این آزمون معنادار نیست. فاصله‌ی ۵۲.۶ تا ۲۴.۷ اما به‌قدری بزرگ است که از محدوده‌ی خطا بیرون می‌زند.

نرخ ورودی و خروجی دست‌نخورده مانده و تنها چیزی که ارزان‌تر شده، خواندن از کش است. آنتروپیک تخمین می‌زند این تغییر برای بارهای کاری معمول حدود ۲۵ درصد و برای کارهای عاملی سنگین تا حدود ۴۵ درصد صرفه‌جویی ایجاد کند.


جایگاه فیبل ۵.۱ در بنچمارک‌های مستقل

در شاخص هوش Artificial Analysis نسخه‌ی ۴.۱.۱، این مدل با تنظیم حداکثری تلاش امتیاز ۶۶ گرفته و در صدر جدول نشسته است. ترتیب کامل بالای جدول به این شکل است:

مدل

امتیاز شاخص هوش

Claude Fable 5.1 (حداکثر تلاش)

۶۶

Claude Opus 5 (حداکثر تلاش)

۶۳

Claude Fable 5 (حداکثر تلاش)

۶۲

GPT-5.6 Sol (حداکثر تلاش)

۶۱

Grok 4.6 (تلاش بالا)

۶۱

Kimi K3 (حداکثر تلاش)

۶۰

GLM-5.1 (حداکثر تلاش)

۶۰

MiniMax Spark 1.2 (تلاش بالا)

۵۷

دو نکته را باید کنار این جدول خواند. اول اینکه Artificial Analysis خودش اعلام کرده در ارزیابی پیش از انتشار به آنتروپیک کمک کرده است، پس این سنجش کاملاً مستقل از سازنده انجام نشده. دوم اینکه در جریان آزمون، حدود ۴ درصد از توکن‌های خروجی توسط سازوکار جایگزینی سمت سرور آنتروپیک تولید شده؛ یعنی درخواست‌هایی که طبقه‌بند ایمنی آن‌ها را علامت زده به Claude Opus 4.8 یا Claude Opus 5 هدایت شده‌اند. امتیاز ۶۶ متعلق به این ترکیب است، نه به مدل خالص.

تفاوت روش‌شناسی خودش را در اعداد نشان می‌دهد. آنتروپیک برای آزمون Humanity's Last Exam بدون ابزار عدد ۶۰.۹ درصد را گزارش کرده، در حالی که Artificial Analysis در سنجش خودش ۵۹.۱ درصد به دست آورده است. هر دو عدد درست‌اند و هیچ‌کدام دروغ نیست؛ صرفاً دو اجرای متفاوت از یک آزمون‌اند. وقتی جایی عددی بدون ذکر منبع می‌بینید، معمولاً یکی از این دو است.


آیا فیبل ۵.۱ قدرتمندترین مدل هوش مصنوعی جهان است؟

روی شاخص Artificial Analysis، امروز بله. اما این جمله سه قید دارد که بدون آن‌ها گمراه‌کننده است.

قید اول: نسخه‌ی قوی‌تر همین مدل عمومی نیست. میتوس ۵.۱ دقیقاً همان مدل با لایه‌های ایمنی سبک‌تر است و در آزمون Terminal-Bench 4.0 امتیاز ۶۰.۹ درصد گرفته، در برابر ۵۵.۸ درصد فیبل ۵.۱. خود آنتروپیک توضیح داده این شکاف هزینه‌ی مداخله‌ی طبقه‌بندهای ایمنی است. یعنی نسخه‌ای که بالاترین عدد را می‌گیرد، آن نسخه‌ای نیست که شما می‌توانید بخرید.

قید دوم: امتیاز به تنظیم تلاش وابسته است. Artificial Analysis پنج سطح تلاش این مدل را جداگانه سنجیده و امتیاز از ۵۸ در پایین‌ترین سطح تا ۶۶ در بالاترین سطح نوسان دارد. مصرف توکن خروجی بین این دو سر طیف یازده برابر فرق می‌کند. عدد ۶۶ یعنی مدل در پرخرج‌ترین حالت ممکن اجرا شده باشد.

قید سوم، و مهم‌تر از دو تای قبلی: خود آنتروپیک در مستندات فنی‌اش نوشته که برای بیشتر بارهای کاری باید از Claude Opus 5 شروع کنید و سراغ فیبل ۵.۱ بروید فقط وقتی کار به استدلال سنگین یا عاملیت طولانی‌مدت نیاز دارد، یا وقتی آزمون‌های خودتان روی Opus 5 با تلاش بالا هنوز جواب نداده است. سازنده‌ی مدل، پرچم‌دار خودش را به‌عنوان انتخاب پیش‌فرض معرفی نمی‌کند.

عدد هزینه هم همین را می‌گوید. طبق سنجش Artificial Analysis، اجرای یک تسک شاخص هوش روی فیبل ۵.۱ با حداکثر تلاش ۳.۷۶ دلار خرج برمی‌دارد؛ حدود ۲۰ درصد بیشتر از ۳.۱۴ دلار فیبل ۵ و تقریباً ۱.۶ برابر ۲.۳۴ دلار Opus 5. دلیلش این است که مدل جدید نزدیک به ۱.۷ برابر نسخه‌ی قبلی توکن خروجی تولید می‌کند. کاهش ۷۵ درصدی نرخ کش این افزایش را جبران نکرده است.


تغییرات ایمنی و یک تغییر فنی که ممکن است کدتان را بشکند

سه تغییر در این نسخه برای کسی که واقعاً از API استفاده می‌کند اهمیت عملی دارد.

طبقه‌بندهای امنیت سایبری دقیق‌تر شده‌اند. آنتروپیک می‌گوید کاربران Claude Code به‌طور میانگین حدود ۶۰ درصد مداخله‌ی کمتر در هر نشست تجربه می‌کنند و از این پس می‌توان از مدل برای شناسایی آسیب‌پذیری نرم‌افزاری استفاده کرد، هرچند نوشتن اکسپلویت برای آن‌ها همچنان مسدود است. تست نفوذ، تولید اکسپلویت و اسکن آسیب‌پذیری مبتنی بر باینری هنوز به مدل‌های Opus هدایت می‌شوند.

در حوزه‌ی زیست‌شناسی، طبقه‌بندها برای پرسش‌های ساده‌ی زیست‌شناسی و پزشکی ۸۵ درصد کمتر از نسخه‌ی اولیه‌ی فیبل ۵ فعال می‌شوند. پرسش‌های مربوط به پژوهش و توسعه در علوم زیستی همچنان به مدل‌های Opus می‌روند.

تغییر سوم می‌تواند برای توسعه‌دهندگان دردسرساز شود. حساب‌های API که از روز عرضه به بعد ساخته شوند دیگر نمی‌توانند در گفتگوی چندمرحله‌ای، کانتکست قبلی کلود را دستی ویرایش کنند و هم‌زمان رونوشت تفکر مدل را حفظ کنند. این یک اقدام ضدتقطیر است و آنتروپیک اعلام کرده حساب‌های موجود فعلاً مشمول آن نیستند، اما در عرضه‌های بعدی به همه تعمیم پیدا می‌کند. اگر یکپارچه‌سازی سفارشی دارید که به این رفتار تکیه می‌کند، بهتر است پیش از مهاجرت آن را بررسی کنید.


دسترسی به فیبل ۵.۱ از ایران

ایران در فهرست کشورهای پشتیبانی‌شده‌ی آنتروپیک نیست؛ نه برای Claude.ai و نه برای API تجاری. این فهرست در صفحه‌ی رسمی کشورهای پشتیبانی‌شده منتشر شده و در ۱۱ شهریور ۱۴۰۵ بررسی شد. یعنی ثبت‌نام مستقیم، پرداخت با کارت ایرانی و استفاده از سرویس از داخل کشور مسیر رسمی ندارد. پرداخت اشتراک هم از طریق درگاه‌های بین‌المللی انجام می‌شود که کارت‌های بانکی ایرانی روی آن‌ها کار نمی‌کنند.

نکته‌ای که قبل از هر خریدی باید بدانید این است که فیبل ۵.۱ روی پلن‌های مختلف رفتار یکسانی ندارد:

  1. روی پلن رایگان اصلاً در دسترس نیست.

  2. روی Pro و صندلی‌های استاندارد Team در دسترس هست، اما با اعتبار مصرفی پرداخت‌به‌اندازه‌ی‌مصرف حساب می‌شود، نه به‌عنوان بخشی از اشتراک.

  3. روی Max و صندلی‌های ویژه‌ی Team بخشی از خود پلن است و می‌توانید تا ۵۰ درصد سقف مصرف هفتگی‌تان را روی مدل‌های فیبل خرج کنید.

یک تفاوت فنی هم هست که کمتر گفته می‌شود: پنجره‌ی کانتکست روی پلن‌های Free، Pro و Max برابر ۲۰۰ هزار توکن است، نه یک میلیون توکن. عدد یک میلیون مربوط به API است. اگر به‌خاطر کانتکست بلند سراغ این مدل می‌روید، این تفاوت را در نظر بگیرید.

قیمت‌های رسمی که در ۱۱ شهریور ۱۴۰۵ از صفحه‌ی قیمت‌گذاری Claude برداشته شده‌اند: پلن Pro ماهانه ۲۰ دلار، یا ۱۷ دلار در ماه با پرداخت سالانه‌ی ۲۰۰ دلار. پلن Max از ۱۰۰ دلار در ماه شروع می‌شود. صندلی استاندارد Team ماهانه ۲۵ دلار و با پرداخت سالانه ۲۰ دلار، و صندلی ویژه ماهانه ۱۲۵ دلار و با پرداخت سالانه ۱۰۰ دلار است. این نرخ‌ها را آنتروپیک بدون اطلاع قبلی تغییر می‌دهد، پس پیش از خرید دوباره بررسی کنید.


چک‌لیست خرید اکانت کلود از فروشنده‌ی داخلی

اگر قصد دارید دسترسی را از یک فروشنده‌ی داخلی تهیه کنید، این پرسش‌ها را پیش از پرداخت بپرسید:

  1. اکانت اختصاصی است یا اشتراکی؟ روی اکانت اشتراکی، سقف مصرف بین چند نفر تقسیم می‌شود و مدل‌های فیبل سقف را سریع می‌بلعند.

  2. پلن دقیقاً کدام است؟ تفاوت Pro و Max برای دسترسی به فیبل جدی است؛ روی Pro هزینه‌ی مصرف جداگانه حساب می‌شود.

  3. اگر پلن Pro است، هزینه‌ی اعتبار مصرفی را چه کسی می‌پردازد؟ این هزینه با نرخ استاندارد API محاسبه می‌شود و می‌تواند از خود اشتراک بیشتر شود.

  4. اشتراک است یا دسترسی API؟ این دو یکی نیستند و پنجره‌ی کانتکست، سقف مصرف و نحوه‌ی محاسبه‌شان فرق دارد.

  5. اگر اکانت به هر دلیلی قفل شد، تکلیف باقی‌مانده‌ی دوره چیست؟ پاسخ را کتبی بگیرید.

  6. پشتیبانی تا چه زمانی و از چه مسیری ارائه می‌شود؟


اینترنت پایدار برای اجراهای طولانی

بخش زیادی از ارزش این نسل از مدل‌ها در کارهایی است که ساعت‌ها بدون نظارت اجرا می‌شوند. آنتروپیک در اطلاعیه‌اش نمونه‌ای از شرکت Ramp نقل کرده که یک اجرای بی‌وقفه‌ی ۳۸ ساعته روی یک مسئله‌ی یادگیری ماشین انجام شده است. برای این نوع کار، قطعی چنددقیقه‌ای اینترنت یا افت پهنای باند وسط آپلود یک مخزن کد بزرگ، هزینه‌ی واقعی دارد.

اگر کارتان به آپلود فایل‌های حجیم مرجع و نشست‌های طولانی وابسته است، پایداری خط بیشتر از سرعت اسمی آن اهمیت دارد. برای بررسی پوشش سرویس‌های آسیاتک در تبریز و آذربایجان شرقی می‌توانید با شماره‌ی ۰۴۱-۹۱۰۱۴۱۴۱ تماس بگیرید یا آدرس خود را استعلام کنید.


پرسش‌های پرتکرار

فیبل ۵.۱ رایگان است؟ خیر. روی پلن رایگان Claude در دسترس نیست و فقط روی پلن‌های Pro، Max، Team و Enterprise فعال می‌شود.

فیبل ۵.۱ از GPT-5.6 بهتر است؟ در شاخص هوش Artificial Analysis بله، با ۶۶ در برابر ۶۱ برای GPT-5.6 Sol. اما نتیجه به آزمون بستگی دارد و هزینه‌ی هر تسک روی فیبل بیشتر است. برای انتخاب، آزمون خودتان روی کار واقعی‌تان قابل اتکاتر از جدول لیدربورد است.

تفاوت فیبل ۵.۱ و میتوس ۵.۱ چیست؟ یک مدل‌اند با لایه‌های ایمنی متفاوت. فیبل عمومی است و میتوس فقط از طریق برنامه‌های دسترسی تأییدشده در اختیار سازمان‌های راستی‌آزمایی‌شده قرار می‌گیرد.

پنجره‌ی کانتکست چقدر است؟ روی API یک میلیون توکن. روی پلن‌های Pro و Max برابر ۲۰۰ هزار توکن.

قیمت API چقدر است؟ هر میلیون توکن ورودی ۱۰ دلار، هر میلیون توکن خروجی ۵۰ دلار، و خواندن از کش هر میلیون توکن ۰.۲۵ دلار. بررسی‌شده در ۱۱ شهریور ۱۴۰۵.

آیا آنتروپیک در ایران سرویس ارائه می‌دهد؟ خیر. ایران در فهرست رسمی کشورهای پشتیبانی‌شده برای Claude.ai و API تجاری قرار ندارد.


قبل از مهاجرت چه چیزی را بسنجید

اگر همین حالا روی Opus 5 یا فیبل ۵ کار می‌کنید، پیش از تعویض مدل یک آزمون کوچک روی بار کاری واقعی خودتان اجرا کنید و دو عدد را ثبت کنید: کیفیت خروجی و هزینه‌ی هر تسک تمام‌شده. اختلاف سه امتیازی در لیدربورد ممکن است در کار شما اصلاً دیده نشود، در حالی که اختلاف ۱.۶ برابری هزینه در صورت‌حساب ماه بعد کاملاً دیده می‌شود. اگر بار کاری‌تان کانتکست ثابت و بزرگی دارد که مدام دوباره خوانده می‌شود، کاهش نرخ کش به نفع شماست؛ اگر کارتان خروجی طولانی تولید می‌کند، احتمالاً نیست.