آنتروپیک از دو مدل تازه‌ی خود با نام‌های Claude Fable 5.1 و Claude Mythos 5.1 پرده برداشت؛ مدل‌هایی که شرکت، آن‌ها را پیشرفته‌ترین سامانه‌هایش برای کدنویسی، کارهای دانش‌محور و پژوهش علمی توصیف می‌کند. تفاوت اصلی دو نسخه در لایه‌های ایمنی و میزان دسترسی است، نه در هسته‌ی مدل.

Claude Fable 5.1 به‌صورت عمومی عرضه شده و Claude Mythos 5.1 فقط از مسیر برنامه‌های دسترسیِ مورد اعتماد در اختیار کاربران قرار می‌گیرد. آنتروپیک می‌گوید نسخه‌ی دوم برای پشتیبانی از کارهای مرتبط با امنیت سایبری و علوم زیستی طراحی شده و همان مدل پایه را با محدودیت‌های متفاوت در اختیار گروه‌های تأییدشده می‌گذارد.

قیمت کمتر، دسترسی گسترده‌تر

بخش مهم رونمایی به هزینه و نگهداری داده‌ها مربوط می‌شود. آنتروپیک اعلام کرده Fable 5.1 در بارهای کاری معمولی، زمانی که مصرف بر اساس توکن محاسبه می‌شود، حدود ۲۵ درصد ارزان‌تر از Fable 5 است. در کارهای شدیدا عامل‌محور، صرفه‌جویی می‌تواند به حدود ۴۵ درصد برسد. کاهش قیمت عمدتا از ارزان‌تر‌شدن خواندنِ کش می‌آید؛ جایی که مدل دوباره از ورودی‌های پردازش‌شده استفاده می‌کند.

پخش از رسانه

هم‌زمان، سازوکار تازه‌ای با نام Enterprise Frontier Safeguards یا EFS معرفی شده که به مشتریان سازمانی حریم خصوصی کامل می‌دهد، با همان سطحی که در سیاست «عدم نگه‌داری داده» دیده می‌شود. داده‌ها در زیرساخت ابریِ تحت کنترل مشتری ذخیره می‌شوند، نه در سامانه‌های آنتروپیک. عرضه‌ی این قابلیت به‌صورت مرحله‌ای از اواخر پاییز آغاز می‌شود و تا زمان آماده‌شدن آن، مشتریان واجد شرایط می‌توانند از Fable 5.1 با عدم نگهداری داده استفاده کنند.

آنتروپیک می‌گوید سیستم‌های حفاظتی را طوری بازطراحی کرده است که هشدارهای کاذب کمتر شوند

آنتروپیک می‌گوید نسخه‌های تازه‌ی حفاظتی را طوری بازطراحی کرده که هشدارهای کاذب کمتر شوند. در امنیت سایبری، سامانه‌های جدید ۶۰ درصد هشدار کاذب کمتری نسبت به قبل تولید می‌کنند. بخشی از این تغییر به آن دلیل است که Fable 5.1 اکنون می‌تواند برای شناسایی آسیب‌پذیری‌های نرم‌افزاری به‌کار رود، اما همچنان برای توسعه‌ی اکسپلویت‌ها مجاز نیست.

در حوزه‌ی زیست‌شناسی نیز برنامه‌ای با دسترسیِ تاییدشده و با همکاری دولت آمریکا شکل گرفته تا توانایی‌های پیشرفته‌ی Claude Mythos 5.1 برای پژوهشگران قابل استفاده شود. آنتروپیک می‌گوید امکان ثبت‌نام دانشمندان به‌زودی فراهم خواهد شد.

جهش عملکرد در کدنویسی و کارهای طولانی

به‌گفته‌ی آنتروپیک، Claude Fable 5.1 استاندارد تازه‌ای برای کدنویسی، کارهای دانشی و حل مسئله‌های طولانی‌مدت تعریف می‌کند. شرکت می‌گوید این مدل نسبت به نسل قبل در بنچمارک‌های مختلف عملکرد بالاتری دارد و زمانی که روی Low یا Medium effort تنظیم شود، می‌تواند با هزینه‌ای کمتر، نتیجه‌ای هم‌سطح یا بهتر از Fable 5 ارائه دهد. در Claude Code حالت پیش‌فرض روی High effort قرار دارد و در Claude Cowork و Claude.ai روی Medium تنظیم می‌شود.

Anthropic

آنتروپیک برای نشان‌دادن کیفیت جدید مدل به نمونه‌ای از آزمون‌های داخلی هم اشاره کرده است. در تست‌های شرکت سرمایه‌گذاری میلنیوم، Fable 5.1 علت یک سقوط نادر در سامانه‌های داخلی را پیدا کرد؛ مشکلی که به‌گفته‌ی آنتروپیک، هیچ‌یک از مهندسان آن شرکت و هیچ مدل دیگری سال‌ها موفق به توضیح آن نشده بودند.

آنتروپیک در این رونمایی بخشی را به پژوهش علمی اختصاص داده و مدعی است که توانایی‌های تحقیقاتی دو مدل تازه، نشانه‌ای زودهنگام از نقش آینده‌ی هوش مصنوعی در پیشرفت علم به‌دست می‌دهد. شرکت در چند حوزه، از طراحی مولکولی تا زیست‌محاسباتی و تحلیل سیاره‌ای، نمونه‌هایی از خروجی‌ها را ارائه کرده است.

در طراحی مولکولی، Claude Mythos 5.1 با ابزارهای متن‌باز طراحی و تاخوردگی پروتئین کار کرد و طراحی‌هایش برای اعتبارسنجی تجربی به دو سازمان بیرونی فرستاده شد. آنتروپیک می‌گوید مدل توانست پیونددهنده‌هایی با قدرت اتصال بسیار بالا طراحی کند و روی سه هدف، افینیتی اتصال (Binding Affinity) آن ۱۰ برابر بهتر از بهترین طرح‌های ارائه‌شده در رقابت‌های Adaptyv Bio بود. نرخ موفقیت آن نیز به حدود ۵۰ درصد در میان ۱۲ هدف رسید، در حالی که نرخ‌های معمول در طراحی پروتئین امروز حدود ۱۰ تا ۱۵ درصد است.

نمودار مقایسه دقت و هزینه مدل‌های Fable 5.1 و Fable 5 در پژوهش‌های علمی
نمودار دقت و هزینه مدل‌های Fable 5.1 و Fable 5 در آزمون استدلال چندرشته‌ای
نمودار دقت در برابر هزینه مدل‌های Fable 5.1 و Fable 5 در بنچمارک CursorBench 3.2.0

در تحلیل محاسباتی، Claude Fable 5.1 یک شبکه‌ی عصبی آموزش داد تا نقشه‌ای تازه و با وضوح بالاتر از یک‌سوم سطح سیاره‌ی ناهید بسازد. داده‌های ورودی از تصاویر راداری ماموریت Magellan ناسا گرفته شده بود؛ ماموریتی که بیش از ۳۰ سال پیش انجام شد.

مدل جدید آنتروپیک، رگه‌هایی از درهم‌تنیدگی هوش مصنوعی و پیشرفت علم را به‌نمایش می‌گذارد

نقشه‌ی تازه جزئیات را تا مقیاس ۲ تا ۳ کیلومتر نشان می‌دهد، در حالی که دقت قبلی حدود ۱۰ تا ۲۰ کیلومتر بود. ارتفاع‌ها نیز تا ۲۵ درصد دقیق‌تر از قبل نمایش داده می‌شوند. آنتروپیک این نقشه را تحت مجوز Creative Commons منتشر کرده تا شاید در ماموریت‌های آتی VERITAS ناسا و EnVision آژانس فضایی اروپا به انتخاب هدف‌های زمین‌شناختی کمک کند.

در زیست‌محاسباتی، Claude Mythos 5.1 با نوشتن کرنل‌های سفارشی GPU و ذخیره‌ی نتایج میانی توانست سرعت هفت مدل یادگیری عمیق متن‌باز را تا ۲٫۵ برابر بالا ببرد، بدون آن‌که خروجی‌ها تغییر کنند.

آنتروپیک می‌گوید چنین بهینه‌سازی‌هایی می‌تواند هزینه‌ی GPU را در تحلیل‌های پرتکرار، مانند آزمودن همه‌ی جهش‌های ممکن در نزدیکی یک ژن انسانی، بین ۳۰ تا ۶۰ درصد کاهش دهد. به‌گفته‌ی شرکت، کاری که معمولا هفته‌ها زمان یک تیم مهندسی عملکرد را می‌خواهد، این مدل در چند روز و تنها با کد منبع عمومی انجام داده است. انتشار متن‌باز این بهینه‌سازی‌ها نیز در برنامه قرار دارد.

Anthropic

ایمنی، امنیت و هم‌ترازی

آنتروپیک می‌گوید با قدرتمندتر شدن توان عامل‌محور مدل‌ها، ریسک‌های تازه‌ای هم شکل گرفته و به همین دلیل ارزیابی‌های ایمنی و هم‌ترازی را پیش از عرضه به‌طور گسترده انجام داده است.

طبق گزارش فنی شرکت، Claude Mythos 5.1 در آزمون‌های زیستی و شیمیایی از نسل قبل توانمندتر است، اما همچنان از آستانه‌ی ریسک بعدی تعریف‌شده در سیاست مقیاس‌پذیری مسئولانه پایین‌تر می‌ماند. به همین دلیل، همان محدودیت‌های Mythos 5 برای دسترسی به قابلیت‌های پژوهشی زیست‌شناسی حفظ شده است.

آنتروپیک می‌گوید مدل تازه قوی‌ترین توان سایبری میان مدل‌های منتشرشده‌ی این شرکت را نشان داده، هرچند هنوز در رده‌ی پایین‌تری از ریسک قرار می‌گیرد. همچنین برای Fable 5.1 آزمون‌های تنش گسترده انجام شده و طبق ادعای شرکت، در این حفاظت‌ها نشانه‌ای از یک جیل‌بریک بحرانی پیدا نشده است.

Anthropic

آزمایش‌های مربوط به رفتار عامل‌محور و حملات تزریق پرامپت هم انجام شده‌اند. آنتروپیک می‌گوید Mythos 5.1 درخواست‌های مخرب مربوط به کدنویسی عامل‌محور و استفاده از کامپیوتر را با نرخی مشابه Mythos 5 و Sonnet 5 و Opus 5 رد می‌کند و در بنچمارک بیرونیِ تزریق پرامپت، مقاوم‌ترین مدل این شرکت تا امروز به‌شمار می‌آید.

در ارزیابی هم‌ترازی، نتایج آنتروپیک حاکی از بهبود در بیشتر شاخص‌ها است. مدل تازه کمتر از نسل قبل تلاش می‌کند به منابع خارج از محیط آزمایشی دسترسی پیدا کند، کمتر از استدلال توجیه‌گر برای پیشبرد رفتار خود استفاده می‌کند و تمایل کمتری به نادیده‌گرفتن محدودیت‌های صریح دارد.

حفاظت‌های سازمانی و ضدتقطیر

بخش دیگری از رونمایی به EFS و مدل‌های حفاظتی دقیق‌تر برای زیست‌شناسی و امنیت سایبری اختصاص دارد. آنتروپیک می‌گوید این لایه‌ها اجازه می‌دهند استفاده‌ی مفید از مدل‌ها حفظ شود، بدون آن‌که حریم خصوصی سازمانی قربانی شود. شرکت برای توسعه‌ی EFS با بیش از ۱۰۰ مشتری در صنایع مالی، سلامت، تولید، مخابرات، حقوقی، خرده‌فروشی و بخش عمومی و همچنین با شرکای ابری خود در AWS و Google Cloud و Microsoft Azure همکاری کرده است.

هم‌زمان، آنتروپیک از سازوکارهای تازه‌ای برای سخت‌تر کردن حملات تقطیر صحبت می‌کند. طبق توضیح شرکت، دیگر برای حساب‌های جدید API امکان ویرایش دستی زمینه‌ی قبلی مکالمه‌ی چندمرحله‌ای، همراه با حفظ نسخه‌ی قبلی تفکر مدل، وجود ندارد. آنتروپیک این اقدام را بستن یکی از روش‌های شناخته‌شده‌ی تقطیر می‌داند و می‌گوید تغییر به‌تدریج اعمال می‌شود تا اختلال کمتری ایجاد کند.

پلتفرم Claude Security نیز اکنون از Claude Mythos 5.1 قدرت می‌گیرد

Claude Mythos 5.1 همان مدل پایه‌ی Fable 5.1 است، اما برای افراد و سازمان‌های تاییدشده که کارشان تحت تاثیر محدودیت‌های سایبری یا زیست‌فناورانه قرار می‌گیرد، با محافظت‌های بازتر در دسترس قرار می‌گیرد. آنتروپیک می‌گوید این دسترسی از مسیر دو برنامه انجام می‌شود؛ Cyber Verification Program یا CVP برای مدافعان امنیت و Life Sciences Verification Program یا LSVP برای متخصصان علوم زیستی.

در کنار این برنامه‌ها، Claude Security نیز اکنون با Claude Mythos 5.1 قدرت می‌گیرد؛ محصولی که پایگاه‌های کد را برای یافتن آسیب‌پذیری‌ها بررسی می‌کند و وصله‌های پیشنهادی را برای بازبینی انسانی ارائه می‌دهد. آنتروپیک می‌گوید در حال حاضر فقط مجموعه‌ای از سازمان‌های آمریکایی به Mythos 5.1 دسترسی دارند و هماهنگی برای گسترش این دسترسی به شرکای داخلی و بین‌المللی ادامه دارد.

دسترسی و قیمت نهایی

Claude Fable 5.1 از امروز روی همه‌ی پلتفرم‌ها در دسترس است؛ از جمله Amazon Web Services و Google Cloud و Microsoft Azure. توسعه‌دهندگان می‌توانند کار را از مسیر claude-fable-5-1 در API آنتروپیک آغاز کنند.

قیمت خواندن کش در این نسخه ۷۵ درصد کاهش یافته و به ۰٫۲۵ دلار برای هر یک میلیون توکن رسیده است. قیمت ورودی همچنان ۱۰ دلار و قیمت خروجی ۵۰ دلار برای هر یک میلیون توکن باقی مانده است. آنتروپیک می‌گوید در حال انتقال بخشی از بهبودهای Fable 5.1 به دیگر مدل‌های خود است.

درباره‌ی Claude Mythos 5.1 نیز شرکت تأکید می‌کند که دسترسی آن فعلا محدود به مدافعان تاییدشده‌ی امنیت و دانشمندان علوم زیستی است و قرار است در ادامه، دامنه‌ی دسترسی با هماهنگی دولت آمریکا گسترده‌تر شود.