آنتروپیک از دو مدل تازهی خود با نامهای Claude Fable 5.1 و Claude Mythos 5.1 پرده برداشت؛ مدلهایی که شرکت، آنها را پیشرفتهترین سامانههایش برای کدنویسی، کارهای دانشمحور و پژوهش علمی توصیف میکند. تفاوت اصلی دو نسخه در لایههای ایمنی و میزان دسترسی است، نه در هستهی مدل.
Claude Fable 5.1 بهصورت عمومی عرضه شده و Claude Mythos 5.1 فقط از مسیر برنامههای دسترسیِ مورد اعتماد در اختیار کاربران قرار میگیرد. آنتروپیک میگوید نسخهی دوم برای پشتیبانی از کارهای مرتبط با امنیت سایبری و علوم زیستی طراحی شده و همان مدل پایه را با محدودیتهای متفاوت در اختیار گروههای تأییدشده میگذارد.
قیمت کمتر، دسترسی گستردهتر
بخش مهم رونمایی به هزینه و نگهداری دادهها مربوط میشود. آنتروپیک اعلام کرده Fable 5.1 در بارهای کاری معمولی، زمانی که مصرف بر اساس توکن محاسبه میشود، حدود ۲۵ درصد ارزانتر از Fable 5 است. در کارهای شدیدا عاملمحور، صرفهجویی میتواند به حدود ۴۵ درصد برسد. کاهش قیمت عمدتا از ارزانترشدن خواندنِ کش میآید؛ جایی که مدل دوباره از ورودیهای پردازششده استفاده میکند.
پخش از رسانه
همزمان، سازوکار تازهای با نام Enterprise Frontier Safeguards یا EFS معرفی شده که به مشتریان سازمانی حریم خصوصی کامل میدهد، با همان سطحی که در سیاست «عدم نگهداری داده» دیده میشود. دادهها در زیرساخت ابریِ تحت کنترل مشتری ذخیره میشوند، نه در سامانههای آنتروپیک. عرضهی این قابلیت بهصورت مرحلهای از اواخر پاییز آغاز میشود و تا زمان آمادهشدن آن، مشتریان واجد شرایط میتوانند از Fable 5.1 با عدم نگهداری داده استفاده کنند.
آنتروپیک میگوید سیستمهای حفاظتی را طوری بازطراحی کرده است که هشدارهای کاذب کمتر شوند
آنتروپیک میگوید نسخههای تازهی حفاظتی را طوری بازطراحی کرده که هشدارهای کاذب کمتر شوند. در امنیت سایبری، سامانههای جدید ۶۰ درصد هشدار کاذب کمتری نسبت به قبل تولید میکنند. بخشی از این تغییر به آن دلیل است که Fable 5.1 اکنون میتواند برای شناسایی آسیبپذیریهای نرمافزاری بهکار رود، اما همچنان برای توسعهی اکسپلویتها مجاز نیست.
در حوزهی زیستشناسی نیز برنامهای با دسترسیِ تاییدشده و با همکاری دولت آمریکا شکل گرفته تا تواناییهای پیشرفتهی Claude Mythos 5.1 برای پژوهشگران قابل استفاده شود. آنتروپیک میگوید امکان ثبتنام دانشمندان بهزودی فراهم خواهد شد.
جهش عملکرد در کدنویسی و کارهای طولانی
بهگفتهی آنتروپیک، Claude Fable 5.1 استاندارد تازهای برای کدنویسی، کارهای دانشی و حل مسئلههای طولانیمدت تعریف میکند. شرکت میگوید این مدل نسبت به نسل قبل در بنچمارکهای مختلف عملکرد بالاتری دارد و زمانی که روی Low یا Medium effort تنظیم شود، میتواند با هزینهای کمتر، نتیجهای همسطح یا بهتر از Fable 5 ارائه دهد. در Claude Code حالت پیشفرض روی High effort قرار دارد و در Claude Cowork و Claude.ai روی Medium تنظیم میشود.
آنتروپیک برای نشاندادن کیفیت جدید مدل به نمونهای از آزمونهای داخلی هم اشاره کرده است. در تستهای شرکت سرمایهگذاری میلنیوم، Fable 5.1 علت یک سقوط نادر در سامانههای داخلی را پیدا کرد؛ مشکلی که بهگفتهی آنتروپیک، هیچیک از مهندسان آن شرکت و هیچ مدل دیگری سالها موفق به توضیح آن نشده بودند.
آنتروپیک در این رونمایی بخشی را به پژوهش علمی اختصاص داده و مدعی است که تواناییهای تحقیقاتی دو مدل تازه، نشانهای زودهنگام از نقش آیندهی هوش مصنوعی در پیشرفت علم بهدست میدهد. شرکت در چند حوزه، از طراحی مولکولی تا زیستمحاسباتی و تحلیل سیارهای، نمونههایی از خروجیها را ارائه کرده است.
در طراحی مولکولی، Claude Mythos 5.1 با ابزارهای متنباز طراحی و تاخوردگی پروتئین کار کرد و طراحیهایش برای اعتبارسنجی تجربی به دو سازمان بیرونی فرستاده شد. آنتروپیک میگوید مدل توانست پیونددهندههایی با قدرت اتصال بسیار بالا طراحی کند و روی سه هدف، افینیتی اتصال (Binding Affinity) آن ۱۰ برابر بهتر از بهترین طرحهای ارائهشده در رقابتهای Adaptyv Bio بود. نرخ موفقیت آن نیز به حدود ۵۰ درصد در میان ۱۲ هدف رسید، در حالی که نرخهای معمول در طراحی پروتئین امروز حدود ۱۰ تا ۱۵ درصد است.



در تحلیل محاسباتی، Claude Fable 5.1 یک شبکهی عصبی آموزش داد تا نقشهای تازه و با وضوح بالاتر از یکسوم سطح سیارهی ناهید بسازد. دادههای ورودی از تصاویر راداری ماموریت Magellan ناسا گرفته شده بود؛ ماموریتی که بیش از ۳۰ سال پیش انجام شد.
مدل جدید آنتروپیک، رگههایی از درهمتنیدگی هوش مصنوعی و پیشرفت علم را بهنمایش میگذارد
نقشهی تازه جزئیات را تا مقیاس ۲ تا ۳ کیلومتر نشان میدهد، در حالی که دقت قبلی حدود ۱۰ تا ۲۰ کیلومتر بود. ارتفاعها نیز تا ۲۵ درصد دقیقتر از قبل نمایش داده میشوند. آنتروپیک این نقشه را تحت مجوز Creative Commons منتشر کرده تا شاید در ماموریتهای آتی VERITAS ناسا و EnVision آژانس فضایی اروپا به انتخاب هدفهای زمینشناختی کمک کند.
در زیستمحاسباتی، Claude Mythos 5.1 با نوشتن کرنلهای سفارشی GPU و ذخیرهی نتایج میانی توانست سرعت هفت مدل یادگیری عمیق متنباز را تا ۲٫۵ برابر بالا ببرد، بدون آنکه خروجیها تغییر کنند.
آنتروپیک میگوید چنین بهینهسازیهایی میتواند هزینهی GPU را در تحلیلهای پرتکرار، مانند آزمودن همهی جهشهای ممکن در نزدیکی یک ژن انسانی، بین ۳۰ تا ۶۰ درصد کاهش دهد. بهگفتهی شرکت، کاری که معمولا هفتهها زمان یک تیم مهندسی عملکرد را میخواهد، این مدل در چند روز و تنها با کد منبع عمومی انجام داده است. انتشار متنباز این بهینهسازیها نیز در برنامه قرار دارد.
ایمنی، امنیت و همترازی
آنتروپیک میگوید با قدرتمندتر شدن توان عاملمحور مدلها، ریسکهای تازهای هم شکل گرفته و به همین دلیل ارزیابیهای ایمنی و همترازی را پیش از عرضه بهطور گسترده انجام داده است.
طبق گزارش فنی شرکت، Claude Mythos 5.1 در آزمونهای زیستی و شیمیایی از نسل قبل توانمندتر است، اما همچنان از آستانهی ریسک بعدی تعریفشده در سیاست مقیاسپذیری مسئولانه پایینتر میماند. به همین دلیل، همان محدودیتهای Mythos 5 برای دسترسی به قابلیتهای پژوهشی زیستشناسی حفظ شده است.
آنتروپیک میگوید مدل تازه قویترین توان سایبری میان مدلهای منتشرشدهی این شرکت را نشان داده، هرچند هنوز در ردهی پایینتری از ریسک قرار میگیرد. همچنین برای Fable 5.1 آزمونهای تنش گسترده انجام شده و طبق ادعای شرکت، در این حفاظتها نشانهای از یک جیلبریک بحرانی پیدا نشده است.
آزمایشهای مربوط به رفتار عاملمحور و حملات تزریق پرامپت هم انجام شدهاند. آنتروپیک میگوید Mythos 5.1 درخواستهای مخرب مربوط به کدنویسی عاملمحور و استفاده از کامپیوتر را با نرخی مشابه Mythos 5 و Sonnet 5 و Opus 5 رد میکند و در بنچمارک بیرونیِ تزریق پرامپت، مقاومترین مدل این شرکت تا امروز بهشمار میآید.
در ارزیابی همترازی، نتایج آنتروپیک حاکی از بهبود در بیشتر شاخصها است. مدل تازه کمتر از نسل قبل تلاش میکند به منابع خارج از محیط آزمایشی دسترسی پیدا کند، کمتر از استدلال توجیهگر برای پیشبرد رفتار خود استفاده میکند و تمایل کمتری به نادیدهگرفتن محدودیتهای صریح دارد.
حفاظتهای سازمانی و ضدتقطیر
بخش دیگری از رونمایی به EFS و مدلهای حفاظتی دقیقتر برای زیستشناسی و امنیت سایبری اختصاص دارد. آنتروپیک میگوید این لایهها اجازه میدهند استفادهی مفید از مدلها حفظ شود، بدون آنکه حریم خصوصی سازمانی قربانی شود. شرکت برای توسعهی EFS با بیش از ۱۰۰ مشتری در صنایع مالی، سلامت، تولید، مخابرات، حقوقی، خردهفروشی و بخش عمومی و همچنین با شرکای ابری خود در AWS و Google Cloud و Microsoft Azure همکاری کرده است.
همزمان، آنتروپیک از سازوکارهای تازهای برای سختتر کردن حملات تقطیر صحبت میکند. طبق توضیح شرکت، دیگر برای حسابهای جدید API امکان ویرایش دستی زمینهی قبلی مکالمهی چندمرحلهای، همراه با حفظ نسخهی قبلی تفکر مدل، وجود ندارد. آنتروپیک این اقدام را بستن یکی از روشهای شناختهشدهی تقطیر میداند و میگوید تغییر بهتدریج اعمال میشود تا اختلال کمتری ایجاد کند.
پلتفرم Claude Security نیز اکنون از Claude Mythos 5.1 قدرت میگیرد
Claude Mythos 5.1 همان مدل پایهی Fable 5.1 است، اما برای افراد و سازمانهای تاییدشده که کارشان تحت تاثیر محدودیتهای سایبری یا زیستفناورانه قرار میگیرد، با محافظتهای بازتر در دسترس قرار میگیرد. آنتروپیک میگوید این دسترسی از مسیر دو برنامه انجام میشود؛ Cyber Verification Program یا CVP برای مدافعان امنیت و Life Sciences Verification Program یا LSVP برای متخصصان علوم زیستی.
در کنار این برنامهها، Claude Security نیز اکنون با Claude Mythos 5.1 قدرت میگیرد؛ محصولی که پایگاههای کد را برای یافتن آسیبپذیریها بررسی میکند و وصلههای پیشنهادی را برای بازبینی انسانی ارائه میدهد. آنتروپیک میگوید در حال حاضر فقط مجموعهای از سازمانهای آمریکایی به Mythos 5.1 دسترسی دارند و هماهنگی برای گسترش این دسترسی به شرکای داخلی و بینالمللی ادامه دارد.
دسترسی و قیمت نهایی
Claude Fable 5.1 از امروز روی همهی پلتفرمها در دسترس است؛ از جمله Amazon Web Services و Google Cloud و Microsoft Azure. توسعهدهندگان میتوانند کار را از مسیر claude-fable-5-1 در API آنتروپیک آغاز کنند.
قیمت خواندن کش در این نسخه ۷۵ درصد کاهش یافته و به ۰٫۲۵ دلار برای هر یک میلیون توکن رسیده است. قیمت ورودی همچنان ۱۰ دلار و قیمت خروجی ۵۰ دلار برای هر یک میلیون توکن باقی مانده است. آنتروپیک میگوید در حال انتقال بخشی از بهبودهای Fable 5.1 به دیگر مدلهای خود است.
دربارهی Claude Mythos 5.1 نیز شرکت تأکید میکند که دسترسی آن فعلا محدود به مدافعان تاییدشدهی امنیت و دانشمندان علوم زیستی است و قرار است در ادامه، دامنهی دسترسی با هماهنگی دولت آمریکا گستردهتر شود.