آنتروپیک گام بلند دیگری در توسعه‌ی هوش مصنوعی برداشت و از تازه‌ترین مدل رده‌بالای خود با نام Claude Opus 5.5 رونمایی کرد. قدرتمندترین نسخه در میان مدل‌های سه‌گانه‌ی کلاد، اکنون با جهشی کم‌نظیر، عملکردی هم‌تراز با مدل غول‌پیکر Claude Fable 5.1 ارائه می‌دهد و در برخی آزمون‌های برنامه‌نویسی و کارهای دانش‌محور حتی از برادر بزرگ‌تر خود پیشی می‌گیرد.

مدل تازه‌نفس نه‌تنها هوشمندتر شده، بلکه ۴۰ درصد ارزان‌تر از نسل پیشین خود یعنی Opus 5 است. هزینه‌ی پردازش توکن‌های خروجی برای هر یک میلیون توکن از ۲۵ دلار به ۲۰ دلار کاهش یافته است و بهینه‌سازی‌های زیرساختی باعث شده تا پاسخ‌ها با سرعتی به‌مراتب بالاتر و مصرف منابع پردازشی کمتر تولید شوند.

Anthropic

یکی از چشمگیرترین تحولات در معماری Opus 5.5، کاهش رفتارهای غیرقابل‌پیش‌بینی است. گزارش‌ها در هفته‌های اخیر پیرامون تلاش برخی مدل‌های پیشرفته برای خروج از محیط‌های ایزوله‌ی آزمایشی و نفوذ به شبکه‌های متفرقه، نگرانی‌های گسترده‌ای پدید آورده بود. بررسی‌ها نشان می‌دهد نرخ تلاش این سامانه برای دور زدن محدودیت‌های حفاظتی، در مقایسه با Opus 5 و Mythos 5.1 تا ۸۵ درصد افت داشته است و تمامی موارد نادر مشاهده‌شده نیز کم‌خطر و خودگزارش‌شده بوده‌اند.

نمودار دقت در برابر هزینه مدل‌های هوش مصنوعی Opus 5.5 و Fable 5.1 و سایر مدل‌ها
نمودار مقایسه دقت و هزینه مدل‌های Opus 5.5 و Fable 5.1 و Opus 5
نمودار مقایسه دقت و هزینه مدل‌های Opus 5.5، Fable 5.1، Opus 5 و GPT-5.6 Sol در CursorBench 4.0

توسعه‌دهندگان برای ارتقاء ضریب اطمینان، سازوکار حفاظتی مدل Fable را در این نسخه پیاده کرده‌اند. بر پایه‌ی این ساختار، درخواست‌های حساس حوزه‌ی امنیت سایبری به نسخه‌ی سبک‌تر Opus 4.8 هدایت می‌شوند و پرسش‌های مشکوک پیرامون مباحث زیستی و عوامل بیماری‌زا در اختیار Opus 5 قرار می‌گیرند تا از هرگونه سوءاستفاده‌ی احتمالی در کشف آسیب‌پذیری‌های نرم‌افزاری یا خطرات بیولوژیکی جلوگیری شود.

سبک پاسخ‌دهی کلاد در نگارش جدید دستخوش بازنگری اساسی شده است. مدل تازه تمایل بسیار کمتری به استفاده از اصطلاحات پیچیده‌ی تخصصی دارد و اطلاعات کلیدی و پاسخ اصلی را درست در ابتدای پیام قرار می‌دهد تا تعامل با کاربران روان‌تر و شفاف‌تر پیش برود.

نمودار خطی مقایسه امتیاز Elo و هزینه هر تسک برای مدل‌های Opus 5.5 و Fable 5.1 و سایر مدل‌ها
نمودار مقایسه نرخ موفقیت و هزینه مدل‌های Opus 5.5 و Opus 5 و GPT-6 Astra و GPT-5.6 Sol

عرضه‌ی Opus 5.5 نخستین اقدام عملی آنتروپیک پس از راهبرد داریو آمودی، مدیرعامل این مجموعه، برای مهار شتاب بی‌رویه و تنظیم سرعت پیشرفت هوش مصنوعی متناسب با پروتکل‌های ایمنی به‌شمار می‌رود. ارزیابی‌های پیش از عرضه توسط نهادهای مستقلی نظیر METR و Frontier Design صورت پذیرفته است و کاربران می‌توانند در هفته‌های آینده منتظر رونمایی از دو عضو دیگر این خانواده، یعنی Sonnet 5.5 و Haiku 5.5 باشند.

آیا کاهش قیمت توکن‌ها و تمرکز بیشتر بر ایمنی مدل‌های جدید هوش مصنوعی می‌تواند به استفاده‌ی گسترده‌تر از آن‌ها در پروژه‌های کاری شما کمک کند؟ دیدگاه خود را با ما در میان بگذارید.