پرش به محتوای اصلی

آنتروپیک با هوش مصنوعی Claude Haiku 5.5 و کاهش ۹۰ درصدی قیمت به جنگ رقبا رفت

مطالعه ۶ دقیقه
سرور هوشمند و داده‌های دیجیتال مربوط به مدل Claude (Claude) در محیط دیتاسنتر

آنتروپیک با معرفی Claude Haiku 5.5 و کاهش ۹۰ درصدی هزینه‌ی توکن‌ها، رقابت قیمتی مستقیمی را با GPT-6 Luna آغاز کرد.

آنتروپیک از جدیدترین مدل زبانی کوچک خود با نام Claude Haiku 5.5 پرده برداشت؛ مدلی که با کاهش ۹۰ درصدی نرخ توکن‌ها برای درخواست‌های زیر ۱۰۰٬۰۰۰ توکن، مستقیما هزینه‌های بالای پردازش‌های سازمانی را هدف می‌گیرد.

تمرکز اصلی مدل جدید بر انجام وظایف تکراری مانند خلاصه‌سازی اسناد، دسته‌بندی داده‌ها، کوئری‌زدن به پایگاه‌های داده و پشتیبانی از عامل‌های هوشمند پیچیده‌تر است.

نرخ پایه‌ی مدل جدید از ۰٫۱۰ دلار به ازای هر یک میلیون توکن ورودی و ۰٫۵۰ دلار به ازای هر یک میلیون توکن خروجی آغاز می‌شود که هم‌تراز با مدل GPT-6 Luna متعلق به اوپن‌ای‌آی است.

با در نظر گرفتن ابعاد درخواست‌ها و بهینه‌سازی‌های اعمال‌شده روی توکنایزر، هزینه‌ی اجرای حجم‌های کاری سازمانی در مقایسه با Haiku 4.5 تا حدود ۷۵ درصد کاهش می‌یابد. در کنار این اقدام، نرخ دسترسی به حافظه‌ی موقت (Caching) در مدل Sonnet 5.5 نیز کاهش یافته و اعتبارات ماهانه‌ی جدیدی به مشترکان بسته‌های Max و Team اختصاص داده شده است.

توسعه‌دهندگان آنتروپیک مدل Haiku را به عنوان بازوی کمکی و پردازشگر مکمل در کنار مدل‌های قدرتمندتر Opus و Sonnet معرفی می‌کنند؛ مدل‌هایی که همچنان گزینه‌ی اصلی برای وظایف سنگین برنامه‌نویسی به شمار می‌روند. در معماری‌های نوین، یک مدل بزرگ می‌تواند چارچوب کلی یک ارائه‌ی مالی پیچیده را سامان دهد، در حالی که Haiku استخراج ارقام دقیق درآمدی برای هر اسلاید را بر عهده می‌گیرد.

الکس وانگ، از متخصصان هوش مصنوعی کاربردی در شرکت مالی Rogo، درباره‌ی عملکرد این مدل اظهار کرد: «دقت مدل در حدی است که بتوانیم به آن تکیه کنیم و هم‌زمان سرعت بالا و هزینه‌ی اندک آن امکان استفاده‌ی پیوسته و مکرر را برای ما فراهم می‌سازد.»

ساختار تعرفه‌گذاری و بیشترین تخفیف برای درخواست‌های کوتاه

ساختار قیمت‌گذاری بر اساس آستانه‌ی حجم درخواست‌ها تفکیک شده است. درخواست‌های بالاتر از ۱۰۰٬۰۰۰ توکن مشمول نرخ ۰٫۵۰ دلار برای ورودی و ۲٫۵۰ دلار برای خروجی می‌شوند که حاکی از کاهش ۵۰ درصدی نسبت به نسل پیشین است، در شرایطی که درخواست‌های زیر این آستانه مشمول کاهش ۹۰ درصدی قیمت شده‌اند.

جدول زیر ساختار دقیق هزینه‌های توکن و حافظه‌ی موقت مدل‌های Haiku را نشان می‌دهد.

هزینه بر اساس هر یک میلیون توکن

Haiku 5.5: زیر ۱۰۰,۰۰۰ توکن

Haiku 5.5: بالای ۱۰۰,۰۰۰ توکن

Haiku 4.5

ورودی

$0.10

$0.50

$1.00

خروجی

$0.50

$2.50

$5.00

خواندن از حافظه‌ی موقت (Cache reads)

$0.01

$0.05

$0.10

نوشتن در حافظه‌ی موقت (Cache writes)

$0.125

$0.625

$1.25

طبق داده‌های آماری ارائه‌شده، حدود ۹۰ درصد از درخواست‌های کاربران مدل Haiku 4.5 در دسته‌ی کوتاه‌تر از ۱۰۰٬۰۰۰ توکن جای می‌گیرند. هرچند توکنایزر جدید تعداد توکن‌های بیشتری را برای اجرای وظایف هم‌ارز مصرف می‌کند، میانگین صرفه‌جویی نهایی در هزینه‌ها به ۷۵ درصد می‌رسد.

مقایسه‌ی قیمت با مدل‌های رقیب

تعرفه‌های جدید توان رقابتی محصول آنتروپیک را در بازار مدل‌های اختصاصی ارتقا داده است، گرچه این مدل در تمام شاخص‌ها ارزان‌ترین گزینه‌ی بازار به شمار نمی‌رود. مدل GPT-6 Luna اوپن‌ای‌آی در تمام چهار نرخ رده‌ی پایین از جمله بخش حافظه‌ی موقت با مدل جدید برابری می‌کند.

جدول زیر مقایسه‌ی قیمت ورودی و خروجی میان ارائه‌دهندگان مطرح هوش مصنوعی را نمایش می‌دهد.

مدل

ورودی به ازای هر یک میلیون توکن

خروجی به ازای هر یک میلیون توکن

شرایط قیمت‌گذاری

Anthropic Claude Haiku 5.5

$0.10

$0.50

درخواست‌های زیر ۱۰۰,۰۰۰ توکن

OpenAI GPT-6 Luna

$0.10

$0.50

نرخ پایه؛ نرخ‌های بالاتر از ۲۷۲,۰۰۰ توکن ورودی

Google Gemini 3.5 Flash-Lite

$0.30

$2.50

قیمت‌گذاری استاندارد

Anthropic Claude Haiku 5.5

$0.50

$2.50

درخواست‌های بالای ۱۰۰,۰۰۰ توکن

Google Gemini 3.8 Flash

$0.75

$3.75

نرخ‌های پروموشنال استاندارد تا پایان سال ۲۰۲۶

Grok 4.3

$1.25

$2.50

زیر ۲۰۰,۰۰۰ توکن پرامپت

Grok 4.7

$2.00

$6.00

زیر ۲۰۰,۰۰۰ توکن پرامپت

OpenAI GPT-6.1 Sol

$2.00

$10.00

نرخ استاندارد پایه

Anthropic Claude Sonnet 5.5

$2.00

$10.00

نرخ‌های فهرست‌شده در جدول عرضه

تفاوت در آستانه‌ی اعمال تعرفه‌ها نقشی کلیدی در محاسبات مالی سازمان‌ها دارد. رده‌ی بالاتر تعرفه‌ی Haiku پنج برابر رده‌ی پایینی آن محاسبه می‌شود، در حالی که هزینه‌ی اضافی مدل Luna از آستانه‌ی ۲۷۲٬۰۰۰ توکن ورودی آغاز می‌شود. از سویی دیگر، مواردی همچون دقت پاسخ، نیاز به تلاش مجدد و میزان توکن مصرفی تاثیر مستقیمی بر هزینه‌ی تمام‌شده‌ی پروژه‌ها دارند.

ارزیابی بنچمارک‌ها و تنظیمات سطح پردازش

داده‌های ارائه‌شده در آزمون‌های بنچمارک نشان‌دهنده‌ی برتری محسوس مدل جدید نسبت به Haiku 4.5 و پیشی‌گرفتن از GPT-6 Luna در برخی ارزیابی‌های منتخب است، هرچند Sonnet 5.5 همچنان دست بالا را در دستاوردهای فنی دارد.

جدول زیر عملکرد مدل‌های مختلف را در بنچمارک‌های تخصصی مقایسه می‌کند.

ارزیابی

Haiku 5.5

Haiku 4.5

GPT-6 Luna

Sonnet 5.5

GDPval-AA v2.1: کارهای دانشی

1,620

735

1,437

1,840

AA-Briefcase v1.1: کارهای دانشی

1,578

614

1,336

1,824

OSWorld 2.1, زیرمجموعه‌ی آفلاین: کار با کامپیوتر

72.4%

15.7%

48.9%

83.9%

Terminal-Bench 4.0: کدنویسی مبتنی بر عامل

39.2%

0.0%

16.4%

70.6%

FrontierCode 1.1, ارزیابی اصلی

46.4%

-

42.4%

52.1%*

قابلیت تنظیم سطوح پردازش (Effort Levels) از نوآوری‌های Claude Haiku 5.5 محسوب می‌شود که حالت پیش‌فرض آن روی سطح متوسط قرار دارد. دستیابی به امتیاز حدود ۳۹ درصد در بنچمارک Terminal-Bench 4.0 در شرایط حداکثر توان پردازشی رخ داده است، در حالی که سطح پردازش متوسط به امتیاز حدود ۲۰ درصد می‌رسد.

سرعت پاسخ‌دهی و بازخورد مشتریان سازمانی

سرعت مدل جدید در وضعیت استاندارد بالاترین میزان را در میان محصولات آنتروپیک ثبت کرده است، هرچند مدل Opus در حالت Fast Mode عملکرد سریع‌تری نشان می‌دهد. آنتروپیک شاخص دقیق تعداد توکن بر ثانیه را منتشر نکرده، اما گزارش‌های دریافتی از شرکت‌های همکار حاوی نکات قابل توجهی است.

یاشودا باونانی از مدیران ارشد هوش مصنوعی در پلتفرم Box از بهبود ۱۱ امتیازی عملکرد نسبت به نسل پیشین همراه با نصف شدن میزان تاخیر خبر می‌دهد.

آرون وین، مهندس نرم‌افزار Asana، به کاهش بیش از ۳۰ درصدی تاخیر در اتمام وظایف و افزایش ۲٫۵ برابری سرعت استنتاج در هر گام عامل اشاره کرده است.

زیو کلاپو، مهندس برجسته‌ی HubSpot، میانگین امتیاز ۹۲٫۸ درصد را در سه دور آزمون سامانه‌ی مدیریت ارتباط با مشتریان گزارش کرده است.

دسترسی ابری و ضوابط امنیتی

عرضه‌ی مدل جدید علاوه‌بر پلتفرم اختصاصی آنتروپیک، روی زیرساخت‌های ابری بزرگ شامل AWS، گوگل کلاد و مایکروسافت آژور با شناسه‌ی claude-haiku-5-5 آغاز شده است. بسته‌های توسعه‌ی نرم‌افزاری پایتون و تایپ‌اسکریپت نیز به‌روزرسانی شده‌اند و امکانات آزمایشی برای هدایت مرورگرها و کنترل کامپیوتر را در اختیار برنامه‌نویسان قرار می‌دهند.

محدودیت‌های امنیتی تازه‌ای در زمینه‌ی سایبری اعمال شده است و اجرای تست‌های نفوذ تحت پروتکل‌های محافظتی استاندارد مسدود می‌شود. سازمان‌های متقاضی دسترسی به ابزارهای پیشرفته‌ی امنیتی یا بیولوژیکی ملزم به ثبت‌نام در برنامه‌های راستی‌آزمایی آنتروپیک خواهند بود.

چالش اصلی پیش روی توسعه‌دهندگان تجاری، ارزیابی توانایی مدل در انجام دقیق وظایف مشخص به‌منظور توجیه اقتصادی به‌کارگیری مداوم آن در فرآیندهای کاری است.

به محتوای این مطلب چه امتیازی میدی؟

نظر شما برامون مهمه و به بهتر شدن کیفیت مطالب کمک می‌کنه.

۱ - بسیار بد۱۰ - بسیار خوب

نظرات

از دیگر اعضاء خانواده قلم