هنرنمایی دوباره چین؛ پیشرفته‌ترین هوش مصنوعی علی‌بابا با ۲٫۴ تریلیون پارامتر معرفی شد

دوشنبه 12 مرداد 1405 - 10:31
مطالعه 3 دقیقه
مدل هوش مصنوعی Qwen 3 max
علی‌بابا از بزرگ‌ترین و قدرتمندترین مدل هوش مصنوعی خود با نام Qwen3.8-Max رونمایی کرد تا رقابت در بازار هوش مصنوعی چین وارد مرحله‌ی جدیدی شود.

علی‌بابا از بزرگ‌ترین و توانمندترین مدل هوش مصنوعی خود به نام Qwen3.8-Max پرده برداشت؛ ابزاری که از نظر ابعاد و کارایی، فاصله‌ی چندانی با محصولی ندارد که ماه گذشته از سوی استارتاپ مون‌شات ای‌آی معرفی شده بود.

غول‌های فناوری چین که نقشی اساسی در توسعه‌ی مدل‌های هوش مصنوعی متن‌باز در جهان دارند، اکنون درگیر رقابتی فشرده و سریع برای ساخت سیستم‌های قدرتمندتر بدون افزایش سرسام‌آور هزینه‌های عملیاتی هستند.

پخش از رسانه

مدل جدید علی‌بابا دارای ۲٫۴ تریلیون پارامتر است. پارامترها در واقع تنظیمات عددی خاصی هستند که مدل از طریق داده‌ها فرامی‌گیرد تا الگوها را شناسایی کند، پاسخ بسازد و وظایف مختلف را انجام دهد.

مدل Kimi K3 متعلق به استارتاپ مون‌شات ۲٫۸ تریلیون پارامتر دارد. تعداد بالاتر پارامترها لزوما به معنای برتری مطلق یک مدل نیست؛ اما معیار مهمی برای سنجش مقیاس پردازش و حجم داده‌های پشتوانه‌ی سیستم‌های پیشرفته به شمار می‌رود. پیش‌تر دستیار هوش مصنوعی کیمی با قابلیت‌های پردازشی خود سروصدای زیادی به پا کرده بود و اکنون علی‌بابا دقیقا در همین مسیر گام برمی‌دارد.

شرکت‌های چینی تمایل زیادی به انتشار تعداد پارامترهای محصولات خود دارند تا از این طریق توجه جامعه‌ی توسعه‌دهندگان را جلب کنند. مدل‌های توسعه‌یافته در آن کشور اغلب به صورت وزن‌باز ارائه می‌شوند؛ به این معنی که تنظیمات یادگیری سیستم برای دانلود و شخصی‌سازی در دسترس توسعه‌دهندگان قرار می‌گیرد.

در نقطه‌ی مقابل، غول‌های آمریکایی مانند گوگل، انتروپیک و OpenAI تعداد پارامترهای مدل‌های انحصاری و کدبسته‌ی خود را اعلام نمی‌کنند.

هوش مصنوعی جدید علی‌بابا همچنان پشت‌سر مدل فیبل ۵ قرار می‌گیرد

مدل Qwen3.8-Max در پلتفرم ارزیابی گروهی Arena.AI معرفی شد و بلافاصله رتبه‌ی نخست را در میان مدل‌های متنی چینی به دست آورد، هرچند همچنان پشت سر مدل Claude Fable 5 و سه نسخه‌ی مختلف از خانواده‌ی Opus قرار دارد.

Qwen3.8-Max در جدول رده‌بندی مدل‌های تحلیل تصویر و محتوای بصری همین پلتفرم، جایگاه دوم جهان را به خود اختصاص داد و تنها پایین‌تر از یک نسخه‌ی خاص از Claude Fable 5 ایستاد.

هر دو مدل Qwen3.8-Max و Kimi K3 توانایی پردازش متن، تصویر و ویدیو را دارند و می‌توانند تا یک میلیون توکن را در لحظه پردازش کنند. توکن‌ها بخش‌هایی از داده‌ها یا کلمات هستند و پشتیبانی از حجم بالای آن‌ها به این معنی است که مدل می‌تواند اسناد حقوقی طولانی، کدهای برنامه‌نویسی حجیم یا صدها صفحه سند را به صورت یک‌جا تحلیل کند.

علی‌بابا می‌گوید Qwen3.8-Max از معماری Mixture-of-Experts استفاده می‌کند. این طراحی هوشمندانه وظایف را میان بخش‌های تخصصی سیستم تقسیم می‌کند و مانع از فعال‌شدن کل مدل برای پاسخ به هر درخواست می‌شود. در این روش تنها ۹۵ میلیارد پارامتر به طور هم‌زمان فعال می‌شوند که هزینه‌ها و تاخیر در پاسخ‌گویی را به شدت کاهش می‌دهد

علی‌بابا ادعا می‌کند که مدل جدیدش توانسته است یک پروژه‌ی مهندسی نرم‌افزار کامل را ظرف مدت ۱۶ روز به پایان برساند.

نظرات

از دیگر اعضاء خانواده قلم