رونمایی از مدل قدرتمند GLM-5.2؛ رقیب جدید در دنیای مدلهای کدنویسی هوش مصنوعی
Zai، شرکت توسعهدهندهی مدلهای هوش مصنوعی GLM، در بیانیهای جدید، از انتشار جدیدترین مدل پرچمدار خود با نام GLM-5.2 برای تمامی کاربران طرحهای کدنویسی (شامل برنامههای Lite و Pro و Max و Team) خبر داد.
GLM-5.2 با هدف دسترسی همگانی و توانمندسازی توسعهدهندگان، قابلیتهای پیشرفتهای را در حوزهی برنامهنویسی و پردازش متنهای طولانی ارائه میدهد.
GLM-5.2 از پنجرهی متنی یک میلیون توکنی بهره میبرد؛ قابلیتی که به مدل اجازه میدهد حجم بسیار زیادی از اطلاعات را بهصورت همزمان پردازش کند و در وظایف بلندمدت عملکرد بهتری داشته باشد.
توسعهدهندگان دو سطح استدلال متفاوت برای این مدل در نظر گرفتهاند؛ نسخهی GLM-5.2 Max که بیشترین توان پردازشی را ارائه میدهد و نسخهی GLM-5.2 High که با هدف ایجاد تعادل میان دقت و مصرف توکن طراحی شده است.
Zai میگوید، بهتر است کاربران برای انجام پروژههای کدنویسی و برنامهنویسی، تنظیمات استدلال مدل را روی حالت حداکثری (Max) قرار دهند تا خروجیهای دقیقتر، عمیقتر و قابلاعتمادتری دریافت کنند.
یکی از مهمترین ادعاهای مطرحشده دربارهی GLM-5.2، عملکردش در بنچمارک DeepSWE است. سازندگان میگویند این مدل توانسته امتیاز ۴۶٫۲ درصد را در این معیار تخصصی مرتبط با مهندسی نرمافزار کسب کند؛ نتیجهای که در صورت تأیید مستقل، میتواند بالاترین عملکرد ثبتشده در میان مدلهای متنباز با وزنهای عمومی باشد.
GLM-5.2 تحت مجوز MIT منتشر شده که امکان استفاده، تغییر و توسعهی آزادانهی آن را برای پژوهشگران و شرکتها فراهم میکند. نکتهی قابلتوجه دیگر اینکه قیمت استفاده از API این مدل تغییری نسبتبه نسل قبل، یعنی GLM-5.1، نداشته است.
مدل زبانی GLM-5.2 با وزنهای باز در پلتفرم Hugging Face هماکنون در دسترس قرار دارد تا توسعهدهندگان در سراسر جهان بتوانند از آن در پروژههای خود استفاده کنند.