هوش مصنوعی Grok Imagine Video 1.5 با قابلیت تبدیل متن به ویدیو سوپرشارژ شد

یک‌شنبه 11 مرداد 1405 - 09:00
مطالعه 2 دقیقه
لوگو هوش مصنوعی گراک روی موبایل و صفحه‌ی مانیتور
مدل تولید ویدیو Imagine Video 1.5 با قابلیت تبدیل متن به ویدیو سوپرشارژ شد.

اسپیس‌ایکس‌ای‌آی قابلیت‌های جدیدی برای مدل تولید ویدیو Imagine Video 1.5 منتشر کرد؛ مدلی که ماه گذشته به‌عنوان پیشرفته‌ترین سیستم تولید ویدیو این شرکت معرفی شده بود.

مهم‌ترین تغییر، اضافه‌شدن قابلیت تولید ویدیو از روی متن است؛ قابلیتی که به کاربران اجازه می‌دهد تنها با نوشتن یک توضیح، ویدیو تولید کنند.

Imagine Video 1.5 اکنون از تصاویر مرجع و نمونه‌ی صوتی یا صدای مرجع نیز پشتیبانی می‌کند. به این ترتیب، کاربران می‌توانند ظاهر شخصیت‌ها یا صحنه‌ها و حتی صدای مدنظر خود را به مدل معرفی کنند تا ویدیوهای تولیدشده از نظر تصویر و صدا، شباهت بیشتری به نتیجه‌ی دلخواه داشته باشند.

پخش از رسانه

یکی دیگر از قابلیت‌های جدید، پشتیبانی از خروجی بومی با وضوح 1080p است. اسپیس‌ایکس‌ای‌آی پیش‌تر اعلام کرده بود که Imagine Video 1.5 نسبت‌به نسخه‌ی قبلی، حرکت سوژه‌ها را طبیعی‌تر نمایش می‌دهد و کیفیت صدا و هماهنگی آن با تصویر نیز بهبود یافته است.

Imagine Video 1.5 بخشی از مجموعه‌ابزارهای Grok Imagine محسوب می‌شود؛ سرویسی که اسپیس‌ایکس‌ای‌آی آن را برای تولید تصویر و ویدیو با هوش مصنوعی توسعه داده است.

اسپیس‌ایکس‌ای‌آی طی ماه‌های اخیر به‌سرعت قابلیت‌های این پلتفرم را گسترش داده و ایلان ماسک نیز اخیراً اعلام کرده بود که Grok Imagine تا پایان سال میلادی حتی توانایی تولید یک فیلم بلند کامل را خواهد داشت؛ موضوعی که نشان می‌دهد xAI قصد دارد رقابت با مدل‌های پیشرفته‌ی تولید ویدئو مانند OpenAI Sora و Runway Gen-4 را جدی‌تر از گذشته دنبال کند.

نظرات

از دیگر اعضاء خانواده قلم