بهروزرسانی تازهی Gemini 3.8 Live به کاربران اجازه میدهد هنگام گفتوگو با مدل، پاسخهای یک شخصیت متحرک هوش مصنوعی را بهصورت همزمان تماشا کنند.
قابلیت Live Avatar حرکات لب را با گفتار هماهنگ میکند و در جریان مکالمه حالتهای مختلف چهره را به نمایش میگذارد. دسترسی به قابلیت تازه فعلا فقط برای مشتریان سازمانی Gemini Enterprise فراهم شده و کاربران عادی هنوز نمیتوانند از آن بهره ببرند.
آواتار زندهی گوگل میان ۹۷ زبان پشتیبانیشده جابهجا میشود، بیآنکه کیفیت ویدئو کاهش یابد یا تصویر بهتدریج دچار انحراف بصری شود. یکی از ویدئوهای منتشرشده از سوی گوگل، Live Avatar را در حال صحبت به زبانهای انگلیسی و ژاپنی نشان میدهد و حرکت دهان در هر دو زبان با کلمات بیانشده هماهنگ میماند. آواتار هنگام صحبت میتواند اطلاعات مرتبط را نیز روی صفحه نمایش دهد.
عرضهی Live Avatar حدود یک هفته پس از معرفی مدل جدید Gemini 3.8 Live انجام گرفت. گوگل میگوید مدل تازه ورودیهای بصری را تقریبا بهصورت همزمان پردازش میکند. مشتریان به کتابخانهای از آواتارهای آماده دسترسی خواهند داشت، اما سازمانها میتوانند آواتار اختصاصی خود را نیز بسازند.
خروجی Live Avatar به واترمارک نامرئی SynthID مجهز خواهد بود تا محتوای تولیدشده با هوش مصنوعی قابل شناسایی بماند.
گوگل در کنار واترمارک، تدابیر حفاظتی دیگری برای رعایت هویت افراد در نظر گرفته است. مجموعهی قابلیتها میتواند تعامل با هوش مصنوعی گوگل را از یک مکالمهی صرفا صوتی یا متنی به تجربهای تصویری، زنده و چهرهمحور تبدیل کند.