شرکت گوگل در تازهترین گام خود برای انسانیتر کردن تعامل با هوش مصنوعی، از قابلیت جدیدی به نام Live Avatar برای مدل پیشرفته Gemini 3.8 Live رونمایی کرد. این فناوری نوآورانه به کاربران امکان میدهد هنگام گفتگوهای صوتی زنده با هوش مصنوعی، چهرهای متحرک، رسا و واقعگرایانه را تماشا کنند که به صورت بلادرنگ همگام با کلمات صحبت کرده و به سوالات پاسخ میدهد.
آواتار زنده جمینای به سیستم بسیار پیشرفته همگامسازی لب و صوت (Lip-sync) مجهز است و حالات چهره، میمیکهای چشمی و هیجانات متناسب با متن گفتگو را شبیهسازی میکند. طبق مستندات گوگل، این فناوری از ۹۷ زبان مختلف دنیا پشتیبانی کرده و قادر است بدون هیچگونه افت کیفیت بصری یا تاخیر، زبان گفتاری خود را در حین مکالمه تغییر دهد و حالات لب و چهره را با زبان جدید منطبق سازد.
علاوه بر گفتگو، این آواتارها میتوانند به صورت تعاملی اطلاعات متنی، نمودارهای آماری یا تصاویر راهنما را در کنار چهره خود روی صفحه به نمایش درآورند که این امر تجربه کاربری در جلسات آموزشی و پشتیبانی فنی را بسیار ملموستر میسازد. در فاز اولیه، دسترسی به این سرویس برای کاربران بخش سازمانی (Gemini Enterprise) فراهم شده است تا شرکتها بتوانند دستیارهای پشتیبانی و فروش اختصاصی خود را بسازند.
گوگل تاکید کرده است که علاوه بر آواتارهای پیشفرض با سبکهای مختلف، سازمانها آزادی عمل خواهند داشت تا آواتارهای اختصاصی برند خود را طراحی کنند. همچنین به منظور مقابله با تهدیدات جعل هویت و دیپفیک، تمامی محتواهای تصویری تولیدشده توسط Live Avatar به واترمارک دیجیتال نامرئی SynthID گوگل مجهز هستند تا منشا هوش مصنوعی بودن آنها همواره قابل ردیابی و اعتبارسنجی باشد.