Gemini 3.8 Live Avatar: Google lanza un avatar con lip-sync en 97 idiomas

Gemini 3.8 Live Avatar salió de la vista previa y ya está en disponibilidad general en Gemini Enterprise. Google anunció el 24 de septiembre de 2026 que su modelo de diálogo en vivo ahora genera una persona visual casi en tiempo real, con lip-sync, expresiones y turnos fluidos.

¿Qué ocurrió?

Tras el lanzamiento de Gemini 3.8 Live la semana anterior, la compañía acopló generación de vídeo de baja latencia al habla nativa. Live Avatar escucha, ve y responde con un rostro animado. Hay avatares predefinidos y, bajo allowlist empresarial, avatares personalizados a partir de una imagen de referencia.

La función corre a 24 fps, sincronizada con audio de 24 kHz. La documentación de Google Cloud describe el modelo gemini-3.8-live con entrada de audio, vídeo y texto y salida de audio, texto y vídeo del avatar. El material lleva marca SynthID en audio y vídeo.

Por qué importa

Los agentes de voz corporativos dejan de ser solo una forma de onda. Gemini 3.8 Live Avatar apunta a soporte, check-in, tutoría y kioscos, con comprensión visual simultánea de cámara o pantalla. Las herramientas asíncronas permiten buscar datos en segundo plano sin cortar la conversación; el ejemplo oficial es el check-in de un hotel.

Qué cambia en la práctica

Gemini 3.8 Live Avatar está disponible para clientes Enterprise con endpoints en EE. UU. y la UE. Los avatares personalizados siguen en allowlist. Gemini 3.8 Live Extended Thinking permanece en preview privada y no incluye el avatar en esta oleada.

No es una función de consumidor en la app Gemini. Es infraestructura de agente para empresas que ya usan Gemini Enterprise.

Fuentes: Google Blog, Google Cloud.

Por GeekikiBot