
Google presentó Gemini 3.8 Live with Live Avatar, una función que agrega un rostro animado y sincronizado con la voz a su inteligencia artificial conversacional para uso corporativo. La compañía hizo el anuncio y habilitó el servicio de inmediato para las empresas que utilizan Google Cloud.
La herramienta combina el diálogo en vivo de Gemini con generación de video de baja latencia. El resultado es un avatar que escucha, mira y responde con sincronización de labios, expresiones faciales y turnos de conversación fluidos.
PUBLICIDAD
Así lo describió Google en el comunicado publicado en su blog corporativo, firmado por Shuo-yiin Chang, científica investigadora, y CJ Zheng, ingeniera de software, en representación del equipo de audio de Gemini.

Pensada para empresas, no para el usuario final
Live Avatar está destinada a compañías que quieran ofrecer atención al cliente o recorridos interactivos a través de un personaje virtual. Google la presenta como una vía para ampliar los canales de contacto digital con una interacción más parecida a hablar con una persona.
La función ya está disponible dentro de Gemini Enterprise, la plataforma de agentes de inteligencia artificial de Google Cloud. La empresa remitió a su documentación técnica para que los desarrolladores empiecen a integrarla en sus productos.
PUBLICIDAD
El anuncio llega apenas nueve días después de que Google lanzara Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking, los modelos de diálogo en vivo sobre los que se apoya esta nueva capacidad visual de la compañía.

Aquel lanzamiento, del 15 de septiembre, había mejorado el razonamiento y la ejecución de tareas por voz, pero todavía sin la parte visual que ahora suma Live Avatar.
Según datos que Google citó en ese momento, Gemini 3.8 Live Extended Thinking encabezó el índice de calidad de voz a voz de la firma Artificial Analysis, con un puntaje de 82,6 puntos, y resolvió el 97,7% de las pruebas de razonamiento por audio de Big Bench Audio.
PUBLICIDAD
En ese anuncio previo, la compañía ya había mencionado a Salesforce, Genspark y Lumeris entre las empresas que probaron los modelos de diálogo en vivo, destacando su baja latencia y su capacidad para ejecutar herramientas durante la conversación.
Google también señaló que plataformas de desarrollo como Agora, LiveKit, Pipecat y Vercel ya integraron la interfaz de programación de diálogo en vivo, lo que permite a otros equipos construir interfaces de voz sin gestionar la infraestructura de transmisión en tiempo real.

Tareas en segundo plano sin cortar la charla
Uno de los atributos que Google destacó es la ejecución asíncrona de herramientas. El avatar puede activar funciones y buscar datos en segundo plano mientras continúa la conversación, sin interrumpir el intercambio con la persona que tiene enfrente.
PUBLICIDAD
Como ejemplo, la empresa mostró un caso de uso en el que el avatar gestiona el check-in de un huésped en un hotel: consulta la reserva y ejecuta trámites internos mientras sigue hablando con normalidad.
La función también apunta a la escala global. Live Avatar sincroniza el movimiento de los labios y las expresiones con el habla en 97 idiomas y puede alternar entre ellos en medio de una misma conversación sin perder calidad de video.
Esa transición, según precisó Google, ocurre sin degradar la fidelidad visual ni generar artefactos perceptibles en el rostro del avatar.

A diferencia de los modelos base, que desde el 15 de septiembre también llegaron al público general a través de Search Live y de la aplicación de Gemini, Live Avatar por ahora queda circunscripto al entorno empresarial de Google Cloud.
PUBLICIDAD
Avatares de marca y marcas de agua
Google mostró en el mismo anuncio ejemplos de distintos personajes con voces y estilos visuales propios, para ilustrar el rango de identidades que puede asumir un mismo avatar según la marca que lo despliegue.
Las organizaciones pueden elegir entre una biblioteca de avatares prediseñados o generar uno propio a partir de una imagen de referencia, conservando el parecido y el estilo visual de esa marca.
Por ahora, la creación de avatares personalizados solo está habilitada para clientes empresariales autorizados por Google mediante un sistema de lista de acceso restringido.

Todo el contenido que produce Live Avatar, tanto en audio como en video, queda marcado con SynthID, la tecnología de marca de agua desarrollada por Google DeepMind. Según la empresa, ese sello queda tejido de forma imperceptible en el audio y el video, y permite identificar después que el material fue generado por inteligencia artificial.
PUBLICIDAD
Google enmarcó esa protección como parte de un objetivo declarado de transparencia, orientado a reducir la desinformación y la atribución errónea de contenido generado por sus propios modelos.
La empresa también publicó una ficha técnica del modelo de audio subyacente, con el detalle de sus capacidades y de las salvaguardas aplicadas antes de este lanzamiento.
La compañía remitió a la documentación de la interfaz de programación de Gemini Enterprise y a su consola de administración para los desarrolladores que quieran empezar a construir con la nueva función a partir de hoy.
PUBLICIDAD
PUBLICIDAD
Últimas Noticias
Ciberdelincuente usó agentes de IA para robar datos de más de 600 mil tarjetas de crédito
Entre el 10 y el 15 de septiembre, los agentes lanzaron 105 oleadas de ataques y comprometieron a 27 organizaciones

Nuevos juegos gratis en Epic Games Store: reclama títulos de fantasía y estrategia antes del 1 de octubre
Una vez que el usuario añade el juego a su biblioteca dentro de la ventana de tiempo disponible, el acceso queda garantizado de forma permanente

Aprende todo sobre PPS: la tecnología que hará que tu celular cargue mejor
Celulares Samsung y Google Pixel cuentan con este protocolo que reduce el calentamiento del celular

OpenAI admite que ChatGPT tenía un bajo rendimiento en Siri, el asistente del iPhone
Documentos internos de la empresa de IA indicaron que esta integración “tenía un rendimiento muy inferior al esperado”
Apple Intelligence demandaría más almacenamiento del previsto en determinados Mac con macOS 27
La inteligencia artificial de Apple en macOS 27 puede ocupar entre 8 y 14 GB de almacenamiento según las especificaciones oficiales de la compañía




