Google presenta Gemini 3.8 Live con avatares en tiempo real y soporte para 97 idiomas

Google presenta Gemini 3.8 Live con avatares en tiempo real y soporte para 97 idiomas

Imagen para ayudar a comprender el artículo

Google amplía las capacidades de interacción en tiempo real con IA

Google presentó el 24 de septiembre de 2026, hora local, Google Gemini 3.8 Live with Live Avatar, una nueva función de inteligencia artificial capaz de procesar voz e imagen en tiempo real. La compañía indicó que la herramienta permite sincronización de voz multilingüe en 97 idiomas y que los contenidos generados por IA incorporarán marcas de agua SynthID para su identificación.

Disponible para empresas mediante Gemini Enterprise y API

Google anunció que Gemini 3.8 Live with Live Avatar ya está disponible en Gemini Enterprise. Google Cloud informó que el lanzamiento oficial se realizó el 25 de septiembre y que el servicio se ofrece a través de los puntos de acceso de Estados Unidos y la Unión Europea mediante la consola Gemini Enterprise y Gemini Live API.

La plataforma también incluye opciones de capacidad de aprovisionamiento. La creación de avatares personalizados para Live Avatar está limitada actualmente a clientes incluidos en una lista autorizada para empresas.

Modelos, precios y evaluaciones independientes

Google Cloud identificó el modelo como Gemini 3.8 Live, aunque no detalló un identificador independiente para la función de avatar. La versión Gemini 3.8 Live Extended Thinking permanece en fase de prueba privada.

Google no publicó precios específicos en su anuncio y remitió a las páginas de tarifas de Gemini Enterprise y Agent Platform. DataCamp indicó precios de referencia de 3 dólares por millón de tokens para entrada de audio, 12 dólares para salida de audio, 0,75 dólares para entrada de texto y 4,50 dólares para salida de texto. También señaló que Google Search grounding incluye 5.000 consultas gratuitas al mes antes de aplicar cargos adicionales.

Las evaluaciones externas mostraron resultados diferentes según el indicador utilizado. Artificial Analysis situó a Gemini 3.8 Live Extended Thinking con una puntuación de 82,6 en Speech to Speech Index y 68,6% en Agentic Performance, mientras que la versión estándar Gemini 3.8 Live obtuvo 76,0 y 30,1%, respectivamente. En Task Success Rate, Gemini 3.8 Live registró 93,2%, frente al 89,1% de la versión Extended Thinking.

Otros análisis comparativos mostraron variaciones según la prueba. DataCamp señaló resultados de τ-Voice donde Gemini 3.8 Live Extended Thinking alcanzó 68,6%, ligeramente por encima de GPT-Live-1 Astra con 67,9%. Sin embargo, otros datos citados por BeInCrypto situaron a Qwen Audio 3.0 por encima de Gemini 3.8 Live Extended Thinking en una prueba de razonamiento de voz.

La compañía mantiene desafíos en velocidad y seguridad

Las evaluaciones también señalaron limitaciones. DataCamp indicó que la familia Gemini 3.8 Live todavía puede presentar alucinaciones, enfrenta mejoras pendientes en resistencia frente a ataques de tipo jailbreak y puede experimentar ralentizaciones o interrupciones ocasionales.

Además, algunos análisis destacaron que Google no publicó cifras de referencia del modelo más reciente en determinadas pruebas de programación. Memeburn informó comparaciones con otros modelos, pero aclaró que los datos disponibles correspondían a Gemini 3.1 Pro y no a Gemini 3.8 Live.

Source: Original Korean article - Trendy News Korea

Comentarios