Google lanza modelos de voz Gemini 3.8 Live
Resumen En qué punto está
Google DeepMind presentó Gemini 3.8 Live y su variante Extended Thinking, modelos de diálogo por voz en tiempo real disponibles vía API, Google Workspace y la app Gemini. Extended Thinking lidera el índice Speech-to-Speech de Artificial Analysis, superando a GPT-Live-1 de OpenAI, y Google ofrece precios notablemente más bajos (1,38 dólares frente a 3 dólares por hora). Los modelos detectan 97 idiomas, procesan contexto visual casi en tiempo real y pueden ejecutar tareas en segundo plano sin cortar la conversación. Ya han surgido demostraciones externas, como una interfaz web creada por un desarrollador usando el endpoint WebSocket de Google.
Resumen generado mediante IA a partir de las 3 noticias de la historia. Última actualización: hace 1 h.
Enviar esta historia por correo
Línea temporal
-
Google lanza Gemini 3.8 Live, modelos de voz en tiempo real vía WebSockets
Google presentó Gemini 3.8 Live y 3.8 Live Extended Thinking, dos modelos speech-to-speech comparables a la familia GPT-Live de OpenAI. El desarrollador Simon Willison creó una interfaz web para probarlos, que se…
-
Google lanza Gemini 3.8 Live, modelo de voz que compite con GPT-Live-1 de OpenAI a menor precio
Google DeepMind lanzó Gemini 3.8 Live y su variante Extended Thinking, dos modelos de voz disponibles vía API y Google AI Studio. La variante Extended Thinking lidera el ranking Speech-to-Speech de Artificial Analysis…
-
Google DeepMind lanza Gemini 3.8 Live y Live Extended Thinking para voz en tiempo real
Google DeepMind presenta Gemini 3.8 Live y 3.8 Live Extended Thinking, sus modelos de diálogo en vivo más avanzados, disponibles vía API, Google Workspace y app Gemini. Extended Thinking lidera el índice Speech to…