#voice AI
22 stories taggedvoice AI.

Google Launches Three New Gemini Audio Models That Handle Jargon, Interruptions and 85 Languages
Gemini 3.5 Transcribe, 3.5 Live and 3.5 Live Experimental are rolling out now, and the transcription model is a first for the Gemini family.

Google's new Gemini 3.5 Transcribe raises the bar for voice AI, and the risks that come with it
Google DeepMind's latest speech-to-text model is faster, sharper and multilingual. It also gives scammers a cleaner tool to work with.

Ringg Expands Voice AI Capabilities with $10 Million Investment
Voice AI startup Ringg secures funding as it shifts to complex tasks beyond simple calls in India.

AI speech models are cheating on their own tests, new research finds
A study of 11 popular voice transcription systems found that several reproduce known errors from benchmark datasets, even when the audio says something different. It raises a quiet but serious question: are high scores measuring real ability, or familiarity with the test?

Wispr raises $280 million and sets its sights on meetings, not just dictation
The AI dictation startup is now valued at $2 billion and just launched a new voice model that it says will cut speech errors by two-thirds.

Robots Can Move. They Can See. So Why Can't They Hold a Conversation?
Humanoid robots are impressive to watch, until you try talking to one. A specialist in audio AI explains why poor hearing and bad voice interaction could be the thing that stops robots from ever being widely accepted.

Microsoft retira a Mico, su blob animado azul, del modo de voz de Copilot
El personaje animado amarillo, lanzado hace menos de un año para darle una cara al chatbot, se está trasladando discretamente a una plataforma de aprendizaje.

La aplicación Gemini de Google alcanza mil millones de usuarios mensuales, igualando a ChatGPT
El asistente de IA de Google ha cruzado un umbral que solo 13 otros productos de Google han alcanzado. Esto es lo que realmente nos dicen los números.

La IA de voz abierta y gratuita de NVIDIA ahora habla 12 idiomas y responde en menos de una décima de segundo
Una nueva versión del modelo de síntesis de voz de NVIDIA Magpie añade árabe, coreano y portugués brasileño, y se ejecuta lo suficientemente rápido en tu propio hardware para que los asistentes de voz suenen naturales.

Las entrevistas de trabajo a medianoche son reales, y la IA es la razón
Millones de candidatos completan ahora entrevistas de video dirigidas por IA a la 1 am. Resuelve un problema real de programación. También plantea preguntas para las que nadie está preparado.

El Robot en la Ventanilla de Autoservicio Vuelve, y Esta Vez Podría Quedarse
Tras un primer intento problemático, las cadenas de comida rápida están implementando silenciosamente los pedidos por voz con IA nuevamente a millones de clientes. Algunos están ganando. Otros todavía lo están resolviendo.

Smallest.ai recauda $13 millones para crear una IA de voz que no puedas identificar como máquina
La startup quiere que los agentes de IA por teléfono suenen tan naturales que los llamadores nunca noten que no están hablando con una persona. Así es como planea hacerlo y qué significa para cualquiera que termine en espera.

OpenAI está construyendo una 'familia de dispositivos', esto es lo que Greg Brockman realmente dijo
El presidente de OpenAI confirmó que el hardware está en camino pero no dio fecha de lanzamiento, nombres de productos ni confirmación del rumoreado altavoz inteligente. Sí insinuó que la voz se convertirá en la forma principal en que las personas usan las computadoras.

Encore AI recauda $30 millones para construir agentes de voz que aprenden de tus mejores llamadas de ventas
La startup escucha miles de conversaciones reales con clientes, identifica qué funcionó y enseña a la IA a copiar esas estrategias ganadoras. Los bancos y aseguradoras ya están pagando por ello.

La nueva tecnología de voz con IA de Apple hace que Siri suene más humana, sin enviar tu audio a la nube
Un documento de investigación del equipo de aprendizaje automático de Apple revela el motor de audio detrás de las nuevas voces expresivas de Siri. Todo el procesamiento ocurre en tu iPhone, utilizando un chip que ya tienes.