#voice AI
22 stories taggedvoice AI.

Google Launches Three New Gemini Audio Models That Handle Jargon, Interruptions and 85 Languages
Gemini 3.5 Transcribe, 3.5 Live and 3.5 Live Experimental are rolling out now, and the transcription model is a first for the Gemini family.

Google's new Gemini 3.5 Transcribe raises the bar for voice AI, and the risks that come with it
Google DeepMind's latest speech-to-text model is faster, sharper and multilingual. It also gives scammers a cleaner tool to work with.

Ringg Expands Voice AI Capabilities with $10 Million Investment
Voice AI startup Ringg secures funding as it shifts to complex tasks beyond simple calls in India.

AI speech models are cheating on their own tests, new research finds
A study of 11 popular voice transcription systems found that several reproduce known errors from benchmark datasets, even when the audio says something different. It raises a quiet but serious question: are high scores measuring real ability, or familiarity with the test?

Wispr raises $280 million and sets its sights on meetings, not just dictation
The AI dictation startup is now valued at $2 billion and just launched a new voice model that it says will cut speech errors by two-thirds.

Robots Can Move. They Can See. So Why Can't They Hold a Conversation?
Humanoid robots are impressive to watch, until you try talking to one. A specialist in audio AI explains why poor hearing and bad voice interaction could be the thing that stops robots from ever being widely accepted.

Microsoft убирает анимированный blob Mico из голосового режима Copilot
Желтый анимированный персонаж, запущенный менее года назад, чтобы дать чат-боту лицо, тихо перемещается на платформу обучения.

Приложение Google Gemini достигло одного миллиарда ежемесячных пользователей, сравнявшись с ChatGPT
ИИ-ассистент Google преодолел барьер, который смогли преодолеть только 13 других продуктов компании. Вот что на самом деле говорят нам эти цифры.

Бесплатный открытый голосовой ИИ NVIDIA теперь говорит на 12 языках и отвечает менее чем за десятую долю секунды
Новая версия модели преобразования текста в речь NVIDIA Magpie добавляет арабский, корейский и португальский языки Бразилии, а также работает достаточно быстро на вашем оборудовании, чтобы голосовые помощники звучали естественно.

Собеседования с ИИ в полночь — реальность, и вот почему они существуют
Миллионы соискателей теперь проходят интервью с ИИ в 1 час ночи. Это решает реальную проблему с расписанием. Но также вызывает вопросы, на которые никто не готов ответить.

Робот на окне заказов вернулся, и на этот раз он может остаться
После неудачной первой попытки сети быстрого питания тихо внедряют голосовые заказы с ИИ миллионам клиентов. Некоторые побеждают. Некоторые всё ещё разбираются.

Smallest.ai привлекает $13 млн для создания голосового ИИ, который невозможно отличить от человека
Стартап хочет, чтобы голосовые ИИ-агенты звучали так естественно, что звонящие никогда не заметят, что говорят не с человеком. Вот как это планируется реализовать и к чему это приведет для всех, кто окажется на удержании.

OpenAI разрабатывает «семейство устройств»: что на самом деле сказал Грег Брокман
Президент OpenAI подтвердил, что аппаратное обеспечение будет выпущено, но не назвал дату выпуска, названия продуктов и не подтвердил слухи об умной колонке. Он намекнул на то, что голос станет основным способом взаимодействия людей с компьютерами.

Encore AI привлекает $30 млн для создания голосовых агентов, обучающихся на лучших звонках продаж
Стартап анализирует тысячи реальных переговоров с клиентами, определяет, что сработало, и учит ИИ копировать эти выигрышные тактики. Банки и страховщики уже платят за это.

Новая технология голоса AI на устройстве Apple делает Siri более естественным, без отправки аудио в облако
Исследовательская работа команды машинного обучения Apple раскрывает звуковой движок нового выразительного голоса Siri. Вся обработка происходит на вашем iPhone с использованием уже имеющегося чипа.