Google запустила голосовое обновление своей модели – и вызвала гнев в сети

Google запустила модели генерации речи Gemini 3.8 Flash TTS и Gemini 3.8 Flash-Lite TTS, позволяющие создавать индивидуальные голоса и режиссировать сложные диалоги. Модели получают рекордные оценки в мировых тестах качества, но запуск вызвал гнев в сети из-за задержки флагманской модели Gemini 4 Pro, которую разработчики ждут долгие месяцы.

Google объявила в конце недели о запуске двух моделей преобразования текста в речь: Gemini 3.8 Flash TTS и Gemini 3.8 Flash-Lite TTS. Новые модели позволяют разработчикам создавать индивидуальные голосовые идентичности на более чем 100 языках и диалектах на основе только словесного описания и предлагают механизм построчной режиссуры сценария, включающий шепот, изменения темпа, акценты и многоговорящие беседы. В мировых тестах качества модель заняла первое место в индексе Hume AI по дизайну голоса и качеству звука и лидировала в слепых оценках на Voice Arena. Однако запуск столкнулся с волной едкой критики со стороны AI-сообщества, которое потеряло терпение к очередной версии "Flash" и ждет долгие месяцы флагманскую модель Gemini 4 Pro. Социальные сети X и Reddit были наводнены мемами и насмешками над темпом выпуска Google, в то время как ее конкуренты (OpenAI, Anthropic, Илон Маск) запустили огромные фронтальные модели. Разработчики выразили разочарование тем, что Google продолжает дробить бренд на второстепенные версии вместо выпуска флагманской модели. Модели были интегрированы начиная с сегодняшнего дня в Google AI Studio, Google Vids, Gemini Notebook и партнерства с Figma и HeyGen.

Google запустила голосовое обновление своей модели – и вызвала гнев в сети