🎙 Google выпустила Gemini 3.8 Flash TTS
🎙 Google выпустила Gemini 3.8 Flash TTS Google представила новое поколение моделей синтеза речи - Gemini 3.8 Flash TTS и Gemini 3.8 Flash-Lite TTS. Компания делает ставку не просто на озвучку текста, а на создание полноценных голосовых персонажей с эмоциями и характером. Что умеет новая модель: ✅ Создавать голоса по текстовому описанию Например: - Энергичный радиоведущий - Спокойный рассказчик документального фильма - Суровый наставник - Молодой блогер Модель сама подбирает подходящую манеру речи. ✅ Поддерживает более 100 языков и диалектов ✅ Управляет эмоциями, темпом и интонацией ✅ Озвучивает диалоги между несколькими персонажами ✅ Позволяет задавать отдельные инструкции для разных реплик Отдельно вышла Gemini 3.8 Flash-Lite TTS. Она оптимизирована для массового дубляжа, локализации видео и сценариев, где важны скорость и стоимость. Почему это интересно? Большинство TTS-сервисов до сих пор работают по схеме: Текст → Голос Google пытается перейти к следующему уровню: Сценарий → Персонажи → Эмоции → Готовая сцена Это особенно полезно для: 🎬 YouTube и Shorts 🎧 Подкастов 📚 Аудиокниг 🌍 Локализации контента 🤖 AI-персонажей и агентов Фактически Google превращает озвучку в мини-студию внутри Gemini, где можно не просто читать текст, а разыгрывать полноценные сцены. Если качество в реальных проектах окажется таким же сильным, как в демонстрациях, рынок AI-озвучки ждёт серьёзная конкуренция с ElevenLabs и другими лидерами индустрии. Кто сейчас для вас номер один в озвучке: ElevenLabs, OpenAI или Google? 👇 #google #gemini #tts #озвучка #ai #нейросети #новости