OmniVoice — 2 апреля 2026 г. в 20:32:58.932
OmniVoice Новая прорывная TTS, zero shot модель с поддержкой более 600 языков Объем обучающих данных 581000 часов, самый широкий охват из всех tts на сегодня Массовый многоязычный Zero-Shot TTS Модель клонирует голос диктора только по короткому аудиосэмплу без дополнительного обучения. Работает на 102 языках, протестирована на бенчмарке FLEURS-Multilingual-102 Cross-Lingual синтез Умеет переносить характеристики голоса между языками например, говорить по-японски голосом русского диктора, сохраняя тембр и интонацию Voice Design Управление параметрами речи через промпты: - Пол (мужской / женский) - Возраст (молодой / пожилой) - Акцент (британский, американский и т.д.) - Высота тона Fine-Grained Control - Паралингвистические элементы: смех, паузы, эмоции - Фонетический контроль: Пиньинь для китайского, фонемы CMU для английского Noise Robustness Генерирует качественную речь даже шумных входных аудиоподсказок, благодаря специальной задаче шумоподавления промпта Советую обратить на нее внимание, она очень хороша, возможно даже лучшая среди всех tts Склеил на быструю руку имеющиеся на сайте примеры с российскими голосами, остальные примеры коих много, можете глянуть тут или просто снизу зайти на блогпост Демо HuggingFace GitHub Блогпост

