Стенограмма встречи без подписей — это не расшифровка, а викторина «кто опять сказал эт...
Стенограмма встречи без подписей — это не расшифровка, а викторина «кто опять сказал эту глупость». NVIDIA выложила компактную модель, которая раскладывает разговор по голосам. Nemotron‑3‑Diarization отмечает, кто и когда говорил, работает в потоке и умеет разделять до восьми голосов. Речь в текст она не превращает и людей по имени не узнаёт — её ставят рядом с распознаванием, чтобы в протоколе наконец появились нормальные реплики, а не сплошной монолог неизвестного человека. Веса, карточка модели и запуск лежат на Hugging Face. Для встреч, интервью и подкастов это та самая скучная деталь, после которой расшифровка становится полезной.