RAG | Нейросети | ИИ | AI | Агенты | Mistral Large 4 | DeepSeek | Qwen 27B | GLM-5.3 | Kimi K3 | GPT-6 Astra
IT и технологии · 25 сентября 2026 г.
Стриминговое распознавание речи обычно жертвует либо контекстом, либо памятью. Тут — не...
Стриминговое распознавание речи обычно жертвует либо контекстом, либо памятью. Тут — нет: скользящий KV-кэш с окном 30 секунд держит память и задержку на одном уровне, транскрибируй хоть сутки напролёт. 12,5 декода в секунду, задержка 240–560 мс, китайский и английский. Семантическая VAD-голова отличает конец реплики от паузы на раздумье или заикания, где акустический VAD обычно пасует. Превью от 21 сентября, веса и код под Apache 2.0.