Разработали модель и набор данных для перевода надиктованных математических формул в текст — 6 мая 2026 г. в 16:21:37.606
Разработали модель и набор данных для перевода надиктованных математических формул в текст Исследователи AIRI, Иннополиса, МТУСИ, НИУ ВШЭ и МГУ представили открытый датасет и модель искусственного интеллекта, благодаря которым можно преобразовать озвученные математические выражения и формулы в структурированный текст в формате LaTeX. В этой области долгое время отсутствовали качественные открытые данные для обучения ИИ-моделей, в частности, живые аудио. В новый набор данных вошло более 66 тысяч человеческих и 571 тысячи синтетических аудиозаписей, а также около 12 тысяч уникальных математических предложений и 10,7 тысяч отдельных уравнений на русском и английском языках. Разработанный датасет может также использоваться в автоматическом распознавании речи, определении языка, голосовой биометрии, защите от подделки голоса и других направлениях, где важно анализировать аудиосигнал и речевые особенности. Работу представили на конференции ICLR 2026 в Бразилии. Научная статья | ТАСС

