Olmo 3: открытый релиз года для исследований в ИИ
Olmo 3: открытый релиз года для исследований в ИИ Olmo 3 — один из самых значимых релизов в сфере ИИ в этом году. Разработчики предоставили не только исходный код и 6T токенов (Dolma 3), но и все промежуточные чекпоинты, а также информацию о порядке данных в батчах. Это делает модель идеальным инструментом для научных исследований и экспериментов. В техническом отчёте представлены интересные и спорные решения. Например, метод Delta-DPO показал, что для ризонинга важнее разница между выбранным и отвергнутым ответами, а не качество самого ответа. Также разработчики переписали инфраструктуру для RLVR, увеличив её производительность в четыре раза, и применили такие технологии, как Inflight updates и Active sampling. Флагманская модель Olmo 3 Think 32B демонстрирует высокие результаты в математических задачах, приближаясь к Qwen-3 32B на MATH и AIME, но немного уступает в общих знаниях (MMLU). Обучение модели заняло 56 дней на кластере из 1024xH100 и обошлось примерно в $2.75 млн. Статья, GitHub Материалы по ссылкам: 1. Olmo 3 Olmo 3 — это семейство современных полностью открытых языковых моделей с количеством параметров 7B и 32B. Модели Olmo 3 предназначены для работы с длинным контекстом, вызова функций, кодирования, выполнения инструкций, общего чата и вызова знаний. Флагманская модель Olmo 3 Think 32B — самая сильная из полностью открытых моделей мышления, выпущенных на данный момент. https://arxiv.org/abs/2512.13961 Источник: оригинальный пост