MiniMax выложила веса M3 на Hugging Face. Сама модель работает с 1 июня, но до сих пор ... — 12 июня 2026 г. в 14:51:28.934
MiniMax выложила веса M3 на Hugging Face. Сама модель работает с 1 июня, но до сих пор только через API, теперь её можно скачать и запустить у себя. Это MoE на 428B параметров с 23B активных, мультимодальная с рождения: текст, картинки и видео шли в обучение с первого шага, а не доклеивались адаптером. Контекст 1M токенов, и главная инженерная находка как раз про него: вместо привычного GQA здесь MiniMax Sparse Attention, за счёт которого на миллионном контексте prefill быстрее предшественника M2 в 9 раз, декодирование в 15 раз, а вычислений на токен нужно в 20 раз меньше. По заявленным самой компанией цифрам модель берёт 59% на SWE-Bench Pro и 66% на Terminal-Bench 2.1, на момент релиза это классический пред-топовый уровень открытых моделей. Есть два режима, thinking для сложных агентных задач и non-thinking для чата и автодополнения с низкой задержкой. Поддержка vLLM и SGLang готова, рецепты деплоя лежат на GitHub. Лицензия не Apache, а собственная MiniMax Community, так что для коммерческого использования стоит прочитать её условия. Дома такое не запустить, веса весят сотни гигабайт, но для компаний со своим инференсом это сейчас один из самых сильных открытых вариантов. @neuro_channel

