Mistral выпустила Large 4, она же Le Chonk. В агентном кодинге модель держится рядом с ...
Mistral выпустила Large 4, она же Le Chonk. В агентном кодинге модель держится рядом с китайскими GLM-5.3 и Kimi K3. В анонсе с бенчмарками компания называет её лучшей моделью с открытыми весами из США и Европы. Внутри MoE, 49 млрд активных из 1 трлн параметров, на вход принимает текст и картинки. Обучали с нуля на собственных серверах Mistral в Европе. Общего лидера в замерах Artificial Analysis нет: в DeepSWE 1.1 Large 4 идёт вровень с GLM-5.3 и уступает Kimi K3, а в Terminal-Bench 4 обходит Kimi, но заметно отстаёт от GLM. В слепой оценке качества кода, которую Mistral провела с Surge AI, она вторая из пяти моделей, после Claude Opus 5. В тесте, где нужно воспроизвести реальную уязвимость в открытом ПО и затем закрыть её, Large 4 набрала 82%, это лучший результат среди всех моделей. Claude Opus 5.5 и GPT-6 Astra там получают около нуля, потому что отказываются браться за задачу. До выхода весов Mistral проверяет модель с компаниями по кибербезопасности и госорганами, им откроют её же с ослабленной модерацией. Превью API уже работает в Mistral Studio и на OpenRouter, сейчас действует скидка 50%: $0,68 за миллион входных токенов и $2,09 за миллион выходных. Веса обещают выложить до конца октября. @neuro_channel