ml-intern: Агент, который сам обучает модели — и бьёт Claude Code на reasoning-бентах — 28 июня 2026 г. в 10:17:11.987
ml-intern: Агент, который сам обучает модели — и бьёт Claude Code на reasoning-бентах 🚀 Hugging Face выпустили open-source агента ml-intern, который полностью автоматизирует research loop для post-training больших языковых моделей. Вставляешь промпт — агент читает статьи, идёт по цитатам, кодит эксперименты на GPU, запускает 12+ итераций fine-tuning. Всё под ключ. 🔬 На бентах GPQA результат оказался впечатляющий: из коробки Qwen3-1.7B с базелином в 10% агент довёл до 32% за ~10 часов на одной H100. Для сравнения — Claude Code показал 22.99% на той же задаче. Стек построен на smolagents, значит его можно гнать локально без облака. 🛠️ В процессе ml-intern тестировал методы вроде NemoTron-CrossThink и Unbabel, автоматически подбирая SFT-папки и гиперпараметры. Фактически Hugging Face упаковала рабочий процесс ML-тренеров в один open-source пайплайн — от lit review до оценки метрик. Это сдвиг парадигмы: вместо ручного fine-tuning теперь делегируешь «интерну», а проверяешь результат.

