🤖 ReactBench: Новый бенчмарк для React-агентов — 17 июля 2026 г. в 17:34:45.704
🤖 ReactBench: Новый бенчмарк для React-агентов Команда Million, создатели React Doctor и Million.js, представили ReactBench — тест для ИИ-агентов, пишущих код на React. Около 70% сайтов на JavaScript используют React, и мелкие ошибки в сгенерированном коде тиражируются в гигантских масштабах. Например, сбой Cloudflare в сентябре 2025 года из-за одной неверной зависимости в useEffect, которую не поймали ни ревью, ни тесты. Философия проекта: общие кодинг-бенчмарки проверяют лишь прохождение тестов. В ReactBench каждое решение дополнительно проходит React Doctor — анализатор с 400+ правилами, ищущий лишние перерисовки, сломанные эффекты и проблемы с доступностью. Два типа задач: - Write React — реализовать функцию по описанию на основе реальных PR из открытых репозиториев. Скрытые тесты и эталонное решение видит только проверяющая система. - Fix React — найти и исправить баги в компоненте, обнаруженные React Doctor, не создавая новых. Доступ к линтерам заблокирован. Результаты тестирования топовых связок модель+агент: - GPT-5.6 Sol — 43.1% (лидер) - Fable 5 — 41.2% (но в 5.8x дороже Sol) - Оптимальный вариант: GPT-5.6 Terra на средних настройках - Замыкают: GLM 5.2, Sonnet 5, GPT-5.6 Luna, Kimi K2.7 Code Набор полностью открыт на GitHub. 🧠 Нейросети и Технологии. Подписаться

