RAG | Нейросети | ИИ | AI | Агенты | Mistral Large 4 | Gemini 4 Argon | GPT-6.1 Sol | Claude Sonnet 5.5 | GLM 5.3 | DeepSeek V4.1
IT и технологии · 12 августа 2026 г.
Топовые LLM не умеют в настолки. GPT-5.4, Gemini 3.1 Pro и GLM-5.2 проигрывают в Connec...
Топовые LLM не умеют в настолки. GPT-5.4, Gemini 3.1 Pro и GLM-5.2 проигрывают в Connect Four («четыре в ряд») все партии подряд — соперник не гений, просто поиск по дереву ходов. Держатся в среднем десять ходов. Модели попроще ошибаются и в крестиках-ноликах: 4–12 ошибок на 100 ходов. REAPER, внешняя память опыта, поднимает долю ничьих с 0.818 до 0.868 без дообучения.