Вышел Claude Haiku 5.5
Вышел Claude Haiku 5.5 В таблице из сообщения о релизе приведены результаты сравнительных тестов: OSWorld 2.1 — выполнение задач на компьютере: на офлайн-подмножестве Haiku 5.5 набрал 72.4% против 15.7% у Haiku 4.5. Terminal-Bench 4.0 — работа с кодом и командами в терминале: 39.2% против 16.4% у GPT-6 Luna. Humanity’s Last Exam — сложные вопросы из разных дисциплин: 45.9% без инструментов и 57.4% с инструментами. FrontierCode 1.1 (Main) — тест задач программирования, основной набор: 46.4% против 42.4% у GPT-6 Luna. Источник: https://t.me/data_secrets/10127 #RealVibe #AI #AI_Новости