GLM-5.3 почти сравнялась с Claude Mythos Preview в автономной разработке эксплойтов — 30 сентября 2026 г. в 18:26:36.094
GLM-5.3 почти сравнялась с Claude Mythos Preview в автономной разработке эксплойтов Anthropic протестировала GLM-5.3 на способность самостоятельно находить уязвимости и создавать эксплойты — код для их практического использования. Главный тезис компании: возможности, которые пять месяцев назад демонстрировала только Claude Mythos Preview, теперь появились у открытой модели без серьёзных ограничений против злоупотреблений. На ExploitBench — наборе задач по эксплуатации известных уязвимостей в JavaScript-движке V8 — GLM-5.3 создала работающий эксплойт в 50 из 410 попыток. Результат Mythos Preview — 56 успешных попыток. На внутреннем бенчмарке Anthropic по бинарной эксплуатации GLM-5.3 набрала 4% против 6% у Mythos Preview. Более ранние Claude Opus 4.6 и GLM-5.2 не справились ни с одной задачей. В другом эксперименте GLM-5.3 за восемь часов нашла неизвестные уязвимости в JavaScript-движке популярного браузера и объединила их в эксплойт для кражи файлов. От человека потребовалось около 20 минут внимания, расходы по тарифам API — программного доступа к модели — составили примерно $20. По утверждению исследователей Anthropic, встроенная защита GLM-5.3 от вредоносных запросов почти не работает. Модель формально отказывается отвечать на них, однако обычные джейлбрейки — формулировки для обхода ограничений — сработали в 92% случаев. После абляции, то есть удаления механизма отказов непосредственно из весов модели, доля успешных запросов достигла 100%. Авторы не призывают прямо ограничивать такие модели. Они предлагают правительствам проводить safety-тесты — проверки безопасности — мощных моделей, а разработчикам уделять защите больше внимания. Anthropic также подчёркивает, что предоставляет доступ к Mythos 5.1 только проверенным специалистам и считает Claude более устойчивой к вредоносным джейлбрейкам. Исследование вышло в тот же день, когда в Белом доме американские лидеры подписали с Дональдом Трампом соглашение о контроле ИИ. протестировала GLM-5.3: https://www.anthropic.com/research/glm-5-3-and-the-spread-of-advanced-cyber-capabilities Источник: https://t.me/data_secrets/10065 #RealVibe #AI #AI_Новости