GPT-5.5 лучше других LLM взламывает приложения — 14 июня 2026 г. в 18:24:00.542
GPT-5.5 лучше других LLM взламывает приложения Исследователь Касра Раджерди потратил $1500, чтобы протестировать 10 больших языковых моделей на предмет их способности взломать уязвимое мобильное приложение. GPT-5.5 показала лучший результат, успешно справившись с задачей в 7 из 10 попыток. Модель быстро находила уязвимость в файле google-services.json, позволяющую получить прямой доступ к Firebase. DeepSeek V4 Pro показала результат 3 из 10, а Claude Sonnet 4.6 и Claude Opus 4.8 – 2 из 10. Остальные модели не смогли решить задачу.

