У Claude, Gemini и ChatGPT нашли уязвимости, раскрывавшие внутренние рассуждения
У Claude, Gemini и ChatGPT нашли уязвимости, раскрывавшие внутренние рассуждения Исследователи в области кибербезопасности обнаружили уязвимости в API популярных ИИ-моделей, которые позволяли получать внутренние reasoning-блоки ещё до финальной фильтрации ответа. В некоторых из них встречались нежелательные сценарии и случаи, когда модель пыталась сформировать объяснение под уже выбранный ответ. Но ещё интереснее другое: среди 315 тысяч проанализированных блоков исследователи обнаружили 367 фрагментов с персональными данными и 182 случая с паролями, API-ключами и другими учётными данными. Информацию об уязвимостях уже передали OpenAI, Anthropic и Google.