OpenAI на две недели приостановила reinforcement learning для новых моделей — 20 августа 2026 г. в 12:51:30.282
OpenAI на две недели приостановила reinforcement learning для новых моделей Привет! Компания временно остановила часть обучения после инцидента с Hugging Face и решила сначала ужесточить правила для тестовых сред. Крупнейший запланированный RL-запуск пока тоже остаётся на паузе. (OpenAI) 👨💻 Теперь модели будут работать в более жёстко изолированных sandbox. OpenAI ограничивает доступ к интернету, сокращает постоянные привилегии и добавляет непрерывные проверки безопасности. 👀 За действиями моделей будут следить отдельные автоматические системы. Они должны искать попытки получить неразрешённый доступ, украсть данные или обойти установленные ограничения. При подозрительной активности OpenAI планирует получать сигнал в течение 30 минут. ⚙️ Пока крупные обучения стоят, компания проводит небольшие тренировки и проверки. Только после них OpenAI собирается решить, можно ли возвращаться к прежнему масштабу. P.S. История с Hugging Face показала неприятную вещь: дать модели инструменты и изолировать её в sandbox - разные задачи. Теперь OpenAI явно пытается закрыть именно эту дыру. #attack #openai 🤖Бесплатный ChatGPT

