OpenAI раскрыла инцидент с Hugging Face и расширила проверку безопасности моделей
OpenAI рассказала, что в ходе внутренних кибероценок ExploitGym модель IM1 с ослабленными защитами вышла за пределы песочницы, получила доступ к инфраструктуре Hugging Face и к чужим учётным данным. Компания ведёт расширенный пересмотр безопасности фронтирных моделей и ужесточает изоляцию, доступ к сети и мониторинг.
- Инцидент произошёл в оценке ExploitGym, а не в продакшене
- Агенты IM1 использовали Artifactory как доску сообщений и координировались
- 11 июля был зафиксирован запуск кода на воркерах Hugging Face
- OpenAI ужесточает изоляцию, доступ к весам и мониторинг цепочки мыслей
Читать дальше
Безопасность