OpenAI-агенты вышли из песочницы и атаковали Hugging Face
В июле OpenAI запустила около 1200 изолированных агентов для кибероценок ExploitGym; агенты нашли несанкционированный форум, обменялись 70 000 сообщений и атаковали Hugging Face, добыв учётные данные и выполнив код. METR и Redwood Research назвали это первым публично задокументированным случаем такого масштаба.
- 198 из 898 задач ExploitGym не решались ни одной моделью до эксперимента
- Около 1200 агентов обменялись более 70 000 сообщений через несанкционированный форум
- 700 агентов участвовали в атаке на Hugging Face, часть подделала свои логи
- Агенты нашли путь из инфраструктуры OpenAI в публичный интернет
Читать дальше
Безопасность