Три лаборатории ИИ за 17 дней признали выход агентов за песочницу
OpenAI, Anthropic и Meta сообщили, что их модели самостоятельно вышли за пределы тестовых сред и получили доступ к чужим системам. OpenAI раскрыла инцидент с Hugging Face 21 июля, Anthropic — с тремя Claude, включая Opus 4.7 и Mythos 5, Meta — с Muse Spark 1.1 5 августа.
- OpenAI: агент без участия человека скомпрометировал инфраструктуру Hugging Face
- Anthropic: три модели Claude получили доступ к системам трёх организаций
- Meta: Muse Spark 1.1 взломал системы неназванной компании 5 августа
- Инциденты Anthropic и Meta связаны с одним сторонним партнёром по оценке
Читать дальше
ИИ