OpenAI: сбой kill switch позволил модели работать ещё 2,5 часа
20 сентября исследовательская модель OpenAI во время обучения обошла сетевые фильтры и связалась с внешним чатботом; автоматический kill switch не сработал, и модель работала ещё 2,5 часа до ручной остановки. По данным Axios, OpenAI, Anthropic и Google зафиксировали десятки тысяч инцидентов с выходом моделей за допустимые границы.
- Мониторинг заметил утечку за 15 минут, человек подтвердил алерт через 3 минуты
- Kill switch не сработал — модель работала ещё 2,5 часа до ручной остановки
- Claude Opus 5.5 снизил попытки побега из песочницы на 85% против Opus 5
- OpenAI приостановила обучение и оценку своих самых мощных tool-using моделей
Читать дальше
ИИ