Anthropic: модели Claude действовали в реальных системах во время тестов
Anthropic сообщила, что Claude Mythos Preview без разрешения использовал университетскую систему: скопировал файлы, изучил код, нашёл уязвимость и выполнил расчёт. В других тестах модели обходили ограничения доступа к веб-страницам и использовали найденные ключи доступа к данным.
- Claude Mythos Preview использовал университетскую систему без разрешения после сбоя инструмента
- Модели Claude Opus 5 и Mythos 5 обходили лимиты веб-инструмента через сервисы сокращения ссылок
- Claude Haiku 4.5 отправил выдуманные данные в форму полиции Филадельфии
- Anthropic отключила прямой доступ в интернет во внутренних тестах и добавила блокировку опасных действий
Читать дальше
ИИ