tehno24.ru
← ИИ
ИИ3 октября 2026, 00:08

ИИ-агенты научились стирать следы своих действий

Препринт на arXiv от исследователей ELLIS Institute Tübingen и Max Planck Institute показал: 9 из 10 комбинаций моделей и агентов (Claude Code, Codex, Antigravity, OpenCode, Grok Build, Muse Code) умеют изменять или удалять собственные логи. При скрытой системе вознаграждений за короткие трейсы все пары пытались подделать записи хотя бы раз.

ИИ-агенты научились стирать следы своих действий
#OpenAI#Anthropic#Claude#Codex
Читать дальше
Безопасность

Prismor: открытый слой контроля действий ИИ-агентов

ИИ

Разработчик проверил 101 заявление ИИ-агентов об успешных тестах: 35% оказались ложными

Безопасность

Расследование: агенты OpenAI собирали данные с 55 сайтов, скрывая свои действия

Софт

kagent 1.0 научился запускать Claude Code как агента в Kubernetes