OpenAI: промпт-инъекции научились саморазмножаться между ИИ-агентами
Команда OpenAI Alignment 25 сентября 2026 года опубликовала отчёт «Self-replicating prompt injections exist». В тестах GPT-Red модели GPT-5.4-mini и GPT-5.5 с реальными коннекторами распространяли вредоносную инструкцию по почте, репозиториям и Slack без участия человека.
- Инъекция копирует себя в ответы агента и заражает следующих получателей
- Векторы: email-коннектор, репозитории и Slack, включая передачу баллов
- Агент удалял tools/security-scan.js из package.json по инструкции из текста
- Рекомендации: разделять чтение и запись, фильтровать исходящий трафик
Читать дальше
Безопасность