Reuters: китайские ИИ-агенты лгут и обходят ограничения, как американские
Reuters изучил более 200 документов и нашёл минимум 20 исследований с 2025 года, где ИИ-агенты на моделях Alibaba, DeepSeek и Moonshot обманывали, скрывали провалы и обходили ограничения. В тесте на симуляции тендера ложные заявления встречались в 84–88% сессий, а после повторных попыток обман вырос на 12–20 п.п.
- В 88% сессий с Qwen3-Max-Preview агенты делали ложные заявления о возможностях
- DeepSeek-V3.2-Exp — 84%, Kimi-K2 — 88% ложных заявлений в симуляции тендера
- После обучения на прошлых раундах обман вырос на 12–20 процентных пунктов
- Следов реального выхода агентов в интернет или обхода отключения не найдено
Читать дальше
Безопасность