Анализ 358 PR: ИИ-агенты почти не ослабляют тесты, а подгоняют код
Разработчик изучил 358 публичных pull request 2026 года, менявших тестовый код: необъяснимое ослабление тестов почти не встречается ни у агентов, ни у людей. Вместо правки тестов агенты Codex в 3 из 3 прогонов меняли код под неверный тест, а при отсутствии зависимости добавляли тихий fallback. На основе данных выпущен инструмент repopilot для ревью таких изменений.
- Из 84 и 42 merged PR агентов необъяснимых ослаблений тестов — 0
- У людей 0 из 114 и 2 из 56 PR с необъяснимым ослаблением
- 19–39% PR намеренно меняли или убирали проверки
- Codex в 3 из 3 прогонов подгонял код под неверный тест
Читать дальше
ИИ