Google Cloud представила RRSI: регуляризация против переобучения ИИ-агентов
Google Cloud AI Research опубликовала работу RRSI — метод регуляризованного рекурсивного самоулучшения обвязок (harness) ИИ-агентов. Подход ограничивает правки промптов и логики, отсеивает подгонку под бенчмарк и лишнюю сложность: прирост до 14,1 пункта на обучающем наборе и до 4,7 пункта на пяти незнакомых бенчмарках при экономии 30% токенов.
- RRSI добавляет регуляризацию в цикл самоулучшения обвязки агента
- Прирост до 14,1 пункта на evolution-наборе и до 4,7 на OOD-бенчмарках
- Регуляризованные обвязки тратят на 30% меньше токенов
- Тесты на Claude Opus 4.8 и Gemini 3.5 Flash, восемь бенчмарков
Читать дальше
ИИ