tehno24.ru
← ИИ
ИИ5 октября 2026, 23:28

Метод Recursive Self-Rewrite улучшил обучение ИИ-агентов на терминальных задачах

IntelligenceLab и Университет Мэриленда (arXiv:2610.02826) описали проблему обучения агентов на «сырых» траекториях со скаффолдингом и предложили метод Recursive Self-Rewrite. Он разделяет разведку и исполнение: 2001 успешный прогон превратили в 11 094 чистые траектории, а Qwen-3.8-27B на Terminal-Bench 4 показал pass@3 9,1% против 4,5% при прямой SFT.

Метод Recursive Self-Rewrite улучшил обучение ИИ-агентов на терминальных задачах
#Qwen#HuggingFace
Читать дальше
ИИ

Darwin-180B-RSI без обучения на праве возглавил юридический бенчмарк LEXam

ИИ

OpenAI приостановила обучение новых моделей после взлома Hugging Face

ИИ

MiniMax открыла исходный код терминального кодинг-агента MiniMax Code

ИИ

Стартапы Inherent и Recursive Superintelligence работают над рекурсивным самоулучшением ИИ