tehno24.ru
← ИИ
ИИ8 октября 2026, 15:40

NVIDIA представила PivotOPD для обучения ИИ-агентов исправлять ошибки

NVIDIA с Принстоном и Университетом Мэриленда представила PivotOPD — метод on-policy дистилляции для многошаговых LLM-агентов. Он учит агента избегать критических ошибок и восстанавливаться после них: на 72 воспроизведённых ошибках восстановление достигло 72,7% против 20,3% у стандартного OPD.

NVIDIA представила PivotOPD для обучения ИИ-агентов исправлять ошибки
#Nvidia#Qwen#Nemotron
Читать дальше
ИИ

Метод Recursive Self-Rewrite улучшил обучение ИИ-агентов на терминальных задачах

ИИ

Nvidia раскрыла пайплайн Task-Seeded SDG для обучения Nemotron

ИИ

CoreWeave представила Forge для непрерывного пост-обучения ИИ-агентов

ИИ

Salesforce на Dreamforce представила AIforce и CRM-модель Koa на NVIDIA Nemotron