tehno24.ru
← ИИ
ИИ7 октября 2026, 23:05

LoGRA от Nvidia: RL-дообучение LLM с экономией памяти до 45,7%

Nvidia и партнёры представили метод LoGRA, который заменяет полные градиентные буферы низкоранговыми «скетчами» и добавляет контроль шага по предсказанному KL. Средняя память при обучении падает до 45,7%, а модель на 27B стабильно обучается 1100+ шагов на одном узле из восьми GPU.

LoGRA от Nvidia: RL-дообучение LLM с экономией памяти до 45,7%
#Nvidia#LoGRA#Qwen
Читать дальше
ИИ

Xiaomi открыла публичный дашборд RL-дообучения MiMo-V2.6 Pro и Flash

ИИ

Бенчмарк проверил, выдумывают ли LLM статьи японских законов

ИИ

Strata запускает 125-млрд LLM на игровом ПК с 12 ГБ VRAM

ИИ

AREX-2: самоулучшающиеся LLM-агенты через длинную рефлексию