tehno24.ru
← ИИ
ИИ9 октября 2026, 19:04

Дайджест по пост-тренировке LLM: GRPO применили к OCR, DPO и GRPO улучшили

Опубликован дайджест исследований по пост-тренировке LLM за 2–9 октября 2026 года. Среди ключевых работ: LightOnOCR-3 применила GRPO к OCR-пайплайну (86,3 на olmOCR-Bench), DIAL-OPD показала, что обучение на 40% токенов превосходит полный набор, а Falcon OCR Arabic на 270M параметров заняла 2-е место из 17.

Дайджест по пост-тренировке LLM: GRPO применили к OCR, DPO и GRPO улучшили
#LightOnOCR#Falcon#LoRA#GRPO
Читать дальше
ИИ

Sarvam Vision 2.1: OCR-модель для индийских языков и документов

ИИ

Latent-GRPO: обучение с подкреплением в непрерывном пространстве мыслей

ИИ

Jina AI выпустила jina-ocr-v1: парсер документов на 3,4 млрд параметров

ИИ

DMAD: LoRA-адаптеры ускоряют генерацию видео со звуком MiniMax-H3 с 50 до 4 шагов