Jina AI выпустила jina-ocr-v1: парсер документов на 3,4 млрд параметров
Jina AI (Elastic) представила jina-ocr-v1 — визуальный парсер документов, превращающий PDF, сканы, таблицы и счета в Markdown за один проход. Модель на 3,4 млрд параметров (около 570 млн активных на токен) построена на DeepSeek-OCR и работает на бюджетных GPU вроде Nvidia L4. Веса открыты под CC BY-NC 4.0, коммерческое использование требует согласования.
- 3,4 млрд параметров, ~570 млн активных на токен, база — DeepSeek-OCR
- 91,14 балла на OmniDocBench v1.6 и 83,4 на olmOCR-Bench
- 2,57 страницы/с на одной A100 — лучший результат среди 14 систем
- Веса ~6,8 ГБ в BF16, лицензия CC BY-NC 4.0, запуск через Transformers или vLLM
Читать дальше
ИИ