vLLM Semantic Router выпустила Decision 3.0 — открытые мультимодальные модели решений
Команда vLLM Semantic Router представила семейство Decision 3.0 из пяти мультимодальных моделей (0,85–26,09 млрд параметров) под лицензией Apache-2.0. Модели принимают текст, JSON и изображения и возвращают вероятности вместо текста, что упрощает классификацию и маршрутизацию запросов. Флагман d3 (27B) лидирует в текстовых и визуальных таблицах по внутренним оценкам, а 9B-версия d3-flash обходит прошлогоднюю 27B-модель Decision 2.0.
- 5 моделей: d3-lite (0,85B), d3-nano (2,21B), d3-mini (4,54B), d3-flash (8,39B), d3 (26,09B)
- Все под Apache-2.0, на базе Qwen, с визуальным энкодером и приёмом изображений до 1,6 Мп
- d3 (27B): 64,1 в тексте и 71,6 в зрении по внутренним оценкам
- d3-flash (9B) набрал 59,0 против 55,9 у 27B-модели Decision 2.0
Читать дальше
ИИ