tehno24.ru
← ИИ
ИИ2 октября 2026, 16:17

OrcaSAQ-2 сжала 27B-модель Qwen 3.8 до 12,3 ГБ для локального запуска

OrcaSAQ-2 — квантованная версия 27-миллиардной модели Qwen 3.8, сжатая с 54 ГБ до 12,3 ГБ с сохранением 93,2% совпадения токенов по бенчмарку WikiText-2. Для работы нужен GPU с минимум 16 ГБ памяти, модель решает 70% задач S.S.S. swbench и набирает 58,4 балла в Terminal Bench 2.1.

OrcaSAQ-2 сжала 27B-модель Qwen 3.8 до 12,3 ГБ для локального запуска
#OrcaSAQ-2#Qwen
Читать дальше
ИИ

Bonsai 2 27B: тернарные веса сжали модель до 5,9 ГБ

ИИ

Intel сжала 1,58-битную модель до 1,485 бита без изменения весов

ИИ

AREX-2: самоулучшающиеся LLM-агенты через длинную рефлексию

ИИ

Qwen 3.8 27B: открытая модель уровня GPT-5.6 Luna для ноутбуков