Swift 1.5 Qwen3.8-27B: GGUF-версия против «переразмышления»
UkisAI выпустила Swift 1.5 Qwen3.8-27B — дообученную версию Qwen3.8-27B, которая тратит на 58,5% меньше токенов рассуждения на GPQA-Diamond при небольшом росте счёта. Доступны GGUF-квантования от 8,9 ГБ (IQ2_XXS) до 29,0 ГБ (Q8_0) для llama.cpp.
- На GPQA-Diamond: 88,59% против 88,28% у базы, токены рассуждения упали с 15 014 до 8 717
- LiveCodeBench v6: 81,71% против 76,76%, при этом на 24,5% меньше токенов рассуждения
- Terminal-Bench 2.1: 72,13% против 69,21%, токены на вызовы агента — с 52 265 до 43 733
- GGUF-тиры от 8,9 ГБ до 29,0 ГБ; заявлено ускорение до 9,18× на отдельных задачах
Читать дальше
ИИ