BottleCap AI выпустила ThinkingCap-Qwen3.8-27B: на 37,2% меньше токенов размышления
BottleCap AI представила ThinkingCap-Qwen3.8-27B — дообученную версию Qwen3.8-27B, которая тратит в среднем на 37,2% меньше токенов размышления при падении точности всего на 0,86 п.п. (с 86,65% до 85,79%). Модель совместима с vLLM и SGLang, доступны сборки FP8, NVFP4, GGUF и MLX.
- Средний расход токенов размышления падает с 15 735 до 12 144
- Точность AA-LCR растёт на 2,25 п.п., AIME 2026 падает на 3,85 п.п.
- Сборки: NVFP4 21 ГБ, GGUF 16–55 ГБ, MLX 4-bit 21 ГБ
- Лицензия PolyForm Small Business, коммерческое использование по договору
Читать дальше
ИИ