tehno24.ru
← ИИ
ИИ9 октября 2026, 12:49

DFlash-2 от Z-Lab ускоряет генерацию LLM через диффузионный драфтинг

Z-Lab и inco.ai выпустили DFlash-2 — улучшение техники предсказания токенов DFlash на основе диффузионной модели. Добавлены Lightweight Path Selector для проверки порядка токенов и Local Convolution против падения точности к концу блока. Поддержка пока у Qwen3.8-27B и Muse-Glimmer-30B, в llama.cpp — через PR #27342.

DFlash-2 от Z-Lab ускоряет генерацию LLM через диффузионный драфтинг
#Z-Lab#Llama.cpp#Qwen#Muse-Glimmer
Читать дальше
ИИ

Inception Labs выпустила Mercury 2.5 — диффузионную LLM на 1107 токенов/с

ИИ

Google Research представила R4T: диффузионный ретривер ускоряет fan-out запросов в 12–20 раз

ИИ

Новый метод устраняет эффект Гидры при поиске схем в LLM

ИИ

OrcaSAQ-2 сжала 27B-модель Qwen 3.8 до 12,3 ГБ для локального запуска