Xiaomi заявила о снижении вычислительных затрат MiMo V3 на 80%
Xiaomi представила дизайн HySparse2 для ещё не выпущенной модели MiMo V3: заявлено сокращение памяти в 4,5 раза и вычислительных затрат на 80%. DeepSeek V4.1 Flash использует механизм обмена заметками между слоями и сжимает память на токен вчетверо; независимых подтверждений точности recall на длинном контексте пока нет.
- HySparse2: память меньше в 4,5 раза, вычисления дешевле на 80%
- DeepSeek V4.1 Flash сжимает память на токен в 4 раза
- Заявлена точность recall до 256 000 токенов у Xiaomi
- MiMo V3 ещё не выпущена, независимых тестов нет
Читать дальше
ИИ