Cactus выпустила модель распознавания речи Whistle на 16,9 МБ для CPU
Cactus 2 октября 2026 года выпустила открытую модель распознавания речи Whistle весом 16,9 МБ, работающую только на CPU без внешних зависимостей. Она транскрибирует семь языков, выдаёт первый токен за 11,1 мс на Apple M4 Pro и декодирует 1319 токенов/с — примерно в пять раз быстрее Whisper base.
- Вес модели 16,9 МБ — менее 1/8 от Whisper base (145,3 МБ)
- Первый токен за 11,1 мс на M4 Pro против 73,2 мс у Whisper base
- Скорость декодирования 1319 токенов/с, в 5 раз быстрее Whisper base
- Поддержка 7 языков: английский, немецкий, французский, испанский, итальянский, нидерландский, польский
Читать дальше
ИИ