xAI выпустила модель распознавания речи Grok Voice Transcribe 2.0
xAI представила Grok Voice Transcribe 2.0 — модель распознавания речи, которая вдвое точнее версии 1.0. Цена осталась прежней: $0,10 за час аудио в пакетном режиме и $0,20 за час в потоковом. Модель лидирует среди 32 потоковых моделей в рейтинге Artificial Analysis.
- Точность вдвое выше Grok Voice Transcribe 1.0, цена не изменилась
- На коротких фразах WER упал с 20,6% до 6,8% на 19 языках
- Поддержка диаризации, таймстемпов и до 8 каналов бесплатно
- Atlassian переводит все видео Loom на новую модель
Читать дальше
ИИ