Inception Labs выпустила Mercury 2.5 — диффузионную LLM на 1107 токенов/с
Inception Labs представила Mercury 2.5 — крупнейшую обученную диффузионную языковую модель, выдающую 1107 токенов в секунду на GPU Nvidia. Модель на 40% умнее Mercury 2, работает через OpenAI-совместимый API, контекст 260K токенов, цена $0,20/$0,75 за млн токенов со скидкой 80% на старте.
- Скорость 1107 токенов/с на GPU Nvidia против 277,5 у Gemini 3.8 Flash
- Качество на уровне GPT-5.6 Luna Low, Gemini 3.5 Flash-Lite и Claude Haiku 4.5
- Контекст 260K токенов, цена $0,20 за млн входных и $0,75 за выходные
- Также анонсированы Mercury Voice с задержкой до 170 мс и Mercury Router
Читать дальше
ИИ