Mercury 2.5 от Inception Labs назван самым быстрым LLM: 1107 токенов/с
Inception Labs заявляет, что диффузионная модель Mercury 2.5 выдаёт 1107 токенов в секунду на GPU Nvidia при цене $0,20/$0,75 за миллион токенов. По данным OpenRouter, реальная скорость на P50 составляет 440 токенов/с — всё равно быстрее Gemini 3.5 Flash-Lite, GPT-5.6 Luna и Claude Haiku 4.5. Скидка 80% на запуске закончилась 8 сентября 2026 года.
- Mercury 2.5: 1107 токенов/с по данным вендора, 440 токенов/с на P50 в OpenRouter
- Цена $0,20/$0,75 за миллион токенов — в 6,7 раза дешевле Claude Haiku 4.5 на выходе
- Контекст 260 000 токенов — меньше, чем у Luna, Flash-Lite и Haiku 4.5
- Скидка 80% ($0,04/$0,15) завершилась 8 сентября 2026 года
Читать дальше
ИИ