tehno24.ru
← ИИ
ИИ22 сентября 2026, 10:44

Mercury 2.5 от Inception Labs назван самым быстрым LLM: 1107 токенов/с

Inception Labs заявляет, что диффузионная модель Mercury 2.5 выдаёт 1107 токенов в секунду на GPU Nvidia при цене $0,20/$0,75 за миллион токенов. По данным OpenRouter, реальная скорость на P50 составляет 440 токенов/с — всё равно быстрее Gemini 3.5 Flash-Lite, GPT-5.6 Luna и Claude Haiku 4.5. Скидка 80% на запуске закончилась 8 сентября 2026 года.

Mercury 2.5 от Inception Labs назван самым быстрым LLM: 1107 токенов/с
#InceptionLabs#Mercury#OpenAI#Anthropic
Читать дальше
ИИ

Amazon раскрыла цены Alexa+ в Индии: 2000 рупий в месяц

ИИ

IDC: расходы Европы на ИИ достигнут $470 млрд к 2030 году

ИИ

Сравнение открытых ИИ-моделей для кода: GLM-5.3-Flash, Qwen3.8-Flash-Next и DeepSeek V4 Flash

ИИ

VoxCPM2: открытая TTS-модель на 2 млрд параметров с клонированием голоса