tehno24.ru
← ИИ
ИИ8 октября 2026, 23:32

Scality представила AI Inference Factory с KV-кэшем в объектном хранилище

Scality выпустила открытый стек AI Inference Factory для запуска открытых моделей на собственной инфраструктуре. KV-кэш хранится в объектном хранилище ADI и передаётся в GPU по RDMA: восстановление контекста в 14 раз быстрее пересчёта, до 8 ТБ кэша и 1000 возобновляемых сессий.

Scality представила AI Inference Factory с KV-кэшем в объектном хранилище
#Scality#VLLM#Nvidia
Читать дальше
ИИ

Google TurboQuant сжимает KV-кэш до 3 бит без потери точности

ИИ

QAT-версия Gemma 4 26B-A4B на одном TPU v6e: KV-кэш больше в 15,6 раза, пропускная способность — в 1,9 раза

ИИ

Prime Intellect запустила Prime Inference для открытых моделей

Железо

MinIO: кэш объектов не нужен, если объектное хранилище достаточно быстрое