tehno24.ru
← ИИ
ИИ10 октября 2026, 07:07

Headroom: сжатие контекста ИИ-агентов экономит 60–95% токенов

Проект Headroom представил слой сжатия контекста между агентом и LLM: модель kompress-v2-base сокращает вывод инструментов, логи, RAG-чанки и файлы. Заявлена экономия 20% токенов для кодинг-агентов и 60–95% для JSON-нагрузок без изменения ответов. Доступны библиотека Python, FastAPI-прокси и MCP-сервер.

Headroom: сжатие контекста ИИ-агентов экономит 60–95% токенов
#Headroom
Читать дальше
ИИ

Nvidia представила Sol-Pi — механизмы экономии токенов для ИИ-агентов

ИИ

StepFun Step 5 Preview появилась на OpenRouter: 600B параметров и контекст 1M токенов

ИИ

Z.ai выпустила GLM-5.3-Flash: 320B параметров, 18B активных и контекст 1M токенов

ИИ

Kimi K3 от Moonshot AI вышла на Amazon Bedrock с контекстом 1 млн токенов