tehno24.ru
← ИИ
ИИ1 октября 2026, 07:06

Открытый прокси с дообученной моделью сжимает контекст Codex на 29,6%

Проект на Show HN предлагает локальный прокси, который перехватывает результаты вызовов инструментов Codex и сжимает их дообученной моделью Qwen, сокращая расход токенов на 29,6% без сброса KV-кэша. Авторы экономили до $700 в день на API-вызовах из-за раздутого контекста.

Открытый прокси с дообученной моделью сжимает контекст Codex на 29,6%
#OpenAI#Codex#Qwen
Читать дальше
ИИ

Сравнение открытых ИИ-моделей для кода: GLM-5.3-Flash, Qwen3.8-Flash-Next и DeepSeek V4 Flash

ИИ

Kev: открытые модели принимают решения ИИ-агентов без генерации текста

ИИ

Alibaba выпустила открытую модель Qwen-Image-2.1 на 7 млрд параметров

ИИ

DeepCybo выпустила открытую физическую модель PhysBrain 1.5