tehno24.ru
← ИИ
ИИ19 сентября 2026, 12:00

BeaconKV сокращает пиковую память KV-кэша на 40%

Метод BeaconKV использует «маячковые» запросы, предсказывающие повторное обращение к удалённым фрагментам контекста, и снижает пиковое потребление памяти KV-кэша до 40% без потери качества ответов. На Qwen3-14B с лимитом кэша 1024 токена точность на AIME24 выросла на 31,7 п.п. Метод не требует обучения, но нуждается в ручной настройке целевого коэффициента сжатия.

BeaconKV сокращает пиковую память KV-кэша на 40%
#Qwen
Читать дальше
ИИ

ИИ-безопасники METR, Redwood и Apollo вышли в центр внимания

ИИ

ChatGPT появился в Microsoft Word и получил расширение для Chrome

ИИ

Polymarket: ставки на лучшую ИИ-модель не изменились после запуска GPT-6 Astra

ИИ

Salesforce: в АСЕАН ИИ продавать сложнее — труд человека дешевле