Meta, MIT и UW представили Context Language Models с самоуправляемым контекстом
Исследователи из Meta, MIT и Вашингтонского университета предложили Context Language Models (CLM): модель сама редактирует свой контекст как файл, без внешних механизмов суммаризации и поиска. Zero-shot CLM дал +11,4% точности при −21,5% FLOPs на BrowseComp-Plus, а RL поднял Qwen3.5-9B с 28,8% до 42,5% при −12% FLOPs.
- Zero-shot CLM: +11,4% точности и −21,5% FLOPs на BrowseComp-Plus
- In-context learning дал до +35,9 п.п. на ContextBench при меньших затратах
- RL улучшил Qwen3.5-9B на BrowseComp-Plus с 28,8% до 42,5%
- Риски: потеря важных данных и новые каналы для prompt injection
Читать дальше
ИИ