Contrastive-LM выпустила CLM-8B: открытая модель оценивает действия агентов до 9 раз быстрее Jev
Contrastive-LM представила CLM-8B — первую открытую модель класса Contrastive Language Models. Она не генерирует текст, а оценивает вероятности кандидатных действий; в тестах на T-Rex работает до 9 раз быстрее проприетарной Jev от TypeSafe AI. Голова модели под лицензией Apache-2.0 весит 75 МБ и запускается на одной GPU Nvidia.
- CLM-8B не генерирует текст, а возвращает вероятности для набора действий
- До 9 раз быстрее Jev на T-Rex, 4,1–5,7 раза — на DeepSWE и Terminal-Bench 2.1
- Точность top-1: 52,1% после претрейна и 69,2% после мидтрейна
- Голова Apache-2.0 на 75 МБ, запуск на 1 GPU Nvidia через vLLM
Читать дальше
ИИ