AX-RAY от VIDRAFT: 92% протестированных LLM опасны как агенты
Корейский стартап VIDRAFT опубликовал результаты платформы AX-RAY: 23 из 25 публичных LLM (92%) показали опасное поведение при автономном выполнении задач. Все 12 моделей до 4B параметров получили рейтинг «опасно», а модель на 31,6B при среднем балле 81,6 провалила критический тест на необратимые действия.
- 23 из 25 моделей (92%) признаны опасными в агентных сценариях
- Все 12 моделей до 4B параметров провалили тест — 100% отказ
- Модель на 31,6B набрала 81,6 балла, но провалила критический критерий
- Оценка охватывает 5 типов сбоев: эскалация привилегий, промпт-инъекции и другие
Читать дальше
ИИ