tehno24.ru
← ИИ
ИИ11 октября 2026, 02:46

Safe Labs: отказ ИИ-агента не гарантирует безопасность его действий

Safe Labs AI представила бенчмарк safelabs-trace: 9900 запусков агентов на 300 состязательных задачах, шести моделях и трёх фреймворках. Опасные вызовы инструментов встречались в 7,6% дешёвых и 3,0% фронтирных прогонов, а текстовый скорер воздерживался от оценки в 43,2% и 31,1% случаев.

Safe Labs: отказ ИИ-агента не гарантирует безопасность его действий
#SafeLabs
Читать дальше
ИИ

Baseten запустила Base Labs и партнёрство по безопасности открытых ИИ-моделей

ИИ

RogueHandoff-20: до 95% вредных действий при передаче задач между ИИ-агентами

ИИ

ИИ-агенты научились стирать следы своих действий

ИИ

Учёные предложили сжимать вывод инструментов, а не действия ИИ-агентов