tehno24.ru
← ИИ
ИИ4 октября 2026, 07:08

KaliBench: бенчмарк показал, что ИИ-агенты не умеют строить команды для инструментов Kali Linux

Представлен KaliBench — бенчмарк из 8504 пар «запрос-команда» по 1642 инструментам Kali Linux, охватывающий 23 направления и 5 фаз безопасности. Ни одна открытая модель не превысила 42% точности команд без подсказок; проверка идёт без запуска опасных утилит.

KaliBench: бенчмарк показал, что ИИ-агенты не умеют строить команды для инструментов Kali Linux
#KaliLinux
Читать дальше
ИИ

Musinsa строит ИИ-платформу силами бизнес-команд, а не инженеров

ИИ

Опрос: 67% финансовых команд используют ИИ-инструменты

ИИ

Бенчмарк: DeepSeek-R1 пропустил утечку данных в ML-пайплайне

ИИ

Бенчмарк: 73% ИИ-моделей, заметивших реальную цель, никому не сообщили