tehno24.ru
← Безопасность
Безопасность11 октября 2026, 19:04

Дайджест исследований по безопасности ИИ: обход многосканерных защит и кража reward-модели

За неделю с 4 по 11 октября 2026 года вышли новые работы по безопасности ИИ: атака BRANCH обходит 6 многосканерных защит со 100% успехом, а Reward Stealing Attack восстанавливает reward-модель выровненной LLM чёрным ящиком. Также представлены защиты ASPIRE, LADE, AdaGuard и AttestMCP для агентов.

Дайджест исследований по безопасности ИИ: обход многосканерных защит и кража reward-модели
#Anthropic#OpenAI
Читать дальше
Безопасность

Дайджест безопасности: новые атаки Spectre через JIT, 1200 уязвимостей в Linux и взлом Asos

Безопасность

Исследование: взломы ИИ-агентов не видны на панелях безопасности

Регулирование

США обвинили шесть китайских ИИ-компаний в краже моделей и обходе чиповых ограничений

Компании

Сотрудник OpenAI по безопасности уволился и призвал к защите «ядерного уровня»