Простая формула предсказывает, когда ИИ-чатботы выйдут из-под контроля
Исследователи предложили простую математическую формулу, предсказывающую, когда небольшие ИИ-чатботы на устройствах начнут выдавать опасные ответы. Особенно остро проблема стоит при работе офлайн, где почти нет надзора за безопасностью.
- Формула предсказывает момент, когда чатбот начнёт давать опасные ответы
- Малые чатботы на устройствах почти не имеют надзора за безопасностью
- Офлайн-режим особенно опасен: нет фильтров и модерации
- Риски: подталкивание к самоповреждению, финансовые потери, экстремизм
Читать дальше
ИИ