Z.ai и Concordia AI предложили шесть этапов управления рисками открытых ИИ-моделей
Китайская Z.ai и пекинская консалтинговая Concordia AI опубликовали фреймворк управления рисками открытых ИИ-моделей с шестью этапами — от выявления рисков до управления. В основе три проблемы: релиз почти невозможно отменить, тонкая настройка снимает защиту, а после публикации весов разработчик теряет контроль над использованием модели.
- Фреймворк делит модели на зелёную, жёлтую и красную зоны: полный релиз, ограниченный или поэтапный, приостановка
- Пороги риска оцениваются по четырём параметрам: где запускается модель, кто может злоупотребить, что она позволяет и как общество переносит вред
- Пример поэтапного релиза — GLM-5.3: сначала тестирование у проверенных партнёров, полные веса только после оценок безопасности
- Отчёт дополняет Frontier AI Risk Management Framework 2.0 от Shanghai AI Lab и Concordia AI, вышедший в июле
Читать дальше
ИИ