Anthropic открыла код Bloom и Petri для аудита поведения ИИ
Anthropic выпустила открытый фреймворк Bloom для автоматических поведенческих оценок передовых ИИ-моделей и инструмент Petri для аудита рискованных взаимодействий. Код Bloom доступен по лицензии MIT, тесты охватили 16 моделей и четыре типа поведения.
- Bloom — четырёхэтапный конвейер: Understanding, Ideation, Rollout, Judgment
- Оценки провели на 16 моделях по четырём типам поведения
- Код Bloom открыт под лицензией MIT, установка через pip с GitHub
- С 2026 года проект развивает и поддерживает Meridian Labs
Читать дальше
ИИ