Red Hat: классификатор DeBERTa на 200 млн параметров почти догнал 35B-модель в защите ИИ
Red Hat протестировала девять конфигураций guardrail на промпт-инъекции и безопасность контента через NeMo Guardrails. Классификатор DeBERTa (около 200 млн параметров) набрал 89,01% против 89,31% у Qwen3.6-35B, но ответил за 54,1 мс против 312,5 мс. Оба классификатора Red Hat станут конфигурациями по умолчанию в OpenShift AI 3.6.
- DeBERTa: 89,01% на промпт-инъекциях против 89,31% у Qwen3.6-35B
- Медианная задержка 54,1 мс у DeBERTa против 312,5 мс у Qwen и 348,1 мс у Jev
- На безопасности контента Jev лидирует с 86,20%, Granite Guardian — шестой с 80,27%
- Смена политики подняла Laya с 57,87% до 75,20%, но снизила Jev с 86,20% до 82,53%
Читать дальше
Безопасность