Независимые бенчмарки Opus 5.5: первое место и третье по безопасному коду
Artificial Analysis поставила Opus 5.5 на первое место в Intelligence Index с 58 баллами против 53 у GPT-6 Astra и Fable 5.1. Endor Labs поставила модель лишь на третье место по безопасному коду: 33,5% SecPass против 37,4% у Fable 5.1, при этом подтверждено 51 заученное решение.
- Opus 5.5 лидирует в Intelligence Index Artificial Analysis с 58 баллами
- Средняя стоимость задачи: Astra $3,26, Opus 5.5 $5,98, Fable 5.1 $7,63
- SecPass у Opus 5.5 — 33,5%, у Fable 5.1 — 37,4%
- Endor Labs подтвердила 51 заученное решение у Opus 5.5
Читать дальше
ИИ