Тест Claude Opus 5.5: 18 из 18 критических дефектов и 87,3 балла
GoML протестировала Claude Opus 5.5 на бенчмарке LatticeBench: модель исправила все 18 критических дефектов и 6 из 7 задач уровня very_hard, набрав 87,3 балла. Цена API — $4 за 1 млн входных и $20 за 1 млн выходных токенов, заявленное снижение затрат до 40%.
- Исправлены 18 из 18 критических дефектов и 6 из 7 задач very_hard
- Оценка AI Matic Bench — 87,3/100, на 7,5 балла выше прошлого максимума
- API: $4 за 1 млн входных и $20 за 1 млн выходных токенов
- Модель изменила 107 файлов, включая настройки вне задачи
Читать дальше
ИИ