tehno24.ru
← ИИ
ИИ11 октября 2026, 05:02

Sakana AI: система рецензирования ловит 73% ошибок в ключевых утверждениях

Sakana AI опубликовала работу Beyond Imitation о системе Multi-Layered Review для ИИ-рецензирования научных статей. На бенчмарке из 1164 подменённых утверждений в 257 статьях MLR поймала 73,43% ошибок в ключевых утверждениях против 14,81% у лучшего базового метода. Стоимость — около $0,47 за рецензию на моделях Claude Sonnet 4 и Haiku 3.5 без дообучения.

Sakana AI: система рецензирования ловит 73% ошибок в ключевых утверждениях
#SakanaAI#Anthropic#Claude
Читать дальше
ИИ

FT: ИИ всё быстрее внедряется в боевые системы, растёт риск ошибок

ИИ

Открытые ИИ-модели мешают ловить распространителей детской порнографии

ИИ

Сбой в ChatGPT, Codex и API OpenAI: повышенный уровень ошибок

ИИ

Claude переживает сбой: Anthropic подтвердила повышенный уровень ошибок