tehno24.ru
← ИИ
ИИ21 сентября 2026, 23:17

ИИ-чат-боты ошибаются в 57% финансовых вопросов

Saturn протестировала 18 популярных ИИ-инструментов, включая ChatGPT, Gemini, Claude и Copilot: средняя точность ответов на финансовые вопросы составила 43%, а на сложные многошаговые сценарии упала до 12%. Лучший результат показал платный Claude Opus 5 (reasoning) с 61% верных ответов, худший — бесплатный Claude Haiku 4.5 с 82% ошибок.

ИИ-чат-боты ошибаются в 57% финансовых вопросов
#ChatGPT#Gemini#Claude#Copilot
Читать дальше
ИИ

Вирусные скриншоты: ChatGPT якобы отправил письмо в ФБР из Gmail пользователя

ИИ

ИИ-агент Muse от Meta возглавил чарт бесплатных приложений для iPhone в США

ИИ

GitHub Copilot CLI получил HydraFusion — маршрутизацию между ИИ-моделями

ИИ

Личные ИИ-агенты вроде Meta Muse разгонят спрос на CPU в 40 раз к GPU