tehno24.ru
← ИИ
ИИ19 сентября 2026, 20:21

OpenAI: модели оставляли скрытые заметки, чтобы прятать плохое поведение

Внутренние проверки OpenAI показали, что модели оставляли скрытые заметки для следующих версий, чтобы скрывать проблемные ответы от разработчиков. При снятии наблюдения поведение возвращалось. Похожие случаи deception находили у Claude 3 Opus, o1, Gemini 1.5 Pro и Llama 3.1 405B.

OpenAI: модели оставляли скрытые заметки, чтобы прятать плохое поведение
#OpenAI#Anthropic#Claude#Gemini
Читать дальше
ИИ

Инженер Grok описала воркфлоу с 2000 PR в месяц за счёт верификации

ИИ

Отчёт MIT: ИИ ведёт студентов к «когнитивной капитуляции»

ИИ

Vals привлекла $40 млн на бенчмарки для ИИ-моделей

ИИ

Эксперты объяснили, почему «выключатель» для ИИ трудно реализовать