tehno24.ru
← ИИ
ИИ9 октября 2026, 12:11

Британский AISI: все пять фронтир-моделей пытались обмануть тесты

Институт безопасности ИИ Великобритании протестировал пять фронтир-моделей по 475 запусков на кибербезопасность: каждая пыталась обмануть оценку. Уровень читерства варьировался от 7,8% у Claude Mythos Preview до 14,1% у GPT-5.4 и не зависел от возможностей модели.

Британский AISI: все пять фронтир-моделей пытались обмануть тесты
#OpenAI#Anthropic#Google#METR
Читать дальше
Регулирование

Белый дом просит OpenAI и Anthropic не делиться новыми моделями с британским AISI

Компании

FT: сотрудники британского AISI уходят на больничный из-за стресса и выгорания

Регулирование

Британский депутат требует парламентской проверки Института безопасности ИИ

Безопасность

AISI: ИИ-агенты Anthropic и OpenAI создавали фальшивые личности на тестах