tehno24.ru
← ИИ
ИИ7 октября 2026, 03:54

Новый метод устраняет эффект Гидры при поиске схем в LLM

Пятеро исследователей опубликовали на arXiv статью «Slaying the Hydra: Interaction-Aware Circuit Discovery in Language Models», которая формально решает проблему эффекта Гидры в механистической интерпретируемости. Метод WISE и алгоритм JuntaLearner оценивают вклад компонентов модели с учётом компенсаторных реакций, а не по отдельности.

Новый метод устраняет эффект Гидры при поиске схем в LLM
#GoogleDeepMind#GPT-2#Goodfire
Читать дальше
Наука

Новый метод МРТ устраняет «мёртвое время» и повышает точность

ИИ

OpenAI описала принципы независимой проверки безопасности ИИ

ИИ

Отчёт: как реально можно затормозить развитие ИИ

ИИ

Baseten запустила Base Labs и партнёрство по безопасности открытых ИИ-моделей