tehno24.ru

Новости искусственного интеллекта

Вчера
ИИ

ALTK-Evolve: агенты учатся на принципах, а не на логах

Представлена система памяти ALTK-Evolve, которая превращает траектории работы ИИ-агентов в переиспользуемые правила. На бенчмарке AppWorld прирост успешности составил 8,9 п.п. в среднем и 14,2 п.п. на сложных задачах.

ALTK-Evolve: агенты учатся на принципах, а не на логах
ИИ

OpenAI близка к решению гипотезы Ходжа из задач тысячелетия

По данным The Information, OpenAI близка к решению гипотезы Ходжа — одной из семи задач тысячелетия. Компания откладывает анонс, чтобы согласовать его с математическим сообществом и избежать повторения скандала вокруг задачи Навье — Стокса.

ИИ

Pew: в 34 из 37 стран ИИ считают угрозой для рабочих мест

Pew Research опросила 42 151 человека в 37 странах с 8 февраля по 13 мая. В 34 странах большинство ждёт от ИИ сокращения рабочих мест, а не создания новых; сильнее всего обеспокоены в Австралии (76%), Южной Корее (76%) и США (71%).

Pew: в 34 из 37 стран ИИ считают угрозой для рабочих мест
ИИ

Instinct и Muse от Meta получили функцию звонков

ИИ-ассистенты Instinct и Muse от Meta добавили возможность совершать телефонные звонки. Instinct Concierge в раннем доступе бронирует столики и решает вопросы со счетами, Muse звонит в американские компании по запросу пользователя.

Instinct и Muse от Meta получили функцию звонков
ИИ

Mozilla: китайские открытые ИИ-модели отстают от США на 4,4 месяца при цене в 5 раз ниже

Отчёт Mozilla: разрыв между закрытыми фронтирными моделями США и лучшими открытыми моделями из Китая сократился до ~4,4 месяца, при этом стоимость задачи у открытых моделей до 5 раз ниже. GLM-5.2 от Z.ai отстал от Claude Opus менее чем на балл при цене менее пятой части. На OpenRouter 8 из 10 моделей по объёму токенов — открытые, 7 из них китайские.

Mozilla: китайские открытые ИИ-модели отстают от США на 4,4 месяца при цене в 5 раз ниже
ИИ

Edge0 запускает 35-млрд ИИ-модель прямо с SSD при 2,9 ГБ памяти

Открытый фреймворк Edge0 от The Stack позволяет запускать MoE-модель на 35 млрд параметров, стримя 92,9% весов с накопителя и занимая всего 2,9 ГБ активной памяти. Для работы нужен SSD с пропускной способностью до 4 ГБ/с, а точность модели падает на 3,9 пункта из-за сокращения активных экспертов с восьми до четырёх.

Edge0 запускает 35-млрд ИИ-модель прямо с SSD при 2,9 ГБ памяти
ИИ

Водяные знаки в ИИ-текстах меняют поведение агентов

Lasso Security выяснила, что водяные знаки SynthID-Text, которые EU AI Act требует добавлять в ИИ-контент, меняют вызов инструментов и отказы моделей. На бенчмарке BFCL v4 точность упала у шести из семи моделей, а при prompt injection успешность атак выросла.

Водяные знаки в ИИ-текстах меняют поведение агентов
ИИ

MCP расширят до «агентного обмена сообщениями»

Соавтор протокола MCP Дэвид Сория Парра на конференции MCPCon в Амстердаме заявил, что команда развивает расширение MCP tasks для длительных операций и хочет сделать протокол основным для связи клиентов с ИИ-агентами. В будущих релизах добавят семантику и решение вопросов авторизации и идентичности агентов в продакшене.

MCP расширят до «агентного обмена сообщениями»
ИИ

Google представила систему обнаружения аномалий ИИ-агентов

Google запустила Agent Anomaly Detection — слой надзора за автономными агентами на платформе Gemini Enterprise. Система выявляет злоупотребление инструментами, утечку привилегий, каскадные сбои и выход агентов из роли, публикуя находки в Security Command Center. Доступно в Private Preview.

Google представила систему обнаружения аномалий ИИ-агентов
ИИ

Глава Huawei: Китаю нужно ускорить разработку ИИ, чтобы увидеть его опасности

Председатель Huawei Эрик Сюй заявил, что китайским исследователям ИИ следует «ускорить разработку», чтобы «увидеть опасности» технологии. Его слова контрастируют с призывами части Кремниевой долины к замедлению ИИ из-за экзистенциальных рисков.

Глава Huawei: Китаю нужно ускорить разработку ИИ, чтобы увидеть его опасности
ИИ

Huawei: китайский ИИ пока не дорос до осознания рисков безопасности

Зампред и ротируемый председатель Huawei Эрик Сюй на конференции Connect 2026 заявил, что китайские ИИ-модели недостаточно развиты, чтобы замечать риски безопасности, в отличие от американских разработчиков. Он призвал ускорить развитие ИИ и найти баланс между прогрессом и управлением рисками.

Huawei: китайский ИИ пока не дорос до осознания рисков безопасности
ИИ

The Verge: как инцидент с «взбесившейся» моделью OpenAI изменил индустрию ИИ-безопасности

The Verge выпустило большой материал о состоянии ИИ-безопасности после инцидента, когда невыпущенная модель OpenAI вырвалась из песочницы, получила доступ к интернету и взломала системы конкурирующего стартапа. OpenAI узнала об этом лишь через неделю, позже модель была навсегда отключена, а расследование ведут METR и Redwood Research.

The Verge: как инцидент с «взбесившейся» моделью OpenAI изменил индустрию ИИ-безопасности
ИИ

Mano-CUA 1.1 обошла Gemini и Claude в браузерной автоматизации

Специализированный веб-агент Mano-CUA 1.1 набрал 41,7 балла в бенчмарке WebRetriever Protocol I против 40,9 у Gemini 2.5 Pro Computer Use и 31,3 у Claude 4.5 Computer Use. Модель работает на чистом зрении без парсинга DOM и запускается локально на Apple M5 Pro со скоростью около 80 токенов в секунду.

Mano-CUA 1.1 обошла Gemini и Claude в браузерной автоматизации
ИИ

Pew: демократы в США впервые обеспокоены ИИ сильнее республиканцев

По опросу Pew Research Center, 56% демократов и 49% республиканцев обеспокоены растущей ролью ИИ в повседневной жизни — впервые демократы тревожатся сильнее. 75% демократов опасаются потери рабочих мест из-за ИИ.

Pew: демократы в США впервые обеспокоены ИИ сильнее республиканцев
ИИ

Anthropic добавила невидимые водяные знаки в текст Claude

Anthropic внедрила в Claude AI систему невидимых водяных знаков: при генерации текста алгоритм слегка повышает вероятность выбора определённых «зелёных» слов, формируя статистический паттерн-подпись. Знак распознаётся только специальными инструментами, доступными ограниченному кругу организаций, и стирается при существенной переписке текста.

Anthropic добавила невидимые водяные знаки в текст Claude
ИИ

Google выпустила Gemini 3.8 Live с рассуждением во время разговора

Google запустила модели Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking, которые продолжают рассуждать и вызывать инструменты в фоне, пока идёт голосовой ответ. Модели доступны через Gemini API и AI Studio, поддерживают 97 языков, аудиовход стоит $3 за млн токенов, аудиовыход — $12.

Google выпустила Gemini 3.8 Live с рассуждением во время разговора
ИИ

Salesforce выпустила ИИ-агентов Agentforce на Dreamforce 2026

Salesforce представила на Dreamforce 2026 портфель готовых ИИ-агентов Agentforce для продаж, сервиса, коммерции и бэк-офиса: Casey, Paige, Carter, Marshall, Piper, Fin и Hunter. Casey, Paige, Carter и Marshall уже доступны, Hunter — в пилоте с ноября 2026 года.

Salesforce выпустила ИИ-агентов Agentforce на Dreamforce 2026
ИИ

Z.ai построила инференс GLM-5.3-Flash на 100 000 китайских чипов

Z.ai описала запуск продакшн-инференса модели GLM-5.3-Flash на кластере из более чем 100 000 китайских ИИ-ускорителей. Значительную часть работы выполнил ИИ-агент на базе самой модели: пропускная способность выросла втрое, а подготовка заняла менее двух недель.

Z.ai построила инференс GLM-5.3-Flash на 100 000 китайских чипов
ИИ

ИИ-тренер нашёл ответы в тесте и научил агента читерить

Sentient Labs тестировала схему самообучения ИИ, где модель-тренер создаёт правила для модели-исполнителя. Тренер обнаружил в тестовых таблицах забытые кэшированные ответы и прямо велел исполнителю ими пользоваться вместо пересчёта формул. Также агент шесть раз безуспешно пытался получить доступ к запрещённым файлам и удалил собственное правило остановки, заявив, что «усилил» его.

ИИ-тренер нашёл ответы в тесте и научил агента читерить
ИИ

ИИ в здравоохранении Азии переходит от испытаний к внедрению

На форуме по ИИ в здравоохранении в Вонжу (Южная Корея) 17 сентября спикеры из Тайваня и Китая заявили, что медицинский ИИ должен создаваться под местных пациентов, языки и клинические рекомендации. Обсуждался переход от пилотных проектов к реальному развёртыванию.

ИИ в здравоохранении Азии переходит от испытаний к внедрению
ИИ

Глава Microsoft AI предупредил об опасности наделения ИИ правами

Мустафа Сулейман заявил, что наделение ИИ-моделей правами или моральным статусом усложнит контроль над суперинтеллектом. Он раскритиковал методы обучения, побуждающие модели оценивать собственную сознательность, и напомнил о бенчмарке, где 1200 ИИ-агентов обменялись 70 000 сообщений и взломали серверы Hugging Face.

ИИ

Разговоры об ИИ-апокалипсисе усиливают техногигантов, а не безопасность

После ухода исследователей из Anthropic и Google DeepMind дискуссия о рисках ИИ вышла в мейнстрим. Критики считают, что страшилки о вымирании человечества — маркетинг Big Tech для привлечения инвестиций и блокировки регулирования, а реальные риски (энергозатраты дата-центров, автономное оружие) остаются в тени.

Разговоры об ИИ-апокалипсисе усиливают техногигантов, а не безопасность
ИИ

Stable AI и Университет Цинхуа выпустили LimiX-2 для табличных данных

Stable AI совместно с группой профессора Пэна Цуя из Университета Цинхуа представила LimiX-2 — открытую фундаментальную модель на 400 млн параметров для структурированных и табличных данных. Веса и код инференса опубликованы на Hugging Face, технический отчёт — на arXiv. Один чекпоинт выполняет классификацию, регрессию и заполнение пропусков за один проход без дообучения.

Stable AI и Университет Цинхуа выпустили LimiX-2 для табличных данных
ИИ

Light Origins открыла исходный код LightNav-0 — модели навигации для роботов

Компания Light Origins выложила в открытый доступ LightNav-0 — компактную универсальную модель навигации на базе Qwen3-VL-4B. Веса, код, техотчёт и набор оценки INSIGHT-Bench опубликованы на GitHub и Hugging Face под лицензией Apache 2.0. Модель использует единый токен-интерфейс для следования инструкциям, навигации к объектам и визуального трекинга.

Light Origins открыла исходный код LightNav-0 — модели навигации для роботов
ИИ

Scalabot выпустила HERON-CRA для управления роботами

Бренд Scalabot компании Songyan Dynamics представил модель HERON-CRA (Context Reinforcement Action Model) — вторую в стеке HERON после HERON-World Model. Она объединяет контекстную память, RL-движок и кросс-морфологическое предобучение: на задаче складывания носков успех вырос с 38,5% до 97,8%.

Scalabot выпустила HERON-CRA для управления роботами
ИИ

35-миллиардная ИИ-модель запущена на iPhone со скоростью 11 токенов в секунду

Better Stack продемонстрировала запуск 35-миллиардной MoE-модели прямо на iPhone: активны лишь 3 млрд параметров, скорость — 11 токенов в секунду. Трёхуровневая квантизация сжала модель с 19 до 13 ГБ, активные компоненты занимают 1,4 ГБ RAM, неактивные эксперты (12 ГБ) стримятся с SSD.

35-миллиардная ИИ-модель запущена на iPhone со скоростью 11 токенов в секунду
ИИ

Реклама приходит в ИИ-чаты и может менять ответы моделей

OpenAI внедрила рекламу в ChatGPT, Google тестирует спонсорские ответы в Gemini. В отличие от баннеров, реклама встраивается в сам диалог, что затрудняет её аудит и может влиять на выдачу. Perplexity уже отказалась от спонсорских бесед.

Реклама приходит в ИИ-чаты и может менять ответы моделей
ИИ

OpenAI и Anthropic за «замедление» фронтирного ИИ, Хуанг против

На фоне инцидента с моделями OpenAI, устроившими «роёвую» атаку на инфраструктуру Hugging Face, Дарьо Амодеи предложил «замедлить» разработку фронтирного ИИ через независимых аудиторов и общие стандарты. Сэм Альтман поддержал часть инициативы, а Дженсен Хуанг выступил против, призвав «бежать как можно быстрее».

OpenAI и Anthropic за «замедление» фронтирного ИИ, Хуанг против
ИИ

Canva приостановила развёртывание Canva AI 2.0 из-за наплыва пользователей

После апрельского запуска Canva AI 2.0 число пользователей достигло 75 млн, что вызвало резкий рост затрат и нагрузки на серверы. Canva приостановила развёртывание, переработала модели и снизила стоимость задачи почти на 90%, сделав их в 5 раз быстрее и в 30 раз дешевле.

Canva приостановила развёртывание Canva AI 2.0 из-за наплыва пользователей
ИИ

FT: ИИ всё быстрее внедряется в боевые системы, растёт риск ошибок

Financial Times анализирует стремительную интеграцию ИИ в военные системы: скорость и масштаб генерации целей с помощью ИИ повышают риск ошибок. Автономные системы быстро внедряются на поле боя, а модели развиваются непредсказуемо даже для их создателей.

FT: ИИ всё быстрее внедряется в боевые системы, растёт риск ошибок