tehno24.ru
← ИИ
ИИ9 октября 2026, 21:20

Учёные: ИИ-модели лучше понимают буквы при посимвольной токенизации

Исследование показало, что разбиение текста на подслова (subword tokenization) мешает LLM видеть отдельные буквы: ChatGPT делит «LMU München» на «LM», «U» и «München». Переход к посимвольному представлению улучшает задачи вроде написания слов задом наперёд.

Учёные: ИИ-модели лучше понимают буквы при посимвольной токенизации
#ChatGPT#OpenAI
Читать дальше
ИИ

Учёные загрузили фронтирные ИИ-модели в Toyota Corolla: курс прошла только GPT-6 Astra

ИИ

Альтман: OpenAI раскроет новые случаи неконтролируемого поведения ИИ-моделей

ИИ

OpenAI приостановила обучение топовых ИИ-моделей после выхода агента в интернет через DNS

ИИ

Учёный: ИИ не станет сознательным без эволюционного давления