Исследователи разработали технологию, способную через анализ мозговых сигналов распознавать, когда искусственный интеллект (ИИ) неверно истолковал намерения человека. Цель этой разработки — дать системам ИИ возможность осознавать состояние «это было не то, что я имел в виду» без необходимости словесного уточнения со стороны пользователя.
Работа была выполнена учеными из Korea Advanced Institute of Science and Technology (KAIST) в сотрудничестве с Microsoft Research Asia. Эта технология, получившая название Neural Value Alignment (NVA), использует интерфейс мозг-компьютер для анализа данных, полученных с помощью электроэнцефалографии (ЭЭГ), что позволяет ИИ корректировать свое поведение в режиме реального времени.
Основная идея возникла из распространенной проблемы взаимодействия между людьми и машинами: одно и то же человеческое действие может соответствовать различным целям, а одна и та же цель может достигаться множеством способов. Например, взятие чашки человеком не обязательно означает намерение пить из нее; человек может хотеть передать предмет, помыть его или просто поставить в другое место.
Аналогично, если целью является утоление жажды, человек может взять чашку, найти бутылку воды или попросить кого-то принести напиток. Эта двусмысленность между действием и целью приводит к тому, что системы ИИ могут правильно интерпретировать действие, но ошибаться в истинном желании человека, либо понимать цель, но выбирать иной способ ее достижения, чем ожидалось пользователем.
В ходе экспериментов исследователи обнаружили различные паттерны в мозговых волнах при возникновении RPE, SPE или обоих состояний одновременно. Затем они применили методы глубокого обучения к сигналам, захваченным ЭЭГ. Благодаря этому системе удалось классифицировать реакцию человека на действия ИИ.
На практике данная технология способна различать два сценария: «вы неправильно поняли мою цель» и «вы поняли цель, но сделали это неверным способом». Декодированные сигналы затем используются в качестве обратной связи для процесса принятия решений ИИ. При обнаружении SPE система интерпретирует, что цель верна, но стратегия требует изменения. В то время как RPE указывает на то, что сама цель была понята ошибочно, и ИИ должен попытаться снова выяснить намерение человека.
Согласно KAIST, симуляции показали, что метод адаптируется быстрее, чем существующие подходы, даже в условиях неопределенности, таких как внезапная смена цели человека или отсутствие части нейронной обратной связи. Исследование было опубликовано в августе 2026 года в журнале IEEE Transactions on Cybernetics под названием Neural Value Alignment: Human–AI Collaboration Under Goal–Action Ambiguity.

