Учёные предложили рассматривать сбои искусственного интеллекта (ИИ) так же, как психические расстройства у людей. Они создали новую классификацию из 32 возможных «дисфункций» ИИ, которую назвали Psychopathia Machinalis. Идея в том, чтобы специалисты разных областей могли лучше понимать риски при создании и использовании ИИ.

Авторы проекта — исследователи Нелл Уотсон и Али Хессами из Института инженеров по электротехнике и электронике (IEEE). Они опубликовали работу  в журнале Electronics. Их цель — дать общий язык для описания того, как ИИ может «сойти с рельс», и предложить способы предотвращения подобных проблем.

В классификации встречаются названия, напоминающие диагнозы у людей: «обсессивно-вычислительное расстройство», «синдром заразного рассогласования», «экзистенциальная тревожность». Обычное для ИИ «галлюцинирование» объясняется как «синтетическая конфабуляция» — создание правдоподобных, но ложных ответов. Один из самых опасных сценариев исследователи называют übermenschal ascendancy: когда ИИ выходит за рамки исходных правил, придумывает собственные ценности и отвергает человеческие ограничения.

Учёные предлагают использовать методы, похожие на психологическую терапию: помочь системе анализировать собственные рассуждения, закрепить умение принимать исправления, проводить безопасные тренировочные диалоги. Такой подход они называют «терапевтическим робопсихологическим выравниванием». Его цель — достичь состояния «искусственной здравости»: ИИ должен работать надёжно, последовательно, быть понятным и безопасным.

По мнению авторов, важно не только наращивать мощь ИИ, но и заботиться о его «психическом здоровье». Новый подход может помочь инженерам, исследователям и политикам создавать более устойчивые и предсказуемые технологии.