Китайскиеученыеутверждают, что нашли доказательства того, что большие языковые модели (Lms) могут понимать и обрабатывать природные объекты, такие как люди. Они предполагают, что это происходит спонтанно, даже без специального обучения.

По словам исследователей из Китайской академии наук и Южно-Китайского технологического университета в Гуанчжоу, некоторые ИИ (такие как ChatGPT или Gemini) могут отражать ключевую часть человеческого познания, которая заключается в сортировке информации.

Их исследование, результаты которого опубликованыв  журналеNature Machine Intelligence, было посвящено изучению того, могут ли модели LLM развивать когнитивные процессы, аналогичные процессам представления объектов человеком. Или, другими словами, чтобы выяснить, могут ли Lms распознавать и классифицировать объекты на основе функций, эмоций, окружающей среды и т.д.

Чтобы выяснить, так ли это на самом деле, исследователи давали ИИ «случайные» задания, используя либо текст (для ChatGPT-3.5), либо изображения (для Gemini Pro Vision). С этой целью они собрали 4,7 миллиона откликов по 1854 природным объектам (таким как собаки, стулья, яблоки и автомобили). Они обнаружили, что из созданных моделей шестьдесят шесть концептуальных измерений были созданы для организации объектов так, как это сделали бы люди.

Эти параметры выходили за рамки базовых категорий (таких как «продукты питания») и охватывали сложные характеристики, включая текстуру, эмоциональную значимость и пригодность для детей.

Ученые также обнаружили, что мультимодальные модели (сочетающие текст и изображение) еще более тесно связаны с человеческим мышлением, поскольку ИИ обрабатывает как визуальные, так и семантические характеристики одновременно. Кроме того, команда обнаружила, что данные сканирования мозга (нейровизуализация) выявили совпадение между тем, как ИИ и человеческий мозг реагируют на объекты.