В статье на Habr под названием «Отличие языковой модели LLM от человека» автор, скрывающийся под ником, делится размышлениями о принципиальном различии между искусственными и биологическими языковыми моделями. Он утверждает, что LLM — это «статистическая машина», которая оперирует токенами, не имея модели мира. В качестве иллюстрации он приводит мысленный эксперимент с комнатой, где человек соединяет каракули по правилам, не понимая их значения.

Автор подчёркивает, что человек, в отличие от LLM, строит внутреннюю модель мира на основе образов, которые первичны, а слова — вторичны. Он ссылается на эволюцию: живые организмы выживали благодаря способности предсказывать будущее, моделируя мир. Слова же, по его мнению, — это абстрактный слой, который без привязки к образам остаётся «набором цифр». Он приводит пример изучения иностранного языка, когда слова сначала воспринимаются как «каракули», и лишь потом связываются с образами.

Автор решил проверить свои размышления, отправив текст в Claude 3.5 Sonnet. Ответ модели оказался неожиданно содержательным. Sonnet признала, что у неё нет модели мира: «Токен предсказывает токен. Референта нет». Однако она указала на неудобный момент: образ в мозге тоже не является «пониманием» — это паттерн активации нейронов. Где граница между паттерном и настоящим пониманием, никто не знает, и это нерешённая «трудная проблема сознания».

Человек строит модель мира на основе образов, а слова — вторичный слой, привязанный к ним.

Sonnet также отметила, что образ без категоризации — это шум, и понимание возникает на стыке образа и абстракции. Этот стык не является принципиальной привилегией биологии, пока не доказано обратное. Главный вопрос, который она подняла: где живёт смысл — в тексте, в интерпретаторе или между ними? Это не риторика, а реальная философская проблема, которая остаётся открытой.

Статья вызвала интерес в сообществе, поскольку затрагивает фундаментальные вопросы о природе ИИ и сознания. Автор не претендует на научную строгость, но его рассуждения перекликаются с дискуссиями о сильном и слабом ИИ, а также с работами по теории воплощённого познания. Пока LLM остаются инструментами для обработки текста, вопрос о том, могут ли они когда-либо обрести модель мира, остаётся открытым.