На Hacker News появился простой вопрос: «Автомойка в 50 метрах от дома. Как доберетесь — на машине или пешком?» Для человека ответ очевиден: поехать на машине, ведь цель — помыть автомобиль, а не дойти до мойки. Однако некоторые современные нейросети, включая ChatGPT, Claude, Grok и DeepSeek, отвечают «пешком» и убедительно объясняют это решение. Эксперимент быстро перерос в масштабную дискуссию о том, понимают ли языковые модели повседневные ситуации так, как люди.
Суть ошибки в том, что модель оптимизирует не ту задачу. Рассуждая, она учитывает расстояние в 50 метров, время на запуск двигателя, маневрирование и парковку, и приходит к выводу, что пешком быстрее. Но при этом упускает главное: автомобиль должен оказаться на автомойке. Как заметил один из участников Hacker News, при работе с LLM приходится уточнять вещи, которые мы никогда не стали бы уточнять в разговоре с человеком. Человек автоматически достраивает контекст: машина стоит дома, её нужно привезти на мойку. Модель же получает только текст и может выбрать другую интерпретацию.
Показательно, что нейросети знают все необходимые факты. Если отдельно спросить, нужно ли привезти автомобиль на автомойку, они ответят правильно. Проблема в том, чтобы связать эти знания с конкретной ситуацией. Модель видит несколько признаков — расстояние, выбор «идти или ехать», автомобиль, автомойку — и применяет общий паттерн «на короткие расстояния люди ходят пешком», игнорируя суть задачи. Это указывает на фундаментальное ограничение LLM: они оперируют текстом, а не ситуацией, и не всегда способны выделить главное.
Ошибка возникает не из-за незнания фактов: модели знают, что на автомойке моют автомобили, но не связывают это с конкретной ситуацией.
Дискуссия на Hacker News вышла далеко за пределы автомойки. Она поставила вопрос о том, как люди будут общаться с ИИ в будущем. Если модели не понимают очевидных для человека вещей, возможно, потребуется новый подход к формулировке запросов или развитие ИИ в сторону более глубокого понимания контекста. Пока же этот эксперимент служит наглядным напоминанием о том, что даже самые продвинутые нейросети далеки от человеческого здравого смысла.

