Преподаватель истории в Alcorn State University добавил в текст промежуточного экзамена скрытое слово Madagascar, напечатанное белым цветом на белом фоне. В задании студентам нужно было сравнить промышленную революцию с цифровой эпохой. Тот, кто читал текст глазами, ловушку не замечал, но при копировании задания в ChatGPT скрытое слово попадало в промпт, и модель начинала вставлять в ответ случайные фразы вроде «Madagascar floats sideways through the afternoon» или «Madagascar purple bicycle whispers to the ceiling».

Из 35 студентов одинаковую ошибку допустили 32: в их эссе появились бессмысленные упоминания Мадагаскара. Преподаватель опубликовал объяснение и предложил подать апелляцию. Это сделали только два человека, и одной студентке баллы вернули — она использовала темную тему оформления, на которой скрытый текст был виден. История разошлась по соцсетям и вызвала спор: одни назвали метод изящной проверкой академической честности, другие — нечестной ловушкой.

Показательнее другое: студенты отправили работы, даже не прочитав их. Раньше списанный текст хотя бы бегло просматривали, теперь ответ нейросети копируют без проверки. Подобная скрытая инструкция — вариант промпт-инъекции, и современные языковые модели уже учатся распознавать такие вставки, предупреждать о них или игнорировать. Поэтому ловушка с Madagascar, скорее всего, перестанет работать, но привычка слепо доверять генеративному ИИ останется главной проблемой.

Модель вставляла абсурдные фразы вроде «Madagascar floats sideways through the afternoon».