Французская команда RESONEO собрала корпус из 1249 ответов ChatGPT и 88 000 результатов поиска в них. Захваты делали с июля по август, вопросы задавали с флота аккаунтов — бесплатных, платных и разлогиненных, из разных стран. Вывод, который касается любого владельца сайта: в быстром режиме, без нажатой кнопки «Think», ChatGPT открывает страницу живьём только в 7% ответов. В остальных 93% в дело идёт готовая карточка — заголовок целиком (зафиксированы 289 знаков) и сниппет на 200 знаков, вырезанный задолго до вопроса.

Карточка собирается один раз, при обходе. Сниппет вырезают от H1 и того, что стоит визуально рядом: категория, alt картинки, дата, автор, оглавление. Отбора под смысл вопроса тут нет — вопроса ещё не существует. Следствие для больших страниц неприятное: таблица характеристик, раздел про доставку и блок с ценами со второго экрана до ИИ-модели не доезжают. Посмотрите, что стоит в первых двух-трёх элементах после вашего H1: хлебная крошка, дата и подпись автора и есть то, чем сайт представляется в 93% ответов. Один и тот же сниппет уходит и в ответ про цену, и в ответ про доставку. Meta description на этом пути игнорируется полностью: он писался под поисковую выдачу, где сниппет пересобирают под запрос, а в индексе OpenAI эта роль занята текстом со страницы. По захватам RESONEO он идёт в дело в одном случае из трёх и только для результатов из выдачи Google, снятой скрейпингом.

РежимДоля источников из индекса OpenAIДоля источников из GoogleЧисло URL на разговор
Быстрый, без «Think»большинствоменьшинство15,1
Размышление, бесплатный аккаунт74,7%25,3%35,3
Размышление, платный аккаунт24,7%75,3%35,1

Кнопка «Think» переворачивает корпус. В режиме размышления страница открывается по-настоящему, и около 75% URL приходят из выдачи Google, лишь четверть — из индекса OpenAI. Источников заметно больше, порядка 28 доменов на разговор. Бесплатный аккаунт с нажатой кнопкой «Think» даёт 35,3 URL против 35,1 у платного режима размышления, а состав зеркальный: у бесплатного 74,7% источников идёт через собственный индекс, у платного 75,3% — через Google. Один клик удваивает число источников, с 15,1 до 35,3 URL, без смены тарифа. Совет купить подписку бьёт не туда: корпус выбирает режим ответа. Режим ответа меняет корпус источников сильнее, чем тариф.

Карточка собирается один раз при обходе: заголовок до 289 знаков и сниппет на 200 знаков, вырезанный из H1 и соседних элементов.

Бюджет поиска у платного режима размышления сократился почти вдвое между 26 и 31 июля, с 47,2 до 33,9 URL, — до выхода новой версии модели 6 августа. Менялась поисковая инфраструктура, а не модель.

Там, где страница всё-таки открывается — режим размышления и те самые 7% быстрых ответов, — её переводят в текстовый формат. Из HTML выбрасывают <script>, <iframe> и JSON-LD целиком: разметка, которую ставят специально для машин, до ИИ-модели не доходит ни одним полем. Alt-текст картинок и текст, скрытый CSS-стилями, наоборот, сохраняются. Ещё у страницы есть жёсткий лимит 4 МБ: превышение даёт HTTP 400 и отказ от чтения целиком — не усечение, а ноль. Прочитанное кладётся в общий кэш: копия свежа около 30 минут, дальше отдаётся устаревшая версия, а обновление идёт в фоне. В корпусе RESONEO попадались копии спустя 90 с лишним дней после обхода, а Cache-Control: no-store и noindex этот слой игнорирует.

Снимать разметку из-за этого не надо, её читают Google и Яндекс. Вопрос в другом: где ещё, кроме неё, лежит тот же факт. Если цена, срок доставки или характеристика есть только в JSON-LD или meta description, для ChatGPT в быстром режиме их не существует. Их стоит продублировать в видимом тексте рядом с H1 — там, откуда сниппет и вырезается.

Методика RESONEO опирается на служебную пометку, которая появилась в мае в потоке ответов ChatGPT: у каждого источника указано, откуда он взят — собственный индекс OpenAI или один из трёх внешних поставщиков скрейпинга. Пометку независимо заметили минимум пять человек, а команда проверила её на своём домене: подняли страницы с уникальным отпечатком и смотрели, приходил ли за ними робот. Поток ответов писали расширением браузера, рядом разобрали серверные логи на 325 000 адресов за три месяца. Отдельно модель спрашивали с принудительно отключённым живым доступом в сеть — так видно, что у неё уже лежит в кэше, а за чем она идёт в интернет.