Долгое время считалось, что ChatGPT полагается на выдачу Google и Bing, не имея собственной поисковой базы. Однако технический анализ внутренней структуры сервиса показывает: OpenAI тайно разработала и развивает собственное семейство поисковых индексов под кодовым названием Labrador. Это не единая база данных, а комплекс вертикальных индексов, настроенных под конкретные типы контента: общий веб, PDF-документы, YouTube, новости (с разделением на временные слои: 24 часа, 7 дней, архив), arXiv, Wikipedia, локальный поиск, финансы, юриспруденция, медицина, товары и изображения. В индексе хранятся полные тексты страниц, даты обхода и публикации — архитектура, аналогичная той, что Google выстраивал десятилетиями.
Существование Labrador подтверждается несколькими фактами. С 21 мая по 21 июля 2026 года в потоке серверных событий ChatGPT передавалось поле result_source, которое принимало четыре значения: три сторонних краулера (Bright, Oxylabs, SERP) и Labrador. Кроме того, независимый эксперимент показал, что поисковый робот OpenAI обходит сайты со скоростью 35 000 запросов в час: тестовый сайт объемом 1 миллиард страниц был обработан более чем на 6 миллионов страниц к началу сентября 2026 года. В режиме изоляции, когда живой поиск отключен, ChatGPT продолжает выдавать точные копии главных страниц крупных изданий, что указывает на использование внутреннего кэша. В вакансиях OpenAI для инженеров поисковых систем упоминаются базы данных эксабайтного масштаба и гибридный поиск, объединяющий BM25 и векторный поиск.
| Вертикаль | Тип контента |
|---|---|
| General web | Общие веб-страницы |
| PDF-документы | |
| YouTube | Видео |
| News | Новости (24 часа, 7 дней, архив) |
| arXiv | Научные публикации |
| Wikipedia | Статьи Wikipedia |
| Local | Локальный поиск |
| Finance | Финансовые данные и PDF |
| Legal | Юридические документы |
| Medical | Медицинская информация |
| Shopping | Товары |
| Images | Изображения |
Разработка Labrador началась не вчера. В 2024 году на антимонопольном процессе против Google руководитель направления ChatGPT Ник Терли под присягой раскрыл, что OpenAI проектировала индекс с 2023 года. Первоначальный план был амбициозным: закрывать 80% запросов собственным индексом к концу 2023 года, но этого не произошло. Разработка ускорилась из-за отказа Google продавать данные. Терли оценил, что даже при идеальных условиях потребуется не менее 5 лет совместной работы с крупным поисковиком, чтобы оценить возможность полного отказа от внешних источников.
В период с 21 мая по 21 июля 2026 года в SSE-данных ChatGPT передавалось поле result_source, где Labrador значился наравне со сторонними краулерами Bright, Oxylabs и SERP.
Наиболее активно Labrador тестируется в товарной вертикали. В середине августа 2026 года в коде ChatGPT обнаружен A/B-тест prefer-index-over-serp-v3, затрагивающий 8% всех чатов. Технологический стек товарного поиска включает BM25 для отбора стартовых 10 источников, модели rerank400 и prod400 для формирования пула из 400 товаров-кандидатов, а также векторные модели ann4096 и ann12288 с размерностями 4 096 и 12 288. Это позволяет ChatGPT ранжировать товары без обращения к внешним поисковикам.
Пока неизвестно, когда OpenAI полностью откажется от сторонних провайдеров. Однако активное развитие Labrador и тесты в товарной вертикали указывают на стратегический курс на независимость. Для пользователей это может означать более быстрые и релевантные ответы, а для рынка поиска — появление нового крупного игрока, способного составить конкуренцию Google.

