🤖 ChatGPT втайне построил собственный поисковик: что такое Labrador?
🤖 ChatGPT втайне построил собственный поисковик: что такое Labrador?
Долгое время в SEO-сообществе считалось, что ChatGPT не имеет собственной поисковой базы и полностью зависит от выдачи Google или Bing. Это оказалось мифом. Анализ внутренних процессов показывает, что OpenAI разработала масштабную независимую поисковую архитектуру.
📂 Что известно о секретном индексе?
Кодовое имя — Labrador. Это не просто одна база данных, а целое семейство специализированных вертикальных индексов.
Направления поиска: Веб-страницы распределены по тематическим слоям:
общий веб, PDF-документы, YouTube, Википедия, академический архив arXiv, новости (с разделением по свежести), медицина, юриспруденция, финансы, товары (Shopping) и изображения. Индекс хранит полные тексты страниц, даты их обхода роботом и даты публикации.
Эксабайтный масштаб: Согласно вакансиям OpenAI, их поисковые системы проектируются под работу на эксабайтном масштабе. Команда нанимает инженеров для разработки гибридного поиска, сочетающего классический текстовый алгоритм ранжирования (BM25) и векторный поиск по эмбеддингам.
Агрессивный кэш вместо «живого» поиска: Около 58% сайтов в интернете загружаются дольше 0,8 секунды, что слишком медленно для масштабов ChatGPT. Чтобы ускорить ответы, OpenAI кэширует страницы.
🔍 Откуда появились доказательства?
След в серверном коде: С мая по июль 2026 года во внутренних данных ChatGPT (SSE-событиях) передавалось скрытое поле result_source. Наряду с внешними парсерами там фигурировал Labrador.
Показания под присягой: Руководитель ChatGPT Ник Терли на судебных слушаниях против Google признался, что разработка собственного индекса началась еще в 2023 году. Изначально OpenAI ставила сверхагрессивную цель — закрывать своими силами 80% поисковых запросов уже к концу 2023 года.
Эксперименты в реальном времени: Прямо сейчас идет масштабное A/B-тестирование товарного индекса (Shopping). Тест «prefer-index-over-serp-v3» (приоритет собственного индекса над внешними парсерами) затронул около 8% всех чатов пользователей.
🛰 Внешние провайдеры больше не нужны? Пока нужны. Полный переход на автономный поиск — это долгий процесс, который может занять не менее 5 лет даже при наличии доступа к данным крупных поисковиков.
Сейчас ChatGPT склеивает выдачу своего индекса с результатами минимум 8 внешних каналов. В их числе: сторонние парсеры (Bright Data, Oxylabs), лицензионные соглашения с Yelp и TripAdvisor, а также поисковая платформа Web IQ от Microsoft.
💡 Что это значит для бизнеса и маркетологов?
Прекратите ориентироваться только на Bing. Видимость вашего сайта там не гарантирует автоматическое попадание в выдачу ChatGPT — здесь работают алгоритмы Labrador и Microsoft Web IQ, чья логика отличается от стандартного поиска.
Заполняйте Yelp и TripAdvisor. Если у вас локальный бизнес, ChatGPT использует эти платформы как официальных лицензированных партнеров.
Проверяйте свой кэш. Используйте режим строгой изоляции (Lockdown Mode) в настройках ChatGPT, чтобы проверить, какие именно страницы вашего сайта уже сохранены во внутреннем кэше OpenAI.
Ссылки из поста:– https://peec.ai/blog/chatgpt-built-its-own-search-...
Источник новости https://t.me/python_seo/89...
9 
