Логи WebSocket фиксируют: ChatGPT Deep Research читает исходный...
Логи WebSocket фиксируют: ChatGPT Deep Research читает исходный код строго сверху вниз, а навигация съедает бюджет
Deep Research транслирует всю свою сессию обратно клиенту через WebSocket: каждый запрос, каждую открытую страницу, вытянутый сырой текст и цепочку рассуждений.
Запись логов в DevTools с 10+ аккаунтов (по ~20 запросов на каждом) вскрывает, как именно читает агент и на чем сайты теряют это чтение.
Бот читает HTML строго линейно сверху вниз: выкидывает <head>, игнорирует JavaScript.
Порядок в исходном коде решает, что влезет в лимит, а не позиция на экране: меню, которое CSS отрисовывает наверху, но висящее в конце кода, не стоит ничего; а ответ, зарытый после массивного блока навигации, может вообще не попасть в первое чтение.
Это первое чтение ограничено ~5700 символами (медиана, максимум — ~8000).
Каждая ссылка отрисовывается инлайн как маркер 【n†anchor†url】, который тратит тот же бюджет.
Метрика по количеству ссылок: до 20 ссылок оставляет ~78% лимита под ваш контент; 20-59 ссылок (стандарт для большинства страниц) снижает долю до ~55%; 60+ ссылок оставляет всего ~33% — две трети лимита сжирают меню до того, как агент дойдет до ответа.
Ссылка "Skip to main content" не спасает: для ее активации нужен клик, а Deep Research не кликает вообще (команда click использовалась ровно ноль раз за все записанные сессии).
Всё управляется тремя командами: search (читает сниппеты Bing через webwithbing, никакого Google), open (беглое чтение) и find (Ctrl+F внутри открытой страницы).
Успешный find — главный триггер перечитывания; в 95% случаев выборки страница открывается заново ровно на найденной строке.
Если искомого термина нет на странице буквально, агент пробует другой ключ или уходит; поэтому точное вхождение слова в тексте гарантирует второе чтение.
Ещё два рычага, которые упускает большинство команд.
Атрибуты alt отрисовываются как обычный текст — это единственное, что бот читает из картинок: бейдж с прописанным альтом закидывает факт прямо в ответ, тогда как alt="" пропускается как декор.
Данные тянет юзер-агент OAI-SearchBot, он работает отдельно от GPTBot (сбор данных для обучения моделей); разблокировка одного ничего не дает другому.
Блокировка в robots.txt отдает боту viewing lines [0 - 0] of 0: ноль контента, и страница молча выпадает из финального отчета.
Механика (поиск через Bing, три команды, ноль кликов, лимит окна, чтение альтов) фиксируется стабильно; точные цифры — это срез на июнь 2026 года для платформы, которую OpenAI постоянно обновляет.
https://peec.ai/blog/how-chatgpt-deep-research-reads-your-site-what-the-logs-reveal
@MikeBlazerX
⚠️ Закрытый канал: @MikeBlazerPRO

– https://t.me/MikeBlazerX
– https://t.me/tribute/app?startapp=sE4X
Источник новости https://t.me/mikeblazerx/6566...
3 
