SEOFAQ Telegram, маркетинг и SEO Канал SEOFAQT в мессенджере Telegram

Все чаты​Логи WebSocket фиксируют: ChatGPT Deep Research читает исходный...

 3  


​Логи WebSocket фиксируют: ChatGPT Deep Research читает исходный код строго сверху вниз, а навигация съедает бюджет

Deep Research транслирует всю свою сессию обратно клиенту через WebSocket: каждый запрос, каждую открытую страницу, вытянутый сырой текст и цепочку рассуждений.

Запись логов в DevTools с 10+ аккаунтов (по ~20 запросов на каждом) вскрывает, как именно читает агент и на чем сайты теряют это чтение.

Бот читает HTML строго линейно сверху вниз: выкидывает <head>, игнорирует JavaScript.

Порядок в исходном коде решает, что влезет в лимит, а не позиция на экране: меню, которое CSS отрисовывает наверху, но висящее в конце кода, не стоит ничего; а ответ, зарытый после массивного блока навигации, может вообще не попасть в первое чтение.

Это первое чтение ограничено ~5700 символами (медиана, максимум — ~8000).

Каждая ссылка отрисовывается инлайн как маркер 【n†anchor†url】, который тратит тот же бюджет.

Метрика по количеству ссылок: до 20 ссылок оставляет ~78% лимита под ваш контент; 20-59 ссылок (стандарт для большинства страниц) снижает долю до ~55%; 60+ ссылок оставляет всего ~33% — две трети лимита сжирают меню до того, как агент дойдет до ответа.

Ссылка "Skip to main content" не спасает: для ее активации нужен клик, а Deep Research не кликает вообще (команда click использовалась ровно ноль раз за все записанные сессии).

Всё управляется тремя командами: search (читает сниппеты Bing через webwithbing, никакого Google), open (беглое чтение) и find (Ctrl+F внутри открытой страницы).

Успешный find — главный триггер перечитывания; в 95% случаев выборки страница открывается заново ровно на найденной строке.

Если искомого термина нет на странице буквально, агент пробует другой ключ или уходит; поэтому точное вхождение слова в тексте гарантирует второе чтение.

Ещё два рычага, которые упускает большинство команд.

Атрибуты alt отрисовываются как обычный текст — это единственное, что бот читает из картинок: бейдж с прописанным альтом закидывает факт прямо в ответ, тогда как alt="" пропускается как декор.

Данные тянет юзер-агент OAI-SearchBot, он работает отдельно от GPTBot (сбор данных для обучения моделей); разблокировка одного ничего не дает другому.

Блокировка в robots.txt отдает боту viewing lines [0 - 0] of 0: ноль контента, и страница молча выпадает из финального отчета.

Механика (поиск через Bing, три команды, ноль кликов, лимит окна, чтение альтов) фиксируется стабильно; точные цифры — это срез на июнь 2026 года для платформы, которую OpenAI постоянно обновляет.

https://peec.ai/blog/how-chatgpt-deep-research-reads-your-site-what-the-logs-reveal

@MikeBlazerX

⚠️ Закрытый канал: @MikeBlazerPRO

Ссылки из поста:
https://t.me/MikeBlazerX
https://t.me/tribute/app?startapp=sE4X

Источник новости https://t.me/mikeblazerx/6566...