Некоторые мысли с презентации Майка Кинга с самита MnSearch...
225
Некоторые мысли с презентации Майка Кинга с самита MnSearch, записанные Рут Берр Риди:
— Исследования показывают, что Google индексирует 0,03% Интернета. По их мнению, 60% веб-сайтов являются дубликатами. Поэтому многие сайты просто не индексируются. В настоящее время Google очень жестко экономит на индексации, и она будет ухудшаться благодаря генеративному искусственному интеллекту.
— Google утверждает, что краулингово бюджета - нет, но они смотрят на спрос на сканирование: если страница более ценная, они будут сканировать ее чаще. Внутренние ссылки очень важны.
— Хак генеративного искусственного интеллекта для увеличения скорости сканирования страницы: создайте для страницы резюме TL;DR и часто его меняйте.
— XML-карты сайта имеют отдельную систему сканирования. Google также ищет дифференциальные карты сайта - небольшие карты сайта, которые часто обновляются.
— Google может прекратить сканирование на основе шаблонов URL. Вот почему так важно предоставлять то, что имеет ценность, и не индексировать не представляющий ценности контент.
— Большинство сайтов не последовательно используют сигналы из Schema или LastMod для сигнализации изменений. Гугл смотрит на то, как часто страница изменялась в прошлом, и основывает частоту сканирования на этом.
— С начала 2000-х годов у нас есть правило, что поисковые системы проникают только на 5 уровней вглубь. Но в настоящее время это правило устарело, поскольку инфраструктура поиска стала намного более надежной.
— Google не переходит от страницы к странице и не краулит от ссылки к ссылке. Он просто собирает список URL-адресов и помещает их в очередь. Google не загружает страницу и не переходит по каждой ссылке, он расставляет приоритеты, основываясь на том, что считает более важным.
— Краулинг не имеет состояний - краулер не хранит куки или какие-либо другие состояния. Каждая загрузка страницы происходит так, как будто это первая загрузка.
— Все SEO-инструменты все еще застряли на лексической модели. По сути, все SEO-программы, которые вы используете, устарели уже 10 лет назад.
— Плотный поиск - Google теперь может понять, какой раздел вашей страницы релевантен запросу. Именно так они могут делать такие вещи, как выделение отрывков в рич сниппетах.
— Релевантность - это функция косинусного сходства. Это количественная мера, а не качественная, как обычно думают/говорят об этом SEO-специалисты.
— Google превращает сайты в векторы. У них есть векторы и для авторов. Это означает, что вы хотите строить ссылки контекстно. Google может понять релевантность с обеих сторон ссылки.
— Word2Vec потерпел неудачу, поскольку он улавливал связи между словами, но не контекст. BERT улучшил W2V за счет учета контекста.
— TF-IDF - это разреженный вектор: он не отражает так много информации, только наличие или отсутствие слов. Word2Vec дал нам плотные векторы, рассматривающие термины более детально.
— То, как вы строите предложения, может быть использовано для улучшения или подтверждения понимания Google о данной сущности. Когда они видят последовательные атрибуты для именованных сущностей, они будут учитывать это в понимании сущности.
-
И еще несколько с презентации Макса Прина:
— Google, как правило, не учитывает канонические теги. Если вы синдицируете свой контент третьим сторонам, это еще хуже, потому что если у третьей стороны больше авторитета, Google, вероятно, проигнорирует канонический тег.
— Если у вас в GSC более 1K карт сайта, вы не получите данных по ним - GSC предоставит информацию только о самых старых 1000.
— Когда вы смотрите на данные CrUX, они агрегируются по посещениям сайта. Если посмотреть на отчеты GSC, то они агрегируются по страницам. Google группирует и экстраполирует эти агрегированные данные.
— Помните, что ваши CWV и Page Experience проценты в GSC - это % страниц, а не % трафика. Если у вас большой % страниц, на которые приходится небольшой % трафика, эти цифры могут не отражать реальный опыт пользователей.
Источник фотки
@MikeBlazerX

– https://twitter.com/ruthburr/status/16697090315003...
– https://twitter.com/marthavanberkel/status/1669705...
Источник новости https://t.me/mikeblazerx/1785...

