Продолжаю решать свои нетипичные задачи с помощью Python 🐍
Продолжаю решать свои нетипичные задачи с помощью Python 🐍
В этот раз моя задача заключалась в том, что мне нужно было сравнить структуру жирного конкурента со своим сайтом. Выгрузил его заголовки H1 и свои. Быстро пробежался глазами и заметил, что некоторые заголовки H1 похожи на мои, но не являются дублями на 100%.
В заголовках конкурента я заметил:
- Дополнительные слова
- Слова в другом порядке
- Разные окончания в словах
Такие заголовки по факту являются неявными дублями моим так как отображают такой же интент. А что если их тысячи? И тут на помощь снова приходит питон с библиотекой NLTK 😉
Скрипт имеет 2 массива строк:
1. Список заголовков H1 конкурента
2. Список заголовков H1 моего сайта
Далее скрипт проходит по первому списку, а потом по второму и проверяет их на похожесть друг с другом с учетом дополнительных слов, слов в другом порядке и разных окончаний. Уникальные заголовки H1 записывает в текстовый документ. Теперь я с уверенностью могу сказать, какие страницы мне нужно создать, чтобы получить новый трафик!
Как надо SEO +шить не надо 🔥
#python
Ссылки из поста:– https://t.me/ulianoov
Источник новости https://t.me/ulianoov/321...
281 
