Если вам нравится SbUP Форум, вы можете поддержать его - BTC: bc1qppjcl3c2cyjazy6lepmrv3fh6ke9mxs7zpfky0 , TRC20 и ещё....

 

PDF и HTML - дубль контента или нет?

Автор kerio, 11-04-2018, 15:30:52

« назад - далее »

kerioTopic starter

Просветите, пожалуйста, как поисковики реагируют на дубли на одном сайте одного материала в форме pdf и html?

Есть Wordpress сайт, на котором много статей в pdf. Для теста перевел десяток pdf в html, не удаляя оригинальные pdf. Дало резкое увеличение траффика, за счет роста траффика с поисковиков на html, но и траффик на pdf так и не пропал за несколько месяцев. Канонических ссылок не прописывал. Сломал голову, отчего так происходит, ведь по идее это дубль контента и в теории поисковики такое не любят. Возможно, кому–то интересно читать именно в pdf и они кликают на них в поиске? Возможно дело в том, что description и title у pdf и html отличаются?

Значит ли это, что поисковики нормально относятся к дублям материалов в разном формате, и при переводе статей в html не надо удалять оригинальные pdf? Или же должно пройти больше времени, чем несколько месяцев, чтобы траффик на pdf срезался?
  •  


Sky-fi

А вы проверяли трафик в аналитиксе? Нет отличий по каким-то характерным признакам?
Моя рекомендация, раз все так хорошо - сделайте еще десяток, подождите 2-4 месяца, если трафик поднимется - продолжайте в том же духе.
Но в теории html файлы не имеют особых отличий от pdf или привилегий в ранжировании. Так что если поднялся трафик по тем же запросам, pdf файлы должны просесть.
Похоже на то, что у вас пдф и хтмл попадают в топ по разным запросам, потому и увеличивается трафик.


#vikup34

подписываюсь на тему...

любопытный момент. Заинтересовало.

Coder

Несмотря на дату...
ЦитироватьВопрос: Рассматривается ли существование страниц как в HTML, так и в PDF как дублирование контента?

Ответ: Насколько это возможно, мы рекомендуем предоставление единственной копии контента. Если это невозможно, убедитесь, что вы указали предпочтительную версию, например, указав предпочтительную URL в Sitemap или определив каноническую версию в HTML или HTTP заготовках PDF.
_https://www.searchengines.ru/faq_google.html

kerioTopic starter

Спасибо большое за ответ! Я очень долго пытался на форумах получить какие-то соображения на эту тему, но везде ничего внятного.

Прошу прощения за паузу с собственным ответом.

По ранжированию pdf - несмотря на официальные утверждения, что они ранжируются одинаково с pdf это не похоже на правду. Во-первых, у них меньше настроек. Во-вторых, и те настройки, что есть у pdf, вряд ли кто будет заполнять (скажем, вбивать вменяемые названия картинок и тому подобное), так как по факту делают их люди, не понимающие задач SEO. В-третьих, yandex тупо открывает pdf в браузере, не переводя на сайт (даже если pdf встроен в какую-то из его страниц). Т.е. теряется брендинг сайта, теряется возможность конверсии в подписчиков, глубина просмотра и так далее. В-четвертых, у pdf из-за специфики сайта нельзя прописать человеческие и интересные description, а у html можно, это даёт ощутимый скачок в росте. Но судя по тестам (хотя и с маленькой выборкой) даже перевод в html с тем же описаниям даёт некоторый выигрыш.

Попробовал выявить разницу через аналитикс - слишком мелкая выборка. Похоже, что в первую очередь разница за счет нормальных title\description.

Спасибо на faq от гугла, не видел этой информации.
  •  


Coder

Цитата: kerio от 13-04-2018, 22:03:48Спасибо на faq от гугла, не видел этой информации.

)Пожалуйста

alexakap

pdf очень интересная тема и я активно использую при продвижении сайтов некоторые фишки, связанные с pdf дoкументами. Гугл отлично понимает содержимое дoкументов и хорошо их индексирует. Яндекс вряд ли понимает содержимое и плохо индексирует эти дoкументы. pdf и html в принципе могут существовать в поисковиках на равных правах, но в pdf нельзя указать например альты картинок, сделать микроразметку заголовков, дат, цен и другого текста. Т.е. какие то важные параметры ранжирования страницы отпадают. Поэтому для CЧ и ВЧ запросов нет смысла делать pdf. По вопросу дублей. Гугл может выдать в ВМ ошибку по дублю тайтла, если у pdf и html дoкумента они совпадают, других ошибок не видел
  •  

kerioTopic starter

О, спасибо большое за реальный опыт! Очень интересно, что единственной ошибкой на практике было совпадение в тайтле.
  •  


zanuda

Цитата: alexakap от 13-04-2018, 22:37:25я активно использую при продвижении сайтов некоторые фишки, связанные с pdf дoкументами
А поподробнее можно? Типа, что в pdf можно линки вставлять и таким образом поиметь бэклинки, знаю. Что-то еще?
  •  

alexakap

Цитата: zanuda от 16-04-2018, 10:37:41
А поподробнее можно? Типа, что в pdf можно линки вставлять и таким образом поиметь бэклинки, знаю. Что-то еще?
Ну да, т.к. pdf тырят не ура, делаю дoкумент под СЧ/НЧ запрос не высокой конкурентности и ставлю несколько анкорных ссылок на свои ключи. дoкументы расходятся как горячие пирожки. Особенно технические и нормативные дoкументы
  •  



Если вам нравится SbUP Форум, вы можете поддержать его - BTC: bc1qppjcl3c2cyjazy6lepmrv3fh6ke9mxs7zpfky0 , TRC20 и ещё....