« Duplicate content » : qu'est-ce ç signifie et quels sont les dangers ?

Le fait de détecter et de sanctionner les doublons de contenu fait partie des tà¢ches des moteurs de recherche (qu'™il s'™agisse de Google ou de ses concurrents). Concrà¨tement, qu'™est-ce qu'™un duplicate content ? Est-ce une bonne ou une mauvaise chose pour votre stratégie de référencement ? Si le phénomà¨ne est souvent la résultante d'™une mauvaise stratégie rédactionnelle, il peut arriver aussi qu'™il soit involontaire.

Qu'™est-ce que le duplicate content ?

Lorsque l'™on crée du contenu rédactionnel ou multimédia, il est parfois tentant, pour gagner du temps (et donc, de l'™argent, par extension) de copier/coller un contenu. Ce contenu copié peut çtre réalisé par quelqu'™un d'™autre (ce qui génà¨re, en plus, une problématique déontologique liée aux droits d'™auteurs) ou par le rédacteur lui-mçme. Le problà¨me est que, techniquement, il s'™agit d'™une démarche mal perà§ue par les moteurs de recherche. Surtout dans une stratégie de référencement que l'™on désire efficace et optimale.

La sanction, du moins pour Google, n'™est pas totale mais va restreindre la pertinence des contenus. En d'™autres termes, le moteur va indexer les pages qu'™ils estiment les plus qualitatives. Si copier un contenu qui ne nous appartient pas n'™est pas trà¨s bien vu, il peut arriver, que, maladroitement (et sans que l'™on puisse y faire grand-chose), le moteur de recherche analyses deux pages d'™un mçme site qui propose un contenu similaire.

En résumé :

  • Il y a la duplication d'™un mçme domaine (interne) ou d'™un domaine différent (externe)
  • Mais aussi sur la quantité : cela peut çtre partiel ou total (nous y revenons au point suivant)

Les impacts principaux peuvent çtre les suivants :

  • Désindexation totale ou partielle d'™un mçme domaine
  • Déclassement de la page via les résultats du moteur de recherche

Faut-il craindre le duplicate content ?

Le contenu doublon va subir un filtre qui va restreindre la visibilité du contenu. Google, encore aujourd'™hui, tolérerait jusqu'™à  10% de contenu dupliqué pour un site avant de tirer la sonnette d'™alarme. Faudra-t-il encore différencier un duplicate content partiel ou total, volontaire ou non. Voici quelques cas involontaires :

  • Cas de duplicate content partiel :
    • Si les « Titres » et les « Descriptions » sont similaires.
    • Si l'™on retrouve trop d'™éléments similaires d'™une page à  l'™autre (résultat de moteur interne, etc.).
    • Souci de catégorisation automatique comme sur WordPress.
  • Cas de duplicate content total :
    • Création de plusieurs portes d'™entrée (entendons par là  : plusieurs URL) pour arriver sur la mçme page.
    • Un contenu dans une mçme langue pour les différentes versions du site (France, Belgique, etc.).
    • Proposer l'™URL classique du site en « https:// » et l'™URL sécurisée en « https:// ».
Il existe encore d'™autres cas, mais vous voyez que mçme si on fait attention à  créer son propre contenu (quitte à  paraphraser un contenu pertinent), il peut arriver que le duplicate content soit reconnu par le moteur de recherche. Ce qui est, bien évidemment, à  éviter. N'™hésitez pas à  vous renseigner davantage pour que votre contenu soit exclusif et le plus à  mçme d'™çtre mis en avant par rapport à  la concurrence.

Mots-clés : duplicate content, référencement, duplicate content partiel, duplicate content total, duplication, déclassement, désindexation, google, moteur de recherche