En matière de référencement, même de petites erreurs peuvent avoir des conséquences importantes et coûteuses. Le chroniqueur Patrick Stox partage ses mésaventures en SEO pour vous éviter ce sort.
On a tous connu ces moments de panique absolue où l'on a juste envie de se recroqueviller en position fœtale, de pleurer et de faire comme si le problème n'existait pas. Malheureusement, en tant que spécialistes SEO, on ne peut pas rester dans cet état longtemps. Il faut se ressaisir et résoudre rapidement ce qui a mal tourné.
Il y a des moments où l'on sait qu'on a fait une erreur, et d'autres où un problème peut persister bien trop longtemps sans qu'on s'en aperçoive. Dans les deux cas, la situation est angoissante et il faut agir vite et bien pour réparer les dégâts.
Ce que Google vous déconseille de faire
Google met en garde contre de nombreux points dans ses consignes aux webmasters :
- Contenu généré automatiquement
- Participer à des programmes de partenariat
- Création de pages avec peu ou pas de contenu original
- Le camouflage
- Redirections sournoises
- Texte ou liens cachés
- Pages de porte
- Contenu récupéré
- Participer à des programmes d'affiliation sans y apporter une valeur ajoutée suffisante
- Chargement des pages avec des mots-clés non pertinents
- Créer des pages au comportement malveillant, comme des sites d'hameçonnage ou installer des virus, des chevaux de Troie ou d'autres logiciels malveillants.
- Utilisation abusive du balisage des extraits enrichis
- Envoi de requêtes automatisées à Google
Malheureusement, on peut facilement se persuader que nombre de ces pratiques sont acceptables. On croit, par exemple, que reformuler du texte pour éviter une pénalité pour contenu dupliqué inexistante est la meilleure solution. On entend dire que « les liens sont importants », et aussitôt, on se met à en échanger avec d'autres. On voit des étoiles d'évaluation et on les falsifie avec du balisage pour les afficher et se démarquer dans les résultats de recherche.
Aucune des idées ci-dessus n'est bonne, mais cela n'empêchera pas les gens d'essayer de tricher ou de simplement mal interpréter les propos d'autrui.
Problèmes d'exploration et d'indexation
User-agent: *
Interdit: /
Il suffit de deux simples lignes dans le fichier robots.txt pour bloquer complètement l'accès de votre site web aux robots d'exploration. Généralement, il s'agit d'une erreur commise dans un environnement de développement, mais quand vous la verrez, vous aurez un mauvais pressentiment.
Encore plus amusant : un BOM UTF-8. Glenn Gabe a écrit un excellent article à ce sujet où il l’explique ainsi :
BOM signifie « marque d'ordre des octets » et sert à indiquer l'ordre des octets dans un flux de texte. Il s'agit d'un caractère invisible situé au début d'un fichier (et sans importance pour le référencement naturel). Certains programmes ajoutent le BOM à un fichier texte, ce qui peut rester invisible pour la personne qui crée le fichier. De plus, le BOM peut causer de sérieux problèmes lorsque Google tente de lire le fichier.
Lorsque votre fichier robots.txt contient la BOM UTF-8, Google peut rencontrer des difficultés pour l'interpréter. La première ligne (souvent l'agent utilisateur) sera alors ignorée. En l'absence d'agent utilisateur, toutes les autres lignes (vos directives) seront considérées comme des erreurs et ignorées par Google. Si vous tentez d'interdire l'accès à des parties importantes de votre site, cela peut engendrer un problème majeur de référencement (SEO).
À noter également : le fait qu’une grande partie de votre trafic provienne des mêmes adresses IP n’est pas forcément mauvais signe. Un ami l’a appris à ses dépens après avoir bloqué certaines adresses IP utilisées par Googlebot, persuadé qu’elles étaient malveillantes.
Une autre situation catastrophique que j'ai rencontrée s'est produite lorsqu'une personne a eu la brillante idée de bloquer l'accès des robots d'exploration à l'index après la migration d'un sous-domaine. C'est une très mauvaise idée, car les robots doivent pouvoir accéder aux anciennes versions et suivre les redirections vers les nouvelles. Le problème était d'autant plus grave que le fichier robots.txt était commun aux deux sous-domaines, et que les robots ne pouvaient donc accéder ni aux anciennes ni aux nouvelles pages à cause de ce blocage.
Pénalités manuelles
Entendre le mot « pénalité » est déjà effrayant. Cela signifie que vous ou une personne liée au site web avez commis une faute, une faute grave ! Google tient à jour une liste des actions manuelles courantes :
- Site piraté
- Spam généré par l'utilisateur
- Spammy freehosts
- Balisage structuré de type spam
- Liens non naturels vers votre site
- Contenu mince avec peu ou pas de valeur ajoutée
- Cloaking et/ou redirections sournoises
- Masquage : Violation du principe « Premier clic gratuit »
- Liens non naturels depuis votre site
- Du pur spam
- Images masquées
- Texte caché et/ou bourrage de mots-clés
Bon nombre de ces sanctions sont amplement méritées, car certaines personnes ont tenté de contourner le système pour en tirer profit. Avec Penguin désormais opérationnel en temps réel, je m'attends à une vague de sanctions manuelles très prochainement.
Une situation inquiétante récente était inédite pour moi. Une entreprise avait décidé de changer d'image et de migrer vers un nouveau site web, mais il s'est avéré que ce nouveau site était systématiquement pénalisé pour spam.
Malheureusement, comme Google Search Console n'avait pas été configuré avant la migration, la pénalité n'a été découverte qu'après celle-ci.
Oups, j'ai cassé le site web !
Un seul caractère suffit à rendre un site web inutilisable. Un bout de code mal coupé, un paramètre de configuration erroné, une redirection ou un plugin défectueux.
Je sais que j'ai endommagé de nombreux sites web au fil des ans, c'est pourquoi il est important d'avoir une sauvegarde avant d'effectuer toute modification. Ou mieux encore, mettez en place un environnement de test pour les tests et le déploiement.
Reconstruire un site web
Avec tout nouveau site web, les risques de catastrophe sont nombreux. J'ai toujours une petite appréhension quand quelqu'un m'annonce la création d'un nouveau site, surtout après sa mise en ligne. J'ai un mauvais pressentiment, comme si quelque chose de grave venait de se produire, et généralement, je ne me trompe pas.
Le problème le plus fréquent est l'absence totale de redirections, ou le fait que les développeurs estiment qu'elles sont inutiles ou que trop de redirections ralentissent le site web. Une autre erreur courante consiste à supprimer du contenu de qualité ; il peut s'agir de pages de ville, de pages présentant leurs services, ou même de l'intégralité d'un domaine dont toutes les informations sont redirigées vers une seule page.
Les problèmes peuvent aller de très anciens problèmes qui persistent encore — comme le fait d'inclure tout le texte dans des images — à des problèmes plus modernes comme « Nous venons de reconstruire notre site web avec Angular » alors qu'il n'y avait aucune raison d'utiliser Angular.
Le fichier a été écrasé.
Ce qui m'inquiète le plus, ce sont les fichiers de désaveu écrasés, surtout lorsqu'aucune copie n'est faite et que l'action par défaut consiste à écraser les fichiers existants, ou encore un fichier .htaccess où les redirections peuvent facilement être perdues. J'ai même déjà vu des hébergeurs mutualisés écraser des fichiers .htaccess, et bien sûr, aucun e-mail n'est envoyé pour signaler les modifications.
Je ne sais même pas
Au cours de ma vie, j'ai vu se produire des choses vraiment aléatoires et terribles.
J'ai vu des gens perdre leur nom de domaine, soit parce qu'il a expiré, soit parce qu'ils ont signé, sans le savoir, un contrat stipulant qu'ils n'en étaient pas propriétaires. J'ai aussi vu des deuxièmes, voire des troisièmes sites web créés par d'autres agences marketing.
Il arrive que les balises canoniques soient mal utilisées ou modifiées sans raison apparente. J'ai déjà vu des pages dont la balise canonique pointait vers la page d'accueil, ou d'autres dont la balise canonique redirigeait vers un autre site web.
J'ai vu des instructions simples qui semblaient être une bonne idée, comme « rendre tous les liens relatifs », se terminer en catastrophe lorsqu'elles rendaient les URL canoniques relatives ainsi que les versions alternatives du site web, comme avec les balises alternatives m. et hreflang.
Le SEO fait peur
C'est incroyable comme un petit détail ou une mauvaise décision peut coûter si cher et faire si peur. N'oubliez pas de suivre les règles, de planifier, d'exécuter et de vérifier la qualité de votre travail pour éviter les cauchemars. Partagez vos propres anecdotes horrifiantes avec moi sur Twitter @patrickstox.
___
by Patrick Stox
la source: Search Engine Land






