Pourquoi un mythe survit à son démenti
Un mythe qui survit a d'ordinaire trois choses pour lui. Il est peu coûteux à croire, parce qu'agir dessus revient à cocher une case et non à réécrire. Il est impossible à réfuter avec vos propres données, car une page qui se positionne après coup ne peut pas montrer ce qui serait arrivé autrement. Et il s'appuie sur une vraie corrélation : quelque chose de vrai se tient juste à côté, assez près pour lui prêter du crédit.
C'est ce dernier point qui fait qu'une contradiction frontale le tue rarement. Les pages longues se positionnent effectivement souvent mieux que les courtes ; simplement, la longueur est un symptôme d'un sujet traité, pas la cause du classement. Les sites aux domaines anciens se positionnent effectivement souvent mieux ; ils ont eu plus de temps pour gagner des liens et construire un historique. Séparez la corrélation de l'affirmation et la plupart cessent d'être discutables.
Des affirmations on-page sans rien derrière
Elles reviennent dans presque toute discussion d'audit, et Google a traité chacune directement plutôt que de les laisser au doute des praticiens.
| Affirmation | Ce que dit la documentation |
|---|---|
| La balise meta keywords aide | Inutilisée pour le classement, et déclaré ainsi depuis 2009 |
| Il existe un nombre de mots idéal | Aucune cible, ni minimum ni maximum |
| La densité de mots-clés a son bon chiffre | Ce chiffre n'existe pas ; le bourrage est du spam |
| Une page doit avoir exactement un H1 | Plusieurs titres de n'importe quel niveau conviennent |
| Les titres doivent suivre un ordre strict | Sauter un niveau ne pose aucun problème à la recherche |
| Il faut ajouter des « mots-clés LSI » | Rien que les systèmes de Google utilisent |
Les points sur les titres méritent un second regard, car c'est là que les outils d'audit font le plus de dégâts. Un correcteur qui retire des points pour deux H1 rapporte sa propre règle, pas celle du moteur. Les titres doivent décrire ce qu'il y a dessous, parce que cela aide à parcourir et montre la structure à une machine : une raison de bien les écrire, pas de courir après un chiffre.
La pénalité de contenu dupliqué
Elle n'existe pas. La position de Google est que le même contenu sous plusieurs URL ne justifie pas d'action contre un site, sauf si la duplication vise délibérément à tromper. Ce qui se produit normalement, c'est une consolidation : le moteur choisit une URL comme canonique et y replie les signaux des autres.
Cela ne rend pas la duplication gratuite. Elle coûte de deux façons, et toutes deux sont des problèmes de rangement avec une solution de rangement. Des signaux qui auraient dû s'accumuler sur une page se répartissent entre plusieurs quasi-copies. Et l'effort d'exploration part dans des pages qui n'ajoutent rien, ce qui pèse sur un grand site et reste invisible sur un petit.
La distinction mérite d'être tenue, car elle change entièrement la réparation. Une pénalité appellerait un retrait et une demande de réexamen. La consolidation appelle à déclarer vous-même la canonique au lieu de laisser le choix au moteur : une balise, pas des excuses.
Liens, domaines et argent
| Affirmation | Ce que dit la documentation |
|---|---|
| Acheter des Google Ads élève le classement naturel | Explicitement démenti ; les deux systèmes sont séparés |
| Les domaines anciens se classent mieux car anciens | L'ancienneté seule ne fait rien |
| Un mot-clé dans le domaine donne un coup de pouce | Très peu d'effet, réduit exprès en 2012 |
| nofollow permet de canaliser le PageRank interne | Le sculpting a cessé en 2009 ; c'est une indication |
| Il faut inscrire son site auprès des moteurs | Inutile ; la découverte passe par les liens |
| Les données Analytics nourrissent le classement | Google affirme ne pas s'en servir pour classer |
Deux méritent un développement. En 2019, nofollow est devenu une indication et non une directive, pour l'exploration comme pour le classement : le vieux tour du sculpting échoue donc deux fois, il ne conserve rien et le lien peut être suivi malgré tout. Et la métrique que l'on souhaite le plus voir en facteur de classement, le taux de rebond, n'en est pas un : le moteur n'y a pas d'accès fiable et il le dit.
La question des sites neufs mérite une réponse honnête plutôt qu'un renvoi. Google nie exploiter une sandbox formelle qui retiendrait les nouveaux domaines. Ce qui est vrai, c'est qu'un site neuf n'offre presque aucun historique aux systèmes — ni liens, ni trace d'avoir satisfait quiconque — et que rassembler cet historique prend du temps. L'attente est réelle. Le mécanisme qu'on imagine derrière, non.
La cuvée arrivée avec l'IA
La recherche générative a produit une série de tactiques en un an, et elles suivent le schéma à la lettre : peu coûteuses à adopter, irréfutables depuis vos données, et portées par l'observation réelle que les réponses d'IA se comportent autrement que dix liens bleus.
- Un fichier déclarant vos contenus aux modèles de langage. Google a indiqué que la recherche n'utilise pas llms.txt, et la comparaison faite était celle de la balise meta keywords : un fichier sous votre contrôle, affirmant des choses sur vous-même, sans moyen de les vérifier.
- Du contenu prédécoupé en portions calibrées pour machines. Les systèmes de récupération font leur propre segmentation ; écrire en fragments pour les devancer vous coûte le lecteur qui doit lire ces fragments.
- Une seconde version de la page écrite pour les machines. C'est du cloaking à justification moderne, et c'est la même infraction aux règles anti-spam qu'à l'époque où la seconde version s'écrivait pour les robots.
Ce qui décide réellement si une page peut figurer dans une réponse d'IA est peu spectaculaire et déjà documenté : la page doit être dans l'index et éligible à l'affichage d'un extrait. Voilà toute l'exigence technique. Au-delà, c'est le même travail qu'avant — être la meilleure réponse à la question, sur une page qu'un moteur peut télécharger, rendre et stocker.
Tester une affirmation avant d'y consacrer un budget
La plupart se tranchent en cinq minutes environ, et l'habitude se transporte aux affirmations que personne n'a encore écrites.
- Trouvez la source primaire. Un billet citant un billet citant une conférence n'en est pas une ; la documentation du moteur ou une déclaration nominative de sa part, si.
- Vérifiez de quoi parle vraiment l'affirmation. Éligibilité à une fonctionnalité, classement et exploration sont trois résultats distincts, et les conseils promettent couramment l'un en citant des preuves pour l'autre.
- Vérifiez la date. La recherche évolue, et un propos exact en 2015 a pu être dépassé deux fois depuis.
- Nommez la corrélation qui la porte. Si la tactique est le symptôme de quelque chose de réel, faites la chose réelle et le symptôme suit.
- Chiffrez le fait de vous tromper. Gratuit et inoffensif peut rester par intuition ; ce qui coûte un sprint exige la source de l'étape un.