Lecture SEO d’une page

Un moteur de recherche juge une page en grande partie sur une poignée de balises de son code source. Ce test télécharge une page, lit ces balises et les note sur 100, avec le correctif pour chaque point faible.

Une seule page par test. Testez d’abord la page d’accueil, puis les pages que vous voulez le plus faire trouver.

Ou essayez wikipedia.org, github.com

Un robot lit la source, pas l’écran

Quand vous ouvrez une page, vous voyez une mise en page, avec un grand titre, une photo et un menu. Le robot d’un moteur de recherche reçoit le même fichier que votre navigateur, mais il ne regarde jamais l’image finale. Il lit le HTML de haut en bas et s’appuie sur un petit nombre de balises pour décider de quoi parle la page, ce qu’il faut afficher dans la liste de résultats et s’il faut garder la page.

Le « SEO on-page » consiste à soigner ces balises. C’est la seule part de la visibilité dans les moteurs qui ne dépend que de vous, puisqu’elle se trouve dans votre propre balisage. Ce test télécharge une seule page comme le ferait un robot simple, sans exécuter de JavaScript et passe les balises en revue une à une.

Où vont les 100 points

Chaque page part de 100. Chacun des sept domaines ci-dessous peut retirer des points une seule fois, au niveau de son pire constat.

DomaineProblème graveAvertissement
Titre (<title>)−20 : il n’y en a pas−7 : moins de 25 ou plus de 65 caractères, ou plus d’une balise title
Meta description−5 : absente, de moins de 70 ou de plus de 160 caractères
Intertitres (h1 à h6)−15 : pas de h1−5 : plusieurs h1, un niveau sauté, un intertitre vide
Texte alt des images−15 : plus d’une image sur cinq n’a pas d’attribut alt−6 : quelques images sans alt, ou un texte qui est un nom de fichier, un seul mot vague ou plus long que 150 caractères
Liens−4 : des liens sans aucun texte, ou avec un texte comme « cliquez ici » et « en savoir plus »
Indexation−30 : une directive noindex, ou une règle de robots.txt qui ferme la porte à Googlebot−5 : pas d’URL canonique, une canonique qui désigne une autre page, ou pas de plan du site
Langue, mobiles, contenu−15 : pas de balise viewport pour mobile−5 : pas d’attribut lang, moins de 150 mots, ou un JSON-LD qui ne se lit pas

La lettre suit le total : A à partir de 90, B à partir de 78, C à partir de 64, D à partir de 50, E à partir de 35, F en dessous. L’indexation pèse le plus lourd parce qu’elle fonctionne comme un interrupteur. Vous pouvez écrire le meilleur titre du monde : si la page est marquée noindex, personne ne la verra jamais.

Pour les images, un alt="" vide n’est pas une erreur. C’est la bonne façon de marquer une image décorative et le test la classe ainsi. Les pixels espions de 1 × 1 sont ignorés.

Les corrections à faire dans l’en-tête de la page

La plupart des constats se corrigent en une ligne chacun. Un <head> sain contient au moins ceci :

<html lang="en">
<title>Oak dining tables made to order | Northfield Joinery</title>
<meta name="description" content="Solid oak tables built to your measurements, delivered in six weeks. See sizes, finishes and prices.">
<link rel="canonical" href="https://www.example.com/dining-tables/">
<meta name="viewport" content="width=device-width, initial-scale=1">
  • Titre. Mettez le sujet de la page en premier et la marque à la fin. Les listes de résultats coupent les longs titres vers 60 caractères et mieux vaut perdre la marque que le sujet.
  • Intertitres. Utilisez un seul h1 qui reprend le sujet, puis h2 pour les sections et h3 à l’intérieur. Choisissez le niveau selon sa place dans le plan et laissez le CSS s’occuper de la taille.
  • Texte alt. Dites ce que montre l’image en une courte phrase, comme alt="Round oak table with four chairs". Un nom de fichier tel que IMG_4032.jpg n’apprend rien à un lecteur.
  • Texte des liens. Nommez la destination. « Voir les tarifs de livraison » garde son sens hors contexte, pas « cliquez ici ».
  • Un noindex non voulu. C’est souvent un reste d’avant le lancement. Dans WordPress, décochez la case sous Réglages › Lecture. Ailleurs, cherchez noindex et X-Robots-Tag dans vos gabarits et la configuration du serveur.
  • Plan du site. Ajoutez une ligne Sitemap: https://www.example.com/sitemap.xml dans robots.txt. Pour tester le fichier lui-même, il y a le test de plan du site.

Ce que la note laisse de côté

La note décrit le balisage d’une URL à un instant donné. Quelques éléments lui échappent.

  • Le texte ajouté par JavaScript. Nous lisons la page telle que le serveur l’envoie. Si vos intertitres et vos paragraphes sont construits dans le navigateur, le test voit peu de mots et aucun plan. La vue du robot montre exactement ce qui a été reçu.
  • La qualité et la réputation. Savoir si votre texte répond à la question mieux que les autres pages et combien de sites pointent vers vous compte bien plus pour le classement que n’importe quelle balise. Aucun outil ne peut lire cela dans la source.
  • Le reste du site. Les titres en double d’une page à l’autre, les pages orphelines et la lenteur de chargement demandent d’autres tests.

Un A veut dire que rien dans le balisage ne fait obstacle. La page a le droit de se classer. Qu’elle se classe vraiment se décide ailleurs.

Questions fréquentes

Quelle longueur doit avoir une balise title ?

Entre 30 et 60 caractères est une cible sûre. Google coupe les titres selon leur largeur en pixels, ce qui donne environ 60 caractères sur un écran d’ordinateur. Ce test avertit en dessous de 25 et au-dessus de 65.

La meta description influence-t-elle le classement ?

Non. Les moteurs ne s’en servent pas pour ordonner les résultats. Elle apparaît pourtant souvent sous forme des deux lignes sous votre titre, donc une description claire apporte plus de clics. Quand elle manque ou qu’elle est hors sujet, le moteur choisit un passage de la page à la place.

Une page peut-elle avoir plus d’un h1 ?

Le HTML le permet et les moteurs s’en accommodent. Un seul h1 donne pourtant le signal le plus clair du sujet principal et les personnes qui utilisent un lecteur d’écran s’y fient pour trouver le début du contenu.

Faut-il une balise canonical sur chaque page ?

C’est une bonne pratique. Une même page est souvent accessible avec ou sans www, avec une barre oblique finale ou avec des paramètres de suivi ajoutés. Une balise canonical qui désigne l’URL préférée évite que ces copies soient traitées comme des pages distinctes.

Pourquoi ma page a-t-elle une mauvaise note alors qu’elle semble correcte dans le navigateur ?

C’est en général du contenu construit par JavaScript. Le test lit le HTML tel qu’il est livré, avant l’exécution du moindre script. Si ce HTML ne contient qu’un conteneur vide, il n’y a ni intertitres, ni images, ni texte à lire.

Que doit dire le texte alt ?

Décrivez ce que montre l’image et pourquoi elle est là, en une phrase de 5 à 15 mots. Évitez « image de » et ne bourrez pas de mots-clés. Pour les images qui ne sont que de la décoration, utilisez un alt="" vide.