Seoditum

Lexique SEO

Les définitions courtes des termes utilisés dans les rapports Seoditum et sur ce blog — sans jargon superflu, avec un lien vers l'article détaillé quand le sujet le mérite.

Indexation et crawl

Crawler (ou robot d'indexation)

Programme automatisé qui parcourt les pages web en suivant les liens, pour les analyser et les faire connaître à un moteur de recherche ou une IA. Googlebot est le crawler de Google ; GPTBot, ClaudeBot et PerplexityBot sont ceux des principales IA génératives.

Crawl budget

Le nombre de pages qu'un crawler accepte d'explorer sur un site pendant une période donnée. Un budget limité par rapport à la taille du site fait que certaines pages sont explorées rarement, voire jamais — surtout un enjeu sur les très grands sites.

Indexation

Le fait qu'une page soit effectivement enregistrée dans la base de données d'un moteur de recherche, la rendant éligible à apparaître dans les résultats. Une page peut être crawlée sans être indexée (si elle est jugée non pertinente ou bloquée par une directive).

Balise noindex

Instruction placée dans le code d'une page pour demander explicitement aux moteurs de recherche de ne pas l'indexer. Utile pour les pages sans valeur de recherche (panier, compte utilisateur...), mais une balise noindex oubliée sur une vraie page de contenu la retire silencieusement des résultats.

Sitemap XML

Fichier listant les URLs qu'un site souhaite voir explorées, avec parfois leur date de dernière modification. Ne garantit pas l'indexation, mais aide un moteur à découvrir les pages plus rapidement, surtout sur un site récent ou peu maillé.

Robots.txt

Fichier à la racine d'un site qui indique aux crawlers quelles zones ils peuvent ou non explorer. Une règle trop large (bloquer tout un dossier par erreur) peut désindexer des pages entières sans qu'aucune erreur ne soit visible ailleurs.

Balises et structure

Balise title

Le titre d'une page, affiché comme lien cliquable dans les résultats de recherche et dans l'onglet du navigateur. Le premier signal de pertinence lu par Google et par l'utilisateur — souvent tronqué au-delà d'une soixantaine de caractères.

Meta description

Court résumé d'une page, affiché sous le titre dans les résultats de recherche. N'influence pas directement le classement, mais influence le taux de clic — Google la réécrit parfois automatiquement s'il la juge peu pertinente.

Balise Hn (H1, H2, H3...)

Balises qui structurent hiérarchiquement le contenu d'une page, du titre principal (H1) aux sous-parties. Une hiérarchie cohérente aide les moteurs et les IA génératives à comprendre l'organisation logique du contenu.

Balise canonical

Indique à un moteur de recherche quelle URL est la version de référence quand plusieurs URLs affichent un contenu identique ou très proche. Consolide les signaux (liens, autorité) sur cette seule version plutôt que de les diluer entre plusieurs.

Contenu dupliqué

Contenu identique ou quasi identique accessible depuis plusieurs URLs différentes. Il n'existe pas de "pénalité" à proprement parler, mais Google doit choisir laquelle afficher — souvent pas celle qu'on espérait — et le signal se dilue entre les versions.

Redirection 301 / 302

Une redirection 301 signale un changement permanent d'URL et transfère la quasi-totalité du signal SEO accumulé vers la nouvelle adresse. Une 302 signale un changement temporaire et ne transfère pas ce signal — utiliser une 302 pour un changement définitif est une erreur fréquente.

Autorité et liens

Backlink

Lien provenant d'un autre site pointant vers le vôtre. Reste un signal de confiance important pour Google, mais Seoditum ne l'analyse pas (nécessite une base de données de liens externes, hors périmètre de l'audit — voir le comparatif des solutions).

Netlinking

L'ensemble des actions visant à obtenir des backlinks vers un site, par opposition au SEO "on-page" qui se limite au site lui-même.

Maillage interne

Les liens entre les pages d'un même site. Détermine quelles pages un moteur de recherche considère comme importantes et à quelle fréquence il les re-explore — un levier gratuit et sous-exploité, contrairement au netlinking externe.

DA / DR (Domain Authority / Domain Rating)

Scores propriétaires calculés respectivement par Moz et Ahrefs pour estimer la force du profil de liens d'un site, sur une échelle de 0 à 100. Ce ne sont pas des métriques officielles de Google ni des facteurs de classement reconnus — seulement des estimations tierces à interpréter avec prudence.

Ancre de lien

Le texte cliquable d'un lien. Une ancre descriptive ("guide de connexion Search Console") donne plus de contexte qu'une ancre générique ("cliquez ici"), pour les moteurs comme pour les lecteurs.

Performance

Core Web Vitals

Trois métriques retenues par Google parmi des dizaines de signaux de performance possibles pour évaluer l'expérience réellement perçue par un visiteur : LCP, INP et CLS, chacune avec des seuils publics.

LCP (Largest Contentful Paint)

Temps nécessaire pour afficher le plus grand élément visible de la page (souvent une image ou un titre). Bon si inférieur à 2,5 secondes.

INP (Interaction to Next Paint)

Délai entre une interaction de l'utilisateur (clic, tap) et la réponse visuelle affichée à l'écran. Bon si inférieur à 200 millisecondes — a remplacé le FID comme Core Web Vital officiel en 2024.

CLS (Cumulative Layout Shift)

Mesure l'instabilité visuelle d'une page — à quel point les éléments se déplacent de façon inattendue pendant le chargement. Bon si inférieur à 0,1.

Recherche et IA générative

SERP (Search Engine Results Page)

La page de résultats affichée par un moteur de recherche pour une requête donnée.

CTR (taux de clic)

Le pourcentage de personnes qui cliquent sur un résultat parmi celles qui l'ont vu (impressions). Un CTR faible malgré une bonne position signale souvent un titre ou une description peu engageants.

Position moyenne

Le classement moyen d'une page pour une requête donnée, tel que rapporté par Google Search Console — une vraie donnée mesurée, pas une estimation d'outil tiers.

E-E-A-T

Experience, Expertise, Authoritativeness, Trustworthiness — le cadre que Google utilise pour évaluer la fiabilité perçue d'un contenu et de son auteur. Pas un facteur de classement unique et mesurable, mais une grille de lecture qui influence de nombreux signaux (auteur identifiable, sources citées, fraîcheur du contenu).

Cannibalisation SEO

Quand plusieurs pages d'un même site se disputent la même requête, sans qu'aucune ne domine clairement — Google doit arbitrer entre elles, souvent au détriment des deux.

Longue traîne

Les requêtes de recherche précises et peu concurrentielles (par opposition aux requêtes génériques à fort volume). Individuellement peu recherchées, elles représentent collectivement une grande partie du trafic organique total d'un site de contenu.

GEO (Generative Engine Optimization)

L'équivalent du SEO pour les réponses générées par les IA (ChatGPT, Perplexity, AI Overviews de Google) plutôt que pour les liens classiques d'une page de résultats — accessibilité aux robots d'IA, contenu structuré et directement citable.

llms.txt

Fichier au format markdown, convention proposée par llmstxt.org, résumant un site pour qu'il soit facilement ingéré par un assistant IA — l'équivalent de robots.txt/sitemap.xml pour les moteurs de réponse plutôt que les moteurs de recherche classiques.

Pour aller plus loin

Voir ces notions vérifiées concrètement sur votre site ?

Lancer mon audit