Comprendre et maîtriser le référencement naturel de A à Z : crawl, indexation, Core Web Vitals, données structurées, maillage interne et Search Console. La formation technique pour développeurs qui veulent que leur site soit trouvé.
Avant d'optimiser quoi que ce soit, comprendre comment Google découvre, analyse et classe les pages web est indispensable. La plupart des erreurs SEO viennent d'une mauvaise compréhension de ce mécanisme.
Google fonctionne en trois phases distinctes. Si une phase échoue, votre page ne sera jamais visible — peu importe la qualité du contenu.
┌─────────────────────────────────────────────────────────────┐
│ │
│ 1. CRAWL 2. INDEX 3. CLASSEMENT │
│ │
│ Googlebot Analyse et stocke Algorithme évalue │
│ télécharge dans la base de 200+ signaux et │
│ le HTML données Google ordonne les résultats │
│ │
│ ↓ bloqué par ↓ bloqué par ↓ influencé par │
│ robots.txt qualité insuffisante contenu + autorité │
│ ou contenu dupliqué + expérience user │
│ │
└─────────────────────────────────────────────────────────────┘Googlebot est un programme automatisé qui parcourt le web 24h/24 en suivant les liens. À chaque URL, il télécharge le code HTML et l'analyse.
Ce qu'il lit sur chaque page :
alt des imagestitle, description, canonical...)robots.txt pour savoir où il est autoriséLe budget de crawl est une notion critique. Googlebot n'a pas des ressources infinies — il ne peut pas crawler toutes vos pages à chaque visite. Sur un petit site (< 1000 pages), ce n'est pas un problème. Sur un grand site, les pages inutiles gaspillent le budget de crawl au détriment de vos pages importantes.
Ce qui gaspille le budget de crawl :
?color=rouge&size=M)Une page crawlée n'est pas forcément indexée. Google décide de stocker ou non la page dans son index selon plusieurs critères :
| Raison de non-indexation | Solution |
|---|---|
| Contenu trop court (< 300 mots) | Enrichir le contenu |
| Contenu dupliqué sans canonical | Ajouter <link rel="canonical"> |
Page bloquée par noindex | Vérifier les meta robots |
| Qualité insuffisante | Améliorer le contenu |
| Bloquée par robots.txt | Corriger robots.txt |
À retenir :
Disallowdans robots.txt empêche le crawl mais pas l'indexation si la page reçoit des liens.noindexempêche l'indexation mais pas le crawl. Les deux rôles sont distincts.
Commande pour vérifier les pages indexées :
site:iducation.frTapez ça dans Google. Vous verrez toutes vos pages indexées. Une page absente de ce résultat est invisible sur Google.
Une fois indexée, la page entre en compétition. L'algorithme de Google évalue trois grandes catégories de signaux :
Pertinence — Le contenu répond-il vraiment à l'intention de recherche ? Les mots-clés sont-ils présents naturellement ? La page traite-t-elle le sujet en profondeur ?
Autorité — D'autres sites de qualité pointent-ils vers cette page ? Le domaine a-t-il une réputation dans ce sujet ?
Expérience utilisateur — Le site se charge vite ? Il est utilisable sur mobile ? Core Web Vitals corrects ?
Google ne classe pas juste des mots-clés — il essaie de comprendre l'intention derrière la requête.
| Requête | Intention | Type de contenu attendu |
|---|---|---|
| "docker tutorial" | Apprendre | Guide pas-à-pas |
| "acheter VPS" | Acheter | Page produit, comparatif |
| "iducation.fr" | Naviguer | Page d'accueil du site |
| "nginx config example" | Trouver | Code concret, exemple |
Écrire un contenu "informatif" pour une requête à intention "achat" ne rankera pas bien — même si le contenu est excellent. L'intention doit correspondre.
Depuis 2019, Google utilise la version mobile de votre site pour l'indexation et le classement. Si votre site mobile a moins de contenu que la version desktop, c'est la version mobile qui est évaluée.
Vérification rapide :
# Simuler Googlebot mobile avec curl
curl -A "Mozilla/5.0 (Linux; Android 6.0.1; Nexus 5X Build/MMB29P) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/W.X.Y.Z Mobile Safari/537.36 (compatible; Googlebot/2.1; +http://www.google.com/bot.html)" https://monsite.frÀ faire : Tapez
site:votredomaine.frsur Google. Comptez les pages indexées. Y a-t-il des pages manquantes que vous attendiez voir ? Notez les écarts — on y revient au chapitre Search Console.