iducationducation
IndexArticlesFormationsProfilOutilsBibliothech
N°014 — 2026
Navigation
01Index02Articles03Formations04Profil05Outils06Bibliothech
N°014 — 2026
iducationducation
IndexArticlesFormationsProfilOutilsBibliothech
N°014 — 2026
Navigation
01Index02Articles03Formations04Profil05Outils06Bibliothech
N°014 — 2026
Formations
SEO · Intermédiaire

SEO Technique

Comprendre et maîtriser le référencement naturel de A à Z : crawl, indexation, Core Web Vitals, données structurées, maillage interne et Search Console. La formation technique pour développeurs qui veulent que leur site soit trouvé.

Google Search ConsoleSchema.orgCore Web VitalsNext.jsrobots.txt
01Comment Google fonctionne02HTML pour le SEO03Robots.txt, Sitemap et URLs04Maillage interne et contenu dupliqué05Core Web Vitals06Données structurées Schema.org07JavaScript, Search Console et Checklist
Chapitre 1·20 min

Comment Google fonctionne

Avant d'optimiser quoi que ce soit, comprendre comment Google découvre, analyse et classe les pages web est indispensable. La plupart des erreurs SEO viennent d'une mauvaise compréhension de ce mécanisme.

Le processus en trois étapes

Google fonctionne en trois phases distinctes. Si une phase échoue, votre page ne sera jamais visible — peu importe la qualité du contenu.

┌─────────────────────────────────────────────────────────────┐
│                                                             │
│   1. CRAWL          2. INDEX           3. CLASSEMENT        │
│                                                             │
│  Googlebot      Analyse et stocke    Algorithme évalue     │
│  télécharge     dans la base de      200+ signaux et        │
│  le HTML        données Google       ordonne les résultats  │
│                                                             │
│  ↓ bloqué par   ↓ bloqué par         ↓ influencé par        │
│  robots.txt     qualité insuffisante  contenu + autorité    │
│                 ou contenu dupliqué   + expérience user     │
│                                                             │
└─────────────────────────────────────────────────────────────┘

Phase 1 : Le crawl

Googlebot est un programme automatisé qui parcourt le web 24h/24 en suivant les liens. À chaque URL, il télécharge le code HTML et l'analyse.

Ce qu'il lit sur chaque page :

  • Le code HTML complet
  • Les attributs alt des images
  • Les liens hypertextes (pour découvrir de nouvelles pages)
  • Les métadonnées (title, description, canonical...)
  • Le fichier robots.txt pour savoir où il est autorisé

Le budget de crawl est une notion critique. Googlebot n'a pas des ressources infinies — il ne peut pas crawler toutes vos pages à chaque visite. Sur un petit site (< 1000 pages), ce n'est pas un problème. Sur un grand site, les pages inutiles gaspillent le budget de crawl au détriment de vos pages importantes.

Ce qui gaspille le budget de crawl :

  • Pages avec paramètres d'URL (?color=rouge&size=M)
  • Pages de résultats de recherche interne
  • Pages dupliquées sans canonical
  • URLs cassées (redirection en chaîne)

Phase 2 : L'indexation

Une page crawlée n'est pas forcément indexée. Google décide de stocker ou non la page dans son index selon plusieurs critères :

Raison de non-indexationSolution
Contenu trop court (< 300 mots)Enrichir le contenu
Contenu dupliqué sans canonicalAjouter <link rel="canonical">
Page bloquée par noindexVérifier les meta robots
Qualité insuffisanteAméliorer le contenu
Bloquée par robots.txtCorriger robots.txt

À retenir : Disallow dans robots.txt empêche le crawl mais pas l'indexation si la page reçoit des liens. noindex empêche l'indexation mais pas le crawl. Les deux rôles sont distincts.

Commande pour vérifier les pages indexées :

site:iducation.fr

Tapez ça dans Google. Vous verrez toutes vos pages indexées. Une page absente de ce résultat est invisible sur Google.

Phase 3 : Le classement

Une fois indexée, la page entre en compétition. L'algorithme de Google évalue trois grandes catégories de signaux :

Pertinence — Le contenu répond-il vraiment à l'intention de recherche ? Les mots-clés sont-ils présents naturellement ? La page traite-t-elle le sujet en profondeur ?

Autorité — D'autres sites de qualité pointent-ils vers cette page ? Le domaine a-t-il une réputation dans ce sujet ?

Expérience utilisateur — Le site se charge vite ? Il est utilisable sur mobile ? Core Web Vitals corrects ?

Les types de recherche et l'intention

Google ne classe pas juste des mots-clés — il essaie de comprendre l'intention derrière la requête.

RequêteIntentionType de contenu attendu
"docker tutorial"ApprendreGuide pas-à-pas
"acheter VPS"AcheterPage produit, comparatif
"iducation.fr"NaviguerPage d'accueil du site
"nginx config example"TrouverCode concret, exemple

Écrire un contenu "informatif" pour une requête à intention "achat" ne rankera pas bien — même si le contenu est excellent. L'intention doit correspondre.

Mobile-first indexing

Depuis 2019, Google utilise la version mobile de votre site pour l'indexation et le classement. Si votre site mobile a moins de contenu que la version desktop, c'est la version mobile qui est évaluée.

Vérification rapide :

# Simuler Googlebot mobile avec curl
curl -A "Mozilla/5.0 (Linux; Android 6.0.1; Nexus 5X Build/MMB29P) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/W.X.Y.Z Mobile Safari/537.36 (compatible; Googlebot/2.1; +http://www.google.com/bot.html)" https://monsite.fr

À faire : Tapez site:votredomaine.fr sur Google. Comptez les pages indexées. Y a-t-il des pages manquantes que vous attendiez voir ? Notez les écarts — on y revient au chapitre Search Console.

Suivant
HTML pour le SEO

Développeur fullstack passionné. J'apprends en construisant et je documente tout — front, back, outils. Le code s'apprend mieux en public.

Naviguer

IndexTous les articlesFormationsProfilOutilsBibliothech

Ailleurs

GitHub RSS

Newsletter

Les articles, libs et découvertes. Une fois par semaine, pas plus.

© 2026 William LoreeConçu & codé à la main