Un site qui vient d'être mis en ligne n'apparaît pas tout de suite dans Google. Le moteur doit d'abord le découvrir, puis explorer ses pages, et enfin décider de les indexer. Vous ne pouvez pas forcer ce processus, mais vous pouvez le faciliter et le suivre. Ce guide couvre les outils techniques : robots.txt, sitemap et Search Console.
1. Comment Google découvre un site
Google découvre les pages en suivant des liens, depuis d'autres sites ou depuis vos propres pages, et en lisant les sitemaps que vous lui déclarez. Chaque page découverte est ensuite explorée par Googlebot, puis évaluée : une page peut être explorée sans être indexée, si Google la juge peu utile, en double ou de faible qualité. D'où une règle simple : chaque page importante doit être accessible par un lien depuis une autre page du site, pas seulement présente dans le sitemap.
2. Le fichier robots.txt
Placé à la racine du site, robots.txt indique aux robots les zones à ne pas explorer. Exemple raisonnable :
User-agent: *
Disallow: /wp-admin/
Allow: /wp-admin/admin-ajax.php
Disallow: /panier/
Sitemap: https://www.monsite.fr/sitemap.xml
robots.txt empêche l'exploration, pas l'indexation. Une page bloquée peut quand même apparaître dans Google, sans description, si d'autres sites y font un lien. Pour retirer une page de l'index, laissez-la explorable et ajoutez la balise <meta name="robots" content="noindex"> : Google doit pouvoir la lire pour en tenir compte.L'erreur la plus fréquente après une mise en ligne est un Disallow: / oublié depuis la phase de développement, ou une balise noindex restée sur tout le site. Vérifiez les deux le jour du lancement : voir la checklist SEO avant mise en ligne.
3. Le sitemap XML
Le sitemap liste les adresses que vous souhaitez voir indexées. La plupart des CMS le génèrent automatiquement ; pour un site fait à la main, le format est simple :
<?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">
<url>
<loc>https://www.monsite.fr/</loc>
<lastmod>2026-09-15</lastmod>
</url>
<url>
<loc>https://www.monsite.fr/services</loc>
<lastmod>2026-09-01</lastmod>
</url>
</urlset>
- N'y mettez que des pages indexables : adresse définitive, réponse 200, pas de
noindex, pas de redirection. Un sitemap rempli de pages en erreur ou redirigées perd la confiance du moteur. - La date
lastmodest utilisée par Google si elle est fiable : ne la mettez à jour que lorsque le contenu change réellement. - Les balises
priorityetchangefreqsont ignorées par Google : inutile de s'en préoccuper. - Un sitemap est limité à 50 000 adresses et 50 Mo. Au-delà, découpez-le et listez les morceaux dans un index de sitemaps.
4. Déclarer le site dans la Search Console
La Google Search Console est l'outil gratuit qui montre comment Google voit votre site. Ajoutez une propriété de type Domaine : elle couvre toutes les variantes, avec et sans www, en HTTP et HTTPS. La vérification se fait en ajoutant un enregistrement TXT fourni par Google dans la zone DNS du domaine : voir configurer les DNS.
Une fois le domaine vérifié, ouvrez Sitemaps, saisissez l'adresse de votre sitemap et validez. Après quelques jours, les rapports Pages et Performances se remplissent : pages indexées ou non, requêtes tapées par les internautes, clics et positions.
5. Inspecter une page et demander son indexation
Collez l'adresse d'une page dans la barre de recherche en haut de la Search Console. L'outil d'inspection indique si la page est indexée, quand elle a été explorée, quelle adresse canonique Google a retenue, et permet de tester l'URL en direct. Pour une page nouvelle ou modifiée en profondeur, le bouton Demander une indexation la place dans la file d'exploration prioritaire. C'est limité à quelques demandes par jour : réservez-le aux pages importantes.
6. Comprendre les pages non indexées
| Statut dans la Search Console | Signification et piste |
|---|---|
| Détectée, actuellement non indexée | Google connaît l'adresse mais ne l'a pas encore explorée. Fréquent sur un site récent ; renforcez les liens internes vers la page. |
| Explorée, actuellement non indexée | Google l'a lue et ne l'a pas jugée utile. Enrichissez le contenu, ou regroupez les pages trop proches. |
| Page en double sans URL canonique sélectionnée | Plusieurs adresses affichent le même contenu. Ajoutez une balise canonique et redirigez les variantes. |
| Exclue par la balise noindex | Normal si c'est voulu ; sinon, retirez la balise. |
| Bloquée par le fichier robots.txt | Vérifiez que la règle ne bloque pas une page importante. |
| Erreur serveur (5xx) | Le serveur a échoué pendant l'exploration : surveillez sa disponibilité et ses ressources. |
Un temps de réponse lent ralentit aussi l'exploration : Google explore moins de pages sur un serveur qui répond mal. Voir optimiser PHP-FPM et le cache Nginx.
7. Bing et IndexNow
Pensez aussi à Bing Webmaster Tools, qui peut importer directement vos propriétés depuis la Search Console. Bing, comme Yandex, prend en charge IndexNow : un protocole qui permet de signaler instantanément une page nouvelle ou modifiée par une simple requête. Plusieurs extensions de CMS l'intègrent. Google ne l'utilise pas, mais le coût est nul et l'effet immédiat sur les moteurs qui le prennent en charge.