Bienvenue sur le nouveau site d’Elev8 Lab : des guides SEO, GEO et acquisition, testés et sourcés. Découvrir les guides

EN, English version
Accueil / Blog / SEO / Analyse de logs SEO : méthode et outils

Analyse de logs SEO : méthode et outils

L’analyse de logs SEO est la seule méthode qui montre ce que Googlebot fait réellement sur un site : pages explorées, fréquence des passages, codes de réponse reçus. Elle complète le crawl et la Search Console, sans les remplacer. Cet article explique ce que contient un fichier de logs, quand l’analyse devient utile, comment la mener étape par étape, comment vérifier qu’un robot est bien Googlebot avec les méthodes documentées par Google (fichiers d’IP déplacés en mars 2026), quels indicateurs suivre et comment traduire les résultats en corrections concrètes. Les robots des moteurs IA, comme GPTBot, sont aussi abordés.

L’essentiel

L’analyse de logs SEO consiste à lire les journaux de votre serveur. Elle montre quelles pages Googlebot visite réellement, à quelle fréquence et avec quel code de réponse. C’est la seule source qui décrit le comportement effectif des robots. Selon les praticiens, elle devient utile au-delà d’environ 1 000 pages. Les logs se lisent croisés avec un crawl et la Search Console.

  • Un user-agent se falsifie : vérifiez Googlebot par DNS inverse ou par les plages d’IP publiées par Google.
  • Le ratio entre pages crawlées et pages qui reçoivent du trafic mesure la rentabilité du crawl.
  • Les logs ne remplacent ni la Search Console ni l’outil d’analytics : ils les complètent.

Qu’est-ce qu’une analyse de logs SEO ?

Un fichier de logs, ou journal d’accès, enregistre chaque requête reçue par le serveur : visiteurs humains, robots, pages, images, scripts. L’analyse de logs SEO filtre ce journal sur les robots des moteurs de recherche. Elle observe leur parcours réel sur le site.

Un crawler comme Screaming Frog simule un robot. La Search Console résume ce que Google veut bien montrer. Les logs, eux, enregistrent ce qui s’est passé, requête par requête. Ils constituent la brique la plus factuelle d’un audit SEO technique.

Définition

Analyse de logs SEO : étude des journaux d’accès d’un serveur web, filtrés sur les robots des moteurs de recherche. Elle mesure ce qu’ils explorent, à quelle fréquence et avec quelles réponses.

Quand une analyse de logs est-elle utile ?

L’exercice demande du temps et un accès au serveur. Il se justifie surtout dans trois cas :

  • Un site de plus de 1 000 pages, ou un e-commerce dont les URL changent souvent. En dessous, la Search Console suffit en général. C’est un repère de praticiens, pas une règle de Google.
  • Des pages importantes qui peinent à être indexées, ou beaucoup d’URL « Détectées, actuellement non indexées ».
  • Une refonte ou une migration, pour vérifier que Googlebot abandonne les anciennes URL et découvre les nouvelles.

Le guide de Google sur le budget de crawl (mis à jour le 22/07/2026) vise deux profils. Les sites d’environ 1 million de pages mises à jour chaque semaine. Les sites d’environ 10 000 pages dont le contenu change chaque jour. Google précise que ces chiffres sont des estimations grossières, pas des seuils. Notre article sur le budget de crawl détaille ces notions.

1 000

Screaming Frog Log File Analyser analyse gratuitement 1 000 lignes de logs sur un seul projet. La licence qui lève cette limite coûte 99 £ par an.

Screaming Frog, page officielle du Log File Analyser, consultée le 24/09/2026.

Que contient un fichier de logs ?

Le format le plus répandu est le « Combined Log Format » d’Apache, repris par Nginx. La documentation d’Apache en donne cet exemple :

127.0.0.1 - frank [10/Oct/2000:13:55:36 -0700] "GET /apache_pb.gif HTTP/1.0" 200 2326 "http://www.example.com/start.html" "Mozilla/4.08 [en] (Win98; I ;Nav)"
ChampExempleUsage SEO
Adresse IP127.0.0.1Vérifier que le robot est authentique
Horodatage[10/Oct/2000:13:55:36 -0700]Fréquence et régularité des passages
RequêteGET /apache_pb.gifURL explorée, paramètres inclus
Code HTTP200Ce que le robot a reçu : 200, 301, 404, 5xx
Poids2326Octets transférés, ressources lourdes
Refererhttp://www.example.com/start.htmlPage d’origine de la requête
User-agentMozilla/4.08…Robot déclaré : Googlebot Smartphone, Bingbot, GPTBot
Champs du Combined Log Format, d’après la documentation Apache HTTP Server 2.4.

Certains serveurs ajoutent le temps de réponse, très utile pour repérer les sections lentes. Sur Apache, les journaux se trouvent souvent dans /var/log/. Chez un hébergeur mutualisé, ils se téléchargent depuis l’espace client.

Attention

Vérifiez la durée de conservation avant de planifier l’analyse. Certains hébergeurs purgent les journaux après quelques jours ou quelques semaines. Demandez une conservation plus longue plusieurs semaines à l’avance.

Comment analyser les logs, étape par étape ?

  1. Récupérer les journaux de tous les serveurs sur une période représentative, idéalement 30 jours ou plus.
  2. Normaliser les formats et les URL : protocole, casse, slash final, paramètres, pour pouvoir les rapprocher d’un crawl.
  3. Filtrer les robots utiles : Googlebot d’abord, Bingbot ensuite, puis les robots des moteurs IA si le sujet vous concerne.
  4. Vérifier l’authenticité des robots (voir la section suivante). Les faux Googlebot faussent toutes les mesures.
  5. Séparer pages et ressources statiques : les images et scripts consomment aussi des requêtes, à mesurer à part.
  6. Croiser avec un crawl complet et les données de la Search Console, puis segmenter par type de page.

Côté outils, Screaming Frog Log File Analyser lit les formats Apache et W3C (IIS, Nginx, AWS ELB). Il vérifie les robots automatiquement. GoAccess, gratuit, produit des rapports en ligne de commande. Oncrawl et Botify proposent des plateformes complètes, sur devis. Le guide de Screaming Frog explique comment préparer le crawl à croiser.

Comment vérifier que Googlebot est authentique ?

N’importe quel script peut se présenter comme Googlebot. Google documente deux méthodes de vérification de ses robots (page mise à jour le 20/03/2026) :

  1. DNS inverse puis direct : la commande host sur l’IP doit renvoyer un nom en googlebot.com, google.com ou googleusercontent.com. Une recherche directe sur ce nom doit redonner la même IP.
  2. Plages d’IP : comparer l’IP aux fichiers JSON publiés par Google (robots courants, robots spéciaux, récupérations déclenchées par un utilisateur).

Ces fichiers ont changé d’adresse le 31/03/2026, selon le blog Search Central. Google les a déplacés vers developers.google.com/crawling/ipranges/. Il annonce la redirection des anciens emplacements dans les six mois. Mettez à jour vos scripts de vérification.

La liste des robots courants de Google permet d’identifier chaque user-agent (Googlebot Smartphone, Googlebot Image, etc.). OpenAI publie de même ses robots (GPTBot, OAI-SearchBot, ChatGPT-User) et leurs plages d’IP sur sa page dédiée. Leur gestion est traitée dans notre article sur les robots des moteurs IA.

Quels indicateurs suivre dans les logs ?

IndicateurLectureAction type
URL distinctes crawléesPérimètre réellement exploréComparer au nombre de pages utiles
Ratio pages actives / crawléesPart du crawl qui touche des pages recevant du trafic organiqueRéduire les URL sans valeur
Fréquence de crawl par segmentSections délaissées ou sur-crawléesMaillage, profondeur, performance
Codes HTTP des hits robotsChaque 301 ou 404 est une requête perdueCorriger les liens internes et les redirections
Part de Googlebot SmartphoneCohérence avec l’indexation mobileVérifier la parité mobile
Temps de réponse par segmentLes sections lentes sont moins exploréesPerformance serveur
Grille Elev8 Lab (base de connaissance SEO vérifiée le 09/09/2026). Seuils à fixer selon le site : Google n’en publie pas.

Le croisement le plus parlant oppose logs et crawl. Une page présente dans le crawl mais absente des logs est trop profonde ou mal maillée. Une page présente dans les logs mais absente du crawl est souvent orpheline. Il peut aussi s’agir d’un vestige d’ancienne version ou d’une URL parasite.

Que faire des résultats ?

Les constats se traduisent en actions sur le site, rarement sur le serveur seul :

  • remonter les pages stratégiques peu explorées dans l’arborescence et le maillage ;
  • corriger les liens internes qui pointent vers des 301 ou des 404 ;
  • traiter les URL parasites (paramètres, filtres) qui captent le crawl, puis suivre l’indexation dans Google ;
  • réintégrer ou rediriger les pages orphelines qui reçoivent encore des visites de robots ;
  • accélérer les gabarits lents, puis mesurer à nouveau un mois plus tard.

Une analyse de logs n’annonce jamais un gain de trafic. Elle établit ce que les robots font, et donc l’ordre des corrections. Elle s’inscrit dans le chantier plus large du SEO technique.

Questions fréquentes

Comment analyser les logs ?

Récupérez les journaux du serveur sur au moins un mois et filtrez les robots des moteurs. Vérifiez leur authenticité par DNS inverse. Croisez ensuite les URL explorées avec un crawl et la Search Console. Un outil comme Screaming Frog Log File Analyser automatise la plupart de ces étapes.

Comment comprendre les logs ?

Chaque ligne décrit une requête : adresse IP, date et heure, URL demandée, code de réponse, poids, page d’origine et user-agent. Pour le SEO, on lit surtout l’URL, le code HTTP et le robot, agrégés par type de page.

L’analyse de logs remplace-t-elle la Search Console ?

Non. Le rapport Statistiques d’exploration de la Search Console donne une vue agrégée, utile mais résumée. Les logs donnent le détail exhaustif, sans données de clics ni de positions. Les deux se complètent.

Faut-il analyser les robots des moteurs IA ?

Oui si la visibilité dans ChatGPT ou les autres moteurs de réponse est un objectif. Les logs montrent si GPTBot ou OAI-SearchBot accèdent vraiment au site. Le fichier robots.txt seul ne le garantit pas.

À quelle fréquence refaire une analyse de logs SEO ?

Après chaque changement structurant (refonte, migration, ouverture de filtres), puis à intervalle régulier sur les gros sites. Une analyse de logs SEO ponctuelle donne une photographie ; un suivi mensuel révèle les tendances.

Sources

  1. Google Search Central, Verifying Googlebot and other Google crawlers, mis à jour le 20/03/2026. Consulté le 24/09/2026.
  2. Google Search Central Blog, New Location for the Google Crawlers’ IP Range Files, publié le 31/03/2026. Consulté le 24/09/2026.
  3. Google Search Central, Crawl Budget Management For Large Sites, mis à jour le 22/07/2026. Consulté le 24/09/2026.
  4. Google Search Central, Google’s common crawlers. Consulté le 24/09/2026.
  5. Apache Software Foundation, Log Files, Apache HTTP Server 2.4. Consulté le 24/09/2026.
  6. Screaming Frog, SEO Log File Analyser, tarifs affichés le 24/09/2026. Consulté le 24/09/2026.
  7. OpenAI, Overview of OpenAI Crawlers. Consulté le 24/09/2026.
Avatar de Baptiste Clair

Consultant marketing digital, SEO et GEO

En savoir plus sur l'auteur

Article vérifié et mis à jour par l'auteur. Sources consultées à la date indiquée.

Citer cet article

Clair, B. (2026, 24 septembre). Analyse de logs SEO : méthode et outils. Elev8 Lab. https://elev8-lab.fr/seo/analyse-de-logs/