Derniers Articles
YouTube va compter les vues dès la première seconde à partir du 24 août ChatGPT Ads arrive en Europe : la publicité s’invite dans vos conversations avec l’IA Une offre d’emploi de Google confirme ce qu’on observe dans Discover Combien coûte vraiment un projet e-commerce B2B ? Ce qu’il faut budgéter en 2026 Étude Ahrefs : un mois après leur lancement en France, les AI Overviews font déjà chuter le CTR de 23 % L’édition d’août 2026 de Réacteur est en ligne ! Google Spam Update d’août 2026 : nouvelle mise à jour anti-spam Goossips SEO : Hreflang & Indexation ChatGPT peut visiter vos pages interdites, et OpenAI l’assume Microsoft Clarity : nouvel indicateur pour mesurer si le scraping des IA vous rapporte du traficLire l'article complet : Gary Illyes : évitez les structures de site « plates »
Publié le 22/12/2023 à 11:04:36 par Neper
Gary Illyes : évitez les structures de site « plates »
Les bots des moteurs de recherche s’appuient sur la syntaxe de vos urls pour regrouper vos contenus et leur attribuer des scores communs.
Par exemple, si vous avez des contenus en anglais et en français, c’est une bonne idée d’avoir des urls présentées comme ceci
https://www.votredomaine.com/en/[reste-de-l-url] pour les pages en anglais
https//www.votredomaine.com/fr/[reste-de-l-url] pour les pages en français
Dans cette syntaxe d’url, l’utilisation du caractère « / » indique un répertoire. Enfin, au moins virtuellement.
Chemin réel, chemin virtuel
Dans les débuts de l’internet, les pages n’étaient pas crées dynamiquement, mais correspondaient à des fichiers htmls stockés sur le serveur web. Les urls pointaient sur des fichiers dont l’emplacement était réellement défini par une arborescence de répertoires.
Donc ces adresses
https://www.votredomaine.com/articles/rubrique1/article-A.html
https://www.votredomaine.com/articles/rubrique2/article-B.html
Reflétaient des emplacements réels sur les serveurs.
Cela fonctionne toujours aujourd’hui : vous pouvez toujours utiliser un chemin vers un emplacement « physique » pour aller chercher une ressource : image, pdf, page html etc.
Mais de plus en plus souvent, le chemin menant à une url est purement virtuel : c’est un programme qui va intérpréter l’url pour aller chercher la ressource correspondante à un certain emplacement, voire générer dynamiquement la page ou le fichier à la demande.
Du coup, rien n’interdit de créer des chemins virtuels (« paths » en anglais) composés d’autant de pseudo répertoires que vous voulez, séparés par des « / »
Un path virtuel très très compliqué :
https://www.votredomaine.com/universA/cat1/souscat23/soussouscat12/catfinale45/produit-1234.html
Ou de tout mettre (virtuellement) à la racine
Un path complètement plat :
https://www.votredomaine.com/universA.html
https://www.votredomaine.com/catfinale45.html
https://www.votredomaine.com/produit-1234.html
La recommandation de Gary Illyes : évitez de tout mettre à la racine
Techniquement, créer des urls ne comportant pas de paths virtuels ou réels, et pointant vers un « emplacement » situé à la racine est possible, et cela fonctionne. Mais c’est déconseillé;
Voilà ce qu’il a déclaré lors de l’une des dernières sessions « SEO Office Hours » :
Pour un gros site, il est probablement préférable d’avoir une structure hiérarchique ». […] cela vous permettra de faire des choses un peu spéciales sur une seule section et permettra également aux moteurs de recherche de traiter potentiellement les différentes sections différemment ».
[…] Il s’agit là d’un élément à prendre en compte, notamment en ce qui concerne l’exploration du site.
Par exemple, le fait d’avoir une section « actualités » pour les contenus récents et une section « archives » pour les anciens contenus permettrait aux moteurs de recherche d’explorer les actualités plus rapidement que les autres répertoires. Si vous mettez tout dans un seul répertoire, ce n’est pas vraiment possible »
Gary Illyes
Google regroupe les urls en fonction de leur path
Excellent conseil : dans de nombreux cas, le crawler adaptera son comportement de crawl en fonction de scores attribués à des « buckets » d’urls, définis par leur path virtuel commun. Si un répertoire virtuel contient beaucoup de pages vides, ou sans valeur ajoutée, avec beaucoup de doublons, il y’a de fortes chances que les urls appartenant...