Vue de l'extérieur, une page qu'aucun moteur n'a trouvée ne se distingue pas d'une page jamais écrite. Cet article sépare les trois choses que l'on comprime dans le mot « indexation », dit lesquelles le Indexing Hub du panneau Semalt observe réellement, et nomme la garantie qu'aucun produit de cette catégorie ne peut offrir.
Les entreprises d'ici qui nous appellent n'ont presque jamais un problème de volume. Un bureau d'ingénieurs-conseils publie six cents pages, dont la moitié rédigées avant l'embauche du responsable actuel du marketing. Pourtant, ses deux pages décisives — le domaine de pratique qui remporte les appels d'offres et le profil de l'associé que l'on cherche par son nom — ont mis des mois à paraître.
Le réflexe est d'accuser la rédaction, qui est en général correcte. Ce qui a mal tourné se situe plus tôt, là où un moteur décide si une adresse mérite d'être connue, d'être demandée, puis d'être conservée.
Une page qui existe n'est pas une page que l'on trouve
Publier change l'état de votre système de gestion de contenu. Cela ne change rien chez Google tant qu'un robot n'a pas appris l'adresse, dépensé une requête pour elle, et qu'un processus distinct n'a pas jugé le résultat digne d'être conservé. Un échec à la première étape ne se répare pas à la troisième.
Les distinguer décide quelle équipe reçoit le travail : la découverte relève de la navigation et du plan de site, l'exploration de qui tient les serveurs et les redirections, l'acceptation de qui rédige la page.
| Étape | Ce que le moteur décide | Comment elle bloque dans une firme d'ici | Qui peut corriger |
|---|---|---|---|
| Découverte | Si l'adresse mérite d'être connue | Une page de pratique accessible seulement par un menu déroulant ; un plan de site configuré lors de la refonte de 2019 | Qui possède la navigation et le fichier de plan de site |
| Exploration | S'il faut dépenser une requête maintenant | Des requêtes absorbées par des offres expirées, des versions imprimables et dix ans d'archives | Hébergement, redirections, robots et paramètres d'URL |
| Indexation | Si ce qui est revenu mérite d'être conservé | Quarante profils issus d'un même gabarit ; trois énoncés de capacités quasi identiques | Qui rédige et approuve le texte |
Le budget d'exploration est la deuxième étape, et il ne s'achète pas. Il découle de la vitesse de réponse de votre serveur, de sa fiabilité passée, et de la valeur que le moteur attribue à une nouvelle visite. Un site qui fléchit sous la charge est exploré prudemment : le robot se freine plutôt que de vous renverser.
Pas volumineux, mais stratifié — par l'histoire et par la fonction
Les sites qui nous donnent le plus de fil à retordre ne sont pas des catalogues. Ce sont des cabinets de services professionnels, des bureaux d'ingénierie et d'environnement, des entreprises interentreprises à clientèle nationale dirigées depuis une seule adresse, dont le domaine sert des publics sans rien en commun.
Comptez les strates. Des pages de personnes, qui changent au gré des arrivées et des départs. Des projets et des études de cas, la matière qui décide des listes restreintes. Des billets d'analyse publiés quand un dirigeant trouve le temps. Des offres d'emploi qui expirent sans disparaître. Des communiqués remontant à quinze ans. Et dessous, deux ou trois refontes qui répondent encore sur d'anciennes adresses.
Pages de personnes
Le profil d'un associé est souvent la page la plus précieuse du site et la plus éphémère.
- Des partants qui répondent encore 200
- Des arrivées absentes pendant des mois
Projets et études de cas
Ce qu'un client potentiel lit avant d'accepter une rencontre, et la couche la plus enfouie.
- Accessibles par un filtre seulement
- Aucun index explorable de l'ensemble
Offres expirées
Des postes fermés depuis deux ans, des communiqués que plus personne ne lit.
- Du volume sans valeur
- Toujours listés au plan de site
Restes des refontes
Deux ou trois structures antérieures qui répondent encore, souvent sur des chemins que plus rien ne relie.
- Chemins en double vers le même texte
- Chaînes de redirection à trois sauts
Mis bout à bout, cela produit la défaillance caractéristique : six cents pages qui comptent se disputent le passage avec deux mille qui ne comptent pas, et personne n'a dit au moteur lesquelles sont lesquelles.
Ce qui consomme le budget quand la taille n'est pas en cause
Sur un site modeste, le budget est rarement épuisé par des pages légitimes. Il part dans des variantes produites par la machine, que personne n'a demandées ni vérifiées depuis la mise en ligne.
Archives paginées sans fin
Douze ans de communiqués engendrent des archives par auteur, année, mois et étiquette, toutes paginées.
- 140 communiqués, des milliers d'adresses
- Chacune répond 200
Filtres de la liste de projets
Secteur, service, région et année se combinent en plus de variantes d'URL que la firme n'a jamais eu de clients.
- Contenu quasi identique partout
- Aucune canonique déclarée
Redirections en chaîne
Chaque saut est une requête distincte : trois sauts sur deux mille adresses héritées font six mille requêtes qui n'arrivent nulle part.
- Les chaînes s'allongent à chaque refonte
- Personne ne les vérifie
Offres sans date de fin
Les postes fermés laissés en ligne sont réexplorés indéfiniment, faute d'avoir dit au moteur qu'ils étaient clos.
- Souvent la plus grosse section
- 410 est la réponse honnête
Rien de tout cela n'exige un grand site : il suffit d'un système laissé en marche plusieurs années, ce qui décrit presque tous les sites de services professionnels de la ville. Le remède tient à la suppression et à des codes de statut justes.
Le Indexing Hub et les quatre chiffres qui façonnent tout calendrier
Dans un panneau qui abrite aussi l'automatisation des campagnes, l'analytique Search Console, le suivi de positionnement et la recherche de marché par IA, le Indexing Hub traite tout ce qui précède le classement : pousser des adresses, lire des plans de site, tenir un registre. L'aperçu des modules du panneau Semalt décrit le reste.
Quatre chiffres à connaître avant d'écrire un échéancier
Toute décision de séquence dans une migration en découle, et les mal lire transforme une promesse de deux semaines en deux mois.
- Un budget quotidien de 1 000 URL par compte. Un débit, non un crédit : les journées inutilisées ne s'accumulent pas, et demain ne se dépense pas aujourd'hui.
- Des lots pouvant atteindre 10 000 URL. Cela mesure une remise, non un mouvement quotidien : remettez le maximum et vous mettez dix jours de travail en file d'un clic.
- Trois niveaux de récursion, 1 000 plans de site par tâche. Donnez au Hub un fichier ou une adresse : là où un index pointe vers d'autres index, il continue de descendre, sur trois niveaux.
- Deux tâches à la fois, une file de vingt derrière. Les tâches de plan de site s'exécutent par paires ; la troisième attend, et la file plafonne à vingt.
La livraison passe par IndexNow, l'interface par laquelle GoogleBot, BingBot et d'autres robots participants apprennent qu'une adresse est nouvelle ou modifiée. La séquence s'inverse : au lieu d'attendre le retour d'un robot dans une section vue au printemps, vous levez la main au moment du changement. Le délai coûte cher à l'arrivée d'un associé, ou pour une page de projet publiée la semaine d'une proposition.
Le plan de site comme instrument, non comme formalité
La plupart des firmes voient le plan de site comme un fichier qu'une extension écrit et que personne ne lit. Bien employé, c'est le diagnostic le moins cher dont vous disposiez : découpé et honnête, il montre quelle couche du site est négligée.
La lecture récursive fait apparaître la vérité : le Hub lit ce que le fichier dit, non ce que l'équipe croit. Une extension laissée à elle-même quatre ans énumère des chemins de préproduction, les offres expirées et les structures antérieures.
Six corrections à faire avant toute soumission
Un après-midi de ménage rachète couramment plusieurs semaines de budget parties sur des adresses que vous n'avez jamais voulu faire explorer.
- N'énumérez que des adresses qui sont leur propre canonique. Une page dont la canonique pointe ailleurs n'a rien à faire dans le fichier.
- Chaque entrée répond 200. Une redirection ou une page morte y brûle une requête. Partants et postes fermés sont les coupables habituels.
- Rien de marqué noindex n'y figure. Inviter un robot à chercher ce que vous lui avez dit d'écarter est la contradiction que nous voyons le plus souvent.
- Découpez par fonction, délibérément. Des fichiers distincts pour personnes, projets, analyses, carrières et communiqués transforment un chiffre opaque en cinq.
- Les horodatages doivent vouloir dire quelque chose. Quand la date de modification bouge à chaque compilation nocturne, le robot cesse de la consulter.
- Les versions linguistiques se répondent dans les deux sens. Une page anglaise qui désigne sa contrepartie française a besoin du pointeur de retour, et les deux doivent concorder avec leurs canoniques.
La limite de deux tâches compte plus qu'il n'y paraît. Un ensemble structuré — un index parent, cinq enfants par fonction — se traite comme une seule tâche. Cinquante soumissions éparses finissent par passer, mais vous perdez toute vue de ce qui a été traité.
Quand une firme fusionne ou change de marque et que tout bouge d'un coup
Cette ville change de plaque plus souvent que d'autres. Des cabinets fusionnent, une pratique nationale en absorbe une locale, une firme abandonne le patronyme d'un fondateur, et le domaine suit. Toute l'arborescence bouge en une soirée, à une date fixée par des gens qui n'ont jamais entendu parler de budget d'exploration.
La suite est prévisible. La recherche de marque — l'essentiel de ce qui compte quand l'acheteur est un comité — se met à renvoyer l'ancien domaine, une fiche d'annuaire, ou rien d'utile. Chaque page de crédibilité siège à une adresse dont aucun moteur n'a été informé.
| Décision au lancement | Ce que le robot rencontre | Coût pour l'allocation quotidienne | Meilleure approche |
|---|---|---|---|
| Tout l'ancien domaine redirige vers la nouvelle page d'accueil | Des milliers d'adresses qui s'effondrent sur une seule destination | Chaque adresse héritée est demandée, aucune utilement | Faire correspondre page à page ; l'accueil seulement à défaut d'équivalent |
| Ancien domaine retiré le jour du lancement | Plus rien ne répond ; l'autorité accumulée est jetée | Non dépensée, mais non récupérable | Garder l'ancien domaine en redirections permanentes au moins un an |
| Les deux marques en ligne pendant la transition | Deux copies complètes de la même firme | Allocation coupée en deux sur un ensemble dupliqué | Une marque canonique dès le premier jour ; l'autre redirige, jamais ne double |
| Tout soumis d'un coup, sans tri | Les pages de pratique en file derrière des offres expirées | Des semaines avant d'atteindre les pages commercialement critiques | Soumettre par valeur mesurée : pages payantes d'abord, archives en dernier ou jamais |
Rien de tout cela ne se séquence tant que vous ignorez quelles pages rapportaient sous l'ancien nom. Clics, impressions et historique de position par page proviennent des vues Search Console intégrées au panneau, qui exportent jusqu'à dix mille lignes en CSV ou en JSON. Triez par impressions et vous tenez l'ordre de travail ; Stream, l'assistant de la section My SEO, accepte de telles listes par lots.
Lire l'état d'un lot sans se raconter d'histoires
L'étape du milieu est celle que le Hub peut réellement attester. Chaque adresse porte une entrée : quel robot est passé, quand, quel statut a été renvoyé, et le détail de chaque échec. Trois compteurs tournent au-dessus : soumises, trouvées, échouées.
- Deux totaux, deux sens. L'écart entre le soumis et le trouvé est l'écart de découverte. Encore large une semaine plus tard, le plan de site ou le maillage est en cause.
- Un 200 daté atteste l'arrivée, jamais l'acceptation. Il confirme que le robot a demandé et que le serveur a répondu. La conservation, le registre ne la tranche pas.
- Les échecs se regroupent, et la forme nomme la cause. Trente erreurs sur une seule branche désignent le routage ; les mêmes réparties uniformément, la charge du serveur.
- Jugez sur les impressions, pas sur l'impression de progresser. Deux semaines après un lot, vérifiez si les pages soumises récoltent des impressions.
Questions fréquentes
Nos nouvelles pages de pratique ont été soumises il y a un mois et rien ne paraît. Que s'est-il passé ?
Ouvrez le registre. Une adresse sans requête consignée n'a jamais atteint un robot : échec de découverte. Une adresse avec des 200 consignés et rien dans les résultats a été lue puis écartée : échec de contenu.
Pourquoi le chiffre quotidien est-il de 1 000 quand un lot en accepte 10 000 ?
Ils mesurent deux quantités. Le lot compte ce que vous pouvez mettre en file d'un seul geste ; le chiffre quotidien compte ce qui sort de la file par compte et par jour. Remettez dix mille adresses et vous avez engagé dix jours.
Devrions-nous pousser tout le site et laisser le moteur trancher ?
Rarement. Une page à zéro impression depuis douze mois demande une fusion ou un retrait, pas une poussée. Le budget dépensé là repousse les pages qui rapportent, et réoffre une matière déjà refusée.
Nos profils de conseillers sortent tous du même gabarit. Est-ce un problème de duplication ?
Cela le devient quand le gabarit forme l'essentiel de la page. Une photo, un titre et un paragraphe passe-partout ne donnent au moteur aucune raison de conserver quarante variantes. Deux cents mots précis — projets nommés, secteurs, titres professionnels — changent la donne. Pour les dix personnes que les clients cherchent par leur nom, c'est un trimestre de travail.
Combien de temps garder l'ancien domaine après une fusion ?
Au moins un an, et il y a peu de raisons de l'éteindre un jour. Des redirections permanentes vers les équivalents ne coûtent rien, et les liens venus d'annuaires sectoriels et d'anciennes propositions continuent d'arriver. Retirer le domaine au lancement jette une autorité qui ne se reconstruit pas.
Le calcul de clôture et par où commencer lundi
Prenons un cas réaliste. Un bureau d'ingénieurs-conseils de 240 personnes fusionne avec une pratique plus petite et passe à un nouveau domaine. Le site vivant combiné compte environ 900 pages, derrière lesquelles se trouvent quelque 2 600 adresses héritées sur deux anciennes structures. Tout doit être découvert de nouveau : 3 500 adresses entrent au plan.
À mille par jour, l'ensemble passe en quatre jours, ce qui semble anodin. L'arithmétique qui compte est autre : sur ces 3 500 adresses, 180 environ décident si la firme survit à une liste restreinte. Ces 180 partent le premier jour, et un plan de site nettoyé les garde hors de la file derrière onze ans d'offres d'emploi. La plupart des 2 600 adresses héritées ne devraient jamais être soumises.
Le rapport tient à plus grande échelle. Une firme fusionnée à 40 000 adresses affronte quarante jours au débit maximal, ce qui n'est une crise que si les pages qui facturent tombent au trente-huitième jour. La séquence est la discipline.
Commencez donc étroit, dans cet ordre. Découpez le plan de site par fonction et retirez tout ce qui ne répond pas 200. Exportez les pages qui récoltent déjà des impressions, triez sur cette colonne, soumettez dans cet ordre. Notez les compteurs comme base, relus chaque semaine. Là où la file de développement est la contrainte, l'automatisation couvre le terrain qui n'en dépend pas : AutoSEO, à 149 $ US par mois et par domaine, mène la découverte de mots-clés et le placement de liens sans mobiliser de mise en production, et quatre à huit semaines restent le délai habituel avant un mouvement mesurable. Notre page de services techniques décrit où une équipe externe prend le relais ; pour parcourir les modules vous-même, ouvrez le tableau de bord Semalt et connectez votre propriété.
D'autres textes sur la recherche technique et la recherche de marque se trouvent dans nos analyses.