La plupart des sites d'ici n'ont pas un problème d'exploration. Ils ont un problème de décision déguisé en problème technique : personne n'a tranché quelles pages devaient exister, ni dans quelle langue, et le robot se débrouille avec une liste d'adresses que personne n'a conçue.
Publier ressemble à une fin. La page est approuvée, elle passe en ligne, quelqu'un vérifie que l'adresse répond, et la tâche est cochée. Du point de vue d'un moteur, il ne s'est presque rien passé : l'adresse doit encore être trouvée, récupérée, puis jugée digne d'être conservée.
Entre ces étapes se loge un goulot d'étranglement qui ne produit aucun message d'erreur. Des pages restent sans visite pendant des semaines et rien n'est signalé en échec parce que rien n'a échoué : le robot n'est jamais descendu si bas dans la liste.
Publiée, découverte et indexée sont trois conditions distinctes
On les traite comme un seul événement, à tort. Une page publiée existe sur votre serveur ; une page découverte est une adresse que le moteur connaît ; une page indexée est une adresse qu'il a décidé de garder. Chaque passage échoue pour ses raisons propres.
La découverte passe surtout par les liens et les plans de site. Une page à deux clics de l'accueil est trouvée en quelques jours. Une fiche de projet accessible seulement par une liste filtrée attend des mois ; sans aucun chemin entrant, elle peut ne jamais être trouvée.
L'indexation, elle, est un jugement. Le moteur se demande si l'adresse ajoute quelque chose à ce qu'il détient déjà. Une page française qui répète l'anglaise phrase par phrase, une fiche qui ne se distingue de quarante autres que par le nom du client, une offre d'emploi comblée l'an dernier : chacune est récupérée, évaluée et refusée sans bruit.
Ce qui dépense réellement l'attention du robot
Chaque site reçoit un rythme de travail approximatif : un nombre de requêtes par période, fonction de la vitesse de réponse du serveur, de la fréquence des changements et de la part du déjà récupéré qui méritait d'être gardée. Aucun chiffre publié, aucune molette.
L'erreur est d'imaginer que cette allocation va à vos pages importantes. Elle va à ce que le robot trouve, dans l'ordre où il le trouve. Sur un site moyen avec portfolio, deux langues et une décennie d'histoire, la majorité des récupérations tombe sur des adresses que personne ne défendrait en réunion.
| Ce qui absorbe les récupérations | Comment cela arrive | Ce que cela vous coûte |
|---|---|---|
| Combinaisons de filtres et de tris | Une liste de projets où chaque facette crée une adresse | Des milliers d'adresses pour quelques dizaines d'éléments |
| Une arborescence traduite en miroir | Tout le site doublé parce que le bilinguisme semblait aller de soi | La moitié de l'allocation sur des pages que personne ne cherche |
| Des paramètres de suivi en circulation | Des étiquettes de campagne partagées, puis reliées | Une page récupérée plusieurs fois sous des adresses différentes |
| Des offres d'emploi encore en ligne | Postes comblés, pages laissées en place et toujours liées | Des récupérations sur du contenu faux autant qu'inutile |
Le temps de réponse du serveur compte plus qu'on ne le croit. Un robot qui trouve des pages répondant en deux cents millisecondes en prend davantage par visite ; devant quatre secondes, il lève le pied, et il le lève sur tout le site. Un seul gabarit coûteux ralentit la découverte partout.
L'arborescence française en miroir, et les adresses qu'elle crée
L'instinct, ici, est de tout traduire. Il part d'une bonne intention, mais il s'applique comme une politique plutôt que comme une suite de décisions. Chaque page anglaise reçoit sa contrepartie française, le nombre d'adresses double du jour au lendemain, et personne ne demande laquelle de ces contreparties quelqu'un chercherait.
Les quarante fiches de projet d'un studio deviennent quatre-vingts ; la documentation d'une firme logicielle double. La moitié des nouvelles adresses décrivent des mandats pour des clients de Californie et de Londres dans une langue que ces clients ne lisent pas, en concurrence avec les versions anglaises qui faisaient déjà le travail.
Les pages qui ne devraient pas exister deux fois
Du contenu destiné à un marché qui ne cherche que dans une langue, dupliqué parce que la politique l'exigeait.
- Études de cas pour clients étrangers
- Documentation à terminologie anglaise
Les pages qui ont vraiment besoin des deux
La poignée de pages qu'un client et un candidat ouvriront tous les deux, souvent présentes dans une seule langue.
- Carrières, équipe et culture du studio
- La page qui explique ce que fait l'entreprise
Les deux erreurs cohabitent dans le même immeuble : des centaines d'adresses traduites que personne n'interroge, et trois ou quatre pages dont deux publics très différents ont besoin dans les deux langues, qui n'existent que dans une. La première draine l'allocation, la seconde perd la demande, et aucun rapport d'exploration ne les signale.
L'exercice utile est inconfortable et rapide. Prenez la liste d'adresses et répondez à une seule question par page : qui cherche ceci, et dans quelle langue ? Trois réponses sont légitimes — anglais seulement, français seulement, ou vraiment les deux. Une page sans réponse ne se traduit pas ; elle se reconsidère.
- Vendu à l'étranger, écrit en anglais. Les pages de réalisations et de capacités visant des studios et des éditeurs hors Québec réclament rarement un jumeau français.
- Embauché ici, écrit en français. Recrutement, culture et localisation se lisent en français, et c'est là qu'une version manquante vous coûte quelque chose.
- Lu par tout le monde, requis dans les deux. La description de l'entreprise, les coordonnées et les grandes pages de services portent les deux publics et méritent deux textes écrits.
- Personne ne répond. Si vous ne pouvez nommer qui cherche une page, la question n'est pas de la traduire, mais de la garder.
Portfolios et fiches de projet qui ne cessent de gonfler
Les firmes créatives et techniques accumulent des pages de réalisations plus vite que tout le reste. Chaque mandat terminé mérite sa fiche : un jeu livré, une séquence rendue, une collection photographiée, un programme d'usinage livré. Rien n'est retiré, parce que retirer un mandat donne l'impression de le nier.
Dix ans plus tard, le portfolio est la plus grosse section et la moins différenciée. Les fiches partagent un gabarit, un vocabulaire et des paragraphes entiers de remplissage. Doublée en français, cette seule section peut représenter la majorité des adresses du site.
L'arithmétique n'a rien d'exotique. Quarante projets, deux langues et six façons de filtrer la liste produisent 480 adresses pour décrire quarante réalisations. Le robot les traite comme des candidates, les trouve presque identiques, et se forge une opinion sur la fréquence de ses retours.
Le correctif est éditorial avant d'être technique. Une douzaine de fiches écrites assez profondément pour tenir seules rapportent plus que quatre-vingt-dix quasi-doublons. Les combinaisons de filtres ne devraient pas générer d'adresses explorables, sauf si quelqu'un a décidé qu'une combinaison précise est une page à part entière.
Les affichages de postes qui survivent au poste
Les pages de recrutement sont le cas le plus net de contenu périssable, et là où les studios embauchent par vagues, elles s'empilent vite. Une équipe de vingt personnes peut afficher trente postes en trois ans. Chacun est une page liée depuis un index, et presque aucune n'est retirée.
Une offre expirée est pire qu'une page inutile. Elle concurrence vos postes actuels sur les mêmes termes, et raconte quelque chose de faux à qui la trouve. En français, là où vit le public du recrutement, elle atteint exactement les gens que vous visez.
| Situation | Traitement courant | Meilleur traitement |
|---|---|---|
| Le poste est comblé | Page laissée en ligne, discrètement déliée | Redirection permanente vers l'index des carrières |
| Le poste revient chaque année | Une nouvelle adresse à chaque cycle | Une page stable, mise à jour sur place |
| L'affichage a beaucoup circulé | Suppression sèche, liens brisés | Redirection, pour garder les liens accumulés |
La même logique couvre les pages d'événement, les annonces et les pages d'atterrissage d'un lancement clos depuis deux ans. Rien de dramatique là-dedans ; simplement des récupérations que votre travail actuel réclamait.
Le plan de site fait un travail que rien d'autre ne fait
Un plan de site n'est pas un levier de classement. C'est une liste d'adresses que vous êtes prêt à défendre, remise en main propre plutôt que déduite de votre navigation. Là où les sections profondes ne sont accessibles que par des filtres, il fait la différence entre être trouvé ce mois-ci et être trouvé un jour.
Un plan de site honnête est donc une déclaration de politique éditoriale ; les outils de plan de site ne rapportent que ce que vous leur remettez. S'il contient les pages censées mériter du trafic, dans les langues où elles doivent exister, il décrit à quoi sert le site.
Soumission, lecture et file d'attente
Ce que le module accepte, jusqu'où il lit, combien il en tient à la fois.
- Fichier téléversé ou adresse. Soumettez un plan de site comme fichier, ou pointez le module vers son adresse.
- Lecture récursive sur trois niveaux. Des fichiers d'index pointant vers d'autres fichiers d'index sont suivis sur trois niveaux, ce qui couvre toute structure réellement utile.
- Jusqu'à 1 000 plans de site par travail. De quoi soumettre un grand parc multilingue en une seule opération.
- Deux travaux actifs, vingt en attente. Deux traitements simultanés et vingt autres en file : une migration se planifie au lieu de partir d'un coup.
Trois niveaux d'imbrication ressemblent à un détail d'implémentation jusqu'à une migration. Les grands sites découpent par langue, puis par section, puis par date ; un tel parc n'est lu correctement que si l'analyseur suit la chaîne jusqu'en bas. S'il s'arrête au premier fichier, tout ce qui est en dessous reste invisible et la soumission paraît quand même réussie.
Gardez les arborescences de langue dans des plans distincts. Cela ne coûte rien et transforme la soumission en un décompte par langue : tant d'adresses françaises offertes, tant trouvées, tant encore en attente.
Limites quotidiennes, lots, IndexNow et lecture du journal
La soumission se heurte à des plafonds fixes, et les connaître transforme une intention en calendrier. Le traqueur travaille avec un budget de 1 000 adresses par jour et par compte, tandis qu'une soumission en masse en prend jusqu'à 10 000 dans un même lot.
Le lot
Jusqu'à dix mille adresses remises en une seule opération, puis traitées au fil des jours.
- Préparé une fois, soumis une fois
- Dix jours de budget à pleine taille
Le budget quotidien
Mille adresses par jour et par compte, ce qui détermine votre calendrier.
- Dépensez-le sur des pages défendables
- Ordonnez le lot en conséquence
La soumission passe par l'intégration IndexNow, un protocole de notification : il annonce aux robots participants, dont GoogleBot et BingBot, qu'une adresse est apparue ou a changé. Cela raccourcit l'attente avant la récupération et ne change rien à ce qui suit.
C'est à la lecture du statut d'un lot que la discipline se voit. Le journal consigne, par adresse, la venue horodatée d'un robot, le statut renvoyé et le détail des échecs, à côté des compteurs en direct des adresses soumises, trouvées et en échec. Ces trois compteurs répondent à trois questions différentes.
- Soumises dit ce que vous avez demandé. Un décompte de vos propres gestes, muet sur le résultat — et le chiffre que l'on cite en réunion de suivi.
- Trouvées dit que le robot est passé. Une visite horodatée est une vraie preuve : l'adresse était joignable et le contenu a été récupéré.
- En échec dit quoi corriger aujourd'hui. Erreurs de serveur, chaînes de redirection et adresses mortes, chacune avec son détail. Court et actionnable.
- Aucun ne dit indexée. Savoir si une page a été gardée est une autre question : seule son apparition y répond.
Un fort taux d'échec est plutôt une bonne nouvelle. Le cas plus difficile est le lot où tout a été soumis, tout a été visité, et rien ne paraît. Ce n'est pas une panne technique, c'est le moteur qui refuse des pages, et la réponse est éditoriale : moins d'adresses, écrites pour quelqu'un en particulier.
Questions courantes
Faut-il soumettre aussi nos pages françaises, ou seulement les anglaises ?
Soumettez les pages françaises que vous défendriez une par une. Si l'arborescence française reproduit l'anglaise au complet, tout soumettre dépense le budget quotidien sur des adresses qui ne seront pas gardées. Soumettez ce qui a été écrit pour un public francophone.
Combien de temps attendre avant de conclure qu'une page ne sera pas indexée ?
Si le journal montre une visite de robot et que plusieurs semaines passent sans aucune apparition, traitez la page comme refusée plutôt que retardée. Resoumettre le même contenu donnera le même résultat. Modifiez la page, fusionnez-la avec une plus solide, ou acceptez qu'elle n'a pas à exister.
Nous avons dix mille adresses de portfolio. Par où commencer ?
Pas par la soumission. Cherchez d'abord combien de ces adresses sont des combinaisons de filtres plutôt que des pages, combien sont des traductions que personne ne demande. Cela retranche généralement l'essentiel de la liste, et le reste entre dans le budget quotidien.
IndexNow rend-il l'indexation plus rapide ou plus probable ?
Plus rapide, parfois. Plus probable, non. Il informe les robots participants qu'une adresse a changé, ce qui avance la visite. La décision de garder la page se prend après la visite et ne dépend pas de la façon dont le robot en a entendu parler.
Supprimer de vieilles pages nous nuit-il ?
Retirer des pages qui ne rapportent rien et se répètent aide généralement, à condition de rediriger tout ce qui a accumulé des liens. C'est la suppression sèche qui nuit : les adresses brisées gaspillent des récupérations et les liens accumulés disparaissent.
Le calcul, et la liste qu'il vaut la peine d'écrire d'abord
Prenons un exemple. Un studio compte 9 400 adresses : 3 100 pages anglaises, 3 100 contreparties françaises produites par politique, et environ 3 200 combinaisons de filtres et d'étiquettes. À mille par jour, tout soumettre prend dix jours de budget, et cela tient dans un seul lot de dix mille avec de la marge.
Faites maintenant le passage éditorial en premier. Les combinaisons de filtres ne sont pas des pages et sortent. Parmi les contreparties françaises, quatre cents servent un public francophone. Il reste environ 3 500 adresses à soumettre : trois jours et demi de budget, et derrière chaque entrée il y a quelqu'un.
Les jours économisés sont la petite part. Le vrai gain, c'est que le robot rencontre désormais un site où chaque adresse récupérée a été choisie par quelqu'un. Le module d'indexation vous donne les plafonds, la file et le journal par adresse ; la liste que vous lui remettez, c'est à vous de l'écrire.
Si le passage éditorial est ce que vous reportez sans cesse
Les décisions restent les vôtres ; l'exécution peut se loger ailleurs.
- AutoSEO à 149 USD par mois, par domaine. Termes trouvés et priorisés automatiquement, liens bâtis sans vous, recommandations sur le site et l'analytique. Autour de 200 CAD — conversion approximative.
- FullSEO à 500 USD par mois, par domaine. Termes choisis à la main avec repli automatique, placements tenus à un seuil d'autorité de domaine, modifications relues par une personne, et une équipe de spécialistes, de développeurs et de rédacteurs derrière.
- Stream, l'assistant de My SEO. Un fil continu de réponses, de rapports, de nouveaux liens et de tâches ouvertes, rattaché aux données du projet, et il accepte les listes d'adresses en lot.
Commencez par une liste, pas par un lot. Exportez toutes les adresses, triez par section, et marquez chacune du public qu'elle sert et de la langue où ce public cherche. L'exercice prend un après-midi et retranche souvent le tiers du site. Ce qui reste passe par une soumission en masse, et le travail structurel qui suit a un ordre défendable. La suite est sur notre blogue.
Pour comparer ces plafonds à votre propre nombre d'adresses, reliez une propriété à un tableau de bord rattaché à votre domaine. Le chiffre à surveiller n'est pas le nombre d'adresses soumises, mais le nombre auquel vous pouvez associer un public — et dans une entreprise qui vit en deux langues, ce nombre est toujours plus petit, et meilleur, que celui du plan de site.