Aller au contenu
ExternFlow
Actualités

Recherche agentique : pourquoi un moteur IA reformule votre question avant de chercher ses sources

Perplexity a publié le 9 septembre Q2D-Web, un banc d’essai bâti sur 190 millions de pages et 69 721 requêtes reformulées par des agents. Le document confirme un point que le SEO ignore encore largement : entre la question posée et les sources citées, le moteur en génère plusieurs autres. Les briefs de rédaction n’en tiennent pas compte.

Robot doté d'un casque face à des écrans de données, image d'un assistant de recherche IA
Par Setraniaina Andrianajason Publié le 13 septembre 2026
7 min de lecture
Partager
Sommaire
  1. Ce que contient Q2D-Web
  2. Trois façons de juger qu’un document est pertinent
  3. La chaîne qui sépare la question de la citation
  4. Ce que le benchmark ne dit pas
  5. Ce que ça change dans un brief de rédaction
  6. Le métier du rédacteur SEO externalisé se déplace
  7. Un mot-clé, une page : la règle qui a tenu vingt ans commence à coûter cher
  8. Sources et références
  9. FAQ - Questions sur la recherche agentique

« Quel prestataire BPO choisir pour externaliser mon service client en français ? » Voilà ce que tape l’utilisateur, et ce n’est pas ce que le moteur envoie au Web.

Un assistant agentique décompose. Il produit une requête principale, des requêtes de soutien, des formulations alternatives, des recherches de contexte, puis d’autres requêtes nourries de ce qu’il vient de trouver. Le corpus publié par Perplexity rassemble 69 721 requêtes de ce type, prélevées sur neuf mois de trafic réel, en dix langues.

Pour une agence ou une équipe de contenu, la conséquence est immédiate. Un brief construit autour d’un mot-clé principal unique optimise pour une formulation que le moteur n’utilisera peut-être jamais. C’est tout l’enjeu de la recherche agentique.

Ce que contient Q2D-Web

Perplexity Research décrit Q2D-Web comme un banc d’essai privé, doublé d’un classement public, consacré à la première étape de récupération documentaire dans les systèmes RAG agentiques. Traduction : la phase où le moteur choisit ses pages candidates, avant tout reclassement et avant toute rédaction de réponse.

Élément du jeu de données Volume publié
Documents Web indexés 190 millions
Requêtes reformulées par des agents 69 721
Langues couvertes Dix
Période de collecte Neuf mois de trafic de production anonymisé
Jugements positifs par requête 99,6 en moyenne sur le jeu combiné

Le point d’attention porte sur le mot « première ». Ce que mesure Q2D-Web, c’est le filtre d’entrée, celui qui décide quelles pages entrent dans la sélection. Une page écartée là ne sera jamais reclassée, jamais citée, jamais lue. La suite du pipeline ne la verra pas.

Treize systèmes de récupération ont été comparés sur cette base. L’échelle est inhabituelle : la plupart des jeux d’évaluation publics du domaine se comptent en millions de documents, pas en centaines de millions.

Trois façons de juger qu’un document est pertinent

Plutôt que de désigner une vérité unique, Perplexity superpose trois jeux de jugements.

  • Les citations retiennent les documents que l’agent a réellement utilisés comme source.
  • Le classement web ajoute jusqu’à cinquante documents sélectionnés par le système de récupération interne.
  • Le jeu combiné fusionne les deux, puis complète par des jugements produits par un modèle.

Cette construction a un mérite. Elle sépare ce qui a été cité de ce qui a seulement été jugé pertinent, deux choses que la plupart des outils de suivi confondent encore, y compris quand ils prétendent mesurer les sources que citent les IA en français. L’étude relève aussi que les performances relatives varient fortement selon le domaine, la langue et le type de requête.

La chaîne qui sépare la question de la citation

Le schéma implicite du SEO classique reste simple : une requête, une page, un classement. Un moteur agentique intercale plusieurs étapes.

Prompt de l’utilisateur, reformulation, sous-requêtes, récupération des documents, reclassement, génération, citations. Sept étapes au lieu de trois. Chacune peut écarter une page pourtant bien optimisée pour la question d’origine.

Un exemple rend la chose concrète. Sur « externaliser son service client », un agent peut aller chercher séparément les modèles de facturation, les niveaux de service constatés, les destinations disponibles et les obligations contractuelles. Quatre recherches, quatre familles de sources, une seule réponse à l’écran.

Pour un contenu, la conséquence tient en une idée : la visibilité dépend de sa capacité à répondre à plusieurs facettes d’un même problème, pas à une formulation exacte. Ce qui rejoint largement ce qui sépare déjà le SEO du GEO.

Ce que le benchmark ne dit pas

Q2D-Web n’est pas un guide de visibilité. Il évalue des modèles de récupération documentaire, rien d’autre. Aucune recette de citation n’en découle : ni nombre de liens entrants, ni longueur de contenu, ni balisage à ajouter.

Perplexity reconnaît une seconde limite, plus intéressante. Le jeu de données provient en partie de son propre trafic de production. Ses modèles peuvent donc bénéficier d’une proximité avec cette distribution de requêtes, même si les données d’évaluation ont été séparées de celles d’entraînement.

Un classement publié par un moteur sur ses propres données se lit avec la prudence réservée à toute étude fournisseur.

Reste que l’information est rare. Peu d’acteurs publient à cette échelle, et aucun moteur généraliste n’a ouvert de jeu de données comparable à ce jour. À défaut d’une recette, on y gagne une carte du terrain.

Ce que ça change dans un brief de rédaction

C’est là que le sujet devient opérationnel pour quiconque pilote une production de contenu externalisée.

Brief classique Brief adapté aux moteurs agentiques
Mot-clé principal unique Intention principale et intentions secondaires
Mots-clés secondaires Questions intermédiaires qu’un agent poserait
Plan Hn Plan Hn et entités attendues dans le texte
Longueur cible Preuves exigées : chiffres, sources, dates
Aucune consigne comparative Scénarios de comparaison à couvrir

Rien d’exotique là-dedans. Ce sont des rubriques qu’un bon cahier des charges SEO côté donneur d’ordre contient déjà en partie. La nouveauté tient à leur statut : elles cessent d’être un supplément pour devenir la colonne vertébrale du brief.

Le coût, lui, est réel. Un brief de ce type demande une heure de préparation au lieu de vingt minutes, et il suppose quelqu’un capable de formuler les sous-questions à la place de l’agent. Sur une production de trente articles par mois, l’écart se chiffre vite.

Le métier du rédacteur SEO externalisé se déplace

Si la visibilité se joue sur des sous-requêtes et des entités, la compétence attendue n’est plus seulement rédactionnelle. Elle mélange contenu, données, SEO et récupération d’information.

  • La cartographie des prompts remplace peu à peu la liste de mots-clés.
  • L’analyse des sous-requêtes documente ce que l’agent cherche vraiment.
  • Le repérage des entités structure le texte autour de concepts, pas de formulations.
  • Le suivi des citations mesure ce qui est repris, et par quel moteur.
  • L’audit de récupération vérifie si les pages sont candidates ou réellement citées.

La question qu’un donneur d’ordre pose à son prestataire change aussi. Elle passe de « sur quels mots-clés me positionnez-vous ? » à « quelles questions intermédiaires mon contenu couvre-t-il ? ». Le contrôle qualité d’une rédaction SEO externalisée devra suivre, et les grilles actuelles n’y sont pas prêtes.

Un mot-clé, une page : la règle qui a tenu vingt ans commence à coûter cher

Q2D-Web ne dit pas comment être cité. Il dit comment les moteurs vont chercher. Cela suffit à périmer une partie des habitudes de brief.

Un brief à mot-clé unique optimise pour une question que le moteur reformule. Le reste du travail consiste à documenter les questions intermédiaires, et cela se cadre au brief, pas à la relecture.

Reprenez un brief en cours et listez les cinq sous-questions qu’un agent poserait à votre place. L’écart se voit tout de suite.

Sources et références

Cet article s’appuie notamment sur la publication officielle de Perplexity consacrée à Q2D-Web, sur le portail de son équipe de recherche et sur l’annonce faite aux développeurs de sa plateforme, qui décrivent le périmètre du banc d’essai ainsi que ses limites. Côté moteur généraliste, la documentation Google Search Central relative aux fonctionnalités de recherche par IA précise ce que les équipes éditoriales peuvent réellement contrôler, quand les consignes sur les contenus utiles rappellent le cadre qui prévaut avant toute considération de récupération documentaire.

FAQ - Questions sur la recherche agentique

Qu’est-ce que la recherche agentique ?

C’est le mode de fonctionnement des assistants qui reformulent une question avant d’interroger le Web. Le moteur génère plusieurs sous-requêtes, récupère des documents, les reclasse, puis rédige sa réponse.

Que mesure exactement le benchmark Q2D-Web ?

Il évalue la première étape de récupération documentaire, celle qui sélectionne les pages candidates. Le jeu de données réunit 190 millions de documents et près de 70 000 requêtes reformulées par des agents.

Ce benchmark permet-il d’être cité par Perplexity ?

Non. Il compare des modèles de récupération et ne livre aucune consigne éditoriale sur les liens entrants, la longueur ou le balisage.

Faut-il abandonner le mot-clé principal dans un brief ?

Pas l’abandonner, le relativiser. Le mot-clé reste utile pour cadrer l’intention, mais il ne suffit plus : le brief doit aussi lister les questions intermédiaires et les entités attendues.

Comment adapter un brief de rédaction externalisé ?

En ajoutant les intentions secondaires, les questions intermédiaires, les entités, les preuves exigées et les scénarios de comparaison. Le contrôle qualité porte alors sur la couverture des sous-questions, plus sur la densité de mots-clés.

La lettre ExternFlow

Chaque semaine, une sélection d’analyses sur le BPO, l’externalisation et le SEO, pensée pour les décideurs. Pas de publicité, pas de revente d’adresse.

Par Setraniaina Andrianajason

Je suis Setraniaina, fondateur de LAPLUME.MG et consultant SEO/GEO indépendant via Red Island SEO, depuis Madagascar. Passionné de nouvelles technologies, d'IA et de marketing digital, je partage sur ExternFlow mes analyses sur l'externalisation, le BPO et le référencement.

Dernières actualités

Restez connectés avec ExternFlow