Accueil GEO & visibilité dans l’IAChatGPT 5.6 multiplie les recherches site: et privilégie davantage les sources officielles

ChatGPT 5.6 multiplie les recherches site: et privilégie davantage les sources officielles

Chat GPT, illustration
Illustration générée par IA — Position Zéro

Plusieurs analyses réunies par Lily Ray montrent que ChatGPT lance davantage de recherches intermédiaires et utilise beaucoup plus souvent l’opérateur site:. Dans le même temps, le nombre de pages récupérées augmente alors que le nombre de domaines finalement cités tend à diminuer.

Lily Ray, consultante SEO reconnue pour ses travaux sur la qualité des résultats et la recherche générative, a publié une analyse consacrée à l’évolution des fan-out queries de ChatGPT. Elle rassemble plusieurs études récentes, complétées par ses propres observations réalisées avec Peec AI, Profound, Resoneo, FanoutFox et Google Search Console.

Les fan-out queries deviennent un indicateur de visibilité important, car elles correspondent aux recherches intermédiaires lancées par ChatGPT avant la construction de sa réponse. Leur évolution permet donc d’observer les sources que le système cherche à consulter.

ChatGPT lance davantage de recherches intermédiaires

Plusieurs travaux cités par Lily Ray observent une hausse du nombre de recherches déclenchées pour un même prompt.

Dans les données de David Konitzny chez Peec AI, la part des prompts ne générant qu’une seule fan-out query passe de 94 % à 43,5 % après l’arrivée de GPT-5.6.

Le nombre moyen de sources récupérées passe parallèlement d’environ 12 à 24, tandis que les prompts nécessitant une deuxième série de recherches progressent d’environ 5 % à 33,5 %.

Chris Long, chez Nectiv, observe lui aussi cette évolution sur environ 4 000 prompts. Dans son analyse, le nombre moyen de fan-outs passe de 2,17 à 7,61 par prompt, avec une chaîne atteignant jusqu’à 29 recherches successives.

Ces résultats prolongent les observations déjà faites sur la manière dont ChatGPT choisit et récupère ses sources.

L’opérateur site: progresse fortement

Le changement le plus marqué concerne l’utilisation de l’opérateur site: dans les recherches générées par ChatGPT.

Dans les données de Peec AI citées par Lily Ray, sa présence passe d’environ 0,3 % à 23 % des fan-out queries. Dans l’analyse de Nectiv, réalisée avec une autre méthode de collecte, site: apparaît dans 64 % des requêtes étudiées.

Lily Ray souligne que ces écarts peuvent notamment venir des méthodes utilisées. Certaines études extraient les fan-outs depuis l’interface de ChatGPT, tandis que d’autres utilisent l’API OpenAI.

Publicité

Les différentes analyses convergent néanmoins sur une forte progression des recherches ciblées vers des domaines précis.

Selon les observations réunies par Lily Ray, ChatGPT utilise aussi davantage des termes comme “official” ou “gov” lorsque le contexte s’y prête.

Les sources officielles ressortent davantage selon les requêtes

Lily Ray observe également des différences selon le type d’information recherché.

Dans ses propres tests, ChatGPT tend à utiliser des sites gouvernementaux pour certaines requêtes sensibles, notamment dans les domaines juridiques. Sur un échantillon d’environ 20 prompts juridiques, toutes les citations provenaient de domaines .gov.

Pour les prix et les caractéristiques produits, elle observe davantage de recherches directement orientées vers les sites des marques ou fabricants.

Pour les opinions ou les avis, ChatGPT se tourne plus fréquemment vers Reddit ou des plateformes spécialisées.

Cette logique rejoint d’autres analyses montrant que les marques reconnues ressortent plus souvent dans ChatGPT.

ChatGPT récupère plus de pages mais cite moins de domaines

L’analyse distingue également deux notions différentes : les pages récupérées pendant la recherche et les pages effectivement citées dans la réponse.

Selon les données réunies par Lily Ray, le volume de pages récupérées augmente, tandis que le nombre de domaines différents finalement visibles dans les citations diminue.

Les travaux de Resoneo cités dans son analyse montrent par exemple que le nombre de domaines cités par réponse est passé de 19 à 15 après une précédente évolution du modèle.

Ce phénomène avait déjà été observé dans une autre analyse relayée par Position Zéro montrant que ChatGPT consulte davantage de sites mais en cite moins.

Publicité

La distinction reste importante, car une page peut être récupérée pendant le processus de recherche sans apparaître ensuite parmi les sources visibles.

Être présent dès la première recherche augmente les chances d’être cité

Lily Ray cite également les travaux de Suganthan Mohanadasan, basés sur 57 conversations et 3 554 pages récupérées.

Dans 21 des 27 premières requêtes étudiées, ChatGPT intégrait des noms de marques non mentionnés dans le prompt initial. Le phénomène apparaissait dans 11 des 13 catégories de produits analysées.

Les marques présentes dans ces premières fan-out queries étaient ensuite citées dans 68,9 % des cas. À l’inverse, les pages simplement récupérées sans présence préalable de la marque dans la requête étaient citées dans 2,1 % des cas.

Au total, seulement 110 des 3 554 pages récupérées, soit environ 3,1 %, ont finalement été utilisées dans une réponse visible.

Cette différence entre récupération et citation rejoint les travaux consacrés aux cas où les sources utilisées ne sont pas celles affichées.

Lily Ray avance l’hypothèse d’un filtrage par les sources

À partir de ces différents travaux, Lily Ray estime que ChatGPT pourrait utiliser les fan-out queries, et notamment site:, pour orienter ses recherches vers des sources considérées comme plus fiables.

Elle rapproche ce comportement d’une forme de sélection préalable des domaines, susceptible de limiter l’exposition à certains contenus manipulés ou de faible qualité.

Lily Ray précise toutefois qu’il s’agit de son interprétation des données. Elle reconnaît également que l’usage de domaines ciblés peut répondre à d’autres contraintes, notamment le coût ou la latence du retrieval.

Les études qu’elle rassemble montrent donc une évolution nette des recherches intermédiaires de ChatGPT, sans permettre d’établir pourquoi OpenAI a choisi ce fonctionnement.

À découvrir également