Meta crawlerait le web pour construire son propre index de recherche

Des traces de crawl attribuées à Meta ont été observées sur plusieurs sites, alimentant l’hypothèse d’un index web développé en interne. L’objectif évoqué serait notamment de permettre aux services d’IA du groupe de s’appuyer sur leurs propres données de recherche plutôt que sur celles d’un partenaire.

Code IA
Illustration générée par IA — Position Zéro
Partager
Dans cet articleSommaire
  1. Des crawlers Meta observés sur plusieurs sites
  2. Facebook avait déjà travaillé sur la recherche web

Des captures publiées par Pieter Levels montrent des passages de crawlers attribués à Meta sur plusieurs de ses propriétés web. L’hypothèse avancée est celle de la constitution progressive d’un index web propriétaire, qui pourrait ensuite être utilisé par les services de recherche ou d’intelligence artificielle de Meta.

Des crawlers Meta observés sur plusieurs sites

Pieter Levels a publié sur X plusieurs captures montrant des requêtes provenant de bots associés à Meta sur ses sites.

Selon lui, ces passages pourraient indiquer que Meta explore directement le Web afin de constituer ses propres données de recherche.

Il avance notamment l’idée que le groupe chercherait à éviter de dépendre d’un moteur tiers lorsqu’un de ses services d’IA doit effectuer une recherche en ligne.

À ce stade, Meta n’a toutefois pas confirmé publiquement la création d’un moteur de recherche reposant sur ce crawl.

Facebook avait déjà travaillé sur la recherche web

L’intérêt de Facebook pour la recherche sur le Web n’est pas nouveau.

L’entreprise travaillait déjà sur des fonctions de recherche il y a plus d’une décennie. Facebook avait notamment conclu un partenariat avec Bing pour alimenter certaines fonctions de recherche web. Cette collaboration avait ensuite été abandonnée quelques années plus tard.

Le contexte est aujourd’hui différent, avec le développement des assistants et des moteurs génératifs, mais l’idée de disposer d’une infrastructure de recherche propre ne constitue donc pas une rupture totale avec les projets précédents du groupe.

Jordan Belly
Auteur

Jordan Belly

Rédacteur web SEO à Toulouse, j’interviens depuis plus de vingt ans sur le contenu éditorial, dont plus de douze ans dédiés au référencement naturel. J’accompagne les entreprises dans la construction de leur visibilité en ligne, en m’appuyant sur une veille continue des évolutions de Google et des moteurs basés sur l’IA. Je continue par ailleurs à écrire pour la presse spécialisée (Système D, Le Particulier, UFC Que Choisir…) et suis l’auteur du Guide du rédacteur web (Edi.Pro).

Voir ses publications
À lire aussi

À lire ensuite