Cloudflare bloque par défaut les robots d'IA

2025-07-01 · Éditeur : Cloudflare · Domaine : Intelligence Artificielle

Cloudflare, qui voit passer environ 20 % du trafic web, inverse la règle : l'exploration par les robots d'IA exige désormais l'accord du site, et un paiement à l'exploration (« pay per crawl ») est testé en bêta privée.

Ce qui change

  • Chaque nouveau domaine est désormais bloqué par défaut aux robots d'IA, sauf autorisation explicite du propriétaire.
  • Pay per crawl permet de fixer un prix par requête et renvoie un code HTTP 402 (« Payment Required », paiement requis) aux robots non payants.
  • Les robots d'IA sont invités à déclarer leur finalité : entraînement, inférence ou recherche.
  • Plus d'un million de clients utilisaient déjà le blocage des robots d'IA proposé depuis septembre 2024.
  • Condé Nast, Gannett, Reddit ou Pinterest soutiennent l'initiative.

Le 1er juillet 2025, présenté par l'entreprise comme un « Content Independence Day » (jour de l'indépendance des contenus), Cloudflare devient le premier fournisseur d'infrastructure internet à bloquer par défaut les robots d'IA qui accèdent aux contenus sans autorisation ni rémunération. Le fournisseur de CDN et de sécurité traite environ 20 % du trafic web mondial. ### Ce qui s'est passé - **Blocage par défaut** : à l'inscription, chaque nouveau domaine se voit demander s'il autorise les robots d'IA ; à défaut, l'accès est refusé. On passe d'une logique de refus explicite (opt-out) à une logique d'autorisation explicite (opt-in). - **Déclaration de finalité** : les entreprises d'IA peuvent indiquer si leur robot sert à l'entraînement, à l'inférence ou à la recherche, pour aider les éditeurs à choisir. - **Pay per crawl** : en bêta privée, l'éditeur fixe un prix unique par requête et choisit, pour chaque robot, d'autoriser, de facturer ou de bloquer. Le système repose sur le code HTTP 402, une authentification cryptographique des robots (Web Bot Auth) et Cloudflare comme intermédiaire de facturation. - **Soutiens** : Condé Nast, Dotdash Meredith, Gannett, Pinterest et Reddit, entre autres. ### Pourquoi c'est un tournant Les moteurs de réponse par IA consomment les contenus sans renvoyer autant de visites que les moteurs de recherche classiques, ce qui fragilise le modèle économique des éditeurs. En agissant au niveau de l'infrastructure, Cloudflare donne aux sites un levier de négociation collectif et pose les bases d'un marché de l'accès aux contenus, y compris pour des agents qui paieraient eux-mêmes dans la limite d'un budget. ### Réserves Le dispositif ne couvre que les sites servis par Cloudflare et suppose que les robots s'identifient honnêtement. Le paiement à l'exploration n'est qu'en bêta privée et son adoption par les entreprises d'IA reste à démontrer. ### À retenir Pour tout site web, l'accès des robots d'IA devient un choix explicite (autoriser, facturer ou bloquer) plutôt qu'un état de fait.

Liens

Tags : IA, Droit d'auteur, Web, Médias, Cloudflare