← Le blog
Chiffres

Quelle part du trafic web est générée par des bots ?

30/08/2026 · 7 min de lecture · par WyndPath

On imagine le web comme un espace peuplé d'humains qui cliquent, lisent et achètent. La réalité est plus étrange : en 2024, pour la première fois depuis dix ans de mesures, le trafic automatisé a dépassé le trafic humain. Autrement dit, une requête sur deux qui arrive sur un site n'est plus envoyée par une personne, mais par un programme.

51 %du trafic web mondial était automatisé en 2024, selon le Bad Bot Report 2025 de Thales/Imperva.

Ce chiffre mérite qu'on s'y arrête, parce qu'il change la façon de comprendre ce qui se passe derrière un simple affichage de page. Voici ce que disent les données récentes, d'où elles viennent, et pourquoi elles ne se lisent pas toutes de la même manière.

Tous les bots ne se valent pas

Un bot, c'est simplement un logiciel qui interagit avec un site sans intervention humaine directe. La catégorie recouvre le meilleur comme le pire.

D'un côté, les bons bots : le robot de Google qui indexe les pages pour la recherche, les moniteurs de disponibilité, les agrégateurs de prix légitimes, les outils qui vérifient les liens. Ils s'annoncent, respectent les règles publiées dans le fichier robots.txt et ne cherchent pas à se cacher.

De l'autre, les mauvais bots : ceux qui tentent de deviner des mots de passe, de racheter tout un stock de billets à la seconde, de copier un catalogue entier, ou de fausser des statistiques publicitaires. Ce sont eux qui inquiètent, et leur part ne cesse de croître.

37 %du trafic internet provient de bots malveillants en 2024, contre 32 % en 2023 et 30 % en 2022 (Imperva).

La tendance est nette et régulière : cinq années consécutives de hausse. Imperva attribue une partie de cette accélération à l'intelligence artificielle générative, qui a rendu la création de bots simples accessible à beaucoup plus de monde. Les bots dits « basiques » regagnent du terrain, précisément parce qu'ils sont devenus faciles à écrire.

La vague des robots d'IA

Un phénomène récent bouscule les compteurs : les crawlers qui alimentent les modèles d'intelligence artificielle. Ils parcourent le web pour collecter du texte, soit pour l'entraînement, soit pour répondre en direct à une question posée dans un assistant.

Leur croissance est spectaculaire. La part de GPTBot, le robot d'OpenAI, a plus que doublé en un an dans le trafic de bots vérifiés mesuré par Cloudflare.

×2la part de GPTBot dans le trafic de bots vérifiés a bondi de 4,7 % à 11,7 % entre juillet 2024 et juillet 2025 (Cloudflare).

Ce qui interpelle, ce n'est pas seulement le volume, mais le déséquilibre. Cloudflare a publié un ratio parlant : le nombre de pages aspirées par un robot pour chaque visiteur qu'il renvoie ensuite vers le site. À l'été 2025, ce rapport atteignait des sommets pour certains assistants, de l'ordre de dizaines de milliers de pages crawlées pour un seul visiteur redirigé. L'éditeur nuance lui-même la mesure, car certaines applications ne transmettent pas l'information permettant de compter les visites entrantes, ce qui gonfle mécaniquement le ratio. La direction reste claire : les sites donnent beaucoup, et reçoivent peu en retour.

C'est ce déséquilibre qui a poussé Cloudflare, en juillet 2025, à bloquer par défaut les crawlers d'IA sur les sites qu'il protège, et à lancer un système où l'accès peut être monnayé. Un basculement d'un web ouvert par défaut vers un web qui demande la permission.

Certains secteurs prennent plus cher que d'autres

La moyenne cache de fortes disparités. Là où il y a de la valeur à extraire ou à détourner, les bots se concentrent.

Ce que ça coûte, concrètement

Derrière les pourcentages, il y a des factures. Les bots malveillants pèsent lourd sur l'économie en ligne.

15,6 Md$coût de la fraude à la prise de contrôle de compte pour les consommateurs en 2024, en hausse de 2,9 milliards sur un an (Mitek).

Ajoutons quelques repères, en gardant en tête que certains chiffres viennent de communications d'entreprises et doivent se lire comme des déclarations :

Une précaution avant de citer ces chiffres

Deux mesures, deux périmètres. Imperva mesure le trafic vu par ses clients ; Cloudflare mesure le sien, et compte parfois les requêtes de pages HTML plutôt que tout le trafic. Les deux racontent la même histoire de fond, mais leurs pourcentages ne sont pas directement comparables. Toujours citer la source et sa méthode.

Ce qu'il faut en retenir

Le web n'est plus majoritairement humain, et la part automatisée grandit d'année en année. Cette réalité a deux conséquences opposées. Pour ceux qui protègent un site, elle justifie des défenses de plus en plus fines. Pour ceux qui collectent de la donnée publique de façon légitime, elle explique pourquoi un simple script ne suffit plus : il évolue désormais dans un environnement pensé pour distinguer, à chaque requête, la machine de la personne. Comprendre cette frontière, c'est le sujet de nos autres articles.

Sources · Thales/Imperva, Bad Bot Report 2025 (données 2024) · Cloudflare Radar 2025 et blog « From Googlebot to GPTBot » (2025) · Mitek, Account Takeover Fraud Statistics (2025) · Netacea, What are bots costing your business (2023) · Verizon Data Breach Investigations Report (2025). Les chiffres déclaratifs d'entreprises sont indiqués comme tels.

Récupérer cette donnée, sans se faire bloquer

WyndPath gère proxys, rendu JavaScript et passage anti-bot en un seul appel API. Payé au succès.

Démarrer gratuitement →
À lire aussi · Technique
Comment fonctionnent les systèmes anti-bot
À lire aussi · Technique
Empreinte TLS (JA3/JA4) : pourquoi un scraper se fait repérer