"99% av min trafik kommer nu från bots": AI fortsätter att ta allt från internet
Nick Gray, skapare av PatronView, har analyserat effekten av AI-bots på sin webbplats i ett och ett halvt år. Under en enda vecka serverade servern 1,28 miljoner sidor, medan de faktiska besöken var 5 977. Slutsatsen var tydlig: för varje riktig sida som visades fanns det 214 från bots, och saker och ting kommer att bli fler, inte mindre.
Som han sa, "99% av min webbplatstrafik är bots." Claude är en frossare. Gray började mäta aktiviteten hos sökrobotar på Internet med ett mycket enkelt mått: sidor som genomsöktes av varje besökare. Google behöver cirka 46 för sin sökmotor, men den här utvecklaren upptäckte att Claudes webbsökare, kallad Claude-Searchbot, begärde 420 680 sidor på en vecka, och Claude skickade bara 12 användare till sin webbplats.
Eller vad är detsamma: det krävdes 35 000 besökta sidor för en som fick en person att besöka dess webbplats. Det slutade med att Gray blockerade den och Anthropic hedrade 403-koden som den installerade på sin webbserver. Det gjorde att Claudes tiotusentals dagliga förfrågningar reducerades till bara några få försök.
I Xataka Priset att betala för att ha AI är plundringen av allt innehåll på Internet. Och förvirring är bara det senaste exemplet.
Amazon är ännu värre. Amzn-SearchBot, som användes för Amazon-produkter som Rufus och Alexa, var ännu mer girig i att genomsöka den här användarens webbplats. Enligt deras uppgifter fick den sökroboten åtkomst till 117 000 sidor på deras Patronview-webbplats per dag.
Och det tråkigaste är att han inte hade en enda sidvisning skickad av Amazon till sin webbplats, så hans förhållande mellan konsumerade sidor och mottagna läsare var bokstavligen oändligt. Han blockerade också den här boten och upptäckte att dessa AI-plattformssökrobotar ber om allt utan att ge praktiskt taget någonting i gengäld.
Kamouflerade bots. I april fick PatronView 3,6 miljoner träffar på en enda dag från 361 844 olika IP-adresser, nästan alla i Kina. Sedan kom vågor av åtkomster från Vietnam och Singapore, automatiserade Chrome-webbläsare på AWS och Azure och även på proxynätverk för bostäder.
De senare var särskilt svåra att identifiera eftersom åtkomsterna kom från till synes normala inrikesförbindelser.
Och det var de inte. Försvaret har ett pris. Gray använde Cloudflares JavaScript-kodexekveringsdetektioner för att skilja mellan människor och maskiner.
Det upptäckte dock att det här systemet lade till 2 875 sekunders bearbetning på en mellanklass mobiltelefon, vilket straffade dess webbprestanda. I själva verket, genom att avaktivera det skyddet, gick dess poäng i Lighthouse, som utvärderar den upplevelsen och hastigheten på webbplatser, från 58 till 99. Precis efter att ha blockerat det laddade en skrapa som var värd i Azure ned 23 000 sidor på en timme, och fördelade förfrågningarna mellan mer än 80 IP-adresser för att undvika att bryta gränserna.
Skapar antibotväggen. Det slutade med att den här användaren skapade en blockeringsmekanism för dessa bots som blockerar vissa länder och spårare, men som också använder CAPTCHA-system om den upptäcker stora datacenter, filtrerar misstänkt gamla webbläsare och tillämpar hastighetsbegränsningar. Resultatet sågs 48 timmar senare.
Cloudflare, till exempel, aktiverade 106 437 popup-fönster med CAPTCHA och endast 252 löstes, 0,24%. För Gray är slutsatsen tydlig: man kan inte lita på Google Analytics, Plausible eller liknande verktyg: för att veta vem som verkligen konsumerar en webbplats måste man titta på serverloggarna.
Bots tar upp räkningen. Och i fallet med den här webbplatsen ökade denna kontinuerliga botspårning notan. PatronView kostar honom cirka 90 USD i månaden, men under en av de värsta topparna i bottrafiken växte hans räkning nästan 500 %.
För att inte tala om att analysen slutade vara användbar och att hans hemsida blev foder för bots hela tiden medan han betalade räkningen. AI har byggts genom att plundra innehållet på Internet. Nu finns det folk som vill ta betalt för att tillåta det.
Om du vill spåra, betala. För denna användare skulle den slutliga lösningen vara enkel: ta betalt för spårning. Cloudflare arbetar redan med ett system för betalning per genomsökning som gör det möjligt för webbplatsägare att prissätta botåtkomst.
Tills något sådant här existerar tillämpar Gray en mycket enklare och mer logisk regel: Om en spårare inte returnerar besökare, blockerar han den. Det var rimligt att Google spårade dig. Att AI gör det är ohållbart.
I Xataka | Alla stora AI:er har ignorerat upphovsrättslagar. Det fantastiska är att det fortfarande inte finns några konsekvenser
Originalkälla
Publicerad av Xataka
11 august 2026, 13:01
Denna artikel har översatts automatiskt från spanska. Klicka på länken ovan för att läsa originaltexten.
Visa originaltext (spanska)
Rubrik
"El 99% de mi tráfico ahora es de bots": la IA sigue llevándoselo todo de internet
Beskrivning
Nick Gray, creador de PatronView, lleva año y medio analizando el impacto de los bots de IA en su web. En una sola semana su servidor sirvió 1,28 millones de páginas, mientras que las visitas verdaderas fueron 5.977. La conclusión era clara: por cada página vista real había 214 procedentes de bots, y la cosa va a más, no a menos. Como él decía, "el 99% del tráfico de mi sitio web son bots". Claude es un glotón. Gray empezó a medir la actividad de los rastreadores de internet con una métrica muy sencilla: páginas rastreadas por cada visitante. Google necesita unas 46 para su motor de búsqueda, pero este desarrollador descubrió que el bot de rastreo (webcrawler) de Claude, llamado Claude-Searchbot, solicitó 420.680 páginas en una semana, y Claude le envió solo 12 usuarios a su web. O lo que es lo mismo: necesitó 35.000 páginas visitdas por una que hacía que una persona visitase su web. Gray acabó bloqueándolo, y Anthropic respetó el código 403 que instaló en su servidor web. Eso provocó que las decenas de miles de solicitudes diarias por parte de Claude se quedaran en unos pocos intentos. En Xataka El precio a pagar por tener IA es el saqueo de todo el contenido de Internet. Y Perplexity es solo el último ejemplo Amazon es aún peor. Amzn-SearchBot, utilizado para productos de Amazon como Rufus y Alexa, fue incluso más avaricioso al rastrear la web de este usuario. Según sus datos, ese rastreador estaba accediendo a 117.000 páginas de su web Patronview al día. Y lo más sangrante es que no tenía ni una sola página vista enviada por Amazon a su sitio web, así que su ratio entre páginas consumidas y lectores recibidos era literalmente infinito. También bloqueó a este bot y comprobó que estos rastreadores de plataformas de IA lo piden todo sin ofrecer prácticamente nada a cambio. Bots camuflados. En abril PatronView recibió 3,6 millones de accesos en un solo día procedentes de 361.844 direcciones IP distintas, casi todas ubicadas en China. Luego llegaron oleadas de accesos desde Vietnam y Singapur, navegadores Chrome automatizados alojados en AWS y Azure y también en redes de proxies residenciales. Estas últimas fueron especialmente difíciles de identificar porque los accesos provienen de conexiones domésticas aparentemente normales. Y no lo eran. La defensa tiene un precio. Gray utilizaba las detecciones de ejecución de código JavasScript que ofrece Cloudflare para poder distinguir entre humanos y máquinas. Sin embargo, descubrió que dicho sistema añadía 2,875 segundos de procesamiento en un móvil de gama media, lo que penalizaba su rendimiento web. De hecho, al desactivar esa protección su puntuación en Lighthouse, que evalúa esa experiencia y velocidad de sitios web, pasó de 58 a 99. Justo después de bloquearla un scraper alojado en Azure descargó 23.000 páginas en una hora repartiendo las solicitudes entre más de 80 IPs para evitar hacer saltar los límites. Creando la muralla antibot. Este usuario acabó creando un mecanismo de bloqueo para estos bots que bloquea determinados países y rastreadores, pero que además utiliza sistemas CAPTCHA si detecta grandes centros de datos, filtra navegadores sospechosamente antiguos y aplica límites de velocidad. El resultado se vio 48 horas después. Cloudflare por ejemplo activó 106.437 popups con CAPTCHA y solo 252 fueron resueltos, un 0,24%. Para Gray la conclusión es clara: uno no puede fiarse de Google Analytics, Plausible o herramientas similares: para saber quién consume realmente una web hay que mirar los logs del servidor. Los bots suben la factura. Y es que además en el caso de esta web, ese rastreo continuo de bots subía la factura. PatronView le cuesta unos 90 dólares al mes, pero durante uno de los peores picos de tráfico por bots, su factura creció cerca del 500%. Eso sin contar que las analíticas dejaron de ser útiles y que su sitio web se convirtió en pasto de los bots durante todo ese tiempo mientras él pagaba la factura. La IA se ha construido saqueando el contenido de Internet. Ahora hay gente que quiere cobrar por permitirlo Si quieres rastrear, paga. Para este usuario la solución final sería sencilla: cobrar por rastrear. Cloudflare ya trabaja en el sistema pay per crawl que permitirá que los propietarios de sitios web pongan precio al acceso de los bots. Hasta que exista algo así, Gray aplica una regla mucho más sencilla y lógica: si un rastreador no le devuelve visitantes, lo bloquea. Que Google te rastreara era razonable. Que lo haga la IA está siendo insostenible. En Xataka | Todas las grandes IA han ignorado las leyes del copyright. Lo alucinante es que sigue sin haber consecuencias (function() { window._JS_MODULES = window._JS_MODULES || {}; var headElement = document.getElementsByTagName('head')[0]; if (_JS_MODULES.instagram) { var instagramScript = document.createElement('script'); instagramScript.src = 'https://platform.instagram.com/en_US/embeds.js'; instagramScript.async = true; instagramScript.defer = true; headElement.appendChild(instagramScript); } })(); - La noticia "El 99% de mi tráfico ahora es de bots": la IA sigue llevándoselo todo de internet fue publicada originalmente en Xataka por Javier Pastor .