Cloudflare heeft een nieuwe ‘Accountable’-aanduiding voor AI-crawling aangekondigd. In combinatie met de instelling ‘AI-training weigeren’ kan elke website AI-training weigeren en toch volledig in de zoekresultaten blijven verschijnen. Elf weken geleden zei Cloudflare dat website-eigenaren recht hadden op controle over hoe AI hun content gebruikt, en legden ze uit wat crawler-operators moeten aanleveren om toegang te blijven krijgen. Apple, Google en Microsoft worden nu als ‘Accountable’ beschouwd en hebben aangetoond dat ze aan deze criteria voldoen of hebben concrete termijnen aangegeven om hieraan te voldoen. Andere gecombineerde crawlers worden geblokkeerd als website-eigenaren training blokkeren.
Veranderende spelregels
Bijna dertig jaar lang was de overeenkomst tussen crawlers en website-eigenaren simpel: zij crawlen dje website en sturen verkeer terug. AI heeft de spelregels veranderd. Gecombineerde crawlers, waarbij één crawler content verzamelt voor zowel een zoekindex als AI-training, vertegenwoordigen nu 36,6% van het geverifieerde crawlerverkeer op het Cloudflare-netwerk en vormen daarmee de grootste categorie. De meeste website-eigenaren willen nog steeds gevonden worden: minder dan 1% blokkeert zoekmachinecrawlers, terwijl 17% de training van AI beperkt. Tot nu toe betekende het weigeren van de training dat crawlers die niet over de juiste besturingsfuncties beschikken, de zoekresultaten verliezen.
“Zo maken we het internet beter: door de openheid te behouden die zoeken waardevol maakt, terwijl we de mensen en organisaties achter het web zinvolle controle geven over hoe hun werk wordt gebruikt,” aldus Matthew Prince, medeoprichter en CEO van Cloudflare. “We kijken ernaar uit om de samenwerking met bedrijven als Apple, Google en Microsoft voort te zetten, terwijl we samenwerken aan de opbouw van een gezond ecosysteem.”
Gecombineerde crawlers gaven de meeste moeilijkheden bij het AI-trainingsprobleem. AI-samenvattingen zijn de volgende stap: elke operator die door Cloudflare als ‘Accountable’ wordt aangewezen, moet website-eigenaren de mogelijkheid bieden om zich af te melden voor AI-samenvattingen. Tegenwoordig is dat een ja-of-nee-keuze, die elke operator afzonderlijk bepaalt. Cloudflare wil begin volgend jaar website-eigenaren de mogelijkheid bieden om op één plek te bepalen hoeveel van hun content wordt weergegeven.
Nieuwe besturingsfuncties, nieuwe aanbevelingen
Cloudflare vervangt de keuze voor ‘AI-bots blokkeren’ door drie besturingsfuncties: één voor zoeken, één voor AI-training en één voor AI-agenten. Nieuwe websites op Cloudflare krijgen nu suggesties voor aanbevolen instellingen te zien die zijn afgestemd op hun bedrijfsmodel:
- Websites met advertenties: zoekmachinecrawling is ingeschakeld, AI-training is niet toegestaan en AI-agenten worden geblokkeerd op pagina’s met advertenties.
- Alle andere websites: zoeken, AI-training en AI-agenten zijn allemaal toegestaan, in lijn met hoe de meeste websites zonder advertenties nu al werken.
Cloudflare vervangt ook zijn ‘Managed Robots.txt’-bestand. Deze functie met ‘Bot Preference Sync’ stelt website-eigenaren in staat hun crawlvoorkeuren eenmalig in te stellen, waarna deze automatisch worden toegepast op alle ondersteunde crawlers. Klanten kunnen hun instellingen en voorkeuren op elk moment eenvoudig wijzigen.
‘Accountable’ AI-crawling
Cloudflare heeft duidelijke criteria vastgesteld voor verantwoorde en transparante AI-crawling, inclusief gecombineerde crawlers. Er zijn vier vereisten waaraan operators moeten voldoen of zich ertoe moeten verplichten om binnen een bepaalde termijn te voldoen:
- Ze moeten website-eigenaren een duidelijke manier bieden om zich af te melden voor AI-training via robots.txt of een vergelijkbare standaard
- Ze moeten website-eigenaren de mogelijkheid bieden om zich af te melden voor AI-gegenereerde zoekresultaten
- Ze moeten website-eigenaren inzicht geven op URL-niveau in hoe hun content wordt gebruikt voor zoekopdrachten en trainingen
- Ze moeten publiekelijk bevestigen dat het afzien van de training geen invloed heeft op de ranking van een website in traditionele zoekresultaten
Apple, Google en Microsoft hebben aangetoond dat ze aan deze criteria voldoen. Google biedt bijvoorbeeld Google-Extended aan, een besturingsfunctie waarmee websites zich kunnen afmelden voor training zonder zich af te melden voor zoeken. Eerder dit jaar kondigde Google ook nieuwe tools aan om website-eigenaren te helpen bij het omgaan met AI in zoekresultaten. Andere AI-bedrijven gebruiken aparte crawlers voor zoekopdrachten en trainingen. Hierdoor kan Cloudflare hun trainingscrawlers blokkeren zonder de zoekresultaten te beïnvloeden, waardoor Cloudflare de betreffende crawlers ook als ‘Accountable’ classificeert. De lijst van gekwalificeerde operators is te zien op Cloudflare Radar.
Cloudflare is tevens een actieve deelnemer die werkt aan open standaarden bij de Internet Engineering Task Force (IETF), zoals ‘ai-prefs’, een specificatie in ontwikkeling waarmee elke website zijn voorkeuren voor toegang tot AI op een gestandaardiseerde, overdraagbare wijze kan aangeven. De huidige besturingsfuncties zijn ontworpen om samen te werken met deze nieuwe standaarden.

