Wikimedia Foundation roept AI-giganten op om datadiefstal te stoppen en hun betaalde API te gebruiken

Wikimedia Foundation roept AI-giganten op om datadiefstal te stoppen en hun betaalde API te gebruiken

· bijgewerkt op 8 augustus 2026
#wikimedia #techcrunch #theverge

De Wikimedia Foundation heeft kunstmatige-intelligentiebedrijven officieel verzocht om te stoppen met het gratis scrapen van Wikipedia-gegevens. In plaats daarvan nodigt de organisatie hen uit om zich te abonneren op haar betaalde dienst, Wikimedia Enterprise, om de duurzaamheid van de vrije encyclopedie te ondersteunen en een ethisch gebruik van de inhoud te garanderen.

De Wikimedia Foundation eist compensatie van AI-giganten voor het gebruik van Wikipedia-gegevens

De Wikimedia Foundation, de non-profitorganisatie achter de online encyclopedie Wikipedia, heeft onlangs een ferm standpunt ingenomen tegenover bedrijven in de kunstmatige intelligentie (AI). Ze heeft hen officieel verzocht om te stoppen met de wijdverbreide praktijk van het "scrapen" (geautomatiseerd verzamelen) van gegevens op Wikipedia en de voorkeur te geven aan toegang tot de inhoud via haar betaalde API, Wikimedia Enterprise. Deze stap markeert een keerpunt in de relatie tussen het ecosysteem van open kennis en de AI-industrie, en roept cruciale vragen op over de waarde van gegevens, de duurzaamheid van collaboratieve projecten en de ethiek van commerciële exploitatie.

Wikipedia: De goudmijn van AI-modellen

Sinds jaar en dag is Wikipedia een onschatbare bron geworden voor het trainen van grote taalmodellen (LLM's) en andere AI-systemen. Met miljoenen artikelen die geschreven en bijgewerkt worden door vrijwilligers over de hele wereld, vertegenwoordigt de collaboratieve encyclopedie het grootste corpus van gestructureerde, meertalige en geverifieerde menselijke kennis dat publiekelijk beschikbaar is. De rijkdom, diversiteit en voortdurende updates maken het een ideale bron om AI's de nuances van taal, feiten, concepten en de onderlinge relaties daartussen aan te leren.

De "vrije en gratis" toegang tot deze inhoud is door AI-bedrijven echter vaak geïnterpreteerd als een impliciete toestemming om massale hoeveelheden gegevens te verzamelen zonder enige vorm van directe bijdrage. Deze praktijk, hoewel technisch mogelijk, veroorzaakt een zware belasting op de infrastructuur van Wikimedia en genereert geen inkomsten om de activiteiten van de organisatie te ondersteunen, die voornamelijk afhankelijk is van donaties.

De oproep tot Wikimedia Enterprise: Een wederzijds voordelige oplossing?

Geconfronteerd met deze situatie heeft de Wikimedia Foundation besloten in het offensief te gaan. Ze roept grote AI-bedrijven, waarvan namen als Google, OpenAI, Meta en Microsoft vaak in deze context worden genoemd, op om een verantwoordelijkere en duurzamere aanpak te hanteren. In plaats van door te gaan met het "plunderen" van gegevens, nodigt de Stichting hen uit om zich te abonneren op Wikimedia Enterprise.

Wikimedia Enterprise, gelanceerd in 2021, is een commerciële dienst die specifiek is ontworpen voor bedrijven die op grote schaal toegang nodig hebben tot gegevens van Wikipedia en andere Wikimedia-projecten. Het biedt gestructureerde, betrouwbare en realtime datastromen, wat een superieure kwaliteit en constante updates garandeert in vergelijking met gegevens die via scraping zijn verkregen. De inkomsten die door Wikimedia Enterprise worden gegenereerd, worden rechtstreeks herinvesteerd in de missie van de Stichting, ter ondersteuning van de infrastructuur, de technologische ontwikkeling en de vrijwilligersgemeenschappen die Wikipedia mogelijk maken.

AI-ethiek en duurzaamheid van open kennis

Deze eis roept fundamentele vragen op over de ethiek van AI en de duurzaamheid van open bronnen. Terwijl AI-bedrijven miljarden dollars aan inkomsten en beurswaarde genereren, mede door de exploitatie van inhoud die door vrijwilligers is gemaakt, is de Wikimedia Foundation van mening dat het tijd is dat deze giganten bijdragen aan het voortbestaan van de bron die hun innovaties voedt.

Betalen voor toegang tot gegevens via Wikimedia Enterprise is niet alleen een financiële kwestie; het is ook een commitment aan de kwaliteit en betrouwbaarheid van gegevens. Bedrijven die van deze dienst gebruikmaken, profiteren van een officiële en onderhouden bron, wat de risico's verkleint van het gebruik van potentieel verouderde of slecht gestructureerde gegevens verkregen via scraping. Bovendien zendt het een krachtig signaal uit over de erkenning van de intellectuele waarde en het collaboratieve werk dat aan Wikipedia ten grondslag ligt.

Welke implicaties voor de toekomst?

De reactie van AI-bedrijven op dit verzoek zal doorslaggevend zijn. Als ze ermee instemmen om zich eraan te conformeren, zou dit een belangrijk precedent kunnen scheppen voor de manier waarop AI-modellen in de toekomst worden getraind, door ethischere en duurzamere partnerschappen met contentmakers en open-sourceprojecten te stimuleren. Het zou ook andere non-profitorganisaties kunnen aanzetten om hun gegevens te monetariseren om te overleven tegenover de onverzadigbare honger van AI.

Omgekeerd zou een massale weigering de spanningen kunnen doen toenemen en zelfs kunnen leiden tot strengere maatregelen vanuit de Wikimedia Foundation, zoals mogelijke juridische stappen of strengere technische beperkingen op de toegang. Er staat veel op het spel: het gaat erom een evenwicht te vinden tussen het bevorderen van vrije kennis en het erkennen van de economische waarde die het genereert voor een snelgroeiende industrie.