Open source-project misleidt AI-scrapers met vergiftigd lettertype
Een ontwikkelaar heeft een lettertype gemaakt dat leesbaar blijft voor mensen maar onzin oplevert voor AI-systemen die websites automatisch uitlezen. Het is een creatieve tegenzet van makers die niet willen dat hun teksten worden gebruikt als trainingsmateriaal. De methode past in een groeiende beweging tegen ongevraagd dataverzamelen.
Een softwareontwikkelaar heeft een speciaal lettertype ontworpen dat visueel begrijpelijk is voor menselijke websitebezoekers, maar volledig onbruikbare tekst oplevert wanneer geautomatiseerde systemen de pagina uitlezen. Dit zogeheten poisoned font is bedoeld om te voorkomen dat content zonder toestemming wordt ingezet voor het trainen van machinelearningmodellen.
Bescherming van online content
De creatie sluit aan bij een bredere trend waarin makers en uitgevers zoeken naar technische middelen om zeggenschap te behouden over hun intellectuele eigendom. Veel websites worden momenteel intensief doorzocht door webscrapers om grote taalmodellen te voeden met trainingsdata, vaak zonder dat de rechthebbenden daarvoor compensatie of toestemming krijgen.
Door tekst op het scherm anders te tonen dan hoe deze in de onderliggende broncode staat, probeert deze methode het geautomatiseerd verzamelen van gegevens te frustreren. Het laat zien dat er binnen de techgemeenschap steeds vaker creatieve oplossingen worden bedacht om de balans te bewaken tussen openbaarheid van het internet en de bescherming van auteursrechten.
Deze samenvatting is gebaseerd op een origineel artikel van The Register AI. Lees het volledige, originele bericht bij de bron.
Lees het originele artikel