Juridische documenten tonen zorgen over webdata bij AI

Uit recent vrijgegeven rechtbankdocumenten blijkt dat zowel OpenAI en Microsoft intern waarschuwden voor de gevolgen van het verzamelen van webdata. Binnen de bedrijven werd onder meer gesproken over mogelijke schade aan het open web en discussies over auteursrecht.
In een lopende juridische procedure waarin een krant optreedt tegen OpenAI en Microsoft, zijn interne documenten openbaar gemaakt die meer inzicht geven in de discussies rondom datacollectie. Uit deze stukken blijkt dat medewerkers binnen de organisaties hun vraagtekens zetten bij de manier waarop content van het internet wordt gebruikt voor het trainen van systemen, en dat er intern werd gewaarschuwd voor de bredere impact hiervan op het digitale landschap.
De bredere discussie rond auteursrecht
De manier waarop makers van taalmodellen aan hun trainingsdata komen, ligt al langere tijd onder een vergrootglas. Veel uitgevers en makers stellen dat het overnemen van online teksten zonder toestemming indruist tegen bestaande regels rond intellectueel eigendom en eerlijk gebruik. Techbedrijven betogen daarentegen vaak dat het trainen van systemen op publiekelijk toegankelijke informatie valt onder bredere uitzonderingen, hoewel de nu openbaar gemaakte stukken laten zien dat dit ook intern tot discussie leidde.
Deze zaak is onderdeel van een bredere reeks juridische conflicten tussen de creatieve industrie en de technologiesector. Naarmate systemen afhankelijk blijven van enorme hoeveelheden menselijke arbeid en content voor hun training, blijft de balans tussen technologische innovatie en de rechten van contentmakers een belangrijk strijdpunt in de industrie.
Deze samenvatting is gebaseerd op een origineel artikel van The Verge AI. Lees het volledige, originele bericht bij de bron.
Lees het originele artikel