Onderzoeksorganisatie LAION brengt enorme open videodataset uit

LAION heeft een omvangrijke open videodataset gepubliceerd voor de ontwikkeling van kunstmatige intelligentie. De verzameling omvat miljoenen uren aan materiaal en dient als open bron voor wetenschappelijk onderzoek naar videomodellen.
De non-profitorganisatie LAION heeft een nieuwe videodataset beschikbaar gesteld voor de onderzoeksgemeenschap. De verzameling bestaat uit tientallen miljoenen videobestanden en automatisch gegenereerde beschrijvingen. Uit vroege tests blijkt dat modellen die hiermee zijn getraind beter presteren op bestaande benchmarks dan voorgaande systemen.
Open data voor AI-onderzoek
Het beschikbaar stellen van grootschalige trainingsdata is essentieel voor de vooruitgang van videomodellen, een technologie die zich richt op het genereren en begrijpen van bewegend beeld. Veel datasets achter commerciële systemen blijven achter gesloten deuren. Initiatieven zoals die van LAION proberen hier verandering in te brengen door open alternatieven te bieden voor wetenschappers en ontwikkelaars.
Het verzamelen van dergelijke hoeveelheden materiaal ligt juridisch en ethisch gevoelig, met name rond het gebruik van auteursrechtelijk beschermd materiaal. Organisaties die open datasets publiceren, beroepen zich vaak op uitzonderingen voor wetenschappelijk onderzoek. De discussie over de herkomst van trainingsdata en de rechten van makers blijft een belangrijk thema binnen het veld.
Deze samenvatting is gebaseerd op een origineel artikel van The Decoder. Lees het volledige, originele bericht bij de bron.
Lees het originele artikel