Google DeepMind test blinde AI-evaluatie voor betrouwbaarheid

Google DeepMind voert een proef uit met een dubbelblinde testmethode voor een geavanceerd AI-systeem. Dankzij cryptografische beveiliging blijven zowel de vragen als de modelgegevens verborgen voor de betrokken partijen.
Google DeepMind is gestart met een nieuwe testmethode om de prestaties van een AI-model te beoordelen. In samenwerking met een instituut in Singapore wordt een systeem van een model getest waarbij gebruik wordt gemaakt van versleutelingstechnologie. Hierdoor kan de maker van de software de testvragen niet inzien, terwijl de beoordelaars op hun beurt geen toegang krijgen tot de onderliggende code en gewichten van het model.
Transparantie in AI-prestatiemetingen
Het meten van de capaciteiten van kunstmatige intelligentie staat al langere tijd ter discussie binnen de sector. Omdat benchmarks vaak bepalen hoe goed een model presteert, is het noodzakelijk dat de resultaten onafhankelijk en controleerbaar zijn. Methoden zoals deze proef kunnen bijdragen aan een betrouwbaardere standaard voor het testen van systemen, zonder dat partijen bedrijfsgeheimen prijsgeven.
Deze samenvatting is gebaseerd op een origineel artikel van The Decoder. Lees het volledige, originele bericht bij de bron.
Lees het originele artikel