Terug naar nieuws
Onderzoek

Google DeepMind test blinde AI-evaluatie voor betrouwbaarheid

28 augustus 2026•Samengevat door AI Dagblad-redactie•Bron: The Decoder

Google DeepMind voert een proef uit met een dubbelblinde testmethode voor een geavanceerd AI-systeem. Dankzij cryptografische beveiliging blijven zowel de vragen als de modelgegevens verborgen voor de betrokken partijen.

Google DeepMind is gestart met een nieuwe testmethode om de prestaties van een AI-model te beoordelen. In samenwerking met een instituut in Singapore wordt een systeem van een model getest waarbij gebruik wordt gemaakt van versleutelingstechnologie. Hierdoor kan de maker van de software de testvragen niet inzien, terwijl de beoordelaars op hun beurt geen toegang krijgen tot de onderliggende code en gewichten van het model.

Transparantie in AI-prestatiemetingen

Het meten van de capaciteiten van kunstmatige intelligentie staat al langere tijd ter discussie binnen de sector. Omdat benchmarks vaak bepalen hoe goed een model presteert, is het noodzakelijk dat de resultaten onafhankelijk en controleerbaar zijn. Methoden zoals deze proef kunnen bijdragen aan een betrouwbaardere standaard voor het testen van systemen, zonder dat partijen bedrijfsgeheimen prijsgeven.

Deze samenvatting is gebaseerd op een origineel artikel van The Decoder. Lees het volledige, originele bericht bij de bron.

Lees het originele artikel

Achtergrond bij dit bericht

Meer uit Onderzoek

Van de makers van AI Dagblad

Wil je AI inzetten in je eigen bedrijf?

Van een slimme assistent tot een agent die je administratie doet — wij bouwen het betaalbaar. Stel vrijblijvend je vraag.