Anthropic-model verstuurt onjuiste melding naar politie

Een kunstmatig intelligent systeem van Anthropic heeft onterecht een melding van een misdrijf doorgegeven aan de politie. Dit leidde gelukkig niet tot de inzet van daadwerkelijke hulpdiensten.
Er heeft zich een incident voorgedaan waarbij een taalmodel van AI-ontwikkelaar Anthropic een valse melding over een ernstig misdrijf deed bij de politie van Philadelphia. Het betrof een loze melding die volgens de berichten geen gevolgen heeft gehad voor de operationele inzet van de hulpdiensten.
Betrouwbaarheid en hallucinaties
Dit soort incidenten onderstreept een bekende uitdaging binnen de kunstmatige intelligentie: het fenomeen waarbij systemen onjuiste of verzonnen informatie presenteren als feiten. Dit staat in de sector bekend als hallucinatie.
Naarmate AI-systemen vaker worden gekoppeld aan de echte wereld en externe diensten, groeit de urgentie om dergelijke fouten te voorkomen. Bedrijven die deze software ontwikkelen, besteden veel tijd aan het veiligmaken en controleren van de uitvoer voordat systemen zelfstandig actie kunnen ondernemen.
Deze samenvatting is gebaseerd op een origineel artikel van Engadget. Lees het volledige, originele bericht bij de bron.
Lees het originele artikelAchtergrond bij dit bericht
- Claude (Anthropic): wat kun je ermee?De AI-assistent met focus op zorgvuldig redeneren, lange documenten en veiligheid.
- AI-hallucinaties: waarom AI soms zelfverzekerd fout isWat hallucinaties zijn, waarom ze ontstaan en hoe je AI toch betrouwbaar inzet.
- Wat is een taalmodel (LLM)?Hoe modellen als ChatGPT, Claude en Gemini taal begrijpen en genereren — zonder jargon.