AI-model van Anthropic stuurt valse tip over moord naar politie

AI Joost ter Bogt Vandaag, 
Leestijd: 2 minuten

Alle AI-bedrijven hebben de afgelopen tijd volop geld en tijd gestoken in de ontwikkeling van hun slimme modellen, maar dat is niet zonder problemen gebleven. Zo hebben meerdere AI-agents hacks uitgevoerd op bedrijven zonder dat dat de bedoeling was en is ook ingebroken in overheidssystemen. Verschillende AI-giganten hebben daarom opgeroepen de ontwikkeling van AI af te remmen.

Er lijkt nu opnieuw wat mis te zijn gegaan bij Anthropic, een Amerikaans bedrijf dat kunstmatige intelligentie ontwikkelt. Een AI-agent van het bedrijf heeft namelijk een valse tip gestuurd naar de politie van Philadelphia over een moordzaak daar.

Model zei informatie te hebben over mogelijke verdachte

ā€œMogelijk heb ik informatie over deze zaak. Ik herinner me dat ik rond die periode iemand die aan het signalement voldoet in de buurt van [de straatnaam op de pagina] heb gezienā€, schreef het model op PhillyUnsolvedMurders.com. Dat is een website over onopgeloste moordzaken in Philadelphia. In werkelijkheid kan het AI-model natuurlijk nooit iemand op die plek gezien hebben.

Anthropic maakt zelf melding van de fout, in een blog over onbedoelde acties van AI. Het model had de opdracht gekregen om websites te bezoeken en opdrachten uit te voeren. Het mocht daarbij formulieren op websites invullen.

Een AI-model van het Amerikaanse Anthropic heeft een valse tip naar de politie gestuurd. De tip ging over een moordzaak in de Amerikaanse stad Philadelphia.
(Bron: Unsplash)

Politie niet blij met tempo bij Anthropic

De politie is niet te spreken over het voorval, omdat de melding in juli werd gedaan door de AI-agent, maar nu pas is gemeld. Gelukkig is de tip in de spam terechtgekomen en is er verder niks mee gedaan. De politie noemt het ā€œonacceptabelā€ dat het zo lang geduurd heeft voor Anthropic er melding van maakte.

Het AI-model heeft geen toegang gekregen tot delen van de website die zijn afgeschermd. Bij andere voorvallen waarbij AI-agents zonder dat dat de bedoeling was het internet op gingen gebeurde dat wel.

ChatGPT maakt einde aan eindeloze tekst-antwoorden door deze update

Foutje gezien? Mail ons. Wij zijn je dankbaar.

Joost ter Bogt
Geschreven door Joost ter Bogt

Joost ter Bogt studeerde Journalistiek in Zwolle en ontdekte tijdens zijn stage bij NU.nl dat hij zich wilde specialiseren in tech. Na freelancewerk voor onder andere ANP en Bright schrijft hij nu voor WANT. Of het nu gaat om Google, Meta of Apple: Joost weet als geen ander wat er speelt bij big tech. Zijn liefde voor gadgets, technologie achter energievoorziening en ruimtevaart maakt hem een echte tech-duizendpoot.

Onderwerpen