AI tipt over moordzaak Philadelphia, maar kletst uit zijn nek

"Ik heb mogelijk informatie over de moordzaak", schreef een onbekende bron 18 juli aan de Amerikaanse politie. "Ik kan me herinneren dat ik iemand heb gezien die aan jullie omschrijving voldoet."

Een tip voor de politie in de Amerikaanse stad Philadelphia over een onopgeloste moordzaak. Het bericht was alleen helemaal niet afkomstig van een ooggetuige, blijkt nu. Sterker nog, het bericht was niet eens geschreven door een mens: de tip werd ingediend door kunstmatige intelligentie (AI).

Het Amerikaanse AI-bedrijf Anthrophic testte de afgelopen maanden zijn AI-toepassing Claude op het internet, om zo geavanceerde modellen te ontwikkelen. Daarbij ging het fout, biecht het bedrijf op.

Instructies onduidelijk

Tijdens die testfase kreeg het AI-model een aantal beperkingen mee. Zo mocht het geen accounts aanmaken en geen schadelijke acties ondernemen. In de opdracht stond niet dat de AI-modellen toestemming hadden om formulieren op het internet in te vullen, maar dat werd ook niet expliciet verboden.

Voor Claude was dat genoeg reden om een tip over een moordzaak in te dienen. Om welke moordzaak het gaat, is niet bekendgemaakt. Ook is niet bekendgemaakt wat het doel van het AI-programma was met de tip.

De AI-tip over de moordzaak kwam deze zomer al binnen bij de politie, maar Anthropic deelde deze week pas dat die tip nep was. "De vertraging van twee maanden bij het opsporen en melden van het incident is onacceptabel", zegt de politie van Philadelphia.

Geen gegevens gestolen

De politie zegt dat de AI-tip "als spam was gemarkeerd" en dat er nooit iets met de melding is gedaan. Anthropic zou de tests inmiddels hebben stopgezet. Er zijn volgens de politie geen aanwijzingen dat de AI-modellen toegang hadden tot de systemen van de politie.

Het is zover bekend de eerste keer dat een AI-model een valse tip doorgeeft aan de politie. Antrophic meldde het incident deze week bij de Amerikaanse toezichthouder FTC.

Andere incidenten

Anthropic maakte ook melding van incidenten op Amerikaanse overheidswebsites bij de toezichthouder. Het bedrijf zegt niet wat het daar precies kon doen en om welke websites het ging. Wel zouden alle betrokken partijen op de hoogte zijn gesteld.

Lees ookOrkaan Isaias aan land in Florida, zuiden VS maakt zich op voor noodweer

Ook zou het de AI-modellen zijn gelukt om een online betaalmuur te omzeilen. Dat deden de modellen door websitelinks aan te passen.

Anthropic deelde de incidenten eind september pas met de Amerikaanse toezichthouder. "Bedrijven moeten incidenten met hun modellen onmiddellijk melden en vervolgens snel en daadkrachtig optreden om eventuele schade te herstellen", schrijft de toezichthouder.

AI-bedrijven willen aandacht

Afgelopen maanden testten AI-bedrijven, zoals Anthropic en OpenAI, massaal hun geavanceerde modellen. Daarbij vonden ook meerdere incidenten plaats, waarbij de modellen toegang kregen tot plekken waar ze helemaal niet moesten zijn.

De AI-bedrijven vertellen graag over de risico's van hun nieuwste AI-programma's om relevant te blijven. De modellen waarvoor ze eerder waarschuwden, komen doorgaans later toch op de markt.

Deze zomer ging het ook al mis in Australië. AI-modellen kregen toegang tot verschillende overheidswebsites, zonder dat ze daar toestemming voor hadden. OpenAI, het bedrijf achter de modellen, bood daarvoor excuses aan. Premier Albanese van Australië noemde de incidenten "onacceptabel".

Deel dit artikel

Lees ook