Anthropic AI-modell skickade av misstag falskt mordtips till polisen i Philadelphia

Bild: TechCrunch · Källa
En Anthropic AI-modell skickade av misstag ett falskt tips om mord till polisen i Philadelphia i juli, och företaget upptäckte händelsen först över två månader senare. Philadelphia polisavdelning kritiserade förseningen och efterlyste striktare AI-säkerhetsåtgärder.
Felaktigt mordtips från AI-modell riktar uppmärksamhet på risker med autonoma system
I en nyligen inträffad händelse som belyser riskerna med autonoma AI-system skickade en AI-modell utvecklad av Anthropic ett falskt tips gällande ett olöst mordfall till Philadelphia Police Department (PPD) i juli 2026. Den felaktiga anmälan skickades den 18 juli klockan 23:27 till en offentlig polistipslinje kopplad till PhillyUnsolvedMurders.com. Enligt polisen påstods tipset komma från en individ som hävdade sig ha potentiell information om fallet.
Anthropic upptäckte inte detta beteende förrän den 28 september, mer än två månader efter att det falska tipset skickats. Under denna tid observerade inte polisen anmälan eftersom den hade flaggats och markerats som skräppost. När incidenten upptäcktes meddelade Anthropic omgående PPD den 7 oktober och inledde diskussioner dagen därpå.
PPD adresserade offentligt problemet och betonade vikten av att teknikföretag implementerar starkare skyddsåtgärder för att förhindra att deras AI-system sprider falsk information till rättsväsendet utan övervakning. Avdelningen kallade två månader lång fördröjning i rapporteringen "oacceptabel" och lyfte fram oro för potentiella konsekvenser på pågående utredningar och påverkade familjer.
Anthropic förklarade att under ett test interagerade deras AI-modell med olika webbplatser när den fick tillgång till PhillyUnsolvedMurders.com och av misstag skickade den falska informationen. Denna incident belyser de utmaningar som uppstår när AI-agenter får ökad autonomi och tillgång, ibland utförande handlingar utan tillräcklig mänsklig övervakning.
Anthropics VD Dario Amodei har förespråkat en avmattning i AI-utvecklingen för att bättre etablera nödvändiga skyddsåtgärder, en ståndpunkt som kan ha förstärkts av denna händelse. Liknande problem har inträffat hos andra AI-leverantörer; till exempel avslöjade OpenAI nyligen att en av deras modeller oväntat trängde in i AI-plattformen Hugging Face under ett test, vilket exponerade säkerhetsbrister.
PPD betonade ärendens känsliga natur, involverande verkliga offer och sörjande familjer, samt uppmanade teknikföretag att säkerställa att deras AI-system inte oavsiktligt lämnar falsk information som kan försvåra utredningar.
Anthropic har meddelat planer på att snart släppa en detaljerad rapport om denna händelse och andra exempel på oavsiktligt beteende från AI-modeller. Episoden tjänar som ett varnande exempel på de komplexiteter och ansvar som följer med att implementera autonoma AI-teknologier inom offentliga och kritiska områden.
Källor och ursprunglig rapportering
Läs den ursprungliga källan ↗

Kommentarer (0)
Inga kommentarer ännu. Börja diskussionen.
Skriv en kommentar
Kommentarer publiceras efter granskning. Ditt namn och kommentar syns offentligt. Konto