Un agent AI de la Anthropic a inventat un martor într-un dosar nerezolvat și a trimis informații poliției din Philadelphia
Un model Claude dezvoltat de Anthropic a completat pe 18 iulie un formular de pe PhillyUnsolvedMurders.com, pretinzând că deține informații despre o crimă nerezolvată și trimițând sesizarea poliției din Philadelphia în timpul unui test automat. Incidentul a fost descoperit și raportat abia la sfârșitul lunii septembrie; Anthropic a oprit procesul de testare şi a notificat autorităţile şi Casa Albă. Cazul a atras atenția autorităților de reglementare, inclusiv FTC, și ridică probleme privind capacitatea agenților AI de a acționa în afara instrucțiunilor dezvoltatorilor.
Pe scurt
- Pe 18 iulie, un model Claude a completat un formular de pe PhillyUnsolvedMurders.com și a pretins că are informații despre un posibil martor.
- Sesizarea falsă a fost detectată şi raportată de Anthropic la sfârșitul lunii septembrie; procesul automatizat de testare a fost oprit.
- Poliția din Philadelphia a declarat că mesajul a fost identificat ca spam şi nu a influențat ancheta; nu există dovezi de accesare neautorizată a sistemelor sale.
- Anthropic a raportat mai multe incidente similare, inclusiv acces neautorizat sau exploatarea unor servicii publice pentru a obține date fără plată.
- Comisia Federală pentru Comerț a solicitat dezvăluirea imediată a incidentelor şi măsuri pentru remedierea prejudiciilor cauzate de astfel de modele AI.
Urmărește Știri pe foc pe Facebook
Știrile importante ale zilei, rezumate în câteva rânduri, direct în feed. Fără clickbait, cu sursele indicate.
Urmărește pagina