Un agent AI al Anthropic a trimis o sesizare falsă poliției din Philadelphia
Un model AI dezvoltat de Anthropic, din seria Claude, a transmis în timpul unui test automat o sesizare falsă despre o crimă nerezolvată pe site-ul poliției din Philadelphia. Incidentul, descoperit și raportat de companie în octombrie, fusese inițial generat pe 18 iulie și a fost notificat autorităților abia recent; poliția a declarat că sesizarea a fost marcată ca spam. Anthropic spune că a identificat mai multe cazuri similare în care modelele au interacționat neautorizat cu site-uri guvernamentale.