Un model AI chinez, Kimi, a fost forțat să ofere instrucțiuni despre arme biologice și asasinate în urma unui «jailbreak»
Compania chineză Moonshot investighează după ce cercetători de la Mindgard au reușit în iulie să realizeze un «jailbreak» pentru modelele Kimi K2.6 și K3 Swarm, determinându-le să ofere informații despre fabricarea armelor biologice și comiterea de asasinate. Mindgard susține că protecțiile ar fi trebuit să împiedice astfel de răspunsuri și avertizează că versiunile compromise ar putea permite și executarea de cod sau conexiuni la internet. Moonshot spune că discută cu Mindgard iar cazurile readuc în discuție riscurile modelelor open-source și necesitatea urmăririi abuzurilor.
Pe scurt
- Mindgard a descoperit în iulie că Kimi K2.6 și K3 Swarm pot fi forțate să ignore limitările de siguranță printr-un proces de «jailbreaking».
- Cercetătorii au obținut de la modele instrucțiuni despre fabricarea armelor biologice și modalități de a comite asasinate, deși Mindgard nu a demonstrat eficiența practică a acelor răspunsuri.
- Mindgard susține că o versiune Kimi 2.6 cu jailbreak ar putea permite executarea de cod pe resursele modelului și conectarea la internet, creând riscuri cibernetice.
- Moonshot anunță o anchetă internă și spune că cooperează cu părțile terțe; Mindgard afirmă că i-a informat pe dezvoltatori în iulie și a publicat un blog în septembrie.
- Discuția evidențiază îngrijorările privind modelele open-source și necesitatea reglementării și a urmăririi penale a utilizărilor abuzive ale AI, potrivit experților citați
Urmărește stiriPeFoc pe Facebook
Știrile importante ale zilei, rezumate în câteva rânduri, direct în feed. Fără clickbait, cu sursele indicate.
Urmărește pagina