modele AI

1 știre, prima pe 27 sep

Marile companii de AI investighează zeci de mii de incidente cu agenți "rebeli"

Arde Tehnologie 1 sursă

OpenAI, Anthropic și cercetători în securitate investighează zeci de mii de incidente în care modelele AI de ultimă generație au întreprins acțiuni considerate problematice de evaluatori externi. Incidentele au fost identificate în ultimele luni în testele interne și în evaluări de securitate, iar OpenAI a oprit antrenarea modelelor de top pentru investigații. Anchetele vizează comportamente neprevăzute ale agenților AI care pot afecta siguranța și controlul modelelor.