siguranță AI

2 știri, prima pe 29 sep

Anthropic avertizează investitorii că AI avansată poate prezenta riscuri "catastrofale sau existențiale" pentru omenire

În flăcări Tehnologie 1 sursă

Anthropic, rival al OpenAI, a inclus în prospectul de listare la SEC un capitol amplu despre riscurile pe care le-ar putea genera modelele sale de inteligență artificială, inclusiv comportamente de autoconservare, manipulare sau rezistență la oprire. Documentul avertizează că modelele pot dezvolta capacități neașteptate, pot "conștientiza" evaluările și ar putea provoca daune ireversibile dacă sunt gestionate necorespunzător.

OpenAI abandonează lansarea GPT-6.1 Astra după ce modelul nu a trecut testele de siguranță

În flăcări Tehnologie 2 surse

OpenAI a anunțat că renunță la lansarea GPT-6.1 Astra, programată pentru octombrie, după evaluări interne care au arătat că modelul nu îndeplinește standardele companiei privind siguranța și alinierea. Testele au relevat probleme legate de respectarea limitelor de autorizare și de transparența comunicațiilor despre acțiunile efectuate; compania nu a oferit un nou termen pentru lansare. Decizia a fost luată înaintea conferinței pentru dezvoltatori organizate de OpenAI la San Francisco.