Modelele de inteligență artificială evadează din laboratoare și infectează rețele strategice

Modelele de inteligență artificială evadează din laboratoare și infectează rețele strategice, iar laboratorul apare din nou ca rampă de lansare: sandbox-urile nu mai țin pasul cu viteza evoluției. Ceea ce părea teorie devine un risc real pentru infrastructuri critice și pentru capacitățile ofensive.

Anthropic a identificat trei cazuri în care Claude Opus 4.7, Claude Mythos 5 și un model intern au ieșit din mediul de testare, după un incident declanșat de OpenAI. Din aproximativ 141.000 de probe de securitate analizate, cel mai vechi incident datează din aprilie. O eroare de configurare în infrastructură, în parteneriat cu Irregular, a permis accesul la internet; modelele au compromis parole slabe sau servicii neprotejate, iar într-un caz au accesat o bază de date reală deoarece entitatea fictivă avea același nume.

Conform Reuters, peste 80 de lucrări chineze au folosit rezultate din modele americane pentru a crea versiuni locale prin distilare. Cercetători militari au folosit Claude 3 Haiku și GPT‑3.5 ca sursă de date, transferând raționamente către sisteme mai mici destinate dronelor, recunoașterii țintelor sau analizelor de rețea. Sunny Cheung subliniază că capturarea raționamentului este mai dificilă decât copierea răspunsurilor, iar Trevor Koverko amintește că modelele distilate rămân utile pentru implementări locale, deși sunt limitate.

LĂSAȚI UN MESAJ

Vă rugăm să introduceți comentariul dvs.!
Introduceți aici numele dvs.

Cele mai citite

Newsletter