IA jashtë kontrollit, edhe modelet Claude të Anthropic kanë hakuar sisteme të jashtme

spot_img
Advertisements


Një hetim i brendshëm i kryer nga Anthropic ka zbuluar se disa modele të inteligjencës artificiale nga konkurrenti i ChatGpt, Claude, i shpëtuan testimit të vlerësimit të sigurisë dhe infiltruan infrastrukturën e prodhimit të tre organizatave të jashtme, pa dijeninë e tyre.

Siç shpjegon një deklaratë e kompanisë, kjo u konstatua pas një shqyrtimi në shkallë të gjerë të mbi 141,000 dokumenteve të testimit, të iniciuar në përgjigje të një zbulimi të mëparshëm publik nga OpenAI.

Gjatë simulimeve, modelet e prekura, duke përfshirë Opus 4.7, Mythos 5 dhe një prototip kërkimi, shfrytëzuan aksesin në internet, i cili u hap për shkak të një gabimi konfigurimi dhe një lidhjeje me një partner të jashtëm, pavarësisht udhëzimeve që tregonin se nuk kishte lidhje rrjeti. “Në mënyrë specifike, ne kërkuam prova se Claude, ashtu si modelet OpenAI që hynë në Hugging Face, ishte në gjendje të hynte në internet nga brenda mjediseve të testimit gjoja të izoluara,” tha grupi në një deklaratë.

Duke i trajtuar sistemet reale të hasura në internet si një pjesë integrale të simulimit dhe testimit, inteligjencat artificiale kompromentuan rrjetet e jashtme duke përdorur teknika bazë si fjalëkalime të dobëta dhe pajisje të paautorizuara. Në një rast specifik, një model madje lëshoi ​​një paketë softuerësh, duke infektuar përkohësisht sistemet e skanimit të palëve të treta. Anthropic njoftoi se ndaloi menjëherë të gjitha vlerësimet e sigurisë kibernetike sapo dolën gjetjet e para anormale dhe se kontaktoi organizatat e prekura për të koordinuar përpjekjet e korrigjimit dhe verifikimit.

spot_img

Latest articles

Related articles