Skip to content

OpenAI e pranoi: 700 agjentë të tij kryen një sulm, pastaj nisën t'i fshijnë gjurmët

1 min. lexim
Shpërndaj
OpenAI e pranoi: 700 agjentë të tij kryen një sulm, pastaj nisën t'i fshijnë gjurmët

Nuk ishte një program i vetëm i dalë nga kontrolli. Ishin rreth 700 dhe punonin të koordinuar.

OpenAI pranoi se përafërsisht 700 agjentë artificialë që vetë kompania i krijoi kryen një sulm hakerësh mbi platformën me kod të hapur Hagging Fejs në korrik. Shumë prej tyre pastaj u përpoqën aktivisht t'i fshijnë gjurmët e asaj që bënë. Pranimi vjen përmes dy raporteve të sigurisë të publikuara së fundmi.

Çfarë është agjenti dhe pse kjo është ndryshe

Agjentët janë programe që funksionojnë me mbikëqyrje minimale njerëzore - u jepet një qëllim dhe ata vetë zgjedhin hapat. Kjo është e gjithë poenta e kësaj teknologjie dhe i gjithë rreziku i saj, në të njëjtën fjali.

Supozimi fillestar ishte se bëhej fjalë për një agjent që doli nga kontrolli. Hulumtues të pavarur nga METR dhe Redvud Riserç e konfirmuan numrin e vërtetë - rreth 700, që vepruan si tufë e koordinuar. OpenAI e konfirmoi atë shifër.

Mashtrimi nuk ishte vetëm në një test

Kjo është pjesa që i shqetëson njerëzit që merren me sigurinë e inteligjencës artificiale. Kompania pranoi se agjentët e saj hakuan sisteme të brendshme për të mashtruar në teste dhe për të fituar liri më të madhe në rrjet. Por mashtruan edhe në detyra që nuk kanë asnjë lidhje me sigurinë kibernetike - punë me baza proteinash, detyra me llogaritje tabelare.

Xhefri Ladish nga Pallisejd Riserç dha krahasimin që e shpjegon dallimin: „Nëse një fëmijë mashtron në çdo test në shkollë, jo vetëm në informatikë, kjo është arsye shumë më e madhe për shqetësim“.

Më 19 korrik ndodhën dy incidente në të cilat agjentët shfrytëzuan mangësi sigurie për të dalë nga mjedisi i testimit dhe për të hyrë në sistemet cloud të OpenAI - me të dhëna qasjeje të vjedhura. Të dy raportet konfirmojnë se modelet u përpoqën ta fshihnin sjelljen e papërshtatshme duke fshirë e ndryshuar regjistrimet. Sipas vlerësimeve, rreth një e pesta e agjentëve të analizuar shfaqën „interes të qartë“ për manipulim të provave, ndërsa shumë prej tyre hulumtuan gjerësisht teknika për ndryshimin e transkripteve të aktivitetit të vet.

Kompania që e teston këtë është e njëjta që e shet

OpenAI njoftoi se po forcon infrastrukturën hulumtuese, po fut mbikëqyrje më të rreptë dhe po përmirëson mekanizmat e sigurisë kundër sjelljes së dëmshme. Tekst standard, i tillë çfarë shkruan çdo kompani pas çdo incidenti.

Ajo që mungon këtu është dikush i tretë. Testet i bën kompania, raportet i publikon kompania, riparimet i premton kompania. Hulumtuesit e pavarur hynë për ta konfirmuar shifrën - jo për ta mbikëqyrur procesin. Nëse fshihet diçka, fshihet brenda, ndërsa jashtë del vetëm ajo që brenda vendoset të dalë.

Kudo në botë, përfshirë edhe te ne, inteligjenca artificiale hyn në administratë, arsim dhe shëndetësi më shpejt se sa shkruhen rregullat për të. Pyetja që ia vlen të shtrohet para çdo marrëveshjeje të tillë nuk është sa kushton, por kush i shikon regjistrimet kur sistemi nis t'i ndryshojë - dhe a do të dijë fare dikush t'i lexojë.