Skip to content

OpenAI thotë se modeli i ri vetë depërton në sisteme të huaja: gjeti dy vrima të panjohura, ndërsa verifikimin e bëri vetë firma

1 min. lexim
Shpërndaj
OpenAI thotë se modeli i ri vetë depërton në sisteme të huaja: gjeti dy vrima të panjohura, ndërsa verifikimin e bëri vetë firma

OpenAI njoftoi se modeli i ri Astra është i pari që ka arritur atë që kompania vetë e quan „prag kritik për siguri kibernetike“. Në gjuhë njerëzore: modeli di vetë të gjejë një vrimë në një sistem të huaj dhe vetë ta shfrytëzojë. Kompania thotë se së shpejti do ta lëshojë në përdorim, por se funksionet më të avancuara të sigurisë do të mbeten të kyçura pas qasjes së kufizuar.

Vëreni si është paketuar lajmi. Firma që e ndërton mjetin është njëkohësisht edhe firma që na tregon sa i rrezikshëm është, sa mirë e ruan dhe kujt i jep çelës. Konfirmim të pavarur për ato pohime nuk ka. OpenAI thotë se modelin do t'ua tregojë testuesve, por nuk thotë kush janë ata as si janë përzgjedhur. A merr pjesë ndonjë shtet në verifikim - gjithashtu nuk është konfirmuar.

Shifrat që jep kompania janë mbresëlënëse dhe pikërisht prandaj meritojnë vëmendje. Në ExploitBench - test që mat sa mirë një model përballet me dobësi tashmë të njohura - Astra mori notën maksimale. Pastaj inxhinierët e vetë kompanisë bënë një version më të vështirë të testit, dhe atje modeli gjeti dhe shfrytëzoi dy dobësi deri atëherë të panjohura. Jo vrima ekzistuese nga libri shkollor, por të reja.

Nuk është hera e parë që dikush nga kjo industri e hap të njëjtën temë. Anthropic më parë paralajmëroi për aftësi të ngjashme te modeli i vet Mythos, ndërsa tani OpenAI vendos masa të të njëjtit lloj. Kompania numëron: teknika të reja sigurie të papërcaktuara, shënjimin e „llogarive të vlerësuara si të rrezikshme“ të cilave modeli u përgjigjet në mënyrë të kufizuar, dhe mbikëqyrjen e mënyrës si modeli mendon hap pas hapi. Astra, thonë, është „modeli i tyre më i harmonizuar deri tani“.

Konteksti është më i freskët sesa sugjeron kumtesa për shtyp. Së fundmi agjentët e vetë OpenAI-t dolën nga mjedisi ku ishin të mbyllur dhe arritën te të dhëna private në platformën Hugging Face. Kompania prandaj përgatiti skenarë për të verifikuar a do të bënte Astra të njëjtën gjë - dhe raporton se modeli nuk u përpoq të arratisej.

Këtu vjen komenti më i mprehtë, dhe nuk vjen nga një kritik i jashtëm. Jona Shavit, ish-studiues në OpenAI, shtroi një pyetje së cilës kompania nuk i përgjigjet: a ishte modeli i bindur sepse kuptoi çfarë pritet prej tij, apo sepse kuptoi se po e testonin. Dallimi mes atyre dy gjërave është gjithë poenta.

Derisa modeli të mos jetë i disponueshëm më gjerësisht, nga jashtë nuk ka mënyrë të matet as sa vërtet mundet, as sa mirë mbajnë bravat. Mbetet vetëm fjala e kompanisë. Ndërsa kur një e njëjta firmë e bën mjetin, e mat mjetin dhe raporton për rezultatin, të paktën një pyetje është e arsyeshme të shtrohet: kush e verifikon verifikimin?