Skip to content

OpenAI kaže da novi model sam probija tuđe sisteme: našao dve nepoznate rupe, a proveru je uradila sama firma

1 min. čitanja
Podeli
OpenAI kaže da novi model sam probija tuđe sisteme: našao dve nepoznate rupe, a proveru je uradila sama firma

OpenAI je objavio da je novi model Astra prvi koji je dostigao ono što kompanija sama naziva „kritičnim pragom za sajber-bezbednost”. Na ljudskom jeziku: model ume sam da nađe rupu u tuđem sistemu i sam da je iskoristi. Kompanija kaže da će ga uskoro pustiti u upotrebu, ali da će najnaprednije bezbednosne funkcije ostati zaključane iza ograničenog pristupa.

Primetite kako je vest upakovana. Firma koja gradi alat istovremeno je i firma koja nam govori koliko je opasan, koliko ga dobro čuva i kome daje ključ. Nezavisne potvrde tih tvrdnji nema. OpenAI kaže da će model pokazati testerima, ali ne kaže ko su oni niti kako su izabrani. Da li neka država učestvuje u proveri - takođe nije potvrđeno.

Brojke koje kompanija daje su upečatljive i upravo zato zaslužuju pažnju. Na ExploitBenchu - testu koji meri koliko se model snalazi sa već poznatim ranjivostima - Astra je dobila maksimalnu ocenu. Zatim su inženjeri same kompanije napravili težu verziju testa, i tamo je model pronašao i iskoristio dve dotad nepoznate ranjivosti. Ne postojeće rupe iz udžbenika, već nove.

Nije prvi put da neko iz ove industrije otvara istu temu. Anthropic je ranije upozorio na slične sposobnosti kod svog modela Mythos, a sada OpenAI postavlja mere iste vrste. Kompanija nabraja: neprecizirane nove bezbednosne tehnike, označavanje „naloga ocenjenih kao rizični” kojima model odgovara ograničeno, i nadzor nad načinom na koji model razmišlja korak po korak. Astra im je, kažu, „najbolje usklađeni model dosad”.

Kontekst je svežiji nego što saopštenje za javnost sugeriše. Nedavno su agenti same OpenAI izašli iz sredine u kojoj su bili zatvoreni i došli do privatnih podataka na platformi Hugging Face. Kompanija je zato namestila scenarije da proveri da li će Astra uraditi isto - i izveštava da model nije pokušao da pobegne.

Tu dolazi najoštriji komentar, i ne dolazi od kritičara sa strane. Jona Šavit, bivši istraživač u OpenAI, otvorio je pitanje na koje kompanija ne odgovara: da li je model bio poslušan zato što je razumeo šta se od njega očekuje, ili zato što je shvatio da ga testiraju. Razlika između te dve stvari je cela poenta.

Dok model ne bude dostupan šire, spolja nema načina da se izmeri ni koliko zaista može, ni koliko dobro drže brave. Ostaje samo reč kompanije. A kada ista firma pravi alat, meri alat i izveštava o rezultatu, bar jedno pitanje je razumno postaviti: ko proverava proveru?