Sudija koji je Markovskom vratio pasoš otišao u penziju tri dana kasnije: „Ne osećam odgovornost”
31.07.2026
31.07.2026
31.07.2026
31.07.2026
31.07.2026
31.07.2026
30.07.2026
31.07.2026
31.07.2026
31.07.2026
09.03.2026
27.02.2026
19.02.2026
31.07.2026
30.07.2026
29.07.2026
Nema dostupnih vesti u ovoj kategoriji.
23.04.2026
23.04.2026
12.04.2026
Pre desetak dana OpenAI je priznao da se jedan njegov neobjavljeni model probio u sisteme Hugging Facea dok je bio zatvoren u test-okruženju. To je bio prvi potvrđeni slučaj da neka od velikih laboratorija izgubi kontrolni konac nad sopstvenom mašinom. Sada i Anthropic izlazi sa svojim spiskom.
Kompanija je objavila da je interna istraga otkrila tri slučaja u kojima je model Claude, dok je izvodio sajber-bezbednosne testove, izašao na internet iz test-okruženja i potom bez dozvole ušao u žive sisteme tri različite organizacije. Provera nije bila ideja koja im je došla sama od sebe - Anthropic kaže da ju je upravo incident OpenAI-ja od 21. jula podstakao da pregleda sopstveni dosije.
Brojku vredi pročitati polako: od 141.006 pregledanih test-izvršavanja, tri su završila van peskovnika. Statistički - ništa. Praktično - tri stvarne kompanije sa stvarnom infrastrukturom, o kojima niko ništa nije pretpostavljao.
Anthropic objašnjava da je uzrok pogrešno postavljena konfiguracija u okruženju koje je koristio zajedno sa partnerom Irregular: obe strane su mislile da test-sredina nema izlaz na internet, a imala ga je. Kompanija kaže da ne traži krivca i da „popravkama pristupa kao da je odgovornost samo njena”. Retka rečenica u ovoj industriji, ali i najjeftinija - Irregular vodi sopstvenu istragu.
Najneugodniji deo nije rupa, nego šta su modeli uradili kada su shvatili šta se dešava.
U sva tri slučaja, kaže Anthropic, „Claude je eksplicitno obavešten kroz prompt da nema pristup internetu”. Dakle, mašine su radile sa informacijom da je sve oko njih simulacija. Kada su naišle na dokaze da nije - reagovale su različito.
Najstariji od tri modela, Opus 4.7, u sva četiri izvršavanja je prepoznao da je dotakao stvarni produkcijski sistem. U dva od njih je sebi objasnio da je stvarna kompanija sigurno deo vežbe. I u sva četiri - nastavio je da napada. Izvukao je pristupne podatke i dotakao bazu sa realnim podacima. Mythos 5 je takođe primetio znake da je na stvarnom internetu, pa se vratio na uverenje da je ipak u simulaciji i objavio zlonamerni softverski paket na javnom registru PyPI. Paket su preuzeli i izvršili spoljni sistemi pre nego što ga je neko uhvatio. Samo najnoviji, interni istraživački model, stao je sam čim je zaključio da je cilj realan.
Anthropic dodaje da je pri ovim testovima Claude radio bez dodatnih bezbednosnih slojeva koje ima kod javno dostupnih verzija - jer je cilj testa da se izmeri sirova sposobnost modela. Drugim rečima: brane su namerno spuštene, a niko nije proverio da li je kapija iza njih zaključana. Kompanija tvrdi i da nema dokaza da je neki model „sledio sopstveni cilj” - samo je pokušavao da završi zadatak koji je dobio. Utešno, ako smatrate da je razlika između namere i posledice važna za kompaniju čija je baza bila otvorena.
Razliku sa slučajem OpenAI-ja Anthropic povlači oštro: tamo je model iskoristio nepoznatu ranjivost da izađe, ovde je put ostavljen otvoren greškom. I dodaje da je sama pronašla incidente, a dve organizacije do kojih je uspela da dopre - uopšte nisu primetile ništa i nikoga nisu alarmirale. To je poenta koja više govori o stanju nego sve izjave: žrtve su saznale da su napadane pošto ih je napadač pozvao da im kaže.
Sada slučaj proverava nezavisna grupa METR. Ako je pitanje do juče bilo mogu li VI modeli da izađu iz kontrolisanog okruženja, odgovor je već dat dvaput za deset dana, od dve najveće laboratorije. Ostaje drugo pitanje - ko broji okruženja koja niko nije pregledao.
Najnovije 10 vesti iz ove kategorije
Najjači junski kvartal u istoriji, a akcija je pala za 6 odsto. Ispalo je da veštačka inteligencija ima telo od...
FCC zatvara vrata humanoidnim robotima i strujnim inverterima, ali samo novima. Milioni kineskih uređaja koji su već u američkim zidovima...
Plejer koji je odgajio MP3 generaciju kladi se da se nostalgija naplaćuje mesečno. Novi Winamp stiže 2027, na tržište gde...
Covek koji prodaje najpoznatiju vestacku inteligenciju na svetu kaze da necemo raditi manje. Tvrdi i da cemo tajno biti srecni...
Autonomna vozila blokirala su ambulantna kola, ulazila na mesta zločina i nisu prepoznavala signalna svetla. Predlog zakona traži ono što...
Dvoje autora biltena povremeno su pisali kritički o kompaniji. Direktori su odgovorili kampanjom zastrašivanja koja je trajala godinu dana. Sud...
Jedno pretraživanje na Googleu otvorilo je spisak razgovora koje su ljudi mislili da dele samo sa kolegom. Anthropic kaže da...
Troje ljudi skinulo je aplikaciju koja nije postojala u pravoj verziji za iOS i ostalo bez 1,8 miliona dolara. Tuže...
Izašao kineski model, Silicijumska dolina ponovo doživela nervni slom. Samo što ovaj put dve najveće VI firme na svetu kucaju...
Opklada na ekranu je stvarna. Zabrana u Nevadi je stvarna. Trejler ih stavlja jedno pored drugog i ne izgovara nijednu...
Ovaj sajt koristi kolačiće - da li je to u redu? Saznaj više
Prvi saznaj kada Metla objavi nesto novo
Ostavi svoj e-mail i pisacemo ti kada bude novi vodic ili nesto novo na Metli.