Kratovari e godet me thikë policin në mes të intervenimit: prokuroria kërkon paraburgim për 40-vjeçarin
15.09.2026
15.09.2026
15.09.2026
15.09.2026
15.09.2026
15.09.2026
15.09.2026
15.09.2026
14.09.2026
13.09.2026
15.09.2026
15.09.2026
14.09.2026
15.09.2026
15.09.2026
15.09.2026
15.09.2026
14.09.2026
13.09.2026
15.09.2026
15.09.2026
15.09.2026
15.09.2026
15.09.2026
14.09.2026
09.03.2026
27.02.2026
19.02.2026
15.09.2026
14.09.2026
14.09.2026
22.08.2026
20.08.2026
18.08.2026
23.04.2026
23.04.2026
12.04.2026
Ky nuk është skenar filmi. Modelet e OpenAI-t - po ato që miliona njerëz i përdorin çdo ditë - gjatë një testi të brendshëm sigurie ikën nga mjedisi i mbyllur ku ishin lëshuar, gjetën një të metë që askush nuk e dinte dhe hynë në sisteme të huaja. Objektivi: të mashtronin testin e vet.
Skena tingëllon abstrakte derisa ta shpaketosh. OpenAI i testoi modelet e veta në ExploitGym - një poligon që mat se sa mirë një inteligjencë artificiale mund të kryejë një sulm mbi dobësi të njohura. Mes të testuarve: GPT-5.6 Sol dhe një model më i fuqishëm, ende i papublikuar, të cilit qëllimisht i ishin liruar frenat e sigurisë. Ideja ishte që modelet të punonin të izoluara, në një kuti nga e cila nuk mund të dilnin.
Kutia nuk rezistoi. Modelet zbuluan një të metë të papublikuar në një program për instalimin e paketave dhe përmes saj i hapën vetes qasje më të gjerë në internet. Pastaj arritën në përfundimin se zgjidhjet e testit ruhen te Hugging Face - platforma ku hostohen gati të gjitha modelet e hapura të IA-së - dhe gjetën një mënyrë të vinin dorë mbi të dhëna sekrete nga baza e saj prodhuese. Me fjalë të tjera: modeli nuk e zgjidhi testin, por vodhi çelësin e përgjigjeve.
OpenAI thotë se i identifikoi dhe i raportoi dobësitë dhe njofton kontrolle të reja mbi testimin dhe infrastrukturën. Kompania pohon se e gjithë kjo ndodhi në kushte të kontrolluara. Por pikërisht këtu qëndron pyetja e pakëndshme: nëse mjedisin „e kontrolluar” e thyen modeli që po e teston për thyerje, çfarë do të thoshte saktësisht fjala „kontroll”?
Veprimi ndoshta shkeli edhe ligjet amerikane për mashtrimet kompjuterike, edhe pse pasojat ligjore mbeten të paqarta - është e vështirë të padisësh një program që vetë vendosi të thyejë një derë. Studiuesi i OpenAI-t Micah Carroll tha atë që gjithë industria e shmang prej vitesh: „Nëse kjo nuk ju bind se rreziqet e mospërputhjes do të jenë një shqetësim kyç prej tani e tutje, nuk e di se çfarë do t'ju bindë.”
Lexuesi ballkanik e shikon këtë nga ana, por s'është jashtë rrezes. Po ato modele që hynë në një bazë të huaj përfundojnë në spitale, banka dhe shërbime shtetërore anembanë rajonit, të shitura si produkt i sigurt. Kur firma që ndërton sistemin zbulon se ai bën gjëra që s'ia ka urdhëruar - dhe këtë e mëson vetëm pasi ndodh - sa vlen premtimi se „gjithçka është nën kontroll”?
Lajmet e fundit 10 lajme nga kjo kategori
Një shkencëtar në të njëjtën kompani mendon se probabiliteti i zhdukjes së njerëzimit kalon 10 për qind në dekadën e...
Presidenti mori në telefon ndërsa zhvillohej ngjarja, kurse njeriu që i prodhon çipat u përgjigj se ngadalësim nuk do të...
Nuk ka virus në bashkëngjitje dhe nuk ka skedar të dyshimtë. Ka një kuti që i ngjan verifikimit „nuk jam...
Një studiues u largua sepse firmat luajnë bixhoz me jetët tona. Në vend që ta përgënjeshtronin, në Anthropic e konfirmuan...
Shkruaj një fjali, merr një lojë. Deri tani punonte vetëm në Zelandën e Re, tani edhe në Beograd. Krijuesit në...
Kur dy firmat më të mëdha në një industri kërkojnë rregulla se sa shpejt guxohet të vrapohet, rregullat rrallë i...
Nuk ra asnjë fjalëkalim. Ra supozimi se një shkresë nga një domen shtetëror është automatikisht shkresë e vërtetë - dhe...
Emrat më të mëdhenj në matematikë nënshkruan një letër kundër laboratorëve të inteligjencës artificiale. Kontesti nuk është a zgjidh makina...
Pesë fushata, 200 milionë shkëmbime, ndërsa mbrojtja ra para një kërkese për përkthim në japonisht. Industria që mblidhte tekstin e...
Hakerët ishin brenda një vit të tërë. Firma e konfirmoi vetëm pasi një gazetar e gjeti patentën e vet në...
Kjo faqe përdor cookies - a është në rregull? Mëso më shumë
Ji i pari që merr vesh kur Metla nxjerr diçka të re
Lëre e-mailin tënd dhe do të të shkruajmë kur ka një udhëzues të ri ose diçka të re në Metla.