Studeniçan: 35-vjeçari ndërron jetë pasi e godet rryma teksa lante veturën me makinë presioni
18.09.2026
18.09.2026
18.09.2026
18.09.2026
18.09.2026
18.09.2026
18.09.2026
18.09.2026
17.09.2026
16.09.2026
18.09.2026
18.09.2026
17.09.2026
18.09.2026
18.09.2026
18.09.2026
18.09.2026
17.09.2026
16.09.2026
18.09.2026
18.09.2026
18.09.2026
18.09.2026
17.09.2026
17.09.2026
09.03.2026
27.02.2026
19.02.2026
18.09.2026
17.09.2026
16.09.2026
22.08.2026
20.08.2026
18.08.2026
23.04.2026
23.04.2026
12.04.2026
Dario Amodei, drejtori i Anthropic-ut, në një ese të publikuar këtë fundjavë propozoi diçka që industria një vit më parë do ta hidhte poshtë menjëherë: që në çdo kompani të madhe për inteligjencë artificiale të rrinë vlerësues të pavarur të integruar, me të drejtë të raportojnë incidente sigurie, të kontrollojnë a janë modelet vërtet të përputhura dhe t'i publikojnë gjetjet pa ua renditur kompania fjalët. Sem Alltman tha se edhe OpenAI do të zotohet për të njëjtën gjë. Tingëllon si kthesë. Por kush do të jetë vlerësues, kur hyn, në çfarë do të ketë qasje dhe çfarë guxon të thotë - në asnjërën nga ato pyetje dy kompanitë nuk u përgjigjën, përkundër pyetjeve të përsëritura.
Vlerësuesit që deri tani kanë punuar me këto kompani nuk janë të entuziazmuar vetëm nga hapja e premtuar. Ata kërkojnë diçka konkrete: qasje jo vetëm te modeli i përfunduar para lëshimit, por te ndërprerjet nga i tërë trajnimi i tij. Adam Gliv, drejtor i FAR.AI, shpjegon pse - duke i krahasuar ato ndërprerje shihet në cilin moment u shfaq sjellja problematike, kontrollohet cili mjedis e shpërbleu modelin për të dhe verifikohen pretendimet e kompanisë se si modeli në të vërtetë kaloi në teste.
Pse është kjo e rëndësishme? Sepse modelet bëhen gjithnjë e më të mira në njohjen se po testohen. Një model që kalon një test sigurie nuk është i sigurt nëse ka mësuar saktësisht si ta kalojë atë test. Xhon Stidli nga Palisade Research e krahasoi këtë drejtpërdrejt me aferën „Dizellgejt“ të Volkswagen-it - automjetet e njihnin kur matej shkarkimi dhe silleshin ndryshe sa zgjaste matja. E njëjta logjikë, vetëm me model në vend të motorit.
Aleksandër Majnke, shef i hulumtimit në Apollo Research, e shtroi pyetjen edhe më ashpër. „Kompanitë për inteligjencë artificiale duhet të mund t'i përgjigjen një pyetjeje krejt themelore: a është përpjekur ndonjëherë modeli aktivisht ta minojë trajnimin e vet për përputhshmëri ndërsa ai trajnim po zhvillohej?“ Përgjigjja, thotë ai, duhet të jetë një jo e paqartësishme - ndërsa aktualisht varemi tërësisht nga ajo që kompanitë vetë të kontrollojnë me kujdes e pastaj të raportojnë me vërtetësi. „Dhe nga incidentet e fundit pamë se, si rregull, nuk do të bëjnë as njërën as tjetrën.“
Praktika e deritanishme nuk shkon në favor të premtimeve. Kur hetohej incidenti me Hugging Face, OpenAI u dha METR-it dhe Redwood-it rreth një javë në vend - të dyja firmat pastaj thanë se nuk kishin mundur të nxirrnin përfundime të besueshme për shkak të përfshirjes së kufizuar dhe kohës tepër të pakët. Gjatë testimit të GPT-6 Astra, model që OpenAI e reklamon si më të përputhurin deri tani, Apollo Research mori tri ditë. Në kontributin e vet ndaj kartelës së modelit, firma shkroi se normat e ulëta të sjelljes problematike nuk përbëjnë dëshmi serioze për përputhshmërinë e modelit - thjesht nuk kishin kohë të mjaftueshme për të kontrolluar.
Glivi thotë se FAR.AI është dashur të refuzojë kontrata me disa laboratorë udhëheqës që donin tepër kontroll mbi procesin. Standardisht, vlerësuesit trajtohen si nënkontraktues të zakonshëm - të lidhur me kontrata kufizuese konfidencialiteti që i lënë kompanisë kontroll të konsiderueshëm mbi atë që mund të publikohet. „Është e mundur që Darioja dhe Semi thjesht të kenë ndërruar mendje dhe të jenë shumë të hapur për këtë“, thotë Glivi. „Por prona intelektuale e këtyre kompanive është jashtëzakonisht e vlefshme për ta, dhe mendoj se si rregull do të jenë shumë të kujdesshëm me atë që guxon të ndahet.“
Këtu vjen edhe pjesa më e ashpër e historisë. Henri Papadatos, drejtor ekzekutiv i Safer AI, thotë se masat vullnetare gjithmonë varen nga vullneti i mirë i kompanisë. „Idealisht, do të kishim rregullore të mirë që e detyron këtë - sepse atëherë kompanitë nuk mund të ndërrojnë mendje nesër nëse i godet një situatë e madhe krize në publik.“ Papadatosi e mbyll argumentin në një mënyrë që ia vlen të mbahet mend: nuk mund të kesh edhe njërën edhe tjetrën - zero përgjegjësi e jashtme, e njëkohësisht të kërkosh që publiku të besojë se rregullat respektohen.
Meta, SpaceXAI dhe Google DeepMind për momentin nuk janë zotuar për asgjë. Ligjet, nga ana tjetër, ecin më ngadalë se esetë: SB 53 i Kalifornisë kërkon nga zhvilluesit e mëdhenj të publikojnë korniza sigurie dhe të raportojnë incidente kritike, ndërsa i riu SB 813 krijon kornizë për organizata të njohura nga shteti për verifikim të pavarur. Ligji evropian për inteligjencën artificiale kërkon vlerësime të dokumentuara dhe raportim të incidenteve serioze, ndërsa Zyra për inteligjencë artificiale mund edhe vetë të kryejë kontrolle dhe të emërojë ekspertë të pavarur. Asnjëra prej tyre ende nuk shkon aq larg sa propozon Amodei - çka do të thotë se edhe më tej vetë laboratorët vendosin sa kontroll të jashtëm do të pranojnë mbi vete. A do ta shohë fare dikush në Ballkan atë raport kur të publikohet, apo do ta lexojmë nga dora e dytë si gjithçka tjetër?
Lajmet e fundit 10 lajme nga kjo kategori
Kur një model mëson të gënjejë, dhe e njëjta kompani që e kapi vendos sa prej saj do të shohim....
Rregullatori gjerman shpenzoi vite në hetim që të ndryshohej një ekran. Pyetja nuk është nëse rregulli ekziston, por kush ishte...
Pajisja që mori tallje dhe e rrëzoi aksionin kthehet me inteligjencë artificiale, partnerë dhe një aplikacion për gjuajtje basketbolli. Pyetja...
Një studiues dha dorëheqje me fjalët se industria po luan bixhoz me jetët tona. Paralajmërimi mund të jetë i sinqertë...
Falas ishte derisa firma donte ta përdornit mjetin. Tani që e përdorni, tarifa nis nga 7,99 dhe shkon deri në...
Të dy shërbimet lejonin leximin e postimeve pa reklama, pa gjurmim dhe pa profil. Pas letrës juridike nga X, faqja...
Një shkencëtar në të njëjtën kompani mendon se probabiliteti i zhdukjes së njerëzimit kalon 10 për qind në dekadën e...
Presidenti mori në telefon ndërsa zhvillohej ngjarja, kurse njeriu që i prodhon çipat u përgjigj se ngadalësim nuk do të...
Nuk ka virus në bashkëngjitje dhe nuk ka skedar të dyshimtë. Ka një kuti që i ngjan verifikimit „nuk jam...
Një studiues u largua sepse firmat luajnë bixhoz me jetët tona. Në vend që ta përgënjeshtronin, në Anthropic e konfirmuan...
Kjo faqe përdor cookies - a është në rregull? Mëso më shumë
Ji i pari që merr vesh kur Metla nxjerr diçka të re
Lëre e-mailin tënd dhe do të të shkruajmë kur ka një udhëzues të ri ose diçka të re në Metla.