Skip to content

Njeriu që shpiku RLHF-në e la OpenAI-n dhe bëri një model që nuk flet: tokenët dalës janë falas, ndërsa hyrësit maten me miliardë

1 min. lexim
Shpërndaj
Njeriu që shpiku RLHF-në e la OpenAI-n dhe bëri një model që nuk flet: tokenët dalës janë falas, ndërsa hyrësit maten me miliardë

Njeriu që ndihmoi të bëhej ChatGPT tani thotë se gjithë industria po vrapon pas gjësë së gabuar. Diogo Almeida, ish-hulumtues në OpenAI dhe një nga njerëzit pas teknikës së të mësuarit nga reagimet njerëzore (RLHF) - metoda mbi të cilën mbështetet pothuajse gjithçka që sot quhet inteligjencë artificiale - u largua nga kompania para dy vjetësh sepse nuk ishte i kënaqur me atë që kishte ndërtuar.

„Kemi vetëtimën në shishe, e megjithatë nuk është e dobishme“, i tha Almeida portalit teknologjik amerikan që i pari e publikoi historinë. „Luftojmë me atë problem që atëherë. Më duhej kohë të arrija në përfundimin: problemi është se optimizojmë për gjuhën njerëzore. Jemi shkëlqyeshëm me gjuhën njerëzore prej katër vjetësh, por kjo nuk është e dobishme për automatizim sepse kompjuterët flasin gjuhë tjetër.“

Startapi i tij TypeSafe AI këtë javë lëshoi një model që quhet Jev dhe që nuk është model i madh gjuhësor. Nuk nxjerr tekst. Nxjerr probabilitete - diçka që kompania e quan „vendime të kalibruara“. Përdoruesi paraprakisht i përcakton daljet e mundshme, prandaj modeli nuk ka ku të shpikë një të re. Me këtë, pohon firma, fjalë për fjalë nuk mund të halucinojë.

Efekti në faturë është ai që i zgjoi programuesit. Tokenët dalës janë falas, ndërsa hyrësit maten me miliardë, jo me milion. Kërkesa ishte aq e madhe sa kompania për pak kohë mbeti pa kapacitet t'i shërbejë përdoruesve të vet përmes ndërfaqes programuese.

Shifra nga përdorimi i vërtetë, jo nga një prezantim marketingu. Pranit Sharma, inxhinier softuerik në Vercel, tregon se firma e tij përdorte një model të OpenAI-t për të verifikuar nëse komandat ishin të sigurta. Pasi e zëvendësuan me Jev, rezultatet vinin nga pesë deri 18 herë më shpejt dhe me saktësi më të madhe. Nikhil Mudholkar, drejtor teknik i Bryo AI, e testoi Jev-in përballë Gemini-t për klasifikimin e mesazheve afariste: Gemini ishte pak më i saktë, por nga 10 deri 20 herë më i shtrenjtë.

Ajo që e interesoi më së shumti Mudholkarin nuk është as shpejtësia, as çmimi. „Është i vetmi që kthen probabilitet të vërtetë, çka e bën ideal për automatizimin e proceseve të punës“, thotë ai. Armin Ronaher, drejtor teknik i Earendil, të njëjtën gjë e shpjegon nga ana tjetër: „Në fund të ditës, problemin e halucinacioneve pjesërisht ia kalon përdoruesit. Përdoruesi duhet të thotë - mirë, nëse kjo kthehet me 50 për qind probabilitet, ndoshta është hedhje monedhe dhe e injoroj. Por nëse është 95 për qind, atëherë mund të bëj diçka me të.“

Kjo është marrëveshje më e ndershme se ajo që ofron industria për momentin. Një model i madh gjuhësor ju kthen një fjali të shkruar me vetëbesim të përsosur, pa shenjë sa i beson vetes. Jev kthen një numër dhe ju lë ju të vendosni nëse mjafton. Nuk është më inteligjent - por është më i verifikueshëm.

Emri nuk është i rastësishëm. Modeli është pagëzuar sipas Uilliam Stenli Xhevonsit, ekonomist i shekullit 19 paradoksi i të cilit thotë se kur diçka lirohet, fillojmë ta harxhojmë shumëfish më shumë, jo më pak. Almeida pikërisht mbi këtë vihet bast: nëse inteligjenca bëhet mjaft e lirë, do të përfundojë kudo. „Mendojmë se do të ketë softuer të zgjuar kudo, në mënyrë të shtrirë e të shpërndarë - shumë më tepër si interneti i hershëm sesa si mega-aplikacionet që njerëzit po përpiqen t'i ndërtojnë tani“, thotë ai.

Për arkitekturën e modelit hesht, ndërsa vëzhguesit e jashtëm supozojnë se nën të megjithatë qëndron një model gjuhësor me pesha të hapura. Ajo që e pranon është se Jev është trajnuar ekskluzivisht mbi të dhëna sintetike - të dhëna që i prodhoi vetë firma. „Bëmë një bast të hershëm se të gjitha të dhënat tona do t'i bënim vetë, dhe ky është një nga bastet më të mira të jetës sime - më i mirë se lansimi ynë, më i mirë se RLHF“, thotë njeriu që shpiku RLHF-në.

I pyetur nëse TypeSafe është laborator i ri kufitar, Almeida u përgjigj me një fjali që vlen më shumë se gjithë PR-i i këtij viti i industrisë: „Produkti kryesor i laboratorëve kufitarë është frika ose hajpi. Unë do të doja që produkti ynë kryesor të ishte inteligjenca. Nuk jemi laborator në kuptimin - e dini - bast mbi pasuri të pafundme, ose fe, ose ndërtim i një zoti në një qendër të dhënash, apo çfarëdo qoftë gjëja e ditës.“

Deri tani Jev është i vetëm në llojin e vet, por Ronaheri pret konkurrentë sapo të bëhet e qartë për çfarë shërben. Shpjegimi i tij pse kjo nuk ndodhi më herët është ndoshta fjalia më e saktë për gjendjen e tregut: „Duhej ta kishim parë këtë më herët në shumë mënyra, por ndoshta ngaqë modelet gjuhësore janë aq të lira e të subvencionuara, shpeshherë ende nuk ju duhet të jeni kreativë.“ Kur paratë e të tjerëve e mbulojnë faturën, askush nuk kërkon rrugë më të lirë.