Skip to content

Čovek koji je izmislio RLHF napustio je OpenAI i napravio model koji ne govori: izlazni tokeni su besplatni, a ulazni se mere na milijardu

1 min. čitanja
Podeli
Čovek koji je izmislio RLHF napustio je OpenAI i napravio model koji ne govori: izlazni tokeni su besplatni, a ulazni se mere na milijardu

Čovek koji je pomogao da se napravi ChatGPT sada kaže da cela industrija trči za pogrešnom stvari. Diogo Almeida, bivši istraživač u OpenAI i jedan od ljudi iza tehnike učenja iz ljudskih povratnih informacija (RLHF) - metoda na kojem počiva gotovo sve što se danas naziva veštačkom inteligencijom - otišao je iz kompanije pre dve godine zato što nije bio zadovoljan onim što je izgradio.

„Imamo grom u boci, a ipak nije korisno”, rekao je Almeida američkom tehnološkom portalu koji je prvi objavio priču. „Borimo se s tim problemom otada. Trebalo mi je vremena da zaključim: problem je što optimizujemo za ljudski jezik. Odlični smo s ljudskim jezikom već četiri godine, ali to nije korisno za automatizaciju zato što kompjuteri govore drugi jezik.”

Njegov startap TypeSafe AI ove nedelje je pustio model koji se zove Jev i koji nije veliki jezički model. Ne izbacuje tekst. Izbacuje verovatnoće - nešto što kompanija naziva „kalibrisanim odlukama”. Korisnik unapred definiše koji su mogući izlazi, pa model nema gde da izmisli nov. Time, tvrdi firma, bukvalno ne može da halucinira.

Efekat na računu je ono što je probudilo programere. Izlazni tokeni su besplatni, a ulazni se mere na milijardu, ne na milion. Potražnja je bila tolika da je kompanija nakratko ostala bez kapaciteta da opsluži svoje korisnike preko programerskog interfejsa.

Brojke iz prave upotrebe, ne iz marketinške prezentacije. Pranit Šarma, softverski inženjer u Vercel, priča da je njegova firma koristila model OpenAI da proverava da li su komande bezbedne. Kada su ga zamenili sa Jev, rezultati su stizali od pet do 18 puta brže i sa većom tačnošću. Nikil Mudholkar, tehnički direktor Bryo AI, testirao je Jev naspram Gemini za klasifikaciju poslovnih poruka: Gemini je bio malo tačniji, ali od 10 do 20 puta skuplji.

Ono što je Mudholkara najviše zainteresovalo nije ni brzina, ni cena. „To je jedini koji vraća pravu verovatnoću, što ga čini idealnim za automatizovanje radnih procesa”, kaže on. Armin Ronaher, tehnički direktor Earendil, objašnjava isto sa druge strane: „Na kraju dana, problem sa halucinacijama delimično prebacuje na korisnika. Korisnik mora da kaže - dobro, ako se ovo vraća sa 50 odsto verovatnoće, možda je bacanje novčića i ignorišem ga. Ali ako je 95 odsto, onda mogu nešto da uradim s njim.”

To je poštenija pogodba nego ono što industrija nudi u ovom trenutku. Veliki jezički model vam vraća rečenicu napisanu sa savršenim samopouzdanjem, bez oznake koliko sam sebi veruje. Jev vraća broj i ostavlja vama da odlučite da li je dovoljan. Nije inteligentnije - ali je proverljivije.

Ime nije slučajno. Model je krsten po Vilijamu Stenliju Dževonsu, ekonomisti iz 19. veka čiji paradoks kaže da kada nešto pojeftini, počinjemo da ga trošimo višestruko više, a ne manje. Almeida se upravo na to kladi: ako inteligencija postane dovoljno jeftina, završiće svuda. „Mislimo da će biti pametnog softvera svuda, na način koji je raspoređen i distribuiran - mnogo više kao rani internet nego kao mega-aplikacije koje ljudi pokušavaju da grade sada”, kaže on.

O arhitekturi modela ćuti, a spoljni posmatrači pretpostavljaju da iza njega ipak stoji jezički model sa otvorenim težinama. Ono što priznaje jeste da je Jev treniran isključivo na sintetičkim podacima - podacima koje je sama firma proizvela. „Napravili smo ranu opkladu da ćemo sve svoje podatke praviti sami, i to je jedna od najboljih opklada u mom životu - bolja od našeg lansiranja, bolja od RLHF”, kaže čovek koji je izmislio RLHF.

Upitan da li je TypeSafe nova granična laboratorija, Almeida je odgovorio rečenicom koja vredi više od celog ovogodišnjeg PR-a industrije: „Glavni proizvod graničnih laboratorija je strah ili hajp. Ja bih voleo da naš glavni proizvod bude inteligencija. Nismo laboratorija u smislu - znate - opklade na beskonačno bogatstvo, ili religije, ili građenja boga u data centru, ili šta god je stvar dana.”

Zasad je Jev sam svoje vrste, ali Ronaher očekuje konkurente čim postane jasno čemu služi. Njegovo objašnjenje zašto se ovo nije dogodilo ranije možda je najtačnija rečenica o stanju tržišta: „Trebalo je da vidimo ovo ranije na mnogo načina, ali verovatno zato što su jezički modeli toliko jeftini i subvencionisani, često još uvek ne morate da budete kreativni.” Kada tuđi novac pokriva račun, niko ne traži jeftiniji put.