Skip to content

RLHF'i icat eden adam OpenAI'dan ayrıldı ve konuşmayan bir model yaptı: çıktı tokenleri ücretsiz, girdi tokenleri milyarla ölçülüyor

1 dk okuma
Paylaş
RLHF'i icat eden adam OpenAI'dan ayrıldı ve konuşmayan bir model yaptı: çıktı tokenleri ücretsiz, girdi tokenleri milyarla ölçülüyor

ChatGPT'nin yapımına yardım eden adam artık bütün sektörün yanlış şeyin peşinde koştuğunu söylüyor. OpenAI'ın eski araştırmacısı ve bugün yapay zekâ denen neredeyse her şeyin dayandığı yöntem olan insan geri bildiriminden öğrenme (RLHF) tekniğinin arkasındaki isimlerden Diogo Almeida, inşa ettiği şeyden memnun olmadığı için şirketten iki yıl önce ayrıldı.

"Şişede yıldırımımız var, yine de işe yaramıyor" dedi Almeida, haberi ilk duyuran Amerikan teknoloji sitesine. "O zamandan beri bu sorunla boğuşuyoruz. Şu sonuca varmam zaman aldı: sorun, insan dili için optimize etmemiz. Dört yıldır insan dilinde muhteşemiz, ama bu otomasyon için işe yaramıyor, çünkü bilgisayarlar başka bir dil konuşuyor."

Girişimi TypeSafe AI bu hafta, büyük dil modeli olmayan Jev adlı bir model yayımladı. Metin üretmiyor. Olasılık üretiyor - şirketin "kalibre edilmiş kararlar" dediği şey. Kullanıcı olası çıktıları önceden tanımlıyor, böylece modelin yeni bir tane uyduracak yeri kalmıyor. Şirkete göre bununla, kelimenin tam anlamıyla halüsinasyon göremiyor.

Geliştiricileri uyandıran şey faturadaki etki. Çıktı tokenleri ücretsiz, girdi tokenleri ise milyonla değil milyarla fiyatlanıyor. Talep öyle büyüktü ki şirket kısa süreliğine, geliştirici arayüzü üzerinden kullanıcılarına hizmet verecek kapasiteden yoksun kaldı.

Pazarlama sunumundan değil, gerçek kullanımdan gelen rakamlar. Vercel'de yazılım mühendisi olan Pranit Sharma, şirketinin komutların güvenli olup olmadığını denetlemek için bir OpenAI modeli kullandığını anlatıyor. Onu Jev ile değiştirdiklerinde sonuçlar beş ila 18 kat daha hızlı ve daha yüksek doğrulukla geldi. Bryo AI'ın teknoloji direktörü Nikhil Mudholkar, iş mesajlarını sınıflandırmada Jev'i Gemini'ye karşı test etti: Gemini biraz daha isabetliydi, ama 10 ila 20 kat daha pahalı.

Mudholkar'ın en çok ilgisini çeken ne hız ne de fiyat oldu. "Gerçek bir olasılık döndüren tek model bu; bu da onu iş süreçlerini otomatikleştirmek için ideal kılıyor" diyor. Earendil'in teknoloji direktörü Armin Ronacher aynı şeyi öteki taraftan açıklıyor: "Günün sonunda halüsinasyon sorununu kısmen kullanıcıya devrediyor. Kullanıcı şunu demek zorunda - tamam, bu yüzde 50 olasılıkla dönüyorsa belki yazı turadır ve görmezden gelirim. Ama yüzde 95'se, o zaman onunla bir şey yapabilirim."

Bu, sektörün şu an sunduğundan daha dürüst bir anlaşma. Büyük bir dil modeli size kusursuz bir özgüvenle yazılmış bir cümle döndürür, kendine ne kadar inandığına dair hiçbir işaret olmadan. Jev bir sayı döndürür ve yeterli olup olmadığına karar vermeyi size bırakır. Daha zeki değil - ama daha denetlenebilir.

İsim rastgele değil. Model, bir şey ucuzladığında onu daha az değil kat kat daha çok tükettiğimizi söyleyen paradoksuyla bilinen 19. yüzyıl iktisatçısı William Stanley Jevons'ın adını taşıyor. Almeida tam da buna oynuyor: zekâ yeterince ucuzlarsa her yere yayılır. "Her yerde akıllı yazılım olacağını düşünüyoruz; yayılmış ve dağıtık bir biçimde - insanların şimdi kurmaya çalıştığı mega uygulamalardan çok, erken dönem internete benzer şekilde" diyor.

Modelin mimarisi konusunda susuyor; dışarıdaki gözlemciler ise altında yine de açık ağırlıklı bir dil modeli olduğunu varsayıyor. Kabul ettiği şey, Jev'in yalnızca sentetik verilerle - şirketin kendi ürettiği verilerle - eğitildiği. "Bütün verilerimizi kendimiz üreteceğimize dair erken bir bahse girdik ve bu hayatımın en iyi bahislerinden biri - lansmanımızdan da iyi, RLHF'ten de iyi" diyor RLHF'i icat eden adam.

TypeSafe'in yeni bir sınır laboratuvarı olup olmadığı sorulduğunda Almeida, sektörün bu yılki bütün halkla ilişkiler çalışmasından daha değerli bir cümleyle yanıt verdi: "Sınır laboratuvarlarının ana ürünü korku ya da hype. Ben bizim ana ürünümüzün zekâ olmasını isterdim. Biz, bilirsiniz, sonsuz servet bahsi, ya da bir din, ya da veri merkezinde tanrı inşa etme, ya da günün modası her neyse o anlamda bir laboratuvar değiliz."

Şimdilik Jev türünün tek örneği, ama Ronacher ne işe yaradığı netleşir netleşmez rakiplerin geleceğini bekliyor. Bunun neden daha önce olmadığına dair açıklaması, pazarın durumu hakkındaki belki de en isabetli cümle: "Bunu pek çok açıdan daha erken görmeliydik, ama muhtemelen dil modelleri çok ucuz ve sübvanse olduğu için çoğu zaman hâlâ yaratıcı olmak zorunda değilsiniz." Faturayı başkasının parası karşılıyorsa, kimse daha ucuz yol aramaz.