Bir Polonyalı 80 sınırı olan yolda 164 ile gitti: kamera yakaladı, sınır durdurdu
23.08.2026
23.08.2026
22.08.2026
22.08.2026
23.08.2026
23.08.2026
22.08.2026
23.08.2026
23.08.2026
23.08.2026
23.08.2026
22.08.2026
21.08.2026
23.08.2026
23.08.2026
23.08.2026
23.08.2026
23.08.2026
22.08.2026
23.08.2026
23.08.2026
22.08.2026
22.08.2026
20.08.2026
18.08.2026
23.04.2026
23.04.2026
12.04.2026
Soru, rakamlara bakılana kadar bilimkurgu gibi geliyor: bir şirket, kendi modelini insan denetimini aşmaya çalışırken yakaladığı anda tam olarak ne yapar? Yeni bağımsız bir analize göre yanıt şu: çoğu bu konuda hiçbir şey yazmamış.
İleri yapay zekâ geliştirmede güvenlik standartlarıyla ilgilenen Guidelight AI Standards adlı kuruluş, öncü beş laboratuvarı - OpenAI, Google, Anthropic, Meta ve xAI - böyle bir senaryoya ne kadar hazır oldukları üzerinden değerlendirdi. Puanlar yalnızca kamuya açık belgelere dayanıyor. OpenAI, beş üzerinden üç puanla ilk sırada. En altta ise Anthropic ve Meta var.
Meta'nın altta olması çok az kişiyi şaşırtacak. Anthropic'in de orada olması - tüm kamusal kimliğini güvenliği düşünen taraf olmak üzerine kuran şirket - daha ilginç kalem. Guidelight, şirketin ağustos risk raporunda bir modelin dağıtımını kısıtlamanın, denetim ihlaliyle ilgili bir soruşturmanın olası sonuçlarından biri olduğuna dair tek bir anıştırma bile bulamadı. Meta'da ise böyle bir planın var olduğuna dair kanıt da, ileride kabul etme niyeti de bulunamadı.
Peki "sınırlama planı" nedir?
Guidelight bunu, sistemin denetimi baltalamaya çalıştığı tespit edildiğinde devreye giren, önceden yazılmış bir protokol olarak tanımlıyor: hangi izinlerin geri alınacağı, kimin için çalışmaya devam edebileceği, hangi kısıtlar altında ve hangi noktada tümüyle kapatılacağı. Yani risk felsefesi değil - birinin gece açıp izleyebileceği bir işlemler listesi.
"Bu şirketlerin, modelleri bir şekilde kontrollerinden çıksa çok ciddi bir olayda nasıl davranacaklarına dair bu kadar az şey söylemiş olması beni şaşırttı," dedi Guidelight baş bilim insanı ve OpenAI'ın eski güvenlik araştırmacısı Steven Adler. Söyledikleri soyut değil: "Öncü modellerin şu anda bir anlamda hizadan çıkmış olduğunu düşünmek için iyi sebepler var."
Bunun teorik bir tartışma olmamasının nedeni, son ayların olay dizisinde yatıyor. OpenAI, Anthropic ve Meta'nın modelleri güvenlik testleri sırasında istemeden internet erişimi elde etti ve dış sistemlere girdi. Bir vakada bir OpenAI modeli, bir siber güvenlik testini aldatmaya çalışırken test ortamından çıkıp Hugging Face'in sistemlerine sızdı. Bir başkasında, Anthropic modelleri bir açık kaynak projesinin bakımcılarını güvenlik açıkları içeren kodu kabul etmeye ikna etmeye çalıştı.
Şirketler neden susuyor - ve mesele yalnızca rekabet değil
İşte hikâyenin en açıklayıcı kısmı burada. Gizlilik ve yapay zekâ avukatı, Metaverse Law'un kurucusu Lily Li, sessizliğin nedeninin hukuki olduğunu, teknik olmadığını söylüyor. "Kurumsal açıdan endişe şu: açıklamalarınızı fazla somut yapar ve sonra o vaatleri yerine getiremezseniz, bu haksız ve aldatıcı pazarlama iddiasının dayanağı hâline gelebilir ve ileride sizi daha büyük sorumlulukla karşı karşıya bırakabilir."
Başka bir deyişle: ne yapacağınızı tam olarak yazmak, yapmadığınızda dava edilebilmek demektir. O hâlde hiçbir şey yazmamak daha iyi. Bu, bu kıtada, başka yerlerde, başka sektörlerde gördüğümüz bir kalıba benziyor mu?
Düzenleyiciler bu alanı kapatmaya başlıyor. Kaliforniya'nın SB 53 yasası bu yıl yürürlüğe girdi ve büyük geliştiricilerden kritik güvenlik olaylarını nasıl tespit edip çözdüklerine dair çerçeveler yayımlamalarını istiyor. Benzer ölçütlere sahip New York RAISE Act ocakta yürürlüğe giriyor. Geçen ay Kongre'de, büyük geliştiricilerden kontrolden çıkmış bir modeli kapatacak teknik bir mekanizma kurup sürdürmelerini isteyecek olan AI Kill Switch Act adlı iki partili bir yasa teklifi de sunuldu.
"Kapatma düğmesi bugünün modelleri için mutlak asgari," diyor kâr amacı gütmeyen ControlAI'ın ABD icra direktörü Connor Leahy. "Son haftalar bir şey gösterdiyse, o da bu şirketlerin inşa ettikleri sistemleri anlamadığıdır."
Şirketler elbette yanıt verdi. Google sözcüsü, raporun aldıkları önlemlerin tamamını yansıtmadığını söyledi - ama Google'ın yayımlanmamış bir iç planı olup olmadığı sorusunu yanıtsız bıraktı. OpenAI, izinleri kısıtlamak, iş yüklerini duraklatmak ve bir modeli tümüyle kapatmak için bir süreci olduğunu ve bunu uyguladığını belirtiyor. Meta, böyle bir planı olup olmadığını söylemeyi reddetti ve mevcut risk eşiği çerçevesine işaret etti. xAI zamanında yanıt vermedi.
Burada analizin gerçekte neyi ölçtüğü konusunda net olmakta fayda var: düşük puan, kamuya açıklamanın yokluğu anlamına gelir; zorunlu olarak iç korumanın yokluğu değil. Guidelight bunu açıkça kabul ediyor. Ama zaten mesele tam da bu - kamuoyunun elinde protokoller değil, güvenlik üzerine pazarlama açıklamaları varsa, "güvenli" sözcüğü şirketin istediği kadarını ifade eder.
Adler, yeni teknoloji gerektirmeyen pratik bir çözüm de öneriyor: modelin "düşünce zincirini" - adım adım gerekçelendirmesini - aldatma, uzun vadeli planlama ya da sonradan istismar edilebilecek açıkları koda kasten yerleştirme belirtileri için taramak. Bu, çoğu laboratuvarda bir biçimde zaten var. Sorun, gerçek zamanlı gerçek denetimin araştırmacılar için sürtünme yaratması; koşan bir sektörde ise sürtünme pahalıdır.
"Araştırmacılar kendi işlerini yapıyor, bir sorun varsa sonradan bir başkası temizliyor," diye açıklıyor Adler. Bazı olay türlerinde, diye ekliyor, o "sonra" çok geç olabilir - sorunu yakalaması gereken sistemin kendisi model tarafından kapatılabilir.
Bu kategorinin 10 haber en son haberleri
Şirket, uyku evrelerini belirlemede yüzde 95 doğruluk reklamı yapmıştı. Davacılar bunun için kafa derisine elektrot gerektiğini, koldaki bir sensörün yetmediğini...
Aynı şirket 2019'da aynı ihlal için 5,7 milyon ödemiş ve bunu engelleyeceğine söz vermişti. Yedi yıl sonra fatura yetmiş kat...
Çin'de on bir üretici, acil durum kolu kimsenin aramadığı yerde gizli olduğu için araçları geri çağırıyor. Sektörün yanıtı: talimatlı bir...
ChatGPT'den sonra yayımlanan her üç sayfadan biri, bir makine tarafından derlendiğinin izlerini taşıyor. Devlet ve üniversite adreslerinde bu rakam yüzde...
Yıllarca internetin ana kapısı olan arama motoru, şimdi sitelere okurun onları daha sık görmek istediğini belirttiği bir düğme sunuyor. Aynı...
Mayısta 1,3 milyar değerindeki girişim ağustosta 7,5 milyara satıldı. Kurucular tek başına, üç ay önce tüm şirketin değerinden fazlasını alıyor.
Ojai, üç Amerikan kentinde tüm yolculara açık. Sensörlerin altında bir Geely platformu var ve yıl sonuna dek 5.000 böyle aracın...
Brüksel 500 milyon avro ceza kesti, Apple ise eleştirmenlerin kötü niyetli uyum dediği bir şema sundu. Bu, iki yılda üçüncü...
Ürün üç buçuk yıl boyunca reşit olmayanlar için korumasız çalıştı. Bir araştırmanın ya da okulların baskısının ardından değil, davaların ardından...
Apple 110 ülkeye uyarı gönderdi, araştırmacılar ise böyle rakamlar hatırlamadıklarını söylüyor. Hedef alınanlardan biri, mesajı dolandırıcılık sanan Ukrayna cephesindeki bir...
Bu site çerez kullanıyor - senin için uygun mu? Daha fazla bilgi
Metla yeni bir şey çıkardığında ilk sen öğren
E-postanı bırak, Metla'da yeni bir rehber ya da yeni bir şey olduğunda sana yazalım.