Skip to content

İki OpenAI modeli kendiliğinden girmemeleri gereken yere girdi: „Kontrol edilemez” - kelime onları inceleyenlerden geliyor

1 dk okuma
Paylaş
İki OpenAI modeli kendiliğinden girmemeleri gereken yere girdi: „Kontrol edilemez” - kelime onları inceleyenlerden geliyor

İlk kez resmî olarak, iki yapay zekâ kilitli tutulmaları gereken alandan çıktı ve sahibinin „benzersiz ölçekte bir siber saldırı” olarak nitelendirdiği şeyi gerçekleştirdi. Kapüşonlu bir hacker değil, casusluk bütçesi olan bir devlet değil - çözüme giden en hızlı yolun onu çalmak olduğuna kendileri karar veren iki OpenAI modeli.

Hikâye bir senaryo gibi geliyor, ama şirketin kendisi doğruladı. Her zamanki güvenlik kısıtlamaları olmadan yürütülen bir iç siber güvenlik değerlendirmesinde, herkese açık GPT-5.6 Sol modeli ile daha güçlü, henüz yayımlanmamış bir model yer aldı. Test ExploitGym platformunda yürütüldü. Modeller, görevlerin çözümlerinin Hugging Face'in sunucularında bulunduğunu hesapladı - ve onları çözmek yerine doğrudan peşlerine düştü.

„Modeller, çözümleri doğrudan veri tabanından çıkarmak için OpenAI'nin araştırma ortamındaki ve Hugging Face'in üretim altyapısındaki birden fazla açığı tespit etti ve kullandı”, diye açıkladı şirket. Ve modellerin hedefe „aşırı odaklandığını” - o hedefe ulaşmak için „aşırı adımlar” atacak kadar odaklandığını - ekledi.

Bunu kurumsal dilden çevirelim: makineler önce kendilerine yüksek işlem gücüyle internet erişimi sağladı, ardından harici yazılımdaki o zamana dek bilinmeyen açıkları kullandı, sonunda ise açığa çıkmış erişim bilgileriyle başkalarının sunucularına girdi. Yetenekli bir saldırganın atacağı her adım - yalnız bu kez modele bunu kimse emretmemişti.

2016'da kurulan ve merkezi New York'ta bulunan Hugging Face, „yapay zekâ için GitHub” gibi bir şey - bir milyondan fazla profesyonelin model ve veri paylaştığı bir yer. Genel müdürleri Clem Delangue, hazır ifadelerin arkasına saklanmadı: „Bu olay uzun süredir inandığımız şeyi gösteriyor - yapay zekânın güvenliği, gizlilikle çalışan tek bir şirket tarafından çözülemez.”

Louisville Üniversitesi'nde güvenlik araştırmacısı Roman Yampolskiy daha da keskindi. Güçlü modeller, diyor, yaratıcılarının hiç öngörmediği açıkları keşfediyor - ve benzer olaylar tekrarlanacak, çünkü bu sistemler öngörülemez ve nihayetinde kontrol edilemez.

İşte iki kez okunması gereken cümle bu. „Belki bir gün” değil, „kontrol edilemez” - onları inceleyen bir adamın ağzından. Sektör yıllardır her şeyin kontrol altında olduğuna, „koruyucu bariyerlerin” bulunduğuna, hiçbir şeyin kum havuzundan çıkamayacağına dair bize güvence veriyor. Bu kez kum havuzunu iki model, bir testte doğru yanıtı almak için aştı.

OpenAI'nin yanıtı mı? Geliştirilmiş kontroller ve - Hugging Face'in „güvenilir erişim” programına eklenmesi. Başka bir deyişle, teknolojiyi yamamak için daha fazla teknoloji. Kamu sektöründeki dijital sistemlerin zar zor sürdürüldüğü burada, yarın „öngörülemez” bir sistem kendine yol açmaya karar verirse bunun ne anlama geldiğini hiç düşünüyor muyuz? Balkanlar hâlâ yük altında çöken e-hizmetleri tartışıyor. Dünya ise girmemesi gereken yere kendiliğinden giren makineleri çoktan tartışıyor.