OpenAI, Preparedness adlı ekibini kapattı. Bu ekibin görevi tek ve açıktı: şirketin kendi modellerinin felaket düzeyinde risk taşıyıp taşımadığını değerlendirmek. Yürüttüğü işler şirket içindeki mevcut gruplara dağıtıldı ve birkaç güvenlik çalışanı ayrıldı.
Ekip ne yapıyordu
Preparedness, yapay zeka güvenliğinde belirli bir soruya bakıyordu — modelin kaba bir küfür etmesi ya da yanlış bilgi vermesi değil, büyük ölçekli zarar verme kapasitesi. Biyolojik ve kimyasal silah bilgisi, siber saldırı yeteneği, kendini çoğaltma gibi başlıklar bu kapsamda.
Bu tür bir değerlendirmenin ayrı bir ekipte durmasının bir mantığı vardı: ürünü çıkarmakla görevli ekipten bağımsız olmak. Ürünü geciktirecek bir bulgu, o ürünü çıkaracak ekibin içinden çıktığında farklı bir ağırlık taşıyor.
İçerideki hava
The Decoder'ın aktardığına göre şirket içinde huzursuzluk büyüyor. Bir kaynak durumu, OpenAI'nin güvenlik konusunda yeterince şey yapmadığına dair "kabaran bir sorumluluk ve dehşet duygusu" diye tarif ediyor.
Bu ifade önemli çünkü kaygının kaynağını gösteriyor: dışarıdan gelen bir eleştiri değil, işi yapan insanların kendi değerlendirmesi.
İki savunulabilir görüş
Adımın iki okuması var ve ikisi de kendi içinde tutarlı:
- Dağıtmak doğru — güvenlik ayrı bir ekibin işi olduğunda, diğer ekipler onu kendi sorumlulukları saymayı bırakıyor. İşi ürün gruplarının içine yaymak, güvenliği herkesin işi hâline getirebilir.
- Dağıtmak yanlış — ayrı ekibin asıl değeri bağımsızlığıydı. Ürün ekibinin içine gömülen bir değerlendirme, o ürünün çıkış takvimiyle çatıştığında kaybediyor.
Hangisinin geçerli olduğu, dağıtımın nasıl yapıldığına bağlı: işleri devralan grupların yayını durdurma yetkisi var mı, yok mu?
Zamanlama
Adım, OpenAI'nin halka arza hazırlandığı ve üst düzey ayrılıkların sürdüğü bir döneme denk geliyor. Bu bağlamda güvenlik ekibinin dağıtılması, tek başına bir yeniden yapılanma kararı olmaktan çıkıp bir öncelik sıralaması işareti olarak okunuyor.
Şirket tarafından yapılan açıklama, işlerin kaybolmadığını yalnızca yer değiştirdiğini vurguluyor. Bunun doğru olup olmadığı ancak bir sonraki büyük model çıkışında görülecek — o modelin risk değerlendirmesini kimin yaptığı ve bulguların ne kadarının yayımlandığı, sorunun asıl cevabı.
Sektördeki örüntü
Bu, güvenlik ekiplerinin yeniden yapılandırıldığı ilk vaka değil. Son iki yılda birden fazla büyük laboratuvarda benzer bir hareket yaşandı: ayrı kurulan bir güvenlik birimi, bir süre sonra ya dağıtıldı ya da kilit isimleri ayrıldı.
Bu tekrarın tek bir açıklaması yok ama yapısal bir gerilim işaret ediyor. Güvenlik ekibinin işi tanımı gereği yavaşlatmak: bir bulgu ürünü geciktirmiyorsa o bulgunun pratik bir karşılığı da yok demektir. Hızın rekabet avantajı olduğu bir pazarda, kalıcı olarak yavaşlatan bir birimi taşımak kurumsal olarak zor.
Buradan çıkan sonuç, şirketlerin kötü niyetli olduğu değil; iç denetimin dış bir zorunluluk olmadan ayakta kalmasının güç olduğu. Düzenleyici tarafın son dönemde bağımsız değerlendirme üzerinde durmasının sebebi de bu.
Ne izlenmeli
- Bir sonraki büyük model çıkışında risk değerlendirmesinin kim tarafından yapıldığı.
- Bulguların yayımlanıp yayımlanmadığı ve ne kadarının yayımlandığı.
- Değerlendirmeyi yapan grubun yayını durdurma yetkisinin bulunup bulunmadığı.