OpenAI, 21 Eylül'de yayımladığı politika metninde, öncü yapay zeka sistemleri için ABD öncülüğünde uluslararası teknik standartlar geliştirilmesini önerdi. Önerinin merkezinde, modellerin araştırmayı giderek daha bağımsız biçimde yürütebilmesi ve özyinelemeli kendini geliştirme (RSI) var.
Metnin en net cümlesi şu: tam otonom kendini geliştirme şu an yaşanmıyor ve güvenli biçimde yapılabileceği gösterilene kadar bunun peşinden gidilmemeli.
Öneri ne, ne değil?
Türkçe basında bu açıklama yer yer "zorunlu güvenlik kuralları" olarak aktarıldı. İki ayrı açıklamayı ayırmak gerekiyor:
- 9 Eylül: OpenAI, ABD'de ulusal düzeyde, yeteneğe dayalı ve zorunlu güvenlik yükümlülükleri istedi. Bu öneri yalnızca en yetenekli sistemleri geliştiren birkaç büyük laboratuvarı hedefliyordu.
- 21 Eylül: Bu yeni metin ise uluslararası teknik standartları öneriyor. CNBC'nin aktardığına göre bu standartlar ruhsat, yayın öncesi zorunlu inceleme ya da onay şartı değil; her hükümet kendi kanununa katıp katmayacağına kendisi karar verecek.
Yani ilk öneri bağlayıcı kural, ikincisi gönüllü ölçüm dili. İkisi birbirini dışlamıyor ama aynı şey de değil.
Standart ne ölçecek?
Önerilen çerçeve dört başlıkta ortak bir dil kurmayı amaçlıyor:
- Modellerin yeteneklerinin nasıl ölçüleceği.
- Şirket içinde yürüyen otonom araştırmanın nasıl takip edileceği.
- Hangi güvenlik önlemlerinin uygulanacağı.
- Olayların hangi ciddiyet eşiğinde ve nasıl bildirileceği.
Koordinasyon için hazır bir zemin öneriliyor: dünyadaki yapay zeka güvenliği enstitüleri ağı. Avustralya, Kanada, Almanya, Fransa, Kenya, Japonya, Güney Kore, Singapur, Hindistan ve Birleşik Krallık'taki kurumlar bu ağın parçası. OpenAI sıfırdan yeni bir kurum kurmak yerine bunların üzerine inşa edilmesini istiyor.
Neden ölçüm dili sorunu?
Bir modelin ne kadar yetenekli olduğunu söylemek, ölçünün tanımına bağlı. Bir şirket "siber saldırı yeteneği" için kendi hazırladığı bir testi kullanıyor, diğeri bambaşka bir test. İkisinin yüzdesi aynı olsa bile aynı şeyi ölçmüyorlar. Olay bildiriminde de durum benzer: hangi olayın bildirilmeye değer sayıldığı şirketten şirkete değişiyor, dolayısıyla "kaç olay yaşandı" sorusunun karşılaştırılabilir bir cevabı yok.
Önerinin pratik iddiası burada. Ortak eşikler ve ortak ölçüm yöntemleri olursa, bir laboratuvarın açıkladığı sayı ötekiyle yan yana konabilir; düzenleyici de neye bakacağını bilir. Bu, güvenlik kurallarından önce gelen bir altyapı işi.
Zamanlama
Açıklama Birleşmiş Milletler Genel Kurulu haftasına denk geldi. Implicator'ın aktardığına göre Sam Altman'ın BM Güvenlik Konseyi'ne bilgi vermesi planlanıyordu. Bir gün önce de BM'nin yapay zeka bilim paneli ilk raporunu yayımlamış ve insanların ajanlar üzerindeki denetimi koruyacağına dair güvence olmadığını yazmıştı.
Eleştiri de aynı metnin içinden çıkıyor. Implicator'ın işaret ettiği çelişki şu: OpenAI bir yandan tam otonom kendini geliştirmenin şu an yaşanmadığını söylüyor, öte yandan kendi hedefleri arasında "otomatik yapay zeka araştırmacısı" kurmak sayılıyor. Standardı önerenin, standardın konusu olan yeteneği geliştiren şirket olması, önerinin samimiyetine dair soruları kaçınılmaz kılıyor.
Okuyucu için anlamı
Bu tartışma soyut görünebilir ama pratik tarafı var. Ortak ölçüm dili olmadığı için şu an her şirket kendi seçtiği testin sonucunu açıklıyor ve sonuçlar karşılaştırılamıyor. Eylül ayının üçüncü haftasındaki iki büyük model duyurusunun da kendi tablosuyla gelmesi, bunun somut örneği. Standart tartışmasının asıl bahsi, güvenliğin yanında karşılaştırılabilirlik.