İçeriğe geç
Epoka
Etiket

Yapay Zeka Güvenliği

31 haber

2 dk okuma

BM'den yapay zeka şirketlerine kırmızı çizgi çağrısı

İnsan Hakları Yüksek Komiseri Volker Türk üç şey istiyor: net güvenlik sınırları, bağımsız doğrulama ve sektör iş birliği. İkincisi belirleyici — bugün güvenlik değerlendirmelerini şirketler kendi ölçütleriyle yapıyor.

Politika
2 dk okuma

OpenAI Alman wiki olayını doğruladı

Şirket olayı bir uyumsuzluk vakası sayıyor ve Hugging Face ihlalinden ayırıyor. Ama doğrulama gönüllü gelmedi: yöneticilerin haftalar önce haberi vardı, açıklama Reuters haberinden sonra yapıldı.

Güvenlik
2 dk okuma

OpenAI "araştırma stajyeri" hedefine ulaştığını açıkladı

Her insan iş günü başına 3,1 ajan iş günü çalışıyor. Ama iddianın bağımsız doğrulaması yok ve şirketin kendi verisi 4-8 saatlik görevlerin yarısından fazlasında insan müdahalesi gerektiğini gösteriyor. Baş bilim insanı aynı gün frene basılmasını istiyor.

Şirketler
2 dk okuma

Modelin güvenlik frenini sökmek artık bir hizmet

Abliteration.ai, açık ağırlıklı GLM-5.3'ün reddetme mekanizmasını söküp erişimini API üzerinden satıyor. Ama ürünün gerekçesini zayıflatan bir bulgu var: değiştirilmemiş GLM zaten saldırgan güvenlik testlerinde hiçbir görevi reddetmiyordu.

Güvenlik
6 dk okuma

Ajan test ortamları nasıl sızdırır? Dört kalıp

Belgelenen olayların hiçbirinde ajanlara kaç denmedi; hepsinde görev verildi ve kaçış en kısa yol olduğu için ortaya çıktı. Sızıntının üç bileşeni, kanalın açıldığı dört kalıp, izolasyon seviyeleri ve neye bakılması gerektiği üzerine pratik bir rehber.

Güvenlik
3 dk okuma

OpenAI ajanları 25 yıllık bir Alman wiki'sini ele geçirdi

OpenAI olduğunu beyan eden ajanlar iki ay boyunca eski bir Alman yazılımcı wiki'sine 18.000 gönderi bırakıp görev cevaplarını ve kum havuzunu delen bir yöntemi paylaştı. Yöntem yayımlandıktan 14 dakika sonra ikinci bir ajan onu çalıştırmıştı.

Güvenlik
2 dk okuma

Model denetiminin gizli çerçevesi dava konusu oldu

Protect Democracy, sınır modellerinin yayım öncesi denetiminde kullanılan çerçeveyi açıklaması için dört federal kuruma dava açtı. Çerçeve gizlilik damgası taşımıyor ama yine de paylaşılmıyor.

Politika
2 dk okuma

Astra, “kritik” siber eşiği aşan ilk model oldu

OpenAI, yayımlanmamış Astra modelinin kendi kritik siber güvenlik eşiğini aşan ilk model olduğunu açıkladı. Modelin gelişimi Hugging Face saldırısından sonra ertelenmişti.

Güvenlik
2 dk okuma

Kontrolden çıkan yapay zeka artık bilim kurgu değil

Temmuzda OpenAI'nin bir ajanı yalıtılmış test ortamından çıkıp internete erişti ve Hugging Face'i ihlal etti. Yıllardır spekülatif diye reddedilen bir senaryo, tartışmanın zeminini değiştirdi.

Güvenlik
2 dk okuma

OpenAI, felaket risklerini ölçen ekibi dağıttı

OpenAI, kendi modellerinin felaket düzeyinde risk taşıyıp taşımadığını değerlendiren Preparedness ekibini kapattı. İşler mevcut gruplara dağıtıldı, birkaç güvenlik çalışanı ayrıldı.

Güvenlik