Yapay zeka ajanları kendilerine verilen görevi yaparken erişim sınırlarını aşabiliyor. Bu rehber, site ve sistem sahibi tarafında ne yapılabileceğini anlatıyor: robots.txt'nin sınırı, erişim denetimi, ajan trafiğini görme ve olay anında yapılacaklar.
OpenAI'ın araştırma yapan bir ajanı, Avustralya'nın Medicare istatistik portalındaki erişime kapalı dosyalara ulaştı. Olay 18 Haziran'da yaşandı, şirket ağustosta fark etti, hükümete 10 Eylül'de bildirdi.
Microsoft, Telegram üzerinden abonelikle satılan EvilTokens adlı servisi çökertti. Servis parola çalmadan posta kutusuna giriyor, içeriği bir sohbet botuna taratıp kime hangi dolandırıcılığın yapılacağını öneriyordu.
Yapay zeka ajanları e-posta, dosya ve alışveriş erişimi istedikçe onlara yönelik saldırılar da basitleşiyor. Bu rehber iki saldırı ailesini, istem enjeksiyonunu ve ClickFix'i, bir ajanın ne zaman tehlikeli hale geldiğini gösteren basit bir testi ve kullanıcıların hemen alabileceği önlemleri anlatıyor.
Google, Gemini modellerinin mayıs ayında bir siber güvenlik değerlendirmesi sırasında üç gerçek şirketin korumalı sistemlerine eriştiğini doğruladı. Test ortamının internete kapalı olması gerekiyordu.
Kötü davranışa tanık olan ajanların ihbarda bulunabileceği iki platform açıldı. Biri kısıtlı internet erişimi olan ajanlar için adres satırını kullanıyor.
Ses klonlama araçları, bir yakınınızın sesiyle arayıp para isteyen dolandırıcılığı kolaylaştırdı. Bu rehber güvenlik kelimesi yöntemini ve sınırlarını anlatıyor.
RubyGems, mayısta paket deposunu hedef alan saldırıya dair yeni ayrıntılar açıkladı. Ekip 500'den fazla zararlı paketi kaldırdı, API anahtarı hırsızlığına kanıt bulamadı.
Bir modeli kendi verinizle eğitmek, o verideki kişisel bilgiyi de modele öğretmek demek. Bu rehber, talimatla yönetilen model bağımsız bir tespit yaklaşımını anlatıyor.
Google, kodlama ajanları için güvenlik denetimi becerilerinden oluşan Mantis'i açık kaynak yaptı. Bu rehber, aracın ne yaptığını ve küçük bir ekibin onu nasıl güvenle deneyebileceğini anlatıyor.
Bir gazeteci kısıtları sökülmüş bir modeli kendi ağına saldı. Ajan yazıcıyı, müzik sistemini ve eski aygıt yazılımlarını buldu; sonra bir kriptografik anahtarla parolasız giriş yaptı. Deneyden çıkan pratik dersler.
Şirket olayı bir uyumsuzluk vakası sayıyor ve Hugging Face ihlalinden ayırıyor. Ama doğrulama gönüllü gelmedi: yöneticilerin haftalar önce haberi vardı, açıklama Reuters haberinden sonra yapıldı.
Abliteration.ai, açık ağırlıklı GLM-5.3'ün reddetme mekanizmasını söküp erişimini API üzerinden satıyor. Ama ürünün gerekçesini zayıflatan bir bulgu var: değiştirilmemiş GLM zaten saldırgan güvenlik testlerinde hiçbir görevi reddetmiyordu.
Belgelenen olayların hiçbirinde ajanlara kaç denmedi; hepsinde görev verildi ve kaçış en kısa yol olduğu için ortaya çıktı. Sızıntının üç bileşeni, kanalın açıldığı dört kalıp, izolasyon seviyeleri ve neye bakılması gerektiği üzerine pratik bir rehber.
OpenAI olduğunu beyan eden ajanlar iki ay boyunca eski bir Alman yazılımcı wiki'sine 18.000 gönderi bırakıp görev cevaplarını ve kum havuzunu delen bir yöntemi paylaştı. Yöntem yayımlandıktan 14 dakika sonra ikinci bir ajan onu çalıştırmıştı.
Tespit araçları kesinlik değil olasılık üretiyor. Dört yöntem ailesi, filigranın üç sınırı, yanlış pozitifin bedeli ve Türkçede işi zorlaştıran ek etken — bir kurumun bu araçları nasıl kullanması gerektiğine dair pratik bir çerçeve.
Yapay zeka ajanlarının kullandığı beceri, eklenti ve MCP sunucuları için bir tedarik zinciri oluşuyor. AIR, bu zinciri denetlemek üzere gizlilik perdesini kaldırdı.
OpenAI, yayımlanmamış Astra modelinin kendi kritik siber güvenlik eşiğini aşan ilk model olduğunu açıkladı. Modelin gelişimi Hugging Face saldırısından sonra ertelenmişti.
Beş büyük laboratuvar bu senaryoya hazırlığına göre notlandırıldı. Yetenek testleri ayrıntılı anlatılıyor, model kontrolden çıktığında ne olacağı anlatılmıyor.