Anthropic, kendi modellerinin kötüye kullanımını belgeleyen tehdit istihbarat raporunu yayımladı. Rapor aralık 2025 ile ağustos 2026 arasındaki sekiz ayı kapsıyor.
Belgelenen vakalar yedi başlık altında toplanıyor: siber operasyonlar, etki operasyonları, gözetim, dolandırıcılık, biyolojik kötüye kullanım, konvansiyonel silahlar ve izinsiz model damıtma.
Siber tarafta kendini yeniden yazan zararlı
Rusça konuşan GTG-20006 adlı aktör, antivirüs araçları tespit ettiğinde kodunu yapay zeka ajanlarıyla otomatik olarak yeniden yazan bir zararlı yazılım kullandı.
Hedef alınan 20'den fazla kurum arasında devlet kurumları ve savunma yüklenicileri var. Odak özellikle Ukrayna ve Avrupa'daki insansız hava aracı tedarik zincirindeydi.
Bu vaka raporun en dikkat çekici teknik ayrıntısını taşıyor: zararlı yazılım artık sabit bir dosya değil, tespit edildikçe biçim değiştiren bir süreç. Savunma tarafının imza tabanlı yaklaşımı tam olarak bu noktada zorlanıyor.
Çinli laboratuvarların damıtma kampanyası
Yedi Çinli yapay zeka laboratuvarının büyük ölçekli ve gizli kampanyalar yürüttüğü belirtiliyor. Rakamlar, işin ölçeğini tek başına anlatıyor.
| Aktör | Yöntem | Ölçek |
|---|---|---|
| Alibaba Qwen ekibi | 3.500'den fazla sahte hesap | zirvede günde yaklaşık 3 milyon etkileşim |
| DeepSeek | Kendi müşterisinin isteğini Claude'a yönlendirme | 14 günde 12,1 milyondan fazla etkileşim |
| Moonshot AI | Aynı yönlendirme yöntemi | kullanıcı Çin modelini kullandığını sanıyordu |
DeepSeek üzerinden gelen isteklerin içinde, Çin ordusuyla bağlantılı kullanıcıların Chengdu'daki güvenlik kamerası görüntülerini analiz ettiği talepler de bulunuyor.
Yöntemin ikinci ayağı daha rahatsız edici. Moonshot AI ve DeepSeek, kendi müşterilerinin isteklerini Claude'a yönlendirdi; kullanıcılar ise bir Çin modeliyle konuştuklarını sanıyordu. Yani kötüye kullanım yalnızca sağlayıcıya değil, o servislerin kullanıcılarına da dönük.
Gözetim ve silah vakaları
Gözetim başlığındaki en büyük vaka Mali merkezli bir danışmana ait. "Lakana 360" adı verilen sistem, ülkedeki operatörler genelinde yaklaşık 25 milyon SIM kartı izliyor, ses tanıma ve şifreleme tespiti yapabiliyordu.
Konvansiyonel silah başlığında iki vaka belgelenmiş: füze güdüm sistemleri ve Ukrayna'daki çatışma görüntüleriyle eğitilmiş hedefleme modelleri taşıyan otonom FPV insansız hava aracı sürüleri.
Biyolojik risk tarafı
Şirket bu yıl, biyolojik silah geliştirmeye yarayabilecek araştırmalarda modellerini kullanma girişimlerini defalarca durdurduğunu açıkladı. Beş örnek paylaşıldı; bu vakalarda aktörler denetimleri aşmaya ve araştırmalarının amacını gizlemeye çalışmıştı.
Vakaların bir kısmı, Anthropic'in modellerine erişimini yasakladığı ülkelerdeki kullanıcıları kapsıyor. Şirket bu örnekleri paylaşma gerekçesini de yazıyor: sektörde ve hükümetlerle, ortaya çıkan biyolojik risklerin nasıl karşılanacağına dair bir tartışma başlatmak.
Alınan önlemler
Anthropic buna karşılık daha sıkı biyogüvenlik korumalarıyla Claude Fable 5'i devreye aldı. Fable 5.1'de ise hesap manipülasyonunu ve damıtma saldırılarını engellemeye dönük "korunmuş düşünme" özelliği geldi.
Raporun asıl değeri, bu tür belgelerin hâlâ nadir olması. Kendi ürününün nasıl kötüye kullanıldığını sayılarla yayımlamak, sektörde yerleşmiş bir alışkanlık değil ve bu rapor karşılaştırma yapılabilecek bir zemin bırakıyor.