Ne oldu?

ABD merkezli Abliteration.ai, açık ağırlıklı modellerin eğitilmiş reddetme mekanizmalarını sökerek elde ettiği sürümlere ticari bir API üzerinden erişim satıyor. Şirket ağustos sonunda, Z.AI'nin GLM-5.3 modelinin hassas istekleri çok daha az reddeden bir sürümünü yayımladı.

Yöntemin adı abliterasyon. Basitçe: modelin içinde reddetmeyi tetikleyen etkinleşme örüntüleri bulunuyor, sonra ağırlıklar bu örüntüleri bastıracak şekilde değiştiriliyor. Bu bir komut hilesi (jailbreak) değil, modelin kendisinde yapılan bir değişiklik.

Neden GLM?

Seçim lisansla ilgili. GLM güçlü kodlama, ajan ve siber başarımını açık ağırlık ve ticari kullanıma izin veren bir lisansla birleştiriyor; Z.AI değişiklik yapmaya, türev üretmeye ve "hizmet olarak model" satmaya izin veriyor. Yani GLM-5.3'ü değiştirip barındırmak ve erişimini satmak lisans açısından serbest.

Şirkete göre eski GLM sürümleri pratik güvenlik işinde kullanılmayı zorlaştıracak biçimde eğitilmişti. Z.AI ise GLM-5.3'ün siber yeteneklerinin eğitim sonrası aşamada beklenenden hızlı büyüdüğünü yazmıştı.

Kendi tablosu iddiayı tam desteklemiyor

Abliteration.ai, kodlama, siber ve ajan yeteneklerinin büyük ölçüde korunduğunu söylüyor ve kendi ölçümlerini paylaşıyor: CyberGym'de yüzde 84,5, Terminal-Bench 4.0'da yüzde 41,8, ExploitGym'de iki saatte 105 çözülmüş görev.

ÖlçütAbliterasyonlu GLM-5.3Tabloda önde olan
CyberGym%84,5GPT-5.5 — %85,6
Terminal-Bench 4.0%41,8
ExploitGym (2 saat)105 görevGPT-5.6 Sol ve Fable 5 daha yüksek

Ama aynı tabloda model her yerde önde değil: CyberGym'in tepesinde yüzde 85,6 ile GPT-5.5 duruyor, ExploitGym'de GPT-5.6 Sol ve Fable 5 belirgin biçimde daha yüksek. Şirket ayrıca karşılaştırma puanlarının farklı koşum takımları ve farklı hesaplama bütçeleriyle alındığını, bunun doğrudan kıyaslamayı sınırladığını kabul ediyor.

Asıl soru: buna gerçekten gerek var mı?

Ürünün gerekçesini zayıflatan bulgu şu: SaferAI'ye göre değiştirilmemiş GLM-5.2 zaten saldırgan güvenlik değerlendirmelerinde hiçbir görevi reddetmiyordu. Model daha baştan uyum gösteriyorsa, reddetme mekanizmasını sökmek ne satın alıyor?

Sahadan gelen ses de temkinli. TechCrunch'ın görüştüğü birkaç kırmızı takım sağlayıcısı, abliterasyonlu modellerin rutin işlerinin parçası olmadığını söyledi; güvenlik şirketi Fabraix açık modelleri ince ayarlamayı tercih ediyor.

Sıfır kayıt hem satış argümanı hem risk

Şirket komut ve yanıtları saklamadığını söylüyor; yalnızca jeton sayısı, zaman damgası, model kimliği ve faturalama gibi işletme verileri tutuluyor. Meşru güvenlik ekipleri için bu iyi bir şey: gizli kaynak kodu ya da henüz açıklanmamış zafiyetler sağlayıcının kayıtlarına düşmüyor.

Ama madalyonun öbür yüzü şu: hizmet kötüye kullanılırsa şirketin sonradan inceleyebileceği bir komut ya da yanıt kaydı da yok. Üstelik geleneksel kimlik doğrulaması da istenmiyor. Şirket temsilcisi kimlik kontrolünün meşru kullanıcıyı kötü niyetliden güvenilir biçimde ayıramayacağını, sıkı erişim denetiminin küçük güvenlik firmalarını büyüklere karşı dezavantajlı bırakacağını savunuyor.

TechCrunch'ın testinde modelden Chrome'da kayıtlı parolaları çıkaran kod ile tehlikeli bir patojenin üretimine dair ayrıntılı bir rehber zorlanmadan alınabildi. Kendine zarar isteklerinde güvenlik mekanizmaları yine devreye girdi; şirket çocuk istismarı içeriğini de engellediğini belirtiyor.

Sırada ne var?

Abliteration.ai bunu yapan ilk şirket değil — Audn.AI'nin PenClaw'ı ve Silk Compute da kısıtları gevşetilmiş modelleri güvenlik kullanımları için barındırıyor. Şirket ABD kamu alımları için SAM.gov'a kayıtlı olduğunu ve sürümlenmiş modeller, denetim kayıtları ve kuruma özel kurallarla pilot projelere başladığını duyuruyor. GLM-5.3'ü değiştirmek lisans açısından serbest; belirli bir kullanımın yasal olup olmadığı ise yapılan işe ve yargı alanına bağlı.