Dolandırıcılık taktikleri kimlik taklidinden sosyal mühendisliğe ve yapay zekayla üretilen tuzaklara doğru evrilirken, WhatsApp buna karşı yeni bir savunma deniyor: Scam Alert. Özellik isteğe bağlı ve tamamen cihazın içinde çalışan bir makine öğrenmesi modeliyle kullanıcıyı olası dolandırıcılık mesajlarına karşı uyarıyor.

Mesaj içeriği cihazdan çıkmıyor

Duyurunun teknik olarak en önemli kısmı bu. Sınıflandırma için hiçbir mesaj içeriği cihazdan ayrılmıyor ve hiçbir şey WhatsApp'a, Meta'ya ya da bir başkasına otomatik olarak bildirilmiyor. Özellik uçtan uca şifrelemeyi tamamlıyor, onun yerine geçmiyor.

Şirket bunu üç ilkeye bağlıyor:

  • Yalnızca cihazda: Model de işlediği mesaj verisi de cihazda kalıyor.
  • Otomatik bildirim yok: WhatsApp, kullanıcının eylemi olmadan hiçbir kullanıcı verisini paylaşmaya başlatamıyor. Mesaj içeriğinin — hatta bir dolandırıcılık tespit edildiği bilgisinin bile — sunuculara ulaşmasının tek yolu kullanıcının açıkça şikâyet etmesi.
  • Kullanıcı denetimi: Özellik istenildiği an açılıp kapatılabiliyor.

Nasıl çalışıyor

Kullanıcı özelliği açtığında cihaza bir makine öğrenmesi modeli iniyor. Model, rehberde kayıtlı olmayan kişilerden gelen mesajları bilinen dolandırıcılık kalıplarıyla eşleşip eşleşmediğine göre sınıflandırıyor.

Model, kullanıcıların şikâyet ettiği dolandırıcılık konuşmalarında gözlenen kalıplarla eğitilmiş. Değerlendirme olasılıksal: konuşmanın yapısına ve dilsel işaretlere bakıyor. Model bir mesajı olası dolandırıcılık olarak işaretlerse kullanıcı sohbette bir uyarı görüyor — ve bu uyarı karşı tarafa görünmüyor.

Neden şimdi mümkün oldu

Şirkete göre bunu mümkün kılan şey cihaz içi makine öğrenmesindeki son gelişmeler. Daha önce cihazda sınıflandırmayı pratik olmaktan çıkaran performans, pil ve model boyutu ödünleri artık gerekmiyor; doğru metin sınıflandırması tamamen mobil donanımda çalışabiliyor.

Scam Alert bu yaklaşıma özellikle uygun: model cihazda çalışacak kadar küçük, bağımsız incelemeye açılabilecek kadar basit ve sunucu tarafı bileşen olmadan etkili.

Önce teknik özet, sonra yayılım

Sıralamanın kendisi de bir tercih. Şirket özelliği bütün kullanıcılara açmadan önce bu teknik özeti yayımladı ve özelliği yalnızca beta sürümünde sınırlı biçimde dağıtıma soktu.

Uygulamayı doğrulamak için hata ödülü topluluğuyla sistemi zorlamaya devam edileceği, geniş güvenlik araştırma topluluğundan da geri bildirim beklendiği belirtiliyor. Uçtan uca şifreli bir uygulamada mesaj içeriğine bakan herhangi bir özellik doğal olarak şüphe çekiyor; iddiayı önce yayımlayıp sonra sınatmak, bu şüpheye verilebilecek en doğrudan yanıt.

Neyi çözmüyor

Özelliğin sınırları da tasarımının parçası. Model yalnızca rehberde kayıtlı olmayan kişilerden gelen mesajlara bakıyor; tanıdık bir numaradan gelen dolandırıcılık — ele geçirilmiş bir hesaptan yazılan mesaj gibi — bu ağın dışında kalıyor.

Değerlendirme olasılıksal olduğu için hem yanlış alarm hem kaçırma ihtimali var. Uyarının karşı tarafa görünmemesi bu açıdan önemli: yanlış işaretlenen bir mesaj gönderene bir şey hissettirmiyor, kararı tamamen alıcıya bırakıyor.

Modelin yalnızca kullanıcıların şikâyet ettiği kalıplarla eğitilmiş olması da bir kısıt. Dolandırıcılık taktikleri değiştikçe modelin de güncellenmesi gerekiyor ve yeni bir yöntem, ilk kez görüldüğünde kalıp havuzunda bulunmuyor.