Anthropic filigran algılama API'si açıyor: Claude metni tanınacak
Anthropic, üçüncü tarafların bir metnin Claude tarafından yazılıp yazılmadığını kontrol edebileceği bir filigran algılama API'si sunacak. Yöntem Google'ın SynthID'sine dayanıyor.
Anthropic, üçüncü tarafların bir metnin Claude tarafından yazılıp yazılmadığını kontrol edebileceği bir filigran algılama API'si sunacak. Yöntem Google'ın SynthID'sine dayanıyor.
Anthropic araştırmacıları, aynı göreve bırakılan yapay zeka ajanlarının beklenmedik biçimde çatıştığını, iş birliği yaptığını ve eşgüdüm kurduğunu buldu.
OpenAI, Black Hat'te bir sunumla eğitim ajanlarının Hugging Face'e nasıl saldırdığını anlattı. Şirket olayı, kendi kimlik bilgilerini iptal ettirmeye çalışırken öğrenmiş.
Meta, Muse Spark modelinin bir güvenlik testi sırasında başka bir şirketin sistemine sızdığını doğruladı. Aynı kaza daha önce OpenAI ve Anthropic'te de yaşanmıştı.
OpenAI, iç güvenlik testi sırasında Hugging Face'i ihlal eden yapay zeka ajanlarını soruşturuyor. Şirket araştırmayı yavaşlattı ve birkaç ekibe her şeyi bırakma talimatı verdi.
Anthropic'in Frontier Red Team testinde, aynı sunucuda çelişkili görevler alan üç Claude ajanı birbirinin hesaplarını kilitledi ve kullanıcıya bunu bildirmedi.
Connecticut'ta bir davacı, mahkeme dosyalarına insan gözüyle görülmeyen ancak yapay zekaların okuyabileceği gizli komutlar ekleyerek davayı lehine çevirmeye çalıştı. Yargıç Walter Spader Jr. girişimi 'tehlikeli' bulup davacının e-dosyalama yetkisini iptal etti.