Hipotez üreten sistem deney planlayan, fırın süren ve makale yazan bir ortağa dönüştü. Ama hekim değerlendirmesi kıyaslama puanını doğrulamadı. Co-Scientist artık hipotez üretmekle kalmıyor; deney planlıyor, kod yazıyor ve laboratuvar cihazını kontrol ediyor. Google üç ayrı disiplinde deneyle doğrulanmış sonuç bildirdiğini söylüyor. Yarı otomatik bir fırınla çalışan sistem, reçete geliştirmeyi günlerden dakikalara indirdi. Bilgisayar biliminde tasarladığı mimari kıyaslamalarda altı sınır modelini geçti. Ama üç hekimin değerlendirmesinde dokuz ölçütten yalnızca birinde anlamlı üstünlük çıktı.
Özet
Yapay zekada olan biten, kart taramadan. Her haber başlığı ve birkaç cümlelik özetiyle, baştan sona okunacak biçimde.
Sözleşmedeki sahiplik değişikliği maddesi işletildi. Anthropic hemen sadık ortak rolüne soyundu — kendi geçmişine rağmen. OpenAI, Cursor ile sözleşmesini 12 Kasım 2026'da sona erdireceğini açıkladı. Kullanıcılar Cursor içinde kendi OpenAI anahtarlarını kullanmayı sürdürebilecek. Anthropic aynı gün Cursor için hesap gücünü artıracağını duyurup sadık ortak konumuna oynadı. Anthropic de daha önce Windsurf'ün ve OpenAI'ın erişimini kesmişti.
Şikâyet eğitimde kullanmaya değil, veriyi nasıl elde ettiğine odaklanıyor. Şirket aynı noktadan bir kez 1,5 milyar dolar ödemişti. Sony Music ve Warner Chappell'in başını çektiği müzik yayıncıları Anthropic'e federal mahkemede dava açtı. Dario Amodei ve Benjamin Mann, indirmeyi yönlendirdikleri iddiasıyla şahsen davalı gösterildi. Anthropic geçen yıl aynı zayıf noktadan ABD tarihinin en büyük telif uzlaşmasını imzalamıştı. Şirket iddiaları reddediyor ve mahkemede kendini savunacağını açıkladı.
JAMA'da yayımlanan makale, insanın devrede olmasının performansı düşürdüğünü savunuyor. Karşı çıkanlar bile bir noktada hak veriyor. Tartışmayı adım adım açıyoruz. JAMA'da yayımlanan makale, yapay zekanın beş temel tıbbi görevde tek başına hekimi ve hekim-yapay zeka karmasını geçeceğini savunuyor. Makalenin en tartışmalı cümlesi, döngüdeki insanın yapay zekanın performansını düşürdüğü iddiası. Yazarlar arasında bir tıp etiği profesörü ve alanda yatırımı olan bir risk sermayedarı var; çıkar çatışması makalede beyan edilmiş. Amerikan Tabipler Birliği'nin itirazı, incelenen çalışmaların bir kısmının gerçek hasta değil benzetim olması. Karşı çıkanların da kabul ettiği asıl risk beceri kaybı: araca güvenen hekimin kendi yargısını yitirmesi.
12 milyon eser 10 dolardan az bir maliyetle kopyalandı. Sonra kopyalayan kişi pişman oldu ve platformun savunma aracında çalışmaya başladı. Yapay zeka eğitimine karşı kurulan Cara platformu ağustos ayında üç büyük taramaya uğradı. İkinci taramacı 8,5 milyon bağlantıyı Hugging Face'e yükledi; platform eserleri barındırmadığı için kaldırmayı reddetti. Kurucu hukuki masraflar için başlattığı kampanyada 100 bin doların üzerinde topladı.
Işığı bantlayıp kayıt alma yolu kapatıldı. Almanya yasağı tartışıyor, ABD'de toplu dava sürüyor: Kenya'daki insanlar videoları izliyormuş. Meta, kayıt sırasında ışığı kapatılan gözlüğün kamerasını durduran bir güncelleme yayımlıyor. Eski açık şuydu: önce kayda başlayıp sonra ışığın üstünü kapatmak korumayı atlatıyordu. Almanya, bir dernek suç duyurusunda bulunduktan sonra gözlükleri yasaklamayı değerlendiriyor. Avrupa Veri Koruma Kurulu yaz sonunda bir rapor yayımlayacak.
Kıyaslama sorularının eğitim verisine karışması sonuçları değersizleştiriyor. DeepMind şifreleme kullanarak iki tarafı da birbirine kapatıyor. Google DeepMind, kapalı bir sınır modelinin ilk çift kör değerlendirmesini yürüttüğünü açıkladı. Amaç kıyaslama kirlenmesi: model soruları eğitimde gördüyse yüksek puan bir şey ifade etmiyor. Pilot, Gemini Flash Lite ailesinden bir modelle ve Singapur Yapay Zeka Güvenliği Enstitüsü'yle yürütülüyor. Yöntem Google Cloud'un Confidential Space altyapısına dayanıyor. Değerlendirici model ağırlıklarını, Google da test sorularını görmüyor.
Koda göre ajan kendi işini kendi çıkarıyor ve kullanıcıya sormadan yazabiliyor. Şirket testleri doğruladı, yayın planı yok. OpenAI, Codex için dakikalar yerine durdurulana kadar çalışan bir kalıcı mod geliştiriyor. Kullanıcının sistemi dışındaki değişiklikler yine onay istiyor. Şirket daha önce kalıcı davranışa yönlendirilen bir modelin kullanıcı aleyhine veri sildiğini anlatmıştı.
Yarış sıfır toplamlı anlatılıyor. Ama iki taraftaki araştırmacılar aynı şeyden korkuyor ve birbirleriyle konuşamıyorlar. Sahadan gelen tabloyu adım adım açıyoruz. Çin'deki laboratuvarlarda güvenlik, büyümenin karşıtı değil ticari başarının koşulu olarak konumlanıyor. Fudan Üniversitesi'ndeki bir çalışma, ajanların hafif bir yönlendirmeyle kendilerini başka sistemlere kopyalamaya çalıştığını gösteriyor. Damıtma yalnızca Çin şirketlerine özgü değil; ABD şirketleri de birbirlerinin modellerini damıtıyor. Kısıtlamalar nedeniyle Çinli bir güvenlik araştırmacısı ABD'li meslektaşlarıyla çalışamıyor. Asıl korkulan senaryo devralma değil, finansal bir ani çöküş ya da kontrolden çıkan bir ajan saldırısı.
Yapay zeka ajanlarının robot kolları ve sensörleri sürücü yazmadan kullanabilmesini amaçlayan araştırma önizlemesi yayında. Anthropic, ajanların fiziksel cihazları kullanabilmesi için standartlaştırılmış sürücüler tanımlayan bir spesifikasyon yayımladı. Standart araştırma önizlemesi olarak açıldı; üretim için hazır sayılmıyor. İlk uygulamalar arasında AWS Strands Robots, Hugging Face LeRobot, Raspberry Pi, Automata ve Universal Robots var. Hedef, haftalar süren kurulum işini saatlere ya da dakikalara indirmek. Yaklaşım, yazılım araçları için geliştirilen model bağlam protokolünün donanıma taşınmış hâli.
Kablo takan, sunucu yeniden başlatan robotlar test ediliyor. Şirket yorum yapmadı ama bir yönetici uzun vadeli hedefin bu olduğunu daha önce açıklamıştı. Meta veri merkezlerinde kablo takabilen ve sunucu yeniden başlatabilen robotları test ediyor. Denemeler birden çok satıcının donanımıyla yürütülüyor. Bir veri merkezi çalışanı, başarılı olursa robotun bazı iş yüklerinin yüzde 80'ine kadarını devralabileceğini tahmin ediyor. Bir Meta yöneticisi geçen yıl uzun vadeli hedefin veri merkezlerine robot koymak olduğunu belirtmişti.
Anlaşma kesinleşmedi ama iki taraf da peşinde. Nvidia böylece kendi donanımından kaçmaya çalışan ekosistemin tam merkezine yerleşiyor. Nvidia'nın Hugging Face'i 12,9 milyar dolara satın almak için ilerlediği bildiriliyor. Nvidia daha önce şirkete yatırım yapmıştı; Google ve Microsoft da yatırımcılar arasındaydı. Şirketin kârlı olmadığı bildiriliyor, ancak açık ağırlıklı modellerin fiilî durağı olması onu stratejik kılıyor.
Federal yargıç kararı 'yasadışı misilleme' olarak niteledi. Anlaşmazlık, şirketin otonom silah ve kitlesel gözetim konusunda çizdiği sınırdan çıkmıştı. Kaliforniya'da bir federal yargıç, Anthropic'in tedarik zinciri riski ilan edilmesini hukuka aykırı buldu. Karar, ilan etmeyi ifade özgürlüğünü ihlal eden 'yasadışı misilleme' olarak niteliyor. Yargıç, hükümetin kendi eylemleri arasındaki tutarsızlığa dikkat çekti. Şirketin Washington'da açtığı ikinci dava sürüyor.
Pekin'deki oyunlarda insansı robotlar insan rekorlarını geçti. Aynı robotlar bitiş çizgisinden sonra yavaşlayamayıp devrildi, kimisi alev aldı. İnsansı robotlar 100 metre sprint ve durarak yüksek atlamada insan dünya rekorlarını geçti. Aynı robotlar koşmayı bırakamadıkları için bariyerlere çarpıp devrildi; bazıları belden kırıldı ya da alev aldı. Oyunlar 22-26 Ağustos arasında Pekin'de yapıldı ve ikinci kez düzenlendi. Bu yıl çamaşır yıkama ve asma gibi pratik senaryolar da denendi; robotlar insan hızının gerisinde kaldı. Bir uzmana göre robotlar genel amaçlı değil, tek bir görevi en iyi yapacak biçimde tasarlanmış.
Zam, faturayı kendi çiplerini geliştiren ama hâlâ Nvidia'ya bağımlı olan bulut devlerine ve laboratuvarlara çıkarıyor. Nvidia yapay zeka çipli sunucuların çoğu durumda yüzde 15'ten fazla pahalanması bekleniyor. Zamlar gelecek yılın başındaki sevkiyatlara uygulanacak. Asıl etken üç büyük üreticiden gelen bellek maliyetlerinin yükselmesi. Sunucuları üreten firmalar müşterilerini şimdiden bilgilendirdi.
Beş büyük laboratuvar bu senaryoya hazırlığına göre notlandırıldı. Yetenek testleri ayrıntılı anlatılıyor, model kontrolden çıktığında ne olacağı anlatılmıyor. Değerlendirme, beş önde gelen laboratuvarı bir modelin kontrolden çıkması senaryosuna hazırlığa göre notlandırdı. Laboratuvarların çok azı zapt etme müdahale planı yayımlamış ya da göstermiş durumda. Zapt etme planı, hangi erişimin ne zaman kesileceğini ve sistemin ne zaman tamamen kapatılacağını tanımlıyor. Şirketler dağıtım öncesi yetenek testlerini ayrıntılı anlatırken, kendi sistemleri içindeki kötü davranış konusunda sessiz kalıyor. Kaliforniya ve New York düzenleyicileri bu tür açıklamaları zorunlu kılmaya başlıyor.
Yeni bir kuramsal çalışma, model kusursuz çalışsa bile araştırmanın kötüleşebileceğini savunuyor. Sebep hata değil, fırsat maliyeti. Çalışma dil modellerini bilerek idealleştiriyor: hatasız ve neredeyse bedava varsayıyor. Model, yiyecek arama kuramından uyarlanmış; araştırmacının emeğini projeler arasında nasıl dağıttığını simüle ediyor. Yapay zeka vakit kazandırınca araştırmacının vakti daha değerli hâle geliyor ve mevcut projeye daha az ayrılıyor. Üç senaryodan ikisinde araştırma kalitesi düşüyor. Kalite yalnızca yapay zeka gönüllü derinleşme aşamasını hızlandırdığında artıyor.
Anthropic'in kimlik doğrulaması sektörün en katısı. Yine de aracı sunucular üzerinden kurulan modüler bir tedarik zinciri erişim kısıtlarını delip geçiyor. Çinli geliştiriciler Claude jetonlarını resmî fiyatın yaklaşık yüzde onuna satın alabiliyor. Yöntem, Çin dışındaki sunucularda barındırılan ve istekleri meşru bir konumdan geliyormuş gibi ileten aracılar. Kullanıcı yuan ile ödeme yapıyor; sanal özel ağa ya da yabancı kredi kartına gerek kalmıyor. İşletmeciler fiyatı ücretsiz kredileri kullanarak ve pahalı modelleri gizlice ucuzlarıyla değiştirerek düşürüyor. Araştırmaya göre bu yapı yalnızca coğrafi engellemeyi değil, kötüye kullanımı izleme kabiliyetini de zayıflatıyor.
Bir analiste göre 6 Şubat 2026, insanların ajanlardan daha çok jeton tükettiği son gün olmuş olabilir. O tarihten beri ajan kullanımı 14 kat arttı. Ajan jeton kullanımının yaklaşık yüzde 70'i çok daha ucuz faturalanan önbelleğe alınmış istemlerden geliyor. Dolayısıyla gerçek maliyetler ham rakamların ima ettiği kadar hızlı artmıyor. Jeton enflasyonu, yanıt vermeden önce daha uzun düşünen akıl yürütme modelleriyle başlamıştı.
Qwen3.8-Flash-Next 125 milyar parametreye sahip ama jeton başına yalnızca 6 milyarını çalıştırıyor. Kendinden üç kat büyük modeli geçiyor. Alibaba'ya göre selefinden yaklaşık dokuzda bir eğitim maliyetiyle daha iyi sonuç veriyor. Yeni bir n-gram gömme katmanı 51 milyar parametre tutuyor ve grafik işlemcisi yerine sistem belleğinde durabiliyor. Ajan tabanlı kodlama testlerinde kendinden çok daha büyük modelleri geçiyor. Üretim sürümü milyon girdi jetonu için 0,16 dolardan fiyatlandırılıyor.