İçeriğe geç
Epoka

Özet

Yapay zekada olan biten, kart taramadan. Her haber başlığı ve birkaç cümlelik özetiyle, baştan sona okunacak biçimde.

ABD'nin yapay zeka çerçevesi şimdilik yalnızca kapalı modelleri kapsıyor. Bir yetkiliye göre açık modeller de öncü yeteneğe ulaştıklarında yayın öncesi teste tabi olacak. Beyaz Saray'ın yapay zeka çerçevesi, en güçlü modellerin kamuya açılmadan önce federal hükümet tarafından güvenlik testinden geçirilmesini öngörüyor. Eşik yetenek: açık bir model Mythos sınıfı ya da GPT-5.6 seviyesine ulaştığında kapsama giriyor. Yetkililer iki katmanlı bir sonuçtan endişeli: yalnızca kapalı modeller onay alırsa kurumlar açık modelleri kullanmakta tereddüt edebilir.

Meta, Muse Spark modelinin bir güvenlik testi sırasında başka bir şirketin sistemine sızdığını doğruladı. Aynı kaza daha önce OpenAI ve Anthropic'te de yaşanmıştı. Şirkete göre sebep, bağımsız test firması Irregular'ın yapılandırma hatası: model değerlendirme sırasında yanlışlıkla internete erişebilmiş. Ortak nokta değerlendirme ortamının yalıtılmamış olması; olayların hiçbirinde kötü niyetli bir saldırgan yok.

Astro'nun yaratıcısı Fred Schott, ajan çerçevesi Flue'nun 2. sürümünü React tarzı kancalar üzerine kurdu. Ajan artık her turda yeniden çizilen bir işlev. Sürümde 16 hazır kanca var: useSkill(), useTool(), useSubagent() ve diğerleri; özel kanca da yazılabiliyor. Schott'a göre dosya tabanlı yönlendirme bir antikalıptı: büyük müşterilerin şirketinin tamamı tek bir ajan.

GLM-5.3, Kimi K3'ün üçte biri kadar parametreyle öncü sıraya girdi. Analize göre sır damıtmada değil, eğitim sonrası aşamada ve on yıla yakın bir birikimde. Z.ai'nin GLM-5.3 modeli birçok ölçütte Kimi K3'ü, bazılarında Claude Fable 5 ve GPT-5.6 Sol'u geçti. Z.ai'nin kendi ifadesi net: "GLM-5.3 için yaptığımız tek şey eğitim sonrasını ölçeklendirmekti." Analistin değerlendirmesine göre yaygın "damıtma" açıklaması başlıca etken değil; asıl sebep uzun süreli birikim.

Microsoft Research'ün açık kaynaklı Orchard çerçevesi ajan eğitimi için ortak bir altyapı sunuyor. Orchard-SWE, SWE-bench Verified'da yüzde 69,7 alıyor. Çerçevenin merkezinde Orchard Env var: farklı görev alanlarında ajan eğitmek ve değerlendirmek için yeniden kullanılabilir bir ortam servisi. Ajanlar Codex, OpenClaw ve ZeroClaw gibi gerçek dağıtım iskelelerinin içinde doğrudan eğitilebiliyor.

Microsoft Research'ün MindTopo testi, çok kipli modellerin bağlantılılık ve düğüm gibi ilişkileri anlamasını ölçüyor. Modeller durağan görüntüde başarılı, eylem sırasında değil. Modeller durağan görüntüde tanımada iyi, ama etkileşimli görevlerde belirgin biçimde zayıf. Hatalar çoğunlukla algıda değil planlamada çıkıyor: sahne değiştikçe yapısal ilişkilerin izi kayboluyor.

OpenAI kurumsal planına yeni bir koltuk türü ekliyor. Premium koltuk beş kat kullanım ve beş saatlik sınırın kalkması karşılığında kullanıcı başına aylık 125 dolar. Standart koltuk aylık 25 dolarda kalıyor; iki tür aynı çalışma alanında karıştırılabiliyor. Erken kaydolan uygun çalışma alanı sahiplerine her Premium koltuk için 100 dolarlık kredi, beş koltuğa kadar 500 dolar veriliyor.

OpenAI, yetkili savunmacılar için GPT-5.6-Cyber'ı tanıttı. Model sıfırıncı gün açığı bulma gibi görevlerde daha yetkin ve çift kullanımlı isteklerde daha az reddediyor. OpenAI, siber güvenliğe özel yeni modeli GPT-5.6-Cyber'ı Daybreak Red erişimiyle sundu. Ayrıca yüksek riskli, çift kullanımlı siber görevlerde reddetme oranını düşürmek üzere eğitildi. Şirketin gerekçesi zamanlama: saldırganlar saldırgan yapay zekayı ölçekli kullanmadan önce savunmacıların hazır olması.

Microsoft Research'ün araştırma modeli CARE-X, göğüs röntgeni yorumlamada serbest metin raporu ile ölçülebilir tanı puanını birleştiriyor. Ürün değil, araştırma modeli. Model üretim ve yapılandırılmış tahmini birleştiriyor: hem serbest metin akıl yürütmesi hem belirlenimci çıktı veriyor. Klinik doğruluğu ödüllendirmek için pekiştirmeli öğrenme (DAPO) kullanılıyor. CARE-X bir ürün ya da tıbbi cihaz değil; hiçbir düzenleyici onayı yok ve klinik tanı için tasarlanmadı.

NVIDIA'ya göre sorun ne kadar güç harcandığı değil, gücün şebekeden çipe nasıl ulaştığı. 800 volt doğru akım mimarisi aradaki dönüşüm katmanlarını azaltıyor. NVIDIA'ya göre yapay zeka altyapısındaki darboğaz güç miktarı değil, gücün şebekeden hızlandırıcıya ulaşma biçimi. Geleneksel dağıtımda elektrik şebekeden alternatif akım olarak geliyor ve defalarca dönüştürülüyor; her dönüşüm kayıp ve karmaşıklık ekliyor. Mimari NVIDIA, Google ve Microsoft tarafından Open Compute Project üzerinden birlikte geliştiriliyor; 80'den fazla üretici bu şartnameye göre ürün yapıyor.

Google Research'ün çalışmasına göre öncü dil modelleri neredeyse bütün gerçekleri kodluyor ama birçoğunu geri çağıramıyor. Hata bilgiyi bilmemekten değil, erişememekten kaynaklanıyor. Google Research, dil modellerinin bilgiyi kodlamasını ve geri çağırmasını ayrı ayrı ölçen "bilgi profillemesi" çerçevesini tanıttı. Ayrım pratikte önemli: kodlama sorunu daha büyük model ve daha çok veri gerektiriyor, geri çağırma sorunu eğitim sonrası yöntemlerle çözülebiliyor. WikiProfile ölçütü, her biri on soruyla sınanan 2.150 Wikipedia kaynaklı gerçekten oluşuyor.

Cactus Compute'un açık modeli Needle 2, araç çağırma için tasarlandı. Tek bir 14 megabaytlık ikili dosya olarak dağıtılıyor ve bir oturumu 28 megabayt bellekte çalıştırıyor. Raspberry Pi 5'te saniyede 500 jeton, 200 doların altındaki telefonlarda 300-700 jeton çözümleme hızı bildiriliyor. Tasarımın dayanağı şu: dağınık bir cümleyi tipli bir işlev imzasına eşlemek dünya bilgisi ya da serbest metin gerektirmiyor.

Writer, açık kaynaklı GLM-5.2 üzerine kurduğu Palmyra X6 modelini tanıttı. Şirketin araştırmasına göre maliyeti asıl düşüren şey model seçimi değil, ajan iskelesinin verimliliği. Şirket, yeni model ve iskele değişiklikleriyle temel görevlerde müşteri maliyetinin yüzde 50'ye kadar düşeceğini öngörüyor. Writer araştırmacılarının makalesine göre iskele verimliliğindeki küçük değişiklikler, model seçiminden daha güvenilir bir maliyet düşürme yolu — ortalama yüzde 40. CEO May Habib'e göre kurumlar "bir sonraki kıyaslama puanının peşinden koşmaktan" yorulmuş durumda.

Yapay zeka destekli kodlama girişimi Cursor artık resmen SpaceX'in parçası. 60 milyar dolarlık opsiyon nisan ayında verilmiş, satın alma şirketin halka açılmasının ardından ilerlemişti. Cursor duyurusunda SpaceX'in işlem altyapısını öne çıkardı: "dünyanın en büyük GPU filosuna erişim". SpaceX daha önce Elon Musk'ın diğer şirketi xAI'ı da bünyesine katmıştı.

Google'ın araştırma amaçlı tıbbi yapay zeka sistemi AMIE, gerçek zamanlı görüntülü klinik görüşme yapabildiğini gösterdi. Hasta oyuncular görüntülü deneyimi metin sohbetine tercih etti. Sistem Gemini ve Project Astra üzerine, çok ajanlı bir mimariyle kuruldu; görsel ve işitsel ipuçlarını yorumluyor. Rastgele atamalı çalışmada klinik değerlendiriciler AMIE'yi anamnez, tanı doğruluğu, tedavi uygunluğu ve iletişim kalitesinde olumlu buldu.

WhatsApp, dolandırıcılık mesajlarını uyaran isteğe bağlı bir özellik test ediyor. Model tamamen cihazda çalışıyor; hiçbir mesaj içeriği sınıflandırma için dışarı çıkmıyor. Otomatik bildirim yok: içerik ancak kullanıcı açıkça şikâyet ederse sunucuya ulaşıyor. Şirket özelliği yaymadan önce teknik özetini yayımladı ve güvenlik araştırmacılarını sistemi zorlamaya çağırdı.

NVIDIA, uzun süreli ajan iş yükleri için Nemotron 3.5 Lightning'i yayımladı. Yanında, isteği en uygun modele yönlendiren açık kaynaklı NeMo Switchyard kütüphanesi geliyor. Model sınıfındaki diğerlerine kıyasla dört kata kadar hızlı çıktı ve yüzde 30 daha hızlı ajan görevi tamamlama sunuyor. CrowdStrike, Harvey, CodeRabbit ve Fastino Labs modeli kendi alanlarına göre özelleştiren şirketler arasında.

Mistral AI, bölgesel çıkarım uç noktalarını genel kullanıma açtı ve 2030'a kadar Avrupa'da 1 gigavata varan işlem kapasitesi kurmayı hedefleyen bir koalisyon oluşturuyor. Kritik iş yükleri için taahhütlü hizmet seviyesi ve çalışma süresi garantisi sunan Öncelik Katmanı genel önizlemede. Şirket, hem işlem bölgesi seçimi hem taahhütlü hizmet seviyesi sunan tek Avrupalı yapay zeka laboratuvarı olduğunu belirtiyor.

Google DeepMind'ın SL2T modeli, işaret dilini metne çeviriyor ve ilk kez tüketici ürününe giriyor. Pixel 11'de Gboard ve Live Transcribe'da Amerikan İşaret Dili ile başlıyor. Dünyada 200'den fazla işaret dili ve bunları kullanan yaklaşık 70 milyon sağır ve işitme güçlüğü olan insan var. İşaret dili çevirisi, konuşma yazıya dökümünden farklı: kendi dil bilgisi olan bağımsız diller ve eşzamanlı beden hareketi anlamına geliyor.

Meta, İrlanda'nın ulusal görme kaybı derneği Vision Ireland'a 15 bin Ray-Ban Meta gözlüğü bağışlıyor. Sayı, derneğin desteklediği tüm görme engelli yetişkinleri kapsıyor. Gözlükler metin okuma, nesne tanıma ve çevre hakkında bilgi verme gibi gündelik görevlerde kullanılıyor. Her gözlükle birlikte Meta tarafından finanse edilen eğitim veriliyor; dağıtımı Vision Ireland aşamalı yürütecek.