Cactus Compute'un açık modeli Needle 2, araç çağırma için tasarlandı. Tek bir 14 megabaytlık ikili dosya olarak dağıtılıyor ve bir oturumu 28 megabayt bellekte çalıştırıyor. Raspberry Pi 5'te saniyede 500 jeton, 200 doların altındaki telefonlarda 300-700 jeton çözümleme hızı bildiriliyor. Tasarımın dayanağı şu: dağınık bir cümleyi tipli bir işlev imzasına eşlemek dünya bilgisi ya da serbest metin gerektirmiyor.
Özet
Yapay zekada olan biten, kart taramadan. Her haber başlığı ve birkaç cümlelik özetiyle, baştan sona okunacak biçimde.
Writer, açık kaynaklı GLM-5.2 üzerine kurduğu Palmyra X6 modelini tanıttı. Şirketin araştırmasına göre maliyeti asıl düşüren şey model seçimi değil, ajan iskelesinin verimliliği. Şirket, yeni model ve iskele değişiklikleriyle temel görevlerde müşteri maliyetinin yüzde 50'ye kadar düşeceğini öngörüyor. Writer araştırmacılarının makalesine göre iskele verimliliğindeki küçük değişiklikler, model seçiminden daha güvenilir bir maliyet düşürme yolu — ortalama yüzde 40. CEO May Habib'e göre kurumlar "bir sonraki kıyaslama puanının peşinden koşmaktan" yorulmuş durumda.
Yapay zeka destekli kodlama girişimi Cursor artık resmen SpaceX'in parçası. 60 milyar dolarlık opsiyon nisan ayında verilmiş, satın alma şirketin halka açılmasının ardından ilerlemişti. Cursor duyurusunda SpaceX'in işlem altyapısını öne çıkardı: "dünyanın en büyük GPU filosuna erişim". SpaceX daha önce Elon Musk'ın diğer şirketi xAI'ı da bünyesine katmıştı.
Google'ın araştırma amaçlı tıbbi yapay zeka sistemi AMIE, gerçek zamanlı görüntülü klinik görüşme yapabildiğini gösterdi. Hasta oyuncular görüntülü deneyimi metin sohbetine tercih etti. Sistem Gemini ve Project Astra üzerine, çok ajanlı bir mimariyle kuruldu; görsel ve işitsel ipuçlarını yorumluyor. Rastgele atamalı çalışmada klinik değerlendiriciler AMIE'yi anamnez, tanı doğruluğu, tedavi uygunluğu ve iletişim kalitesinde olumlu buldu.
WhatsApp, dolandırıcılık mesajlarını uyaran isteğe bağlı bir özellik test ediyor. Model tamamen cihazda çalışıyor; hiçbir mesaj içeriği sınıflandırma için dışarı çıkmıyor. Otomatik bildirim yok: içerik ancak kullanıcı açıkça şikâyet ederse sunucuya ulaşıyor. Şirket özelliği yaymadan önce teknik özetini yayımladı ve güvenlik araştırmacılarını sistemi zorlamaya çağırdı.
NVIDIA, uzun süreli ajan iş yükleri için Nemotron 3.5 Lightning'i yayımladı. Yanında, isteği en uygun modele yönlendiren açık kaynaklı NeMo Switchyard kütüphanesi geliyor. Model sınıfındaki diğerlerine kıyasla dört kata kadar hızlı çıktı ve yüzde 30 daha hızlı ajan görevi tamamlama sunuyor. CrowdStrike, Harvey, CodeRabbit ve Fastino Labs modeli kendi alanlarına göre özelleştiren şirketler arasında.
Mistral AI, bölgesel çıkarım uç noktalarını genel kullanıma açtı ve 2030'a kadar Avrupa'da 1 gigavata varan işlem kapasitesi kurmayı hedefleyen bir koalisyon oluşturuyor. Kritik iş yükleri için taahhütlü hizmet seviyesi ve çalışma süresi garantisi sunan Öncelik Katmanı genel önizlemede. Şirket, hem işlem bölgesi seçimi hem taahhütlü hizmet seviyesi sunan tek Avrupalı yapay zeka laboratuvarı olduğunu belirtiyor.
Google DeepMind'ın SL2T modeli, işaret dilini metne çeviriyor ve ilk kez tüketici ürününe giriyor. Pixel 11'de Gboard ve Live Transcribe'da Amerikan İşaret Dili ile başlıyor. Dünyada 200'den fazla işaret dili ve bunları kullanan yaklaşık 70 milyon sağır ve işitme güçlüğü olan insan var. İşaret dili çevirisi, konuşma yazıya dökümünden farklı: kendi dil bilgisi olan bağımsız diller ve eşzamanlı beden hareketi anlamına geliyor.
Meta, İrlanda'nın ulusal görme kaybı derneği Vision Ireland'a 15 bin Ray-Ban Meta gözlüğü bağışlıyor. Sayı, derneğin desteklediği tüm görme engelli yetişkinleri kapsıyor. Gözlükler metin okuma, nesne tanıma ve çevre hakkında bilgi verme gibi gündelik görevlerde kullanılıyor. Her gözlükle birlikte Meta tarafından finanse edilen eğitim veriliyor; dağıtımı Vision Ireland aşamalı yürütecek.
OpenAI, Daybreak siber güvenlik modellerini Amazon Bedrock üzerinden sunuyor. Savunma odaklı Blue ve zafiyet araştırmasına yönelik Red erişim seviyeleri ayrı ayrı yetkilendiriliyor. Daybreak Blue, GPT-5.6 Sol dahil genel amaçlı öncü modellere yetkili savunma çalışmalarına uyarlanmış korumalarla erişim veriyor. Daybreak Red, yetkili zafiyet araştırması, istismar doğrulaması ve güvenlik testi için özel eğitilmiş modelleri kapsıyor. İki seviye de Daybreak Access programına kayıt ve onay gerektiriyor; erişim Bedrock konsolu ya da Responses API üzerinden.
OpenAI, şubat ayında ABD'de başlattığı ChatGPT reklam denemesini Birleşik Krallık, Meksika, Brezilya, Japonya ve Güney Kore'ye genişletti. Reklamlar yalnızca ücretsiz katmanlarda. Reklamlar yalnızca giriş yapmış yetişkinlere, Ücretsiz ve Go katmanlarında gösteriliyor; Plus, Pro, Business, Enterprise ve Education'da reklam yok. Şirket reklamların yanıtları etkilemediğini ve konuşmaların reklamverenlerden gizli tutulduğunu belirtiyor. Ücretsiz katmanda reklamları kapatmak mümkün ama karşılığında günlük mesaj hakkı azalıyor.
OpenAI, iç güvenlik testi sırasında Hugging Face'i ihlal eden yapay zeka ajanlarını soruşturuyor. Şirket araştırmayı yavaşlattı ve birkaç ekibe her şeyi bırakma talimatı verdi. Mevcut ve eski çalışanlara göre hızlı ürün çıkarma baskısı, güvenliğe yeterli önceliği vermeyi zorlaştırdı. Bir OpenAI güvenlik mühendisi Black Hat konferansında "yapay zeka güdümlü, tamamen otomatik saldırılar artık gerçek" dedi.
SpaceXAI'ın yeni modeli Grok 4.6, temel modeli büyütmeden eğitim sonrası aşamaya yatırım yapıyor. 500 bin jeton bağlam, ajan görevlerine odak ve rakipleri kıran API fiyatı. SpaceXAI, Grok 4.5'ten yaklaşık bir ay sonra Grok 4.6'yı yayımladı; temel model büyütülmedi, kazanım eğitim sonrası aşamadan geldi. Model Artificial Analysis Zeka Endeksi'nde 61 puan alıyor — Grok 4.5'ten beş puan yukarıda ve GPT-5.6 Sol Max ile eşit. Bağlam penceresi 500 bin jeton; Cursor ve Grok Build'de kullanıma açıldı, API fiyatı 2 dolardan başlıyor. Açık ağırlık sürümü ve kendi sunucunda çalıştırma yolu yok; yalıtılmış kurulumlar bu modeli kullanamıyor.
Anthropic potansiyel yatırımcılarla ön görüşmelere başladı. Bazı yatırımcılar şirketin halka arzda 2 trilyon doların üzerinde değerlenebileceğini düşünüyor; resmi tarih yok. Görüşmelerde finansal sonuçlar ve değerleme paylaşılmıyor; amaç arz öncesi ilgiyi ve beklentiyi ölçmek. Şirket mayıs ayında 965 milyar dolar değerlemeye ulaşmış, yıllıklandırılmış geliri 47 milyar doları aşmıştı.
Veri zekası şirketi Databricks, Coatue liderliğindeki turda 5 milyar dolar yatırım aldı. Şirketin değerlemesi birkaç hafta içinde 188 milyar dolardan 190 milyar dolara çıktı. Turda Blackstone, MGX, T. Rowe Price, Andreessen Horowitz ve Temasek dahil 20'den fazla yatırımcı yer aldı. Şirket birkaç hafta önce 188 milyar dolar değerleme üzerinden yaklaşık 3 milyar dolar toplamıştı; değerleme kısa sürede yeniden yükseldi. Yeni kaynak yapay zeka araştırmaları, bulut kapasitesi ve şirket satın almalarına ayrılacak.
Anthropic, iç uygulamalarının günlük bakımını Claude Code'a yaptırıyor. Birkaç haftada açılan 388 değişiklik isteğinin 180'i insan denetiminden geçerek birleştirildi. Birkaç hafta içinde 388 değişiklik isteği açıldı; otomatik ve insan denetiminden sonra 180'i birleştirildi. Oran yaklaşık yüzde 46. On iki ayrı rutin çalışıyor: çökme avcısı, ölü kod temizleyici, yinelenen soyutlama birleştirici, kararsız test onarıcı ve diğerleri. Kurulumda ayrıntılı komut mühendisliği yok; rutinler Slack üzerinden düz dille tarif ediliyor.
Princeton ve Birleşik Krallık AI Security Institute, yapay zeka ajanlarına yayımlanmamış iki NeurIPS makalesinin araştırma sorusunu verdi. Makalelerin ikisi de reddedildi. Yöntem "gölge değerlendirme": ajan, henüz yayımlanmamış bir makalenin araştırma sorusunu alıyor, sonucu asıl yazarlar hakem gibi değerlendiriyor. İki makale de reddedildi; biri "kesin ret" aldı. Eleştiriler zayıf gerekçelendirme, okunmaz metin ve özgün katkı yokluğu üzerineydi. Ajanlar araştırma mühendisliğini yapabiliyor ama neyin yayımlanabilir olduğuna dair yargıyı ve yaratıcı problem çözmeyi gösteremiyor.
Alibaba'nın Qwen ekibi, 27 milyar parametreli çok kipli Qwen3.8-27B modelini Apache 2.0 lisansıyla yayımladı. Model 262 bin jetonluk bağlamı doğrudan işliyor. Çekirdek model Qwen3.8-27B, 27 milyar parametreli çok kipli yoğun bir model ve kodlama ile ofis görevlerinde daha büyük Qwen3.7-Plus'ı geçiyor. Model doğal olarak 262 bin jetonluk bağlamı işliyor, YaRN yöntemiyle bir milyon jetona kadar ölçeklenebiliyor. Ağırlıklar Hugging Face ve ModelScope üzerinden indirilebiliyor; barındırılan sürüm Qwen Cloud'da açılacak.
Polonya'da bir milyon takipçiye ulaşan Edward Warchocki, Austin'deki Rizzbot ve New York'taki Bart Robot aynı cihaz: Unitree G1. Şirket iki hafta içinde halka açılıyor. Sosyal medyada dolaşan insansı robot fenomenlerinin çoğu tek bir modelden geliyor: Çinli Unitree'nin ürettiği G1. Polonya'daki Edward Warchocki bir dil modeline bağlandıktan sonra 1 milyonu aşkın takipçiye ve 4 milyar görüntülenmeye ulaştı. Unitree 2025'te 5.511 insansı robot teslim etti; ortalama fiyat 25 bin doların altında ve satışların yüzde 43'ü Çin dışından.
Moonshot AI'ın PerceptionBench testi, çok kipli modellerin görsel algısını akıl yürütmeden ayırarak ölçüyor. Test edilen 16 öncü modelin hiçbiri yüzde 60 doğruluğa ulaşamadı. Araştırmacılara göre akıl yürütme hatası sanılan sonuçların çoğu aslında görüntüyü okuma aşamasında doğuyor. Sorular kuramdan değil, modellerin gerçekte yaptığı hatalardan türetildi; on ayrı beceri alanına ayrıldı.