Epoka

Özet

Yapay zekada olan biten, kart taramadan. Her haber başlığı ve birkaç cümlelik özetiyle, baştan sona okunacak biçimde.

Washington Post'un haberine göre Kongre üyeleri ve yardımcıları konuşma yazmaktan seçmen postasını ayıklamaya kadar pek çok işte yapay zeka araçlarını çok az denetimle kullanıyor. Kullanım büyük ölçüde denetimsiz: ortak bir kural ya da bildirim yükümlülüğü bulunmuyor. Söz konusu işlerin bir kısmı doğrudan yasama sürecine giriyor.

OpenAI'nin Computer History özelliği Mac'te tıklamaları, tuş vuruşlarını ve uygulama geçişlerini kaydedip ChatGPT ile Codex için aranabilir bir zaman çizelgesine dönüştürüyor. Veri cihazda, şifrelenmemiş Markdown dosyaları olarak saklanıyor. OpenAI verinin eğitimde kullanılmadığını söylüyor; ancak sohbete giren belleklerin eğitim verisine dönüşebileceği belirtiliyor.

Anthropic CEO'su Dario Amodei, yapay zeka düzenlemesine dair görüşlerini paylaştı. Açık ağırlıkların tek başına yeterli olmadığını savundu ve sektörde bir güven krizine dikkat çekti. Model testinin gerekliliğini savunuyor ve sektörde bir "güven krizi" olduğunu belirtiyor. Tartışma, düzenlemenin gücü birkaç şirkette mi toplayacağı yoksa dağıtacağı mı sorusu etrafında dönüyor. Açıklamalar bir sosyal medya tartışması içinde geldi; resmî bir politika belgesi değil.

Sıralamaların tepesindeki DeepSeek V4 Flash, karmaşık ajan görevlerinin yalnızca yüzde 53,8'ini tamamladı. Testte otuz zor görev sekiz farklı iskelede çalıştırıldı. Composio, modeli Claude Code ve Codex dahil sekiz farklı ajan iskelesinde, Gmail ve GitHub gibi canlı araçlar üzerinde 30 zor görevle sınadı. Toplam 240 koşudan 129'u başarılı oldu; 30 iş akışının yalnızca altısı bütün iskelelerde tamamlandı. Fark, sonucun modelden çok çevresindeki iskeleye bağlı olduğunu gösteriyor.

Fields Madalyalı matematikçi Timothy Gowers, dil modellerinin bugüne kadar çözdüğü ünlü matematik problemlerinin neredeyse tamamının ispatla değil karşı örnekle çözüldüğünü söylüyor. Karşı örnek bulmak, bir iddianın yanlış olduğunu gösteren tek bir örnek üretmek demek; ispat ise iddianın her durumda doğru olduğunu göstermek. İki iş bilişsel olarak farklı: biri arama, diğeri kurgu gerektiriyor. Ayrım, modellerin matematikteki gerçek katkısının nerede olduğunu gösteriyor.

Epoch AI'nin temsili anketine göre çalışan Amerikalıların yüzde 20'si, eskiden bir insanın yaptığı en az bir işi yapay zekaya devrediyor ve çıktıyı çoğu zaman düzeltmeden kabul ediyor. Söz konusu işler daha önce bir insan tarafından yapılan işler; yani devir bir eklenti değil, yer değiştirme. Bulgu, verimlilik artışının ölçülmesinden çok denetimin nereye gittiğine dair bir soru doğuruyor.

Anthropic yatırımcılara ikinci çeyrekte 11,5 milyar doları aşan gelir bildirdi. Şirket 2028 için 190-200 milyar dolar aralığında gelir öngörüyor. Bir yıl önce aynı çeyrekte gelir 787 milyon dolardı; artış yaklaşık 14 kat. İlk çeyrek geliri 4,73 milyar dolardı, yani çeyreklik büyüme de sürüyor.

Anthropic'in güvenlik raporuna göre biyolojik ve kimyasal silah risklerini süzen iç sistem yaklaşık bir yıl devre dışı kaldı. Bu sürede 133 milyon etkileşim filtresiz geçti. Bilgi şirketin kendi güvenlik raporundan geliyor; dışarıdan bir sızıntı ya da inceleme değil. Olay, güvenlik önleminin varlığı ile çalıştığının denetlenmesi arasındaki farkı gösteriyor.

OpenAI, kendi modellerinin felaket düzeyinde risk taşıyıp taşımadığını değerlendiren Preparedness ekibini kapattı. İşler mevcut gruplara dağıtıldı, birkaç güvenlik çalışanı ayrıldı. Bir kaynak şirket içinde "kabaran bir sorumluluk ve dehşet duygusu" oluştuğunu aktarıyor. Tartışma, güvenlik çalışmasının ayrı bir ekipte mi yoksa ürün ekiplerinin içinde mi yürütülmesi gerektiği üzerine.

Apple'ın Çin pazarına özel bir büyük dil modelini Alibaba ile birlikte geliştirdiği bildirildi. Şirket hizmeti Çin'in düzenleyicisine resmen kaydettirdi. Bilgi Reuters'ın konuya yakın üç isimsiz kaynağına dayanıyor. Apple daha önce Çin'de yerli şirketlerin modellerini kullanıyordu; kendi modelini geliştirmesi strateji değişikliğine işaret ediyor. Şirket hizmeti Çin'in siber uzay düzenleyicisine kaydettirdi; onay gelirse bu izni alan ilk ABD şirketi olacak.

Yayıncı ve internet öncüsü Tim O'Reilly, büyük yapay zeka laboratuvarlarının kullanıcıyı kilitleyen bir mimari kurduğunu ve gerçek yeniliğin açık kaynaktan geleceğini savunuyor. O'Reilly'ye göre açık kaynak yapay zeka yalnızca ağırlıkları paylaşmak değil; model, ara katman ve uygulama arasında net bir ayrım gerektiriyor. En büyük siber güvenlik olaylarının öncü modellerden kaynaklandığını belirtiyor. Gerçek yeniliğin, girişim sermayesiyle finanse edilmeyen açık kaynak hareketinden geleceğini öngörüyor.

Enerji araştırma firması Noreva, ABD'nin bazı bölgelerinde doğal gaz fiyatlarının üç katına çıkabileceğini öngörüyor. Dört büyük şirket gigawatt ölçeğinde gaz santrali planlıyor. Amazon, Google, Meta ve Microsoft yapay zeka veri merkezleri için gigawatt ölçeğinde doğal gaz santralleri planlıyor. Hâlihazırda 2 ile 4,5 dolar arasında seyreden fiyatların bazı bölgelerde 10 doları aşabileceği tahmin ediliyor. Yakıt, büyük bir santralin elektrik maliyetinin yaklaşık yarısını oluşturduğu için artış doğrudan jeton fiyatına yansıyabilir.

Connecticut'ta avukatsız bir davacı, dilekçelerine beyaz zemin üzerine beyaz 3 punto metinle görünmez yapay zeka talimatları gizledi. Hakim, olağandışı boşluktan fark etti. Gizli metin, olası bir yapay zeka inceleme sistemine dilekçe lehine çıktı üretmesi talimatı veriyordu. Hakim Walter Spader Jr. manipülasyonu, dilekçedeki olağandışı boşluktan fark etti ve davacının elektronik dosyalama hakkını iptal etti. Connecticut mahkemeleri dosya incelemesinde yapay zeka kullanmıyor; talimatların sonuca etkisi olmadı.

Bir değerlendirme düzeneği, nitel incelemenin yakalayamadığı bir örüntüyü ortaya çıkardı: modeller yanlış cevap verirken en yüksek güveni gösteriyor. Aynı örüntü nitel incelemede fark edilmemişti: yanlış cevaplar akıcı ve tutarlı olduğu için doğru okunuyordu. Ekiplerin çoğu doğrulama adımını atlıyor; sıkıcı, zaman alıcı ve son kullanıcıya görünür bir çıktısı yok. "Kulağa doğru geliyor" ile "doğrulanabilir biçimde doğru" arasındaki boşluk, kurumsal araçların sessizce başarısız olduğu yer.

Yapay zeka kodlama girişimi Cognition'ın 40 milyar dolar değerleme üzerinden yeni bir tur için görüştüğü bildirildi. Önceki tur yalnızca birkaç ay önceydi. Bu, birkaç ay içinde yaklaşık yüzde 54'lük bir değerleme artışı anlamına geliyor. Yapay zeka kodlama araçları, kurumsal benimsemenin en hızlı olduğu alanların başında geliyor.

Apple'ın Siri'yi güncel haberle beslemek üzere yayıncılarla görüştüğü bildirildi. WSJ'ye göre şirket dokuz haneli bir bütçeyi değerlendirdi. Apple, Siri'ye güncel haber sağlamaları karşılığında yayıncılara ödeme yapmak üzere görüşmeler yürütüyor. Adım, yapay zeka şirketlerinin haber içeriğini izinsiz kullanmaktan lisanslamaya geçen genel eğilimini sürdürüyor. Anlaşma, güncel bilgi gerektiren sorularda Siri'nin uzun süredir zayıf kaldığı bir açığı kapatmayı hedefliyor.

Google, Ads ve Analytics platformlarına Gemini tabanlı yapay zeka özet ve raporlama araçları ekliyor. Yeni araçlar performans içgörülerini hızlandırmayı ve benchmarking imkânı sunmayı hedefliyor. Analytics ana sayfasına eklenen AI özetleri (AI Overviews) son girişten itibaren önemli performans değişikliklerini gösteriyor. Google Ads'te yeni Dashboards özelliği metin komutlarıyla görsel rapor oluşturmayı sağlıyor. Ask Advisor içindeki yeni benchmarking özelliği kullanıcıların performansını benzer işletmelerle karşılaştırıyor. Tüm yeni özellikler Gemini modeli üzerine inşa edildi.

Accenture'ın sızan iç toplantı kaydına göre jeton tüketimini mühendisler değil diğer çalışanlar sürüklüyor. En büyük tüketim kalemlerinden biri PDF'leri metne çevirmek. Yapay zeka maliyetleri, kurumlarda bütçe kaleminden operasyonel bir soruna dönüşüyor. Sorunun kaynağı model fiyatı değil, kurum içindeki belge biçimleri ve iş alışkanlıkları.

Nvidia, GPU'larının değer kaybetmemesi için bir plan kurdu. Amaç, yeni bir finansör kitlesini yapay zeka altyapısına kredi vermeye devam etmeye ikna etmek. Nvidia'nın planı, GPU'larının ikinci elde değer kaybetmemesini sağlamaya odaklanıyor. 500 milyar dolarlık ölçek, planı tek bir şirketin bilançosunu aşan bir finans meselesi hâline getiriyor. TechCrunch değerlendirmesi planı "riskli ama parlak" diye niteliyor; özellikle eskiyen donanım açısından.

Google, 3.6 Flash'ın üzerinden yalnızca üç hafta geçmişken Gemini 3.7 Flash'ı yayımladı. Şirketin kendi ölçütlerine göre model rakiplerini yarı fiyata geçiyor. Model, şirketin kodlama ve yapay zeka ajanları için en yetenekli "iş atı" modeli olarak konumlandırılıyor. Fiyat, üç hafta önce çıkan kendi selefinin yüzde 50 altında.