Nvidia hakkındaki hâkim anlatı şuydu: yapay zeka patlamasının ilk yıllarında en gelişmiş ekran kartlarının tek kaynağıydı ve sektör büyüdükçe muazzam kâr etti. Son yıllarda Amazon ve Google gibi büyük bulut sağlayıcıları kendi çiplerini üretmeye başladı, yani Nvidia artık tek adres değil — ve yatırımcılar üstünlüğün ne kadar kalıcı olduğunu sorgulamaya başladı.

Anlatı ikna edici ve büyük ölçüde doğru. 2023 başı ile 2025 ortası arasında piyasa değerini on katına çıkaran şirketin hisseleri, son bir yıldır ekran kartı rekabeti endişesiyle daha ölçülü bir seyir izliyor.

Şirketin son bilanço açıklamasından sonra yeni bir anlatı şekillendi: Nvidia'nın avantajı ekran kartının çok ötesine geçiyor. Yapay zekanın hesap gücü gigavat ölçeğine büyüdükçe, işleri düzenlemek giderek karmaşıklaşan bir görev hâline geldi — ve Nvidia bunun için gereken donanımın büyük bölümünü çoktan kurmuş durumda.

Raf raf satılan sistem

Bunu şirketin gerçekte ne sattığına bakarak görmek mümkün. Nvidia şu anda Vera Rubin mimarisini yaygınlaştırıyor: Rubin ekran kartını Vera CPU, çıkarım hızlandırıcı ve depolama ile ağ için benzer raflarla birlikte sunan bir bütün.

Vera Rubin paketinde satılanlar:

  • Rubin — ekran kartının kendisi
  • Vera CPU — veri düzenlemeden sorumlu işlemci
  • Çıkarım hızlandırıcı — jeton üretimini üstlenen ayrı birim
  • Depolama ve ağ rafları — verinin geldiği ve gittiği yollar

Bu sistemler de en az ekran kartı kadar özelleşmiş, ama işleri jeton üretmek değil: ekran kartının dışındaki her şeyin olabildiğince verimli çalışmasını sağlamak. Ekran kartı motorsa, bunlar arabanın geri kalanı.

Asıl darboğaz: veriyi doğru anda ulaştırmak

Vera CPU özellikle veri düzenleme sorununa odaklanıyor. Nvidia'nın depolama teknolojilerinden sorumlu başkan yardımcısı Jason Hardy'nin ifadesiyle: "Vera önemli, çünkü tek bir sunucuya ya da herhangi bir hesap platformuna koyabileceğiniz bellek sınırlı."

Veri merkezleri hesap gücünü büyüttükçe bellek kapasitesi de büyüdü — ikinci dalga altyapı patlamasında bellek üreticilerinin zenginleşmesinin sebebi bu. Ama o veriyi doğru anda ekran kartına ulaştırmak basit değil. Şirketler watt başına jeton maliyetini düşürmeye çalıştıkça bu tür trafik yönetiminin ne kadar önemli olduğunu fark ediyor.

Hardy'nin verdiği rakam: "Vera CPU'nun hızlandırma sağladığı bu işlemlerde üç kata kadar iyileşme gördük. Artık flaş belleğimizi tam potansiyelinde kullanabiliyoruz, çünkü darboğaz yaratmadan bütün performansı alabiliyoruz."

Aynı sorun, farklı çözüm

Aynı problemin başka versiyonlarını Nvidia dışında da görmek mümkün. OpenAI kendi Jalapeño çipini geliştirirken ana odağı bu zorluklardan tamamen kaçınmaktı: hareket ettirilmesi gereken veri miktarını en aza indirmek.

Şirketin blog yazısındaki ifade şöyle: "Jalapeño'yu veri hareketini ve iletişim gecikmelerini en aza indirecek şekilde tasarladık. Geniş alanı, iş yükünün tamamının tek bir bağlı sistem içinde kalmasına imkân veriyor."

Farklı bir yaklaşım — veri hareketini tümüyle bir bütünleşik çipin içinde tutarak önlemek — ama mantık aynı: daha fazla işlem döngüsü yerine daha akıllı trafik yönetimiyle verim artırmak.

Ne değişiyor

Bu yeni odak Nvidia için otomatik bir zafer değil. Şirket, ekran kartlarında olduğu gibi rakip çip üreticileri ve bulut sağlayıcılarıyla yarışmak zorunda kalacak. Ama rekabet yeni bir katmana taşındı: burada rakip bir ekran kartı üretmek, sistemin tamamını verimli çalıştırabilmekten daha az önemli.

Ve en azından bu erken aşamada Nvidia açık ara önde görünüyor.