OpenAI, şirket içinde geliştirdiği çıkarım çipinin ilk kıyaslama sonuçlarını Hot Chips konferansında paylaştı. Jalapeño adlı çip, aktarılan sonuçlara göre hem watt başına verim hem de jeton gecikmesi tarafında Nvidia'nın Blackwell ve Rubin platformlarını geçiyor.

Çipin kapsamı sınırlı ve bunu belirtmek gerekiyor: yalnızca çıkarım yapıyor, yani modelleri çalıştırıyor ama eğitmiyor. Ayrıca OpenAI'ın kendi modellerine göre ayarlanmış değil; genel amaçlı bir dil modeli çıkarım hızlandırıcısı.

Bildirilen rakamlar

OpenAI'ın açıkladığı sonuçlar şöyle:

  • Watt başına iş — tepe verimde test edilen üç modelde 1,5 ile 1,9 kat daha fazla.
  • Uçtan uca gecikme — ticari olarak erişilebilir en iyi sistemlere göre 1,7 ile 3,6 kat daha düşük.
  • Etkileşimli iş yükleri — 2,1 ile 4,1 kat daha yüksek başarım.

Sonuçlar SemiAnalysis'in herkese açık InferenceX kıyaslamasıyla alındı. Rakamları OpenAI sağladı; SemiAnalysis bazı koşuları laboratuvarda yerinde doğruladı. Test edilen modeller GPT-OSS 120B, Deepseek R1 670B ve Kimi K2.5 1T.

OpenAI donanım başkanı Richard Ho basın görüşmesinde şunu söyledi: "Sonuçlar mevcut en iyi teknolojiye göre çok ama çok belirgin bir başarım sıçraması gösteriyor. Jalapeño birim güç başına daha fazla iş sunabiliyor, üstelik yanıtları daha hızlı döndürerek."

Neyin karşılaştırıldığı önemli

SemiAnalysis'in kendi değerlendirmesinde dikkat çektiği nokta şu: adil karşılaştırma Blackwell değil, Nvidia'nın daha yeni Vera Rubin platformu — çünkü ikisi de HBM4 bellek kullanıyor. Bu karşılaştırmada bile Jalapeño megavat başına daha fazla çıktı jetonu üretiyor. Üstelik bunu, Nvidia'nın hızlandırıcısının kullandığı çok jetonlu tahmin gibi iyileştirmeleri devreye almadan yapıyor. Jeton başına toplam sahip olma maliyetinde ise ikisi aşağı yukarı başa baş çıkıyor.

SemiAnalysis üst yöneticisi Dylan Patel değerlendirmesini şöyle özetliyor: "Genellikle birinci nesil çipler rekabetçi olmaz, ama OpenAI Nvidia Blackwell'i, hatta Rubin'i geçiyor."

Çekinceler

Rakamları temkinli okumayı gerektiren birkaç nokta var. Nvidia ve AMD, Jalapeño'da henüz test edilmemiş daha büyük modellerle sonuç yayımladı. Daha önemlisi zamanlama: Rubin sistemleri müşterilere sevk edilirken, Jalapeño'nun mühendislik örneği aşamasını geçmediği bildiriliyor.

Ho'nun kendi takvimi de bunu doğruluyor: çip 2026 sonunda "çok küçük hacimlerde" devreye girecek, daha anlamlı dağıtım 2027'de gelecek. Yani kıyaslama bugünkü Nvidia sistemine karşı yapıldı ama Jalapeño tam dağıtıma ulaştığında rakip epeyce ilerlemiş olabilir.

Dokuz ayda tasarım

Jalapeño, Broadcom ile birlikte geliştirildi. Tasarım çalışması 2024 ortasında başladı, nihai tasarım Kasım 2025'te üretime gitti. Tüm döngü yaklaşık on altı ay sürdü, ancak OpenAI'a göre ilk çip tasarımıyla fabrikaya giden bitmiş plan arasında yalnızca dokuz ay geçti.

Şirket geliştirme sırasında kendi modellerini kullandığını söylüyor: eski model kuşakları çip tasarımına yardım etti, yenileri programlama ve iyileştirmeyi hızlandırdı.

Neden önemli

SemiAnalysis bunu Nvidia'nın çok konuşulan "CUDA hendeği"nin artık tutmayabileceğinin işareti olarak görüyor: "OpenAI'ın kendi silikonu üzerinde yeni modelleri ne kadar hızlı ayağa kaldırabildiği düşünülünce CUDA hendeği muhtemelen ölmüş durumda."

OpenAI finans başkanı Sarah Friar ise çipi daha geniş bir hesaplama stratejisinin parçası olarak sunuyor: veri merkezleri, çipler, modeller, geliştirici platformu, ürünler ve cihazlar tek bir bütünleşik sistem olarak çalışıyor. Friar, Jalapeño'nun Nvidia, AMD, AWS, Cerebras ve CoreWeave gibi mevcut ortaklıkların yerini almadığını, onları tamamladığını söylüyor.