OpenAI, en güçlü modeli GPT-5.6 Sol'un hızlandırılmış bir sürümünü önizlemeye açtı. Ultrafast adı verilen yeni çıkarım modu, saniyede 750 çıktı jetonuna kadar çıkıyor — standart moda göre 14 kata varan bir hızlanma.

Donanım tarafı: Cerebras

Hızın kaynağı bir yazılım eniyilemesi değil, farklı bir donanım. Ultrafast, OpenAI'nin Cerebras ile kurduğu 10 milyar dolarlık ortaklıktan gelen çiplerde çalışıyor.

Cerebras'ın yaklaşımı GPU üreticilerinden ayrılıyor: şirket, tek bir silikon levhanın tamamını tek bir çip olarak üreten "levha ölçeğinde" mimariyi savunuyor. Bu tasarımın en belirgin avantajı, modelin ağırlıklarını çipin üzerinde tutabilmesi ve böylece bellekle işlemci arasındaki veri trafiğini büyük ölçüde ortadan kaldırması. Jeton üretiminde darboğaz çoğu zaman hesaplama gücü değil, bu trafik.

Üç katmanlı yapı

Ultrafast tek başına gelmiyor. Standard ve Fast modlarıyla birlikte OpenAI artık üç katmanlı bir yapı sunuyor:

  • Standard — varsayılan hız ve varsayılan fiyat.
  • Fast — ara katman.
  • Ultrafast — saniyede 750 jetona kadar, en yüksek fiyatla.

Buradaki asıl haber teknik değil ticari. Aynı model, aynı çıktı kalitesi, farklı hız — ve farklı fiyat. Çıkarım hızı kendi başına bir ürün hâline geliyor.

Hız neden bu kadar önemli

Sohbet arayüzünde saniyede 50 ile 750 jeton arasındaki fark, kullanıcı için okuma hızının ötesinde bir anlam taşımıyor; zaten hiç kimse o hızda okuyamıyor. Farkın karşılık bulduğu yer ajan iş akışları.

Bir ajan bir görevi tamamlarken onlarca hatta yüzlerce model çağrısı yapıyor: planlıyor, araç çağırıyor, sonucu okuyor, yeniden planlıyor. Bu zincirde her adımın gecikmesi toplanıyor. Tek çağrıda kazanılan birkaç saniye, otuz adımlık bir zincirde dakikalara dönüşüyor.

Kurumsal tarafta bu doğrudan kullanılabilirlik meselesi. Yarım dakikada biten bir ajan görevi bir iş akışının içine yerleştirilebiliyor; on dakika süren aynı görev ise ancak toplu işlem olarak gecelik çalıştırılabiliyor.

Rekabet açısından

Hızı ayrı fiyatlandırmak, OpenAI'nin kurumsal pazardaki konumunu güçlendirme girişimi. Model kalitesinde rakiplerle arasındaki fark daraldıkça, farklılaşma noktaları da kaydırılıyor: kalite yerine gecikme, gecikme yerine maliyet.

Cerebras ortaklığının büyüklüğü de bu tercihi destekliyor. 10 milyar dolarlık bir taahhüt, hızın geçici bir kampanya değil kalıcı bir ürün hattı olarak düşünüldüğünü gösteriyor.

Fiyatlandırmanın diğer yüzü

Üç katmanlı yapı kullanıcı açısından bir seçim özgürlüğü gibi görünüyor, ama başka bir okuması daha var: varsayılan katmanın artık en iyi katman olmadığı bir düzen. Daha önce bir modele erişmek tek bir fiyat anlamına geliyordu; şimdi aynı modelin ne kadar hızlı çalışacağı bütçeye bağlı.

Bu, bulut hizmetlerinde uzun süredir bilinen bir kalıp. Depolama ve ağ hizmetlerinde de aynı veri farklı erişim hızlarıyla farklı fiyatlardan sunuluyor. Yapay zeka çıkarımının bu kalıba oturması, sektörün olgunlaşma işareti sayılabilir — ama küçük geliştiriciler için hızın bir ayrıcalık hâline gelmesi anlamına da geliyor.

Önizleme aşamasında olması, fiyatların ve sınırların henüz oturmadığını gösteriyor. Ultrafast'ın kalıcı fiyatı, modun gerçekten kimin işine yarayacağını belirleyecek asıl değişken olacak.