IBM, Granite 4.2 dil modellerini 3 milyar, 8 milyar ve 30 milyar parametre boyutlarında yayımladı. Modeller sıfırdan, yaklaşık 15 trilyon jetonla eğitildi.
Sürümün en dikkat çekici tarafı lisans: bütün modeller Apache 2.0 ile dağıtılıyor. Bu, ticari kullanımı da kapsayan izin verici bir lisans; kurumsal kullanıcı için modeli kendi altyapısında çalıştırıp değiştirme ve ürününe gömme hakkı anlamına geliyor.
Teknik özellikler
- Bağlam penceresi — 512 bin jetona kadar.
- Düşünme kipi — modeller "düşünen" ve "düşünmeyen" kipler arasında geçiş yapabiliyor; böylece görev başına harcanan hesaplama denetlenebiliyor. Basit sorgularda kaynak tasarrufu sağlayan bir "düşük çaba" kipi de var.
- Ajan eğitimi — 8B ve 30B sürümler IBM'in "ajan pekiştirmeli öğrenme" dediği eğitimden geçiyor: gerçek korumalı ortamlarda araç kullanmayı, kod yazıp çalıştırmayı ve gerçek zamanlı web araması yapmayı öğreniyorlar.
- Uyumluluk — bütün modeller OpenAI biçiminde araç çağırmayı destekliyor ve yaygın çalıştırma altyapılarında koşuyor.
Konuşmadan yazıya tarafı
Aynı sürümle gelen yeni konuşma modelleri yalnızca 470 milyon parametre taşıyor. IBM'e göre bu modeller açık konuşma tanıma sıralamasındaki önceki liderlerin iki katı hızda çalışıyor ve üç saatlik sesi bir saniyede yazıya çevirebiliyor.
Rakam çarpıcı ama bağlamıyla okunmalı: konuşma tanıma, dil üretiminden çok daha dar bir görev ve küçük modellerin bu alanda etkili olması beklenen bir şey. Yine de 470 milyon parametrelik bir modelin bu hızda çalışması, cihaz üzerinde çalışan uygulamalar için anlamlı bir eşik.
Boyut seçimi neden bu
Üç boyut rastgele seçilmiş değil. Her biri farklı bir donanım sınıfına denk düşüyor: 3 milyar parametrelik model dizüstü bilgisayarda, 8 milyarlık tek bir sunucu grafik işlemcisinde, 30 milyarlık ise mütevazı bir sunucu grubunda çalışabiliyor.
Bu, sınırdaki modellerin izlediği yoldan farklı bir tercih. Sınır laboratuvarları tek bir devasa model çıkarıp erişimi arayüz üzerinden satıyor; IBM ise kurumun elindeki donanıma göre seçebileceği bir aralık sunuyor. İkisi farklı soruya cevap veriyor: biri "en iyisi ne", diğeri "bende çalışan en iyisi ne".
Neden önemli
Bu sürüm, yerel çalışan dil modellerine yönelik ilginin arttığı bir döneme denk geliyor ve IBM'in konumlanması bunu açıkça hedefliyor.
Kurumsal alıcı için hesap şöyle işliyor. Kapalı bir modelde jeton başına ödeme yapılıyor, veri sağlayıcıya gidiyor ve fiyat sağlayıcının kontrolünde. Apache 2.0 lisanslı 8 milyar parametrelik bir model kendi sunucunuzda çalışıyorsa üçü de ortadan kalkıyor. Bunun karşılığında model sınırdaki modellerden daha zayıf oluyor — ama pek çok kurumsal görev sınır yeteneği gerektirmiyor.
IBM'in seçtiği boyutlar da bu okumayı destekliyor. 3B, 8B ve 30B, sırasıyla dizüstü bilgisayarda, tek bir sunucu grafik işlemcisinde ve mütevazı bir sunucu grubunda çalışabilecek ölçekler. Şirket sınırda yarışmıyor; kurumun kendi duvarları içinde çalışacak bir katman satıyor.