Anthropic, kendi yazılımının günlük bakımını Claude Code'un üstlenip üstlenemeyeceğini deniyor. Claude Code'u yazan Anthropic mühendisi Boris Cherny'ye göre sonuçlar "şaşırtıcı derecede olumlu".
Kurulum
Cherny'nin anlattığına göre Claude, Tag aracılığıyla "proj-claude-maintains-apps" adlı özel bir Slack kanalı üzerinden günlük rutinler çalıştırıyor. Kapsam şirketin bütün platformlarını içeriyor: iOS, Android, masaüstü, web, komut satırı ve Agent SDK.
Amaç, geliştiricileri tekrar eden bakım işlerinden kurtarmak. Bu işler yazılımın kaçınılmaz ama kimsenin gönüllü olmadığı tarafı: çöken bir ekranın kök nedenini bulmak, artık çalışmayan kodu ayıklamak, birbirine benzeyen iki soyutlamayı birleştirmek.
On iki rutin
Claude'un çalıştırdığı özel bakım rutinleri şunlar:
- Çökme avcısı: Uygulamayı benzeticide açıyor, rastgele dokunarak çökme tetikliyor, kök nedeni çözümleyip düzeltme üretiyor
- Ölü kod temizleyici: Statik olarak ulaşılamayan kodu siliyor; şüpheli koda önce günlük kaydı ekleyip ertesi gün gerçekten kullanılmadığını doğruluyor
- Yineleme birleştirici: Kod tabanında benzer ama biraz farklı soyutlamaları tarayıp birleştirme öneriyor
- Mantık sadeleştirici ve mantık hatası onarıcı: İç içe geçmiş iş mantığını sadeleştiriyor, karmaşık mantığı modelleyip hataları buluyor
- İşe yaramaz test ayıklayıcı: Hiçbir zaman başarısız olamayacak testleri kaldırıyor
- Kararsız test onarıcı: Sürekli entegrasyondaki oynak testleri çözümleyip düzeltiyor
- Soyutlama iyileştirici ve soyutlama polisi: Aşırı mühendislik yapılmış soyutlamaları sadeleştiriyor, mimarideki katman ihlallerini düzeltiyor
Ölü kod temizleyicinin çalışma biçimi dikkat çekici: emin olmadığı kodu doğrudan silmek yerine önce oraya bir günlük kaydı bırakıyor ve ertesi gün o kodun gerçekten hiç çalışmadığını doğruluyor. Bu, insan geliştiricilerin de uyguladığı temkinli bir yöntem.
Komut mühendisliği yok
Cherny bazı komutlarını Slack'te paylaştı ve ortada ayrıntılı bir komut mühendisliği yok. Claude'a düz dille söylüyor: iOS, Android ve masaüstünde çökme avı rutinlerini başlat, sahte veri yerine gerçek uygulamaları kullan, çökme tetikle ve düzeltmeleriyle birlikte değişiklik isteği aç.
388 istek, 180 birleştirme
Claude ilk birkaç haftada Anthropic'in depolarında 388 değişiklik isteği açtı. Otomatik Claude Code incelemesi ve insan denetiminin birleşiminden sonra 180'i birleştirildi — yaklaşık yüzde 46'lık bir oran.
Cherny'ye göre Claude istekleri genellikle ilk denemede doğru yapıyor. Yapmadığında ekip rutini ayarlıyor ki ertesi gün daha iyisini üretsin; bu ince ayar bazen birkaç gün sürüyor. Anthropic şimdi birleştirme sürecini hızlandırmanın yollarına bakıyor.
Rakamın anlamı
Yüzde 46'lık birleştirme oranı tek başına iyi ya da kötü değil; karşılaştırma noktasına bağlı. Açılan isteklerin yarısından azının kabul edilmesi, insan denetiminin devrede olduğunu ve her önerinin otomatik geçmediğini gösteriyor. Öte yandan reddedilen 208 istek de birer maliyet: birileri onları okuyup değerlendirdi.
Asıl kazanç, seçilen iş türünde yatıyor. Bu rutinlerin hiçbiri ürün kararı vermiyor, yeni özellik tasarlamıyor. Hepsi ölçülebilir ve doğrulanabilir bakım işleri: çöken bir ekran ya çöküyor ya çökmüyor, ulaşılamayan kod ya ulaşılamaz ya değil. Doğruluğun makine tarafından sınanabildiği alanlar, otomasyonun en çok işe yaradığı alanlar.
Cherny'nin aktardığı ayrıntı da bunu destekliyor: sistem çalışmadığında düzeltilen şey kodun kendisi değil, rutinin tarifi oluyor. Yani süreç, insan geliştiricinin bir kez düzeltip bir daha uğraşmayacağı bir döngüye dönüşüyor.