Anthropic, 23 Eylül'de yapay zeka modeli Claude'un daha önce tanımlanmamış bir enzim sistemi bulduğunu açıkladı. Sisteme ART adı verildi ve bakterileri enfekte eden virüslerin, yani bakteriyofajların DNA'sında bulunuyor.

Haberi ilgi çekici kılan, enzimin yanındaki yapı: CRISPR sistemlerindekine benzeyen, düzenli aralıklarla tekrar eden uzun bir DNA dizisi. CRISPR'da bu diziler, sistemi programlanabilir kılan RNA rehberlerinin bankası işlevini görüyor.

Claude ne yaptı?

Çalışma, Anthropic'in bu yıl kurduğu yaşam bilimleri programı kapsamında yürütüldü. Rakamlar şöyle:

  • Veri tabanlarından 200 binden fazla ters transkriptaz örneği toplandı. Bunlar RNA'daki bilgiyi DNA'ya kopyalayan enzimler.
  • Yaklaşık 950 Claude ajanı 21 saat boyunca bu örnekleri taradı ve yaklaşık 210 milyon jeton harcadı.
  • Tarama sonunda 3.500 aday sistem çıktı; bunlardan 20'si ayrıntılı inceleme için seçildi.
  • Bir ajan, seçilen adaylardan birinin geninin yanında CRISPR'ı andıran tekrar dizisini fark etti.

Anthropic'e göre modelin asıl katkısı yeni bir enzim keşfetmek değil. Buradaki enzim daha önce bir dev bakteriyofajda tanımlanmıştı. Yeni olan, enzimin yanındaki tekrar dizisiyle işlevi bilinmeyen bir yardımcı proteinin birlikte değerlendirilmesi ve bunun ayrı bir sistem olabileceğinin fark edilmesi.

Seçilen 20 adayın nasıl daraltıldığı da yöntemin parçası: ajanlar tekrar sayısını ve aralarındaki mesafeyi ölçüp bilinen sistemlerle karşılaştırdı, sonra bilimsel literatürdeki kayıtları taradı.

Neyin bilinmediği

Bu tür haberlerde asıl mesele, iddianın nerede durduğunu doğru okumak:

  • ART'nin biyolojik işlevi bilinmiyor. Anthropic de bunu araştırdıklarını söylüyor.
  • İlk laboratuvar çalışmalarında tekrar bölgesinin kısa RNA molekülleri ürettiği görüldü; bu, CRISPR'daki gibi programlanabilirliğe işaret edebilir ama kanıtlamıyor.
  • Yardımcı proteinin ne işe yaradığı bilinmiyor.
  • Çalışma ön baskı olarak yayımlandı, hakem denetiminden geçmedi.

Yani "yapay zeka yeni bir gen düzenleme aracı buldu" cümlesi şu an için doğru değil. Doğru cümle şu: model, insan araştırmacıların incelemeye değer bulduğu bir aday çıkardı.

Karşılaştırma için ölçek şu: 200 binden fazla dizi, bir araştırmacının tek tek okuyup değerlendirmesi mümkün olmayan bir hacim. Bu tür taramalar daha önce de yapılıyordu, ama kalıp arayan yazılımlar yalnızca kendilerine tanımlanmış kalıbı buluyordu. Buradaki fark, modelin taradığı şeyle literatürdeki kayıtları karşılaştırıp "bu ikisi bir arada olmamalıydı" diyebilmesi. İddianın değeri de burada; doğrulanması gereken kısım ise sistemin gerçekten ne yaptığı.

Laboratuvarın kendisi

Anthropic, Bay Area'da kendi moleküler biyoloji laboratuvarını bu yılın ilkbaharında açtı. Şirketin açıklamasına göre laboratuvar yalnızca en düşük iki biyogüvenlik seviyesinde çalışıyor ve insanda hastalık yapan etkenlerle iş görmüyor. Deneyleri modeller değil, insan bilim insanları yapıyor; modelin ürettiği hipotezler önce araştırmacılar tarafından değerlendiriliyor.

Bu ayrım, yapay zekanın bilimdeki rolünü anlatan en somut örneklerden biri. Claude'un yaptığı iş, 200 bin örneği tarayıp insanın gözden kaçıracağı bir örüntüyü işaretlemek; laboratuvarda tüp tutan yine insan. Keşfin gerçek olup olmadığını da deney ve hakem süreci söyleyecek.