Claude Fable 5, dört yıllık bir tweet'i tek bir geliştirme oturumunda oynanabilir bir 3D tarayıcı oyununa dönüştürdü ve bunu herhangi bir insan tarafından seçilmiş teknoloji yığını veya tasarım girdisi olmadan, tüm ağır işi kendisi üstlenerek yaptı.

Simon Willison modele tweet'in kısa açıklamasını, bir ekran görüntüsünü ve iki destekleyici görseli verdi. Bu mütevazı istemden (prompt) yola çıkarak Claude Fable 5 tüm kod tabanını yazdı, 3D motoru olarak Three.js'i seçti, oyunun dokularını bir OpenAI modeli aracılığıyla oluşturdu ve her değişikliği bir GitHub deposuna (repository) gönderdi. Depo GitHub Pages'e bağlıydı, bu nedenle her commit yaklaşık yarım dakika içinde canlı bir URL'de görünüyordu. Sonuç, bugün herkesin bir tarayıcıda oynayabileceği işlevsel bir “Raccoon Heist” oyunudur.

Deney nasıl gerçekleşti

  • Minimal istem (prompt) – Orijinal 2022 tweet'i bir oyun konseptini listeliyor ve tek bir ekran görüntüsü gösteriyordu. Willison, referans olması için iki ekstra görsel ve birkaç satır metin ekledi. Programlama dili, grafik kütüphanesi veya dağıtım (deployment) hakkında hiçbir talimat vermedi.
  • Model odaklı kararlar – Claude Fable 5, 3D grafikler için bir JavaScript kütüphanesi olan Three.js'i işleme motoru (rendering engine) olarak seçti. Oyunu çalıştırmak için gereken HTML, JavaScript ve varlık yükleme (asset-loading) kodlarını yazdı.
  • Yapay zeka tarafından oluşturulan varlıklar (assets) – Bir OpenAI modeli doku görsellerini üreterek bir tasarımcıya olan ihtiyacı ortadan kaldırdı.
  • Sürekli teslimat (Continuous delivery) – Her kod gönderimi (push), GitHub Pages'in siteyi yeniden oluşturmasını tetikleyerek en yeni sürümün 30 saniyeden kısa sürede görünür olmasını sağladı. Willison, oyunun boş bir tuvalden tamamen oynanabilir bir prototipe gerçek zamanlı olarak evrim geçirmesini izledi.

Bu neden önemli

Geleneksel yapay zeka kodlama asistanları, bir geliştirici ayrıntılı bir teknik şartname sunduğunda otomatik tamamlama, hata düzeltme önerileri veya kod parçacığı (snippet) oluşturma konularında yardımcı olmuştur. Claude Fable 5 ise bir sınırı aştı: üst düzey bir hedefi kabul etti, uygulama yığınını (implementation stack) seçti, varlıkları üretti ve canlı bir ürünü piyasaya sürdü; üstelik bunların hepsini daha fazla insan yönlendirmesi olmadan yaptı.

SWE-bench gibi kıyaslama testleri (benchmarks), modellerin programlama problemlerini ne kadar iyi çözdüğünü ölçer; ancak bir modelin uçtan uca etkileşimli bir deneyimi otonom olarak inşa etmesini izlemek farklı bir yeteneği gösterir. Hızlı prototipleme için bu iş akışı, bir geliştiricinin modele bir konsept ve birkaç varlık verip, onu bir dağıtım hedefine yönlendirerek dakikalar içinde kullanılabilir bir demo alabileceğini kanıtlıyor.

Kimler kazanacak ve kimler geride kalabilir

  • Start-up'lar ve bağımsız geliştiriciler, tam bir mühendislik ekibi işe almadan oyun fikirleri veya kullanıcı arayüzü (UI) konseptleri üzerinde yinelemeler yapabilirler.
  • Ürün ekipleri, dahili incelemeler için kavram kanıtlama (proof-of-concept) özellikleri oluşturmak amacıyla bu yaklaşımı kullanabilir.
  • Yapay zeka destekli kod üretimi sağlayan araç satıcıları, talebin modellerin framework'leri seçmesine ve CI/CD süreçlerini yönetmesine olanak tanıyan daha üst düzey orkestrasyon özelliklerine kaydığını görebilir.

Aksine, mimari kararlar, performans iyileştirme veya sanat yönetimi konularında uzmanlaşmış geliştiriciler, en görünür ve düşük karmaşıklıktaki görevlerin giderek otomatize edildiğini görebilirler. Modelin otonomisi aynı zamanda kod kalitesi, güvenlik ve yapay zeka tarafından üretilen varlıkların lisanslanması gibi hala insan denetimi gerektiren soruları da beraberinde getiriyor.

Mevcut demonun sınırları

  • Kapsam – Oyun mütevazı bir 3D prototiptir; bu yaklaşımın büyük ve veri yoğunluklu uygulamalara ölçeklendirilmesi henüz kanıtlanmamıştır.
  • İnsan desteği (scaffolding) – Willison, GitHub Pages hattını kurdu ve modelin çıktısını izledi. Tamamen insansız bir sistem, derleme hatalarını veya güvensiz kodları tespit etmek için mekanizmalara ihtiyaç duyacaktır.
  • Varlık sadakati (fidelity) – Yapay zeka tarafından üretilen dokular basit bir oyun için işe yarar ancak fotorealizm veya markaya özgü sanat gerektiren yüksek bütçeli yapımlar için yetersiz kalabilir.

Sırada ne var?

  • Araç entegrasyonu – Büyük dil modelleri ile bulut derleme hizmetleri arasında daha sıkı bir bağ bekleniyor; bu da Willison'ın gerçekleştirdiği manuel adımları azaltacaktır.
  • Güvenlik katmanları – Platformlar, dağıtım öncesinde güvenlik açıklarını yakalamak için otomatik kod incelemesi veya kum havuzu (sandboxing) özellikleri ekleyebilir.
  • Kıyaslama testlerinin evrimi – Uçtan uca ürün teslimatını test eden yeni değerlendirme setleri, mevcut kod tamamlama metriklerini tamamlayabilir.

Çıkarılacak ders net: Yapay zeka, kendisine özlü bir hedef ve bazı kaynak materyaller verildiğinde, artık "bu fonksiyonu yaz" aşamasından "tam, çalıştırılabilir bir ürün inşa et ve gönder" aşamasına geçebilir. Teknoloji henüz yolun başında olsa da Claude Fable 5 demosu, birçok yazılım fikrinin ilk taslağının otonom olarak oluşturulduğu, böylece geliştiricilerin rafine etme, strateji ve yaratıcılığa odaklanabileceği bir geleceğin ipuçlarını veriyor.