İnternet çok yeni bir teknoloji değil malum. 60 yıldan fazla bir tarihi var. Fakat asıl sıçramayı ne zaman yaşadık? Web 2.0 ile. Web 2.0 neydi peki? Etkileşimdi! Sadece bilgiye ulaşmak, bir şeyleri okumak, izlerken artık insanların da “içerik üretmeye” başlaması. Sonra bunları, bildiklerini, gördüklerini, çektikleri fotoğrafları, videoları çeşitli platformlar aracılığı ile paylaşması. Muhteşem bir veri akışının başlangıcıydı. İşte bu veri akışı işte tam olarak yine çok eskiye dayanan Big Data, Derin Öğrenme, Makine Öğrenmesi, Yapay Zeka ve çok daha fazlasının da derin uykusundan uyanmasını sağlayan şey olacaktı.
Yapay zekada da, özellikle bugün dünyayı kasıp kavuran generative yani üretken yapay zekada da çok benzer bir yol ayrımındayız şu anda. Gerçeğinden ayırt edilemeyen fotoğraflar ve hatta daha geçen hafta çıkan SORA ile inanılmaz gerçekçi videolar üretmeye başladık. Peki. Gelelim kırılma noktasına. Bu ürettiğimiz fotoğraflar, videolar ile “etkileşime” geçmek nasıl olurdu? Yani yarattığımız karakterlerle etkileşim kurabilsek, onlarla yine o hayal dünyamızın ürünü yapay evrenlerde uçsak, zıplasak, keşfe çıksak? Bir interaktif oyuna dönüştürebilseydik bunları? Harika olurdu değil mi?
Heh. İşte Google henüz birkaç gün önce, 23 Şubat 2024’te yayımladığı bir çalışması ile tam da bunu yapabilecek bir modeli duyurdu. Google Genie… Sıfırdan oyun yapabilmenizi, bir oyun tasarımcısı olmanızı, sınırı hayal gücünüz olan evrenler, hikayeler, maceralar oluşturmanızı sağlayacak bir model… Düşünmesi bile muhteşem değil mi? Aman aman… Nasıl yetişeceğiz bu hıza bilmiyorum ama vaktimiz yok. Gelin bu gelişmeyi de hemen tüm detayları ve olasılıkları ile, gelecekte açabileceği kapıları da irdeleyerek konuşalım.
Google’ın geleceği konusunda birçok spekülasyon var malum. Çok olumlu bakmıyor uzmanlar. Gerek geçmişindeki sayısız başarısız ürün denemesi, gerekse bir türlü bu yeni dünyaya tam olarak adapte olamaması nedeniyle yeni oyuncular karşısında zorlanıyor diyebiliriz. Ama Google tabi. Öyle kolay lokma değil. Kaldı ki zaten kimse bu piyasada büyük bir potansiyel görmezken DeepMind’ı bünyelerine katarak belki de tüm şirket tarihinin en doğru kararını vermişti. Ki bugün konuşacağımız Google Genie de DeepMind’ın bir çalışması.
Ve burada, Google Genie ile olasılıkların sınırı gerçekten hayal gücünüze bağlı. Eminim en baştan beri hemen zihninizde yapabilecekleriniz ile ilgili bir sürü tilki dolaşmaya başlamıştır. Çünkü bu gelişmeyi geçen konuştuğumuz SORA ile birleştirmenizi istiyorum. Ve oluşturduğunuz videolardaki bu evrenlerde, bu karakterlerle yapabileceklerinizi düşünün. Ve bunun üzerine sanal gerçekliği, Elon Musk’ın Neuralink’ini de ekleyin. Anlıyorsunuz değil mi? Neyse. Biz Genie’nin yapabildiklerini bir anlayalım önce. Önce tabi şunu belirtelim. Bu öyle bugünden yarına tüm dünyayı sarsacak, kökünden değiştirecek bir şey değil. Daha gidecek çok yolu var.
Fakat Genie’nin arkasındaki çok çarpıcı mantığı söyleyeyim. Genie eğitilirken sıfır insan denetimi söz konusuydu. Çalışmada da bahsettikleri üzere “denetimsiz öğrenme” ile internette bulunan “hiçbir etiketi” bulunmayan oyun yayıncılarının paylaştıkları sayısız oyun videosunu analiz ederek eğitilmiş bir model Genie. Deepmind bu konuda zaten uzman biliyorsunuz. Alphazero, Alphago gibi modellerde de satranç gibi oyunları neredeyse sıfır denetimle kendi kendine oynayarak öğrenmişti. Burada da videoları ve videolarda bulunan karakterlerin, cisimlerin hareketlerini kendisi öğrenerek siz ne kadar uğraşırsanız uğraşın veremeyeceğiniz o doğallık hissini özümseyen bir model var karşımızda. Şu aşamada eğitimi için kullanılan “gameplay” yani oynama videoları için 2 boyutlu platform oyunları tercih edilmiş tabi. Zira oyun dünyasının gelişimi de 2 boyutlu oyunlarla başlamıştı malum. Önce 2 boyutlu dünyada uzmanlaşıp 3 boyutlu evrene geçiş söz konusu olacak bu model için. Ve en güzeli bahsettiğimiz gibi sadece bir görsel veya bir yazı girerek “etkileşimli ortamlar” üretebileceksiniz.
Şimdi durduğumuz yeri bir anlayalım. Bu modelin kısıtlamalarına bir bakalım isterseniz. Eğitildiği videolara bakıldığında belirli bir kritere göre düzenlenen, elenen videolar söz konusu. Ve saniye başına 10 kare yani 10 FPS değerinde 160×90 boyutlarında her biri 16 saniyelik 55 milyondan fazla video arasından toplamda 30.000 saate karşılık gelen 6.8 milyon video ile eğitiliyor model. E tabi bunun sonucunda şu aşamada ürettiği oyunlar neredeyse saniye başına 1 karelik bayağı ilkel sonuçlar ortaya çıkarıyor. Öyle SORA seviyesinde video kalitesinde oyunları şu an için beklememek gerekiyor. Fakat çalışmada da not düştükleri gibi “işlem gücü” artırıldıkça oyun kalitesi, süresi ve olasılıklar da inanılmaz artıyor. İşlem gücü deyince hemen NVidia CEO’su ortamda beliriyormuş diyorlar da neyse. Onu bir sonraki videoya saklıyorum. NVidia’nın destansı hikayesine hazır olun yeri gelmişken belirmiş olayım.
Bu arada şunu da söylemek gerekiyor. Bu modelde bir oyun oluşturmak için bahsettiğimiz gibi kısa bir metin girebilir ya da bir görsel yükleyebilirsiniz. Ama bu görselin illa ki bir yapay zeka görseli olmasına gerek yok. Gerçek hayatta, kameranızla çektiğiniz fotoğrafları da oyunlaştırabilir ve hatta bence çocukların eğitimi için harika bir olasılık olan çocuklarınızın çizimlerini de oyunlaştırabilirsiniz. Bu olasılık beni bayağı heyecanlandırdı açıkçası. Ki zaten yine Deepmind’ın makalesinde de bahsettiği bir olasılık bu. Sosyal etki başlığı altında çok fazla insanın kendi “oyunlaştırılmış” evrenlerini yaratabileceğini söylüyorlar. Ve özellikle çocuklar için kendi hayal dünyalarını tasarlayıp bu dünyaları deneyimleyebileceklerini de belirtiyorlar.
Yani Witcher gibi No Man’s Sky gibi çok büyük evrenler oluşturmak için daha çok beklememiz gerekecek belki ama ilk etapta bu bahsettiğimiz olasılık hayata geçse bile harika olur diye düşünüyorum.
Şimdi başka ilginç bir detaydan daha bahsedelim. Normalde bir oyun piyasaya çıktığında herkes aynı hikayeyi, aynı düzlemde, neredeyse aynı şekilde deneyimler. Sınırlar bellidir. Bu işte bir görselden veya metinden oluşturduğunuz oyunda siz ilerledikçe dünya her seferinde kare kare sıfırdan yaratıldığı için aynı başlangıç noktasından başlayan hiçkimse aslında aynı deneyimi yaşamayacak. En azından bu şekilde tasarladığınızda. Herkes aynı yerde başlayıp bambaşka deneyimler yaşayıp tamamen kendilerine özel, başka kimsenin oynamadığı bir oyun oynayabilecek demek oluyor bu.
Bu da kişiselleştirilmiş etkileşimli oyun dünyasının nirvanası olur herhalde.
Bir de deepmind’ın makalesine göz gezdirirken bir ayıbımı fark ettim. Şu son kısımda çalışma için teşekkür ettikleri isimlere dikkat edin. Bize yabancı gelmeyen bir isim göreceksiniz. Koray Kavukçuoğlu. Deepmind gibi dünyayı şekillendiren bir şirketin Araştırma bölümünün başkan yardımcısı olarak görev alıyormuş kendisi. ODTÜ mezunu, NYU’da doktorasını yapmıuş ve deep learning konusunda dünyada en yetkin isimlerden birisi olarak görülüyor. 50.000’in üzerinde atıfla bu alanda dünyada gerçekten de sayılı isimlerden birisi. Daha önce bahsettiğimiz Alphazero, Alphago ve Alphafold gibi projelerde de çok önemli görevler edinmiş. Kendisini bugüne kadar duymamış olmak beni bir miktar utandırdı o nedenle bu vesileyle kendisini de anmak, duyurmak istedim. Kendisi vesilesiyle bizleri bu alanlarda dünyada temsil eden tüm bilim insanlarımıza da teşekkür ediyoruz. Gençlerimize ilham olması dileğiyle…
Yani özetle. Gün geçmiyor ki daha birkaç yıl önce başlayan hikayede yepyeni bir sayfa açılsın. Bundan 30 yıl önce bu tip gelişmelerin her biri “çığır açan” gelişmeler olur, yıllarca insanlar bunları konuşurdu. Bugün “gelişimi” o kadar kanıksamış durumdayız ki… İnsanın her türlü şarta ayak uydurma yeteneğinin bir sonucu sanırım bu da. Kısacası. Çok heyecanlı zamanlar yaşıyoruz. Gelişmelerin bu kadar hızlı olması bir miktar bizi korkutsa da yine de tarihi gelişmelere tanık olmak harika değil mi?




