OPENAI, istersen kalk sen. Evet. Büyüğün geldi de. Biraz saygı lütfen… Çok acayip şeyler oluyor. Durun. Bakın. Önce şu örneklere bir bakın… Neyi fark ettiniz? ChatGPT filan kullandıysanız. Ondan farklı neler gördünüz? Evet. ChatGPT insan gibi yazabiliyor, insan dilini çok iyi taklit edebiliyordu. Ama. Bir sıkıntı vardı. ChatGPT , en azından GPT-4 biraz, yaratıcılıktan sınıfta kalıyordu değil mi?
Var olan şeyleri birbirine karıştırıp veya elindeki verileri güzelce önünüze serip bir yaratıcılık “illüzyonu” yaratıyordu ama yok.. Biraz zorladığınızda. Özellikle. Çok da karmaşık olmasına gerek yok. Çok basit analitik bir soru sorduğunuzda en basit haliyle “saçmalıyordu”…
En önemlisi. ChatGPT ile sadece “konuşabiliyordunuz”… Yazı ile iletişim kuruyordununuz. Şimdi. Gerçek bir “yapay zekadan” bahsedeceksek, insanı geride bırakacak, onun yerine geçecek filan. Çok karmaşık düşünmenize gerek yok. Kendinizi düşünün. İletişim biçiminizi. Ne kadarı sadece “sözle” veya “yazıyla” geçiyor? En basit iletişimde bile sözü, yazıyı destekleyecek yığınla şey kullanırsınız. Gösterirsiniz mesela, işaret edersiniz, vücut dili kullanırsınız. Duyar, konuşur, koklar ve dokunursunuz. Hayalimizdeki yapay zekadan da bunu bekliyoruz değil mi? Heh, işte. Hoş geldiniz. Yavaştan oraya geliyoruz…
İşte tam da bunu anlatıyordum bu haftasonu yayınlayacağım videoda. Önce OpenAI’dan bahsedecektim, sonra Q* denen projeden. OpenAI’ın yanlışlıkla sızdırdığı, CEO’su Sam Altman’ın kovulmasına neden olan projeden. Bu projeyi gören, en başta OpenAI’ın asıl beyni Ilya Sutskever olmak üzere çalışanlar ve araştırmacılar “hemen bu projeyi durdurun, bunu yayınlamak için çok erken, çok riskli” diye uyarmışlar, Sam Altman bunu çok da dinlememiş ve en nihayetinde kovulmuştu. Oradaki entrikaları konuşacağız ama işte tüm bunlara neden olan şeyin bir versiyonu, “durdurun bunu, henüz erken” denen şeyin benzer ve belki de daha üstün bir versiyonu bugün karşımızda: Google GEMINI…
Bunu birçok anlamda bir çağın başlangıcı olarak düşünebilirsiniz. GEMINI’ı konuşalım o yüzden, nereden geldiğini, nereye gideceğiniz. Ne demek istediğimi daha iyi anlayacaksınız.
Google’ın bu hamlesi neden çok önemli biliyor musunuz? Çünkü GOOGLE olduğu için. Şimdi. OpenAI filan piyasaya çok iyi bir giriş yaptı ve gerçekten de şu 5 büyük var ya? Onların arasına girmiş durumda. Belki de bazılarını geride bırakacak durumda. Fakat bu tür çalışmalarda deneyim, bilgi birikim, geçmiş çok önemlidir. Ve Google zaten varolan alan hakimiyetini 2014 yılında Deepmind’ı satın alarak en tepeye oturmuştu. Hiç vakit kaybetmeden çalışmaya başlayan Deepmind da çok kısa sürede inanılmaz işler yapmıştı. Bunlardan en önemlisi ise Alphago denen bir oyun algoritmasıydı. 2015 yılında çıkardıkları bu bir tür derin öğrenme algoritması kullandığı sinir ağı ve getirdiği yaklaşım ile 5 maçta dünyanın en iyi Go oyuncusu Lee Sedol’u alt etmeyi başarmıştı. Hele 2. Oyunda yaptığı ünlü bir 32. Hamlesi var ki… İşte bu hamle birçok şeyin habercisiydi.
Asıl devrimsel olan bu algoritmanın çalışma mantığıydı. Alphago ve buna dayanan AlphaZero “kendi kendine öğrenen” bir algoritmaydı. Pekiştirmeli öğrenme ile, yani doğru hamlede kendini ödüllendirerek ve yanlış hamlede bir anlamda cezalandırarak öğrenmeyi sağlayan bir makine öğrenmesi yaklaşımı kullanarak öğrenen ve çok kısa sürede kendi kendine milyonlarca oyun oynayarak herhangi bir oyunda insanı geride bırakabilecek bir sistemdi. Ki bu sayede go, satranç ve sonrasında video oyunlarında insanı tamamen geride bırakmayı başarmıştı. Daha da önemlisi. Bu yazılım önceden programlanmıyordu. Bizim gibi. Tecrübelerden öğreniyordu.
Bu işte yıllar sonra yazılacak tarih kitaplarında bir çağın başlangıcı olarak görülecek bir gelişmedir. Bununla ilgili ben de 2019’da bir video hazırlamıştım. Ve bugüne hızlı bir sıçrama yaparsak.
Alphago ve benzeri yaklaşımlarla ilgili çalışmalar devam ederken OpenAI çıktı sahneye. Çok farklı bir yapı ile hem de. Bu tip “pekiştirmeli öğrenme” yaklaşımından farklı bir şekilde Large Language Model denen bir yaklaşımı kullanarak devasa miktarda veriyi analiz eden ve en nihayetinde “insan dilini” anlayıp insanı şaşırtıcı derecede iyi bir şekilde taklit edebilen bir şey sundu bize ChatGPT ile. Ortalık karıştı tabi. Aynı bizim gibiydi. Bizim gibi konuşuyor. Aynı bizim gibi yazabiliyor, şiir filan yazıyor, DALL-E ile resim filan yapabiliyordu.
Tamam dedik. Budur. Yapay Zeka geldi. Hatta ben de ilk bununla ilgili yaptığım videoda böyle düşünmüştüm. İlk heyecanla, herkes gibi, yapay zeka geldi demiştim ama… Öyle değilmiş… ChatGPT, özellikle GPT-4 inanılmaz başarılı bir model olsa da bir “yapay zeka” olmaktan uzakmış aslında. İyi bir “taklitçi”den öteye gidemeyecek bir şeymiş…
Çok basit ilişkileri bile kuramayan, sık sık yanlış cevap veren veya alakasız bağlantılar kurmaya çalışan bir şey olduğunu deneyimledikçe de anladık bunu aslında. Yanlış anlaşılmasın. Belirli görevlerde hala çok çok başarılı, ki ben de sık sık kullanıyorum ama… Ama yapay zeka devrimi için bizim başka bir şeye ihtiyacımız vardı. Alphago’nun düşünce sistemine. Matematiksel, analitik düşünebilen bir “şey”… Daha önce hiç düşünülmemiş bir şeyi düşünebilecek, daha önce hiç sorulmamış bir soruyu sorup, hiç verilmemiş bir cevabı verebilecek bir şey… En başından beri de bu alanda insanı heyecanlandıran şey bu zaten. Bir yaratıcı zeka…
Ve işte Google GEMINI ile bunun tohumlarını atmış durumda. Çünkü. GEMINI, Google CEO’su Sundar Pichai’nin de söylediği gibi “GEMINI’ı Alphago gibi sistemlerin gücü ve genetiği ile büyük dil modellerinin bir kombinasyonu gibi düşünebilirsiniz…” Yani. Teknik detaylarına şimdilik çok girmeden (gireceğiz merak etmeyin), insan gibi düşünebilen, mantık yürütebilen, problemi parçalara bölüp, konuya hakim bir şekilde “yaratıcı” cevaplar verebilen, görebilen, duyabilen, gördüğünü anlayabilen, yorumlayabilen bir şey GEMINI.
Gördüklerinden, duyduklarından öğrenen, neyin yanlış neyin doğru olduğunu kendince tartabilen, bunun için kendi içinde bir geribildirim mekanizması bulunan bir şeyden bahsediyoruz. Bunun için de bahsettiğimiz pekiştirmeli öğrenmeye ek olarak insanın karar verme sürecini çok yakından andıran “tree search” adı verilen bir yöntem kullanıyor. Elindeki verilere bu yöntem ile yaklaşan bir yapay zeka algoritması bir karar vermeden önce birçok olasılığı, farklı alternatifleri ve rotaları değerlendirerek en iyi alternatifi kendisi bulabiliyor. Yani aslında bahsettiğimiz gibi. Analitik düşünmekten bahsediyoruz.
Bunun en çılgın göstergelerinden biri yine Alphago’da ortaya çıkmıştı. Algoritmanın “analiz edebildiği” ve uygulayabileceği hamle sayısı kaçtı biliyor musunuz? Evrendeki atom sayısından daha fazla… Anlayabiliyorsunuz değil mi? İşte evet. Gemini, ChatGPT filan konuşuyoruz, konuşacağız, birazdan Gemini ile ilgili genel geçer bilgileri de vereceğim size ama ben özünü yakalamanızı istiyorum. Bizi bekleyen olasılıkları görmek, bunları konuşmak, buna hazır olmak çok önemli.
GEMINI’ın en önemli özelliği ise hem yazı, hem video, hem görsel hem de ses gibi modelleri ayrı ayrı işlemektense bu şekilde farklı tüm verileri aynı şekilde uygulayabilecek durumda olacak. Hem video gösterebilecek, hem konuşabilecek hem de yazabileceksiniz. Gelecekte ise buna “dokunmayı” da entegre edecekler gibi görünüyor ama ona biraz daha var… GEMINI ise ilk etapta üç farklı model olarak çıkacak. Nano, Pro ve Ultra şeklinde. NANO daha çok internet bağlantısına da ihtiyaç duymadan mobil cihazlarda kullanabileceğiniz bir model olacak. PRO ise daha zorlu uygulamalar için geliştirildi.
ULTRA versiyonu ise GEMINI ailesinin asıl bombası olacak ki bu yazıda bahsettiklerimizi ULTRA’da görebileceğiz. Önümüzdeki hafta itibariyle kurumlar ve geliştiriciler bu özelliklerin bazılarına ulaşabilecek ve özellikle ULTRA daha çok önümüzdeki yılın başında hayata geçecek gibi görünüyor. En nihayetinde alışık olduğumuz Google Arama da yapay zeka destekli olacak gibi görünüyor ancak bunu hemen yapmayacaklar anladığım kadarıyla. Google’ın hala en değerli varlığı “arama motoru”. Bunu mükemmel hale getirmeden bu entegrasyonu yapmayacaklardır. Ancak o da gerçekleştiğinde… Yepyeni bir deneyim bizi bekliyor.
Ama Google bu duyuruyu da biraz aceleye getirmiş görünüyor. Çünkü OpenAI’da buna çok benzer bir şey üzerinde çalışıyor. Q* dediğimiz şey. Büyük ihtimalle burada üstünlüğü ele geçirme hevesinde Google. Çok da zorlanmayabilir bu durumda fakat Q*’ı da hiç yabana atmamak lazım. GPT-5’i de hızlandırabilir OpenAI bu gidişle. Farkındasınız değil mi. Bir güç savaşı. Birileri bir yerlerde bir “üstünlük” savaşı veriyor. Ve bunun etkileri ve yansımaları düşündüğümüzden çok daha geniş olacak. Ben buna “yeni dünya düzeni” diyorum. Sadece ben demiyorum elbette. Birçok alandan, birçok uzman bu konuda hemfikir.
Bazı dengeler değişiyor ve… Biz buna pek de hazır değiliz gibi. Çok geç olmadan bir şeyler yapmamız gerekiyor. Ne yapacağız peki? Onu da birlikte bu yolculukta buluruz diye ümit ediyorum. Fikir kardeşliği yaparak, güçlerimizi birleştirerek bu yeni düzene hazırlanmak durumundayız. bu yazıyı sıcağı sıcağına hazırladım ve aslında bu videoya ve burada bahsettiklerime daha derinlemesine bakacağımız videoları da hazırlıyordum. O yüzden burada bahsettiğim ve biraz havada kalan bazı konuları, özellikle OpenAI ve Q*’ı, bu yeni dünya düzeninin tam olarak ne olduğunu konuşacağımız videolar da sırada, geliyor. Takipte kalmayı unutmayın.




