Kabul edelim. Artık yapay zekadaki gelişmeleri takip edemez olduk değil mi? Bir yerden sonra artık zaten takip edemiyoruz deyip bıraktık gibi. Normal. Çok haklısınız. Hayat koşuşturmacası içerisinde hiç kolay değil. Daha önce her gelişme için ben de bir video hazırlardım ama ben de artık biraz uzaklaşıp izlemeye başladım. Ve şuna karar verdim. Her gelişme için bir video yerine o hafta, o ay olanlarla ilgili arada bir güncelleme videosu iyi olur diye düşündüm. Hem gelişmeleri takip etmekte zorlananlar ama haberdar olmak isteyenler de bu sayede gündemden uzak kalmamış olur. O yüzden bu ve bunun gibi güncelleme videoları her zaman yaptığımızdan farklı olarak çok derinine inmediğimiz “haberdar olma” formatında olacak. Ama tabi çığır açacak bir şeyler olursa da merak etmeyin. Onlar için mutlaka derin analizler gelir.
Neyse. Haydi vakit kaybetmeden yakın zamanda neler oldu bir konuşalım. Öncelikle elbette SORA geldi…
SORA ve yapabildikleri ve potansiyeli ile ilgili ilk duyurulduğunda geniş çaplı bir video hazırlamıştım. O zaman genel kullanıma açık değildi. Ama şimdi işte geldi. Artık herkes yönetmen olabilecek. Elbette belirli kısıtlamalar dahilinde. 20 dolarlık üyeler için aylık 50 civarı 5 saniyelik kısa video üretebileceksiniz. Ayda 50 tane 5 saniyelik videolar ne işimize yarayacak diye düşünebilirsiniz. Haklısınız da. Ki zaten bu da bir süreç. Teknolojiyi deneyimleme adımları bunlar. Kaldı ki baştan sona bir video, film, kısa film çıkarmak pek kolay olmayacak yakın zamanda. Kısa bir video üretmek için bile inanılmaz kaynak, enerji, depolama alanı ve donanım gerekiyor. Bunlara da henüz sahip değiliz. Ama şunların gerçek olmadığını düşünmek insanın başını ağrıtıyor biraz. İnanılmaz… Ve bu seviyenin henüz başlangıç olduğunu ve bundan 5-10 yıl sonra “bunlara mı şaşırıyorduk biz” diyeceğimizi bilmek ayrı bir çılgınlık. Bu kedi gerçek değil… Bu animeyi de hiçbir insan yapmadı mesela. Ama tabi jimnastik konusunda bayağı sıkıntı var hala. Yapay zeka ile oluşturulan videolar konusunda jimnastik oyunları önemli bir eşik galiba
Ve elbette Gemini 2.0 geldi. Google boş durmuyor. Hem de beklenmedik bazı özelliklerle birlikte geldi. Multimodal olarak geldi. Bu ne demek? Duyuları arttı diyebiliriz kısaca. Sadece yazı ile değil, sesle ve daha da ötesi görüntülü olarak etkileşim kurabiliyorsunuz. İsterseniz kameranızla bir şeyler gösterebilir ister ekranınızı paylaşabilir ve projelerinizde, çizimlerinizde, veya içinde kaybolduğunuz gelir gider tablonuzda yardım isteyebilirsiniz. En güzeli ise google’a burada büyük bir alkış: bunların hepsini bedava deneyimleyebilirsiniz. Evet. aistudio.google.com’a gittiğinizde müthiş bir panel karşılıyor sizi. Buradan tüm özelliklerini deneyimleyebilirsiniz. Bence hemen gidin deneyin. Videodan sonra tabi. Daha haberler bitmedi
Gemini’ın tabi en heyecan verici özelliği kameranız ile etkileşim kurabilmek oldu. Gösterdiğiniz her şey ile ilgili bilgi verebiliyor. Görebiliyor artık yapay zeka. Ve benim ilk anda aklıma gelmeyen harika bir avantajı var bunun. Bir Twitter kullanıcısından gördüğüm üzere görme engelliler için göz olabiliyor Gemini. Bu kullanıcı görme engelli bir vatandaşımız ile Gemini kullanarak Pazar alışverişi yapıyor mesela. Harika değil mi? Kolaylaştıracağı hayatları düşününce muhteşem bir şey bu… Ve tabi bunun açtığı kapıları da ancak hayal edebiliriz. Onu da başka bir zaman yaparız.
Ayrıca multimodal olduğunu söylemiştik. Yine ücretsiz olarak fotoğraf yükleyip fotoğrafta değişiklikler yapabiliyor, dönüştürebiliyor, ekleme çıkarma yapabiliyorsunuz. Hatta iki görseli birleştirebiliyorsunuz. Bu arada bu deneyimleyebildiğiniz özellikler Google’ın Project Astra adını verdiği daha gelişmiş bir projesinin bir parçası olarak demo olarak düşünülebilir. Project Astra hayata geçtiğinde telefonunuz yanınızda taşıdığınız eksiksiz bir asistana dönüşecek. Gösterdiğiniz her şey konusunda yardımcı olacak ve yine yabancı olduğunuz yerler ve konular konusunda yardımcı olurken özellikle engelliler için müthiş kullanışlı olacak gibi görünüyor.
Google tabi bununla kalmadı. SORA’ya rakip çıkmadı diye düşünüyorsanız yanılıyorsunuz. SORA’dan birkaç ay sonra duyurdukları VEO modelini geçtiğimiz günlerde belirli kullanıcılar için kullanıma açtı. Veo 2 adını verdikleri bu model, açık söylemek gerekirse şu anda SORA’dan iyi görünüyor. Google’ın bu yarışta geride kaldığını görmüştük ve yakalaması ne kadar sürecek acaba derken tabi bir dev olduğunu unutmamak lazım. Şu anda OpenAI’ı her anlamda yakalamış ve bazı alanlarda geride bırakmış durumda. Açık söyleyeyim. Ben şaşırdım. Ve tabi Google yılların gücünü, donanım altyapısını, kendi sunucularını kullanarak kullanıcılara AI Lab’de ücretsiz deneyimler sunduğu gibi Veo modelinde de 1 dakikaya kadar uzun videolar üretme fırsatı sunuyor. Google yine google’lığını yapıyor. Tebrik etmek lazım. Imagen 3’yi de unutmamak lazım. Google’ın görsel üretim modeli. O da 3. Nesli ile performansını bayağı iyileştirmiş durumda. Google ile ilgili tek bir şikayetim var. İSİMLER KONUSUNDA KENDİNİZE ÇEKİ DÜZEN VERİN! TAKİP EDEMİYORUZ! Google’ın isimlendirme problemi var gerçekten. Bir isim veriyorlar, sonra o başka bir şeyle birleşiyor, sonra ondan vazgeçip başka bir şey… Neyse.
Bir başka gelişme de yine Google’ın Deepmind laboratuvarlarından geldi. Motion Prompting adı verilen bu proje başta basit bir fotoğrafı hareketlendirme gibi görünse de aslında çok daha karmaşık bir sistemin işlediğini bu örneklerde görebiliriz. Akışkanlar mekaniğinden farklı fizik yasalarına kadar modelin ne kadar başarılı olduğu ortada. Söylediğimiz gibi. Bu demolar hep ufak denemeler. Hepsi en nihayetinde büyük bir sistemin parçası olacaklar. AGI…
Bunun yanında bahsedebileceğimiz TRELLIS isimli bir 3D modelleme modeli. Sadece metinden 3 boyutlu modeller oluşturabiliyorsunuz. Bu özellikle oyun tasarımcılar, dijital sanatçılar, mimarlar ve bu gibi alanlarda çalışanlar için çok önemli kapılar açabilir. 3 boyutlu yazıcılarla entegrasyonunu düşündüğünüzde ki bunun denemelerini yapmaya başladılar bile, çok önemli bir sektör de çıkıyor karşımıza. Çok ilginç bulduğum projelerden biri bu.
İlginç başka bir proje de bu arada Manga severlere gelsin. Evet. Sizin için comic ya da manga hazırlayabilen bir model var artık. Sadece metinle, sayfalar boyunca aynı tarzda, tutarlı karakterlerle hikayeler oluşturabileceğiniz, kendiniz, çocuğunuz için çok güzel hikayeler üretip belki de baskı alıp birlikte okuyabileceğiniz bir olasılık sunuyor. İlginç bir proje.
Bir heyecan verici proje de sürpriz. Yapay zeka destekli bir mesajlaşma uygulaması. Dil engellerini ortadan kaldıran bayağı heyecan verici bir proje. Hangi ülkeden hangi dilde kimle konuşursanız konuşun siz Türkçe yazın karşıdaki kendi dilinde görüyor. Sadece yazı değil. Sesli mesajları da sizin ses tonunuzda o kişinin diline çeviriyor. Bitmedi. Canlı olarak görüntülü konuşuyorsunuz diyelim. Aynı anda çeviri yapıyor ve siz karşınızdakini kendi dilinizde karşıdaki de sizi kendi dilinde duyuyor. Dahası bir de yapay zeka asistanı var. Mia adında. Toplantılarınızı organize ediyor, takviminizi yönetiyor, seyahatlerinizde size rehberlik ediyor. Özellikle işitme engelli bireyler için müthiş fırsatlar sunuyor. Pazar alışverişinden iş toplantılarına kadar her alanda iletişim engellerini ortadan kaldırıyor. Projenin adı? Mektup. Evet. Ve nereden çıktı dersiniz? Kahramanmaraş’tan. Evet. Zor zamanlardan inanılmaz hikayeler çıkabiliyor kimi zaman. Uygulamanın beta kayıtları açık bu arada. Siz de kayıt olup arkadaşlara destek olabilirsiniz. Yakın zamanda da lansmanı yapacaklar. Ben duyurmuş olayım. Ülkemizde de büyük bir potansiyel olduğunu unutmamak lazım. Böyle projeleri de takip etmeye çalışıyorum. Sizin de gözünüze çarpan projeler olursa yorumlarda paylaşın ya da [email protected] üzerinden benimle paylaşın destek olalım.
Bir hızlı tur yapalım diğer gelişmeler için de: Anthropic’in yeni nesil dil modeli ailesi Claude 3 geldi mesela. Görsel yetenekleri, analiz kapasitesi gerçekten etkileyici. Hem görüntüleri anlayabiliyor hem de onlar hakkında detaylı analizler yapabiliyor. GPT-4V’nin görsel yetenekleri genişletildi, artık video analizi bile yapabiliyor. Teknik çizimleri, karmaşık görselleri anlama konusunda ciddi ilerleme kaydetti.
Meta’nın Emu Video’su video üretimi konusunda SORA’ya rakip olarak çıktı. Stability AI de Stable Video ile bu yarışa katıldı. Henüz SORA kadar karmaşık videolar üretemese de, kısa ve basit videolar için gayet başarılı sonuçlar veriyor.
Adobe ise Project Res ile bambaşka bir kapı açtı. Profesyonel içerik üreticiler için yapay zeka destekli video düzenleme araçları sunuyor. Düşünsenize, saatlerce uğraşmanız gereken efektleri, geçişleri, renk düzenlemelerini yapay zeka sizin için yapıyor. Perplexity AI’ın yeni versiyonu da tüm bu görsel AI’larla etkileşime girebilen özellikleriyle geldi. Yani artık bir yapay zeka diğer yapay zekaların ürettiklerini analiz edebiliyor, onlar hakkında yorumlar yapabiliyor.
Görüyorsunuz, özellikle görsel AI ve video üretimi konusunda müthiş bir rekabet var. Ve bu daha başlangıç… Her şirket bir yandan kendi modelini geliştirirken, bir yandan da diğerlerinin yaptıklarını izliyor ve daha iyisini yapmaya çalışıyor. Kim bilir belki birkaç ay sonra bunları izlerken "vay be, o zaman bunlara mı şaşırıyorduk" diyeceğiz. Teknoloji o kadar hızlı ilerliyor ki…
Evet, işte son dönemde yapay zeka dünyasında öne çıkan bazı gelişmeler bunlardı. Tabi bunlar sadece bir kısmı. Donanım ve robotik tarafında da çok heyecan verici gelişmeler var. Özellikle VR teknolojilerinde Meta’nın yeni nesil gözlükleri ve benzer gelişmeler de var ama onları başka bir güncellememizde konuşalım. Çünkü artık biliyorsunuz, her gelişmeyi tek tek anlatmak yerine böyle düzenli güncellemelerle size aktarmaya çalışacağım. Bu sayede siz de bu hızlı gelişen teknoloji dünyasından kopmuş olmayacaksınız.




