Hazırlamış olduğum müzik için yapay zeka araçlarından Veo, Gemini ve ChatGPT’yi kullanarak bir animasyon film hazırladım. Animasyon sahnelerinin tasarımında Veo modelini, karakterlerin tasarımında ChatGPT’yi ve sahnelerin planlanmasında her iki modeli de kullandım. Peki bu modelleri kullanırken hangi sorunlarla karşılaştım, sorunları çözmek için neler uyguladım? Bu videoda yapay zekayla animasyon hazırlamanın yanı sıra VEO ve yapay zeka modellerini etkili ve tasarruflu kullanmanın yollarını da keşfedeceksiniz.
Müzik klibini de 26 Ekim tarihinde sizlerle paylaşacağım. Takipte kalın!
Animasyon Klip Hazırlamak
Bir önceki deneyde yapay zekadan yardım alarak müzik ve şarkı sözü bestelemiştim ve yapay zekayla bir klip hazırlayacağımı da belirtmiştim. Eğer izlemediyseniz o videoya kanalımdan gidebilirsiniz.
Videoda karşılaşacağınız terimleri açıklayarak başlayalım.
Videoda Kullanılacak Terimler
Flow Flow, Google'ın Veo, Imagen ve Gemini gibi en gelişmiş üretken yapay zeka modellerini kullanan, yapay zeka destekli bir video üretim aracıdır. Açıklamada bırakacağım bağlantıdan erişebilirsiniz.
AI Credit (Yapay Zeka Kredisi) AI Credit veya kısaca kredi, yapay zeka platformlarında üretken içerik oluşturmak için kullanılan bir çeşit sanal para veya jetondur. Krediler yapay zekayla metin, görsel ve video üretirken belirli miktarda harcanır. Ne kadar harcanacağını kullandığınız modelin detaylı dokümanından öğrenebilirsiniz.
Ayrıca videonun sonunda kredilerinizi korumanıza ve dengeli harcamanıza yardımcı olacak tavsiyeler vereceğim.
Expander (Genişletici)
Expander yani genişletici, sizlerin vermiş olduğu basit komutları belirli bir amaç doğrultusunda yapay zekanın anlayacağı şekilde genişleten ve sizi büyük zahmetten kurtaran bir özelliktir. Mesela klibinizin Cyberpunk, siyah beyaz ya da pixel tarzı gibi belirli bir stilde olmasını istiyorsanız sahnelerinjizi Expander kullanarak genişletebilirsiniz. Yapay zekada genişleticileri hazırlamak için diğer yapay zeka modellerinden ya da Gemini’dan yardım alabilirsiniz.
Lenser, video içerisinde kullanmış olduğum animasyon karakterlerinin ortak ismi. Lense, Lensa ve Lens olmak üzere üç farklı karakter animasyonda kullanılan karakterleri temsil ediyor. Her bir karakterin özel isminin olması yapay zekanın da anlamasını kolaylaştırır.
Ayrıca kanalımı takip edenler Lenser’ın topluluğumuzu temsil ettiğini bilir. Siz de topluluğumuza katılmak için abone olabilir ve WhatsApp grubumuza katılmak istiyorsanız bağlantıdaki formu doldurabilirsiniz.
Aspect Ratio (En Boy Oranı) Görüntü veya videonun genişliğinin yüksekliğine olan oransal ilişkisidir. En çok kullanılan16:9 formatı yatay videolar, 9:16 formatı ise dikey videolarda tercih edilir. Bu oran, görsellerin farklı ekranlara uygunluğunu belirler.
JSON, bilgileri düzenli bir şekilde depolayıp bir yerden bir yere kolayca göndermeye yarayan, hem insanların hem de programların rahatça okuyabildiği, anahtar ve değer çiftlerinden oluşan bir metin formatıdır. İnternetteki uygulamaların birbirleriyle konuşma dilidir.
Text to Video (Metinden Videoya) Flow aracındaki Metinden Videoya, yapay zekanın, sadece yazılı komutlarınızı analiz ederek tanımlama yapması ve hareketli görüntüler oluşturma yöntemini ifade eder. Flow aracında Expander (Genişletici) kullanmak istiyorsanız Text to Video özelliğinizin aktif olması gerekir.
Ingredients to Video (Malzemelerden Videoya) Flow aracındaki Malzemelerden Videoya, metin komutlarınızın yanı sıra; görsel ve stil referansları gibi birden fazla girdiyi yani malzemeyi birleştirerek yapay zeka ile video üretme yöntemini ifade eder. Flow aracında şimdilik sadece 4 farklı uzantıdaki fotoğrafları yükleyebilirsiniz ama ilerleyen tarihlerde müzik, video gibi malzemelerin de ekleneceğini düşünüyorum.
Outputs per Prompt (Komut Başına Çıktı Sayısı) Google AI Studio videosunda da belirttiğim Komut Başına Çıktı Sayısı, yapay zeka modelinin vermiş olduğunuz komuta karşılık olarak kaç farklı alternatif video veya görsel varyasyonu üreteceğini belirtir. Bu, en iyi sonucu seçme esnekliğinizi arttırır ancak doğru orantılı şekilde AI kredisi harcar.
Scenebuilder, Flow içindeki tüm video kliplerinizi sıralayıp düzenlediğiniz ve sahnelerinizi devam ettirmenize olanak veren sanal kurgu masasıdır. Bu araç, parçaları bir araya getirmenin yanı sıra, karakter ve nesne tutarlılığını koruyarak sahneler arasında yumuşak geçişler (Jump To) yapmanıza ve mevcut çekimleri uzatmanıza (Extend) olanak tanır. Ancak bu yöntemde 10 katı fazla kredi harcayacağınız hatırlatmak isterim.
Artık animasyon üretim sürecine bakalım.
Deneyde Kullanılacaklar
Bu deneyde kullanacağım yapay zeka modelleri ve araçlar şunlar:
- Sahne planlanması ve komut hazırlama süreçleri için Gemini Flash ve ChatGPT Plus,
- Lenser ismini verdiğim animasyon karakterlerinin tüm hatlarıyla planlanması ve tasarlanması için ChatGPT Plus,
- Veo modellerini kullanarak animasyon tasarlamak için Google’ın Flow aracı,
- Expander hazırlamak için ChatGPT Plus veya Gemini Flash
- Veo modelini kullanırken İngilizce komut kullanmanız gerektiğinden tüm komutlar İngilizce olmalı. Bu yüzden eğer ihtiyaç duyarsanız bir çeviri aracı
Veo modellerini ve Flow aracını detaylıca anlattığım videoma kanalımdan ulaşabilirsiniz. Eğer videom hoşunuza gittiyse beğenebilir ve yeni gelecek videolar için takipte kalabilirsiniz.
Not olarak, Gemini ve ChatGPT’nin ücretsiz modellerini kotanız dahilinde deneyebilirsiniz ancak büyük bir proje hazırlamak istiyorsanız ödeme yapmanız gerekebilir. Gemini’ın Aralık tarihine kadar duyurmuş olduğu öğrenci indirimine de açıklamadaki bağlantıdan gidip bir yıl boyunca Gemini Pro’yu ücretsiz kullanabilirsiniz.
Video Hazırlarken Kullandığım Veo Modelleri Hakkında
Deney için hazırlıklarımı tamamladıktan sonra Flow’da tertemiz bir proje açtım. Elimde kullanabileceğim 1000 kredi olduğu için tüm komutları detaylıca hazırlamam gerekiyordu. Her komut bir kredi harcayacağından dolayı animasyon tasarlamaya hazırlıksız başlamak yerine tüm planlarımı yaptım.
Lenser Karakterinin Tasarlanması
ChatGPT’yi kullanarak aylar önce tasarlamış olduğum Lenser karakterlerinin DNA’sını JSON formatında çıkardım. Bunu yapmamdaki sebep yapay zekaların karakterimi tam anlamıyla anlamasını sağlamaktı.
json uzantılı bu DNA dosyalarını ChatGPT’de oluşturduğum projeye dosya olarak ekledim. Ardından karakterin illustrasyonunu 16:9 oranında hazırladım. Eğer yatay bir video yerine dikey bir video hazırlamak isteseydim 9:16 formatını komuta parametre olarak verecektim. Yeri gelmişken komut tasarlamayla ilgili bilgi edinmek istiyorsanız kanalımdaki oynatma listelerine göz atabilirsiniz.
Bu kısımda önemli birkaç nokta var:
- Benim için karakterin ön açıdan görseli yeterli oldu ancak farklı açılarda karakterin nasıl göründüğü önemliyse onları da tasarladıktan sonra modele vermeniz gerekir.
- Karakter tasarımını Flow aracında yüklerken belirli bir oranda kırpmanız gerekir. Tasarımlarınızda kestiğiniz her bir alanın yapay zeka tarafından öngörüleceğini ve farklılaşacağını unutmayın.
Karakterlerden Senaryo Tasarlama
Karakterlerin DNA’sına sahip olduğum için bu dosyaları ChatGPT ve Gemini’a yükleyerek sahneleri planladım. Toplam 1 dakika 40 saniyelik bir müzik klibim olduğundan ve Veo modeli 8 saniyelik videolar ürettiğinden dolayı 13 sahnelik bir sahne planı hazırladım.
Sahneleri yapay zekanın nasıl anladığını test etmek için hem Gemini hem de ChatGPT ile görselleştirdim. Görsel oluştururken Cyberpunk stilini kullanacağımı ve yatay formatta kaliteli bir görsel istediğimi de her sahne için ayrı ayrı belirttim.
Lenser DNA’sının yüklü olduğu projede yeni bir sohbet başlatıp tüm sahneleri adım adım tasarlattım. Lenser maskotları bazı kısımlarda değişkenlik gösteriyor olsa da fikir vermesi açısından önemli oldu. Hatta bazı yerlerde yapay zeka insansı Lenser’lar oluşturdu. Ancak bu istediğim bir şey değildi.
Gemini’ın Nano Banana modeliyse aynı sahneleri farklı şekillerde betimlemişti. Öyle ki bazı yerlerde garip karakterler ortaya çıktı.
Sahnelerin Planlanması ve Tanımlanması
Senaryo üzerinde düşünürken birden aklıma bir fikir geldi. Bu klip Lense ve Lensa arasındaki bir aşk hikayesini anlatıyordu. Peki Lense ve Lensa’yı popüler aşk filmleri sahnelerindeki gibi kurgulayabilir miydim?
Zihnimde birden şimşekler çaktı. ChatGPT’den popüler dizi ve filmlerdeki aşk sahnelerini göstermesini istedim. Titanik, The Notebook, La La Land gibi bazı filmleri saydı. Ardından popüler aşk mekanlarını listeledim.
Tüm mekanların fotoğraflarını edindikten sonra ChatGPT’ye yükledim ve bu sahneleri ve karakterleri uzunca tanımlamasını istedim. Arkaplanı ve karakterleri detaylıca tanımladı.
Karakterlerden Animasyon Tasarlama
Animasyon tasarlarken iki farklı yaklaşımla ilerledim. Birisi sadece metinden görsel üreterek, bir diğeri de Lenser karakterlerini kullanarak video oluşturmak.
Lenser karakterlerinin tasarımlarının değişmesini istemediğim için malzemelerden videoya formatını kullandım. Çünkü metinden videoya formatında Genişleticileri kullansam da bir videoda doğru tasarlanan karakter diğer videoda berbat görünebiliyor hatta Lenser’ların farklı varyasyonları ortaya çıkıyordu.
Malzemelerden Videoyu Etkili Kullanmak
Flow aracında malzemelerden videoya özelliğini açtıktan sonra yüklediğim Lenser’ları diğer yapay zekalarda kullandığım sahne betimlemeleriyle kullanmaya giriştim. Arka planda müzik olacağı için birkaç sahne dışında sessiz videolar işimi gördüğünde Veo 2 Fast modelini tercih ettim. Bu hem daha az kredi harcıyordu hem de bazı durumlarda Veo 3’den daha iyi performans gösteriyordu.
Bundan sonra tek yapmam gereken deneme yapmak ve klip için en hatasız ve estetik duran sahneleri ayıklamaktı. Her sahne 10 kredi harcadığından rahat rahat denemeler yapma fırsatım oldu. Ancak kötü bir haberim var. Google zaman içerisinde Veo 2 Fast modeli için desteğini sonlandıracak.
Ayrıca şunu da belirtmeliyim ki Metinden Videoya modunda Expander’ları denerken yaklaşık olarak 400 krediyi tüketmiştim. Bu yüzden geri kalan 600 krediyi dikkatli kullanmak için tüm sahneleri detaylıca planladım.
Ve evet. Klip ve müzik 26 Ekim 2025 tarihinde sizlerle buluşmak için hazır. Benim içime sinen bir proje oldu. Umarım sizlerin de hoşuna gider.
Expander kullanımı ve sahnelerden adım adım görseller üretilmesi kısmı başlı başına bir video olduğundan bugün bu konuyu pas geçiyorum. İsterseniz ilerleyen videolarda ele alabiliriz.
Animasyon Tasarlama Adımları
- Stil belirleme
- Hangi boyut için video üreteceğinizi belirleyin.
- Karakterleri belirleme
- Ortamları belirleme
- Senaryonun tamamlanması
- Kontroller ve tekrar üretimler
Karşılaştığım Hatalar
Metinden video üretirken karşılaştığım bazı problemler oldu:
- Lenser karakterleri tek göze sahip ancak Veo ile video üretirken defalarca vurgulasam da zaman zaman insana benzer iki gözlü varlıklar üretti.
- Metinden videoya özelliğinde Lenser DNA’sı tam olarak işlenmedi ve yapay zeka farklı stillerde karakterler hazırladı.
- Bir kelimenin değişmesi bile yapay zekanın kafasını karıştırdı. Mesela Lenser karakteri robot benzeri tek gözlü bir yapıyken komutta kullanılan “human” tarzı ifadeler ya da “eyes” tarzı çoğul ifadeler nedeniyle yapay zeka farklı karakter varyasyonları üretti.
Video Oluşturma Tavsiyelerim
- Eğer sınırlı sayıda AI kredisine sahipseniz ve sessiz bir video işinizi görüyorsa Veo 2 Fast modelini kullanarak maliyetten kaçınabilirsiniz. Eğer sesli bir video üretmeniz gerekiyorsa Veo 3 modelini seçmeniz gerekecek.
- Yüksek kaliteli videolar yüksek krediler gerektirdiğinden yeterince krediniz yoksa Fast modelleri kullanmanız daha az maliyetli olacak. İlla kaliteli bir video olsun istiyorsanız Fast ile ürettiğiniz videonun kalitesini sonradan yükseltmeniz mümkün. Böylelikle hoşunuza gitmeyen bir video olduğunda fazla kredi harcamamış olursunuz.
- Bir film/klip/dizi senaryosunda, zaman dilimi, hava koşulları, mekanlar ve karakterler değişiklik gösterebilir. Bu değişiklikler komutta detaylı şekilde belirtilmediği taktirde aklınızdaki sonucu almanız pek olası değil.
- Filminizin nasıl bir stilde olacağını ilk başta belirlemeli ve her komutta bunu vurgulamalısınız. İster Flow aracındaki Expander ile bunu yapın isterseniz her komutun sonuna tekrar tekrar ekleyin. Eğer eklemezseniz yapay zeka gerçek dünya koşullarını ya da komuta eklediğiniz görsellerdeki tasarımı baz alacak.
- Flow’da projeniz içerisindeki görüntüleri birleştirmeniz ve sahneleme yapmanız mümkün. Bunun için SceneBuilder bölümüne geçiş yapmalısınız. Ancak bir sahneyi devam ettirmek için Veo 3’nin kaliteli modelini kullanmanız gerekir ki bu da bir video için 100 kredi harcamak demek. Kredi miktarları bu videoyu izlediğiniz tarih itibariyle değişiklik gösterebilir.
- “Outputs per prompt” ayarı varsayılan olarak iki gelir. Eğer fazla AI kredisi harcamak istemiyorsanız bu ayarı 1 olarak değiştirmenizi kesinlikle tavsiye ediyorum. Eğer komutunuz başarılı değilse Flow’da aynı komutu tekrar kullanarak yine benzer videoyu üretebilirsiniz.
- Karakterlerinizin illüstrasyon hallerini transparan olarak yükledikten sonra Flow aracında kullanabilirsiniz. Tasarımlarınızı yüklerken videonuzun en-boy oranına göre kırpma yapmanız gerekeceğinden nesnelerin tüm alana sığdığından emin olun. Yoksa karakterin kırpılan kısımları farklı tasarlanabilir.
Yapay zekayla kaliteli ve uzun videolar üretmek bundan bir iki yıl öncesine kadar zordu. Bugünse hem Sora hem de Google’ın tarafındaki gelişmeler süreci oldukça hızlandırdı. Üç yıl içinde alınan bu ivmeyi düşündüğümde bir iki yıl sonrasında nelerle karşılaşacağımızı düşünemiyorum.
Teknoloji ve üretkenlik temalı içeriklerde görüşene dek hoşçakalın!
GKFFmJoNicsSxSKYp
25.10.2025drciFyaUyDHiJMiSVFmZyyF
GKFFmJoNicsSxSKYp
25.10.2025drciFyaUyDHiJMiSVFmZyyF