Google AI 101 serisinin 3. bölümünde Gemini ve Google AI Studio’yu kullanarak Nano Banana, Imagen ve Whisk gibi araçlarla görsel ve animasyon üretmeyi deneyeceğiz. Hem ücretli hem de ücretsiz hesaplarla nasıl kaliteli görseller üretebileceğinizi serinin bu bölümünde bulacaksınız.
İlk bölümde Google’ın yapay zeka tarihini anlatırken Google Brain ve DeepMind’ın öneminden bahsetmiştik. Bu videoda göreceğiniz modeller, Google’ın yapay zeka ekibi tarafından geliştirildi. Görsel üretime geçmeden önce Google DeepMind’ın resmi web sitesindeki görsel modellerine birlikte göz atalım.
Google DeepMind
2025 yılı itibariyle Google’ın farklı amaçlar doğrultusunda hazırladığı halka açık modeller şunlar: Gemini, Gemma, Veo, Imagen ve Lyria. Gemini’ı nasıl kullanabileceğinizi önceki hafta A’dan Z’ye ele almıştık. O videoya kartlardan ve kanalımdan gidebilirsiniz. Bugünse Imagen modelini inceleyeceğiz.
Imagen Serisi
Google DeepMind’ın Imagen serisi, metinden görsel üretim alanında gelişmiş modeller sunuyor. İlk olarak 2022’de duyurulan [2] Imagen, yüksek çözünürlüklü görseller üretmesiyle dikkat çekti [1]. Ardından gelen Imagen 2, yazı ve logoları daha doğru biçimde yerleştirme yeteneği kazandırdı [3]. Imagen 3 ile detay, ışıklandırma, çoklu kişi sahneleri ve betimlemeye uygunluk geliştirildi [4]. Serinin en güncel sürümü olan Imagen 4 ise foto-gerçekçilik, tipografi ve ayrıntılarda önemli iyileştirmeler içeriyor. Ayrıca “Imagen 4 Fast” gibi hız odaklı varyantlarla farklı kalite, hız ve maliyet seçenekleri de sunuluyor [5].
En son yayınlanan Imagen 4 modelini kullanarak görsel oluşturmak için Gemini, Google AI Studio ve Whisk araçlarını planınız dahilinde kullanabilirsiniz.
- Modeli kullanarak insanlar, bitkiler, hayvanlar ve manzara görsellerini gerçekçi şekilde üretebilirsiniz. Zihninizde bir kompozisyon tasarlayıp onu komut haline dönüştürdükten sonra tek yapmanız gereken modele göndermek. Komut ne kadar kapsamlı ve gereksizliklerden arındırılmış olursa o kadar başarılı sonuç alırsınız ki bununla ilgili hazırlamış olduğum videolar kanalımda mevcut. Abone olmayı ve takipte kalmayı unutmayın!
- Model aynı zamanda ince detayları yakalamada da oldukça başarılıdır. Daha zengin renkler, dokular ve geçişlerle aşırı yakın plandaki görselleri yüksek kalitede üretebilirsiniz.
- Ayrıca gelişmiş yazım ve tipografi özellikleri sayesinde çizgi romanlar, ambalaj tasarımları ve koleksiyon ürünleri çok daha canlı hale gelir. Daha uzun metin dizileri, yeni düzenler ve farklı stillerle kreatif konseptler kolaylıkla oluşturulabilir.
- Bununla birlikte model, çeşitli sanat tarzlarını da yüksek doğrulukla yansıtabilir. Foto-gerçekçilikten empresyonizme, soyut sanattan illüstrasyona kadar birçok tarzı başarılı bir şekilde üretmenizi sağlar.
Nano Banana Nedir?
Nano Banana olarak da adlandırılan Gemini 2.5 Flash Image modeli, görüntü üretme ve düzenleme yeteneklerini geliştirme amaçlı DeepMind tarafından sunulan güncel bir modeldir [6]. Aynı karakterin farklı sahnelerde doğru şekilde konumlandırma, birden fazla görseli tek sahnede harmanlama (multi-image fusion), doğal dil komutlarıyla yerel düzenlemeler yapabilme ve genel dünya bilgisini görsellere entegre edebilme gibi yeni özelliklere sahiptir [6].
“Nano Banana” ismi, model halka tam açıklanmadan önce test aşamasında LMArena gibi platformlarda kullanılan kod adı olarak ortaya çıkmıştır; bu isim kullanıcı topluluğu arasında yayılarak resmi olmayan takma ad haline gelmiş, ardından Google, bu modeli resmi olarak Gemini 2.5 Flash Image adıyla yayımlamıştır [7][8].
Peki Nano Banana ile Neler Yapılabilir?
Nano Banana (Gemini 2.5 Flash Image), yalnızca sıfırdan görsel üretmek değil, aynı zamanda mevcut görselleri düzenlemek, birleştirmek ve dönüştürmek için de güçlü özellikler sunar.
- “Bir resmi yükle ve arka planı tropik bir sahil ile değiştir.”
- “Bu karakteri aynı kıyafetle farklı bir şehir meydanına yerleştir.”
- “İki fotoğrafı birleştir: birinde güneşli sahil, diğerinde karla kaplı dağ — tek bir kompozisyon yap.”
- “Bu kahramanı çizgi roman tarzında yeniden çiz.”
- “Yüklediğim resmi Van Gogh’un empresyonist tarzına dönüştür.”
- “Bir portredeki kişiye kışlık mont giydir.”
- “Bir müzik grubunun konser sahnesini oluştur, sahnenin arkasına dev bir ejderha illüstrasyonu ekle.”
- “Bir metin logosunu (ör. ConnectLens) neon tabela olarak gerçekçi bir şekilde üret.”
- “Bir köpeğin fotoğrafını al, ona kral tacı ve pelerin ekle.”
- “Aynı sahneyi hem gündüz hem gece versiyonuyla oluştur.”
-
3D Figürin Komutu
“Create a 1/7 scale commercialized figurine of the character in the picture, in a realistic style, in a real environment. The figurine is placed on a computer desk. The figurine has a round transparent acrylic base. The content on the computer screen is a 3D modeling process of this figurine. Next to the computer screen is a toy packaging box, designed in a style reminiscent of high-quality collectible figures, printed with original artwork.” [9]
-
Yönergelere Göre Görüntü Değiştirme
“Change this image by following the instructions written on the image.” [10]
-
Corporate Executive Portrait
Transform the casual photo into a Fortune 500 CEO portrait with impeccable business attire, confident posture, and a modern office environment backdrop. Include subtle power accessories like a luxury watch, leather portfolio, and city skyline view through floor-to-ceiling windows. Lighting should convey authority and success.[11] -
Magazine Cover Star
Convert the image into a high-fashion magazine cover shot with professional styling, dramatic makeup, and avant-garde fashion elements. Add magazine masthead, cover lines, and barcode details. Include studio lighting effects with rim lighting and fashion-forward color grading.[11]
| BAD | GOOD | |
|---|---|---|
| zoom on a flower | “Extreme macro close-up of a dew-covered red rose petal, captured with 100mm lens simulation, super-sharp micro-textures, bokeh background, photorealistic botanical photography, focus stacking effect” | |
| Poster design for a tech event, modern layout, dark background, bold title, futuristic font | Cinematic poster design for an international technology conference. Background: futuristic neon city skyline at night with glowing skyscrapers. Foreground: bold headline text ‘AI FUTURE 2025’ in large modern sans-serif typography, glowing blue and magenta gradient effect. Sub-header: smaller subtitle line ‘Innovation, Ethics, Humanity’ placed beneath main title in white clean font. Composition: centered layout with symmetrical balance. Color scheme: high-contrast dark background with neon highlights (purple, cyan, electric blue). Extra elements: reserved space at bottom for event date and QR code on the right corner, minimal sponsor logos on bottom left. Style: futuristic, professional, and visually striking, vertical 9:16, poster format for TikTok/Reels | |
| make a newspaper | Vintage black-and-white newspaper front page design, bold masthead ‘CONNECT LENS’, multiple text columns, small square photo of city skyline in top-right, realistic 1950s print look with slightly aged paper texture | |
| Photo of sneakers on table | E-commerce style product photo of black leather sneakers, isolated on pure white background, realistic shadows, sharp details, optimized for Amazon catalog listing | |
| Photo of sushi on plate | Top-down professional food photography of a gourmet sushi platter. Composition: neatly arranged assorted sushi rolls (salmon, tuna, avocado) and sashimi slices, placed symmetrically on a clean dark wooden table. Props: black ceramic serving plate, a pair of bamboo chopsticks angled diagonally on the right side, a small soy sauce dish in top-left. Lighting: soft natural daylight coming from left window, subtle highlights on glossy fish textures, no harsh shadows. Style: restaurant menu photography, crisp focus, shallow depth on plate edges, background slightly blurred for separation. Color palette: natural tones of wood, deep reds and pinks of fish, clean whites of rice, subtle greens of wasabi and avocado. Output: styled for premium restaurant menu layout with negative space around dish for text placement | |
| Colorful Instagram post with modern design | Square Instagram-style social media graphic. Background: bold gradient (blue → pink) with subtle diagonal texture. Foreground: centered motivational text ‘Keep Creating’ in large modern sans-serif font, crisp white color with soft drop shadow. Layout: clean minimal composition with generous negative space. Style: high-contrast, optimized for Instagram feeds, eye-catching at small thumbnail size. Color palette: neon pinks, cyan blues, pure white text. Output: designed as shareable social media post. | |
| Corporate slide with title and chart | Professional corporate slide design. Background: clean white canvas with subtle light gray gradient. Header: bold title ‘Q2 Sales Growth’ in navy blue sans-serif font, aligned top-left. Main element: vector bar chart in blue and green theme with three bars labeled ‘Q1, Q2, Q3’. Icons: small flat revenue icon (💰) above bar chart, user icon (👤) near data point. Layout: minimal spacing with wide margins, flat design style, crisp lines. Purpose: presentation-ready visual optimized for PowerPoint or Google Slides | |
| Simple infographic with world map | Flat vector infographic design. Background: clean white canvas. Title: bold text ‘Global Internet Usage 2025’ in dark blue. Main element: flat world map with countries shaded in gradient from light blue (low) to dark blue (high). Icons: small WiFi symbol above Asia, smartphone icon above Europe, user icon above Africa. Layout: left-aligned text box with three bullet points. Style: minimal pastel palette (blue, green, gray). Purpose: LinkedIn-ready infographic or corporate report slide | |
| Pixel art character of a knight with a sword | Retro pixel art sprite of a medieval knight holding a steel sword. Style: 16-bit SNES-era video game character, 32×32 grid resolution, limited color palette (grays, metallic silver, deep blue for armor, red accent on cape). Composition: knight standing in idle pose facing forward, one hand holding sword upright, shield strapped to back. Background: transparent so character can be placed in game scenes. Purpose: classic RPG game asset, optimized for pixel-perfect design with sharp edges. | |
| make a house | Photorealistic architectural visualization of a modern cliffside villa. Structure: two-story house with large floor-to-ceiling glass walls and flat rooftop terrace. Materials: concrete, steel, and reflective glass. Background: cliff overlooking the ocean, visible horizon line. Lighting: golden hour sunlight from left side, soft shadows falling across terrace. Landscaping: minimal, with trimmed grass, stone pathway leading to entrance, and small pool in front. Style: professional ArchViz render, clean lines, realistic reflections, designed for luxury real estate brochure |
Whisk nedir?
Whisk, Google Labs tarafından geliştirilen deneysel bir görsel üretme aracıdır. Kullanıcılar uzun metin komutları yerine görsellere dayalı yönlendirme yaparak yeni görseller oluşturabilirler. Burada subject (özne), scene (sahne) ve style (tarz) şeklinde üç tür girdi kullanılır. Her girdi için birden fazla opsiyon kullanabilirsiniz. Kullanıcı bu görselleri etik çerçevede sisteme yükler ya da otomatik oluşturur. Whisk, tanımlanan görselleri, komutları ve ayarlamaları kullanarak görseller üretir. [12]
Whisk’te uzun uzadıya komut yazmak yerine görselleri kullanarak komutların otomatik oluşturulmasını sağlatabilirsiniz. Whisk yüklenen görseli analiz ettikten sonra uzun bir komut hazırlar ve bunu yeni görseller üretirken kullanır. Aynı zamanda görselleri boyutlandırabilir ve otomatik görseller, animasyonlar ve videolar üretebilirsiniz.
Not olarak bu tarz platformlara yüklediğiniz içeriklerin telif hakkı dahilinde korunduğunu unutmayın! Kendinize ait olmayan ya da telif hakkı içeren görselleri yüklemekten kaçının!
Google AI 101 serisinin 3. bölümünde Google’ın görsel üretmeye yarayan modellerini ve araçlarını inceledik. Bir sonraki videoda artık Veo 3 ile video nasıl oluşturabileceğimize bakacağız. Tüm eğitim serileri ve yapay zeka içerikleri için takipte kalmayı ve videoyu unutmayın!
Tek bir görselimi kullanarak benim bir benzerimi oluşturan bu yapay zeka tüm sosyal medya hesaplarımdaki görselleri kullansaydı yeni bir beni tasvir edemez miydi? Peki bunun önüne ne geçecek?
- Sources
- https://imagen.research.google/
- https://en.wikipedia.org/wiki/Imagen_(text-to-image_model)
- https://cloud.google.com/blog/products/ai-machine-learning/imagen-2-on-vertex-ai-is-now-generally-available
- https://cloud.google.com/blog/products/ai-machine-learning/introducing-veo-and-imagen-3-on-vertex-ai
- https://developers.googleblog.com/en/imagen-4-now-available-in-the-gemini-api-and-google-ai-studio/
- Introducing Gemini 2.5 Flash Image (aka nano-banana) — Google Developer Blog, 26 Ağustos 2025, Google Developers Blog
- Nano Banana is the latest upgrade to image generation in the Gemini app — Google Blog (Gemini), blog.google
- https://en.wikipedia.org/wiki/Nano_Banana
- https://www.reddit.com/r/Bard/comments/1ngm4rb/how_to_generate_nano_banana_3d_figurine/
- https://www.reddit.com/r/GeminiAI/comments/1naslb7/example_of_nanobanana_following_instructions
- https://aisuperhub.io/gallery
- https://blog.google/technology/google-labs/whisk/
- https://support.google.com/googleone/answer/16287445?hl=en&visit_id=638942065263028286-1898875165&p=g1_credit_management&rd=1
İlk yorumu paylaşan siz olun.