Yapay Zekâ ile Görsel Oluşturma: Tam Rehber
Hangi aracı seçeceğinizden prompt yazmaya, telif durumundan pratik iş akışlarına kadar bilmeniz gereken her şey — tek sayfada, sırayla.
Kısa cevap
Yapay zekâ ile görsel oluşturmak için bir araç seçip ne görmek istediğinizi yazılı olarak tarif etmeniz yeterlidir. Ücretsiz başlamak için Bing Image Creator veya Google Gemini, en yüksek kalite için Midjourney, fotogerçekçilik ve görsele yazı için Flux, Türkçe prompt için DALL·E 3 öne çıkar. İyi bir prompt konu, ortam, stil ve teknik ayrıntıyı kısa öbekler hâlinde içerir.
Yapay zekâ görseli nasıl üretiyor?
Bugün kullanılan görsel üretme araçlarının neredeyse tamamı difüzyon adı verilen bir yöntemle çalışır. Model, eğitim sırasında milyonlarca görsele adım adım gürültü eklemeyi ve bu işlemi tersine çevirmeyi öğrenir.
Üretim sırasında ise tam tersi olur: model saf gürültüyle başlar ve sizin yazdığınız promptun yönlendirmesiyle bu gürültüyü adım adım temizler. Yirmi otuz adım sonunda ortaya bir görsel çıkar.
Bu yöntemin iki pratik sonucu var. Birincisi, aynı promptu iki kez çalıştırdığınızda iki farklı görsel alırsınız — başlangıçtaki gürültü rastgeledir. İkincisi, model nesneleri anlamaz, yalnızca istatistiksel örüntü öğrenir; "el" kavramını bilir ama elin beş parmaklı olması gerektiğini bir kural olarak bilmez.
Bozuk eller, anlamsız harfler ve mantıksız mimari bu ikinci gerçeğin sonucudur. Son nesil modeller bu konuda belirgin biçimde iyileşti ama sorun tamamen ortadan kalkmış değil.
Hangi aracı seçmelisiniz?
Tek bir "en iyi araç" yoktur ve bu soruyu böyle sormak yanlış sonuca götürür. Doğru soru şudur: ne üreteceksiniz ve ne kadar kontrol istiyorsunuz?
Hiç para ödemeden başlamak istiyorsanız Bing Image Creator tamamen ücretsizdir ve ödeme bilgisi istemez. Türkçe yazmak istiyorsanız Google Gemini veya DALL·E 3 Türkçe promptu doğrudan anlar. Görselin güzelliği en önemli ölçütse Midjourney belirgin biçimde öndedir. Fotoğraf gibi görünmesi gerekiyorsa ya da görselin içinde okunabilir yazı olacaksa Flux daha iyi sonuç verir.
Belirli bir kompozisyonu, pozu ya da mekân geometrisini korumanız gerekiyorsa hiçbir kolay araç işe yaramaz; Stable Diffusion ve ControlNet gerekir. Logo ya da ikon üretiyorsanız çıktının vektör olması gerekir ve bunu yalnızca Recraft verir.
| İhtiyaç | Önerilen araç | Neden |
|---|---|---|
| Hiç ödeme yapmadan başlamak | Bing Image Creator | Tamamen ücretsiz, kurulum yok |
| Türkçe prompt yazmak | Google Gemini, DALL·E 3 | Türkçeyi doğrudan ve isabetli anlar |
| En yüksek estetik kalite | Midjourney | Kompozisyon ve renk uyumu ilk denemede tutar |
| Fotogerçekçilik ve görsele yazı | Flux | Eller, yüzler ve harfler tutarlı çıkar |
| Tam kontrol ve sınırsız üretim | Stable Diffusion | ControlNet ve LoRA; kurulumdan sonra ücretsiz |
| Logo ve ikon | Recraft, Ideogram | Vektör çıktı ve doğru yazı |
Prompt nasıl yazılır?
Prompt yazmanın tek kuralı vardır: modele bir cümle değil, bir tarif verin.
İyi bir prompt dört bileşen içerir. Konu: ne var. Ortam: nerede. Stil: nasıl görünüyor. Teknik ayrıntı: ışık, objektif, kompozisyon. Bu dördü virgülle ayrılmış kısa öbekler hâlinde yazıldığında çoğu araçta en iyi sonucu verir.
Uzun ve şiirsel cümleler beklenenin aksine daha kötü sonuç verir; modeller cümle yapısını değil anahtar kavramları okur. "Bir kadın portresi" zayıf bir prompttur; "portrait of a woman in her fifties, soft window light from the left, neutral grey background, shot on 85mm, natural skin texture" aynı isteği çalışır hâle getirir.
En sık atlanan bileşen tekniktir ve en çok fark yaratan da odur. Objektif odak uzaklığı, ışığın yönü ve kalitesi, alan derinliği — bunları yazmak sonucu stok fotoğraf estetiğinden çıkarır.
- Konu: kim ya da ne var, kaç tane, ne yapıyor
- Ortam: mekân, zaman, hava, arka plan
- Stil: fotoğraf mı illüstrasyon mu, hangi teknik, hangi palet
- Teknik: ışığın yönü, objektif, alan derinliği, kadraj
- İstemedikleriniz: negatif prompt ya da --no parametresi
- Biçim: en-boy oranı, çözünürlük
Bir seri boyunca tutarlılık
Tek bir güzel görsel üretmek kolaydır. Asıl zorluk, on görselin bir arada tek bir marka ya da tek bir yayın gibi görünmesidir.
Yapay zekâ her üretimde biraz farklı sonuç verir; bu, tek görsel için zenginlik, bir seri için sorundur. Çözüm üç katmanlıdır.
Birinci katman prompt disiplinidir: stil bölümünü değişmez bir metin bloğu hâline getirin ve yalnızca konuyu değiştirin. Palet renklerini isimle sayın.
İkinci katman stil referansıdır ve prompt tekrarından belirgin biçimde daha güvenilirdir. Midjourney'de --sref parametresi, Leonardo ve Recraft'ta kaydedilmiş stiller bu işi yapar.
Üçüncü katman, aynı karakter ya da ürün tekrar edecekse gerekir: Midjourney'in karakter referansı ya da Stable Diffusion tarafında o varlık için eğitilmiş bir LoRA.
Telif ve ticari kullanım
Burada iki ayrı soru var ve karıştırılmaları en sık yapılan hatadır.
Birinci soru: bu görseli kullanabilir miyim? Cevap aracın kullanım koşullarındadır. Araçların çoğu ücretli katmanda ticari kullanıma izin verir; bazılarında ücretsiz katmanda üretilen görseller kısıtlıdır ve açık ağırlıklı modellerde lisans sürümden sürüme değişir.
İkinci soru: bu görsel bana ait mi? Cevap telif hukukundadır ve genellikle hayırdır. Türkiye dahil birçok ülkede, insan yaratıcılığı içermeyen tamamen yapay zekâ üretimi eserler telif korumasından yararlanamaz. Yani görseli kullanabilirsiniz, ama başkasının aynısını kullanmasını engellemek için dayanacağınız hukuki zemin zayıftır.
Marka tescili ya da kurumsal kullanım söz konusuysa üçüncü bir konu daha var: eğitim verisi. Adobe Firefly lisanslı ve kamuya açık eserlerle eğitildiği için çıktının başkasının telifli işini taklit etme riski en düşük olan seçenektir.
En sık yapılan altı hata
Bu hataların hepsi düzeltilebilir ve hepsi zaman kazandırır.
- En-boy oranını üretimden sonra kırpmak — oranı prompta yazın, kompozisyon buna göre kurulur
- Tüm metni görselin içine yazdırmaya çalışmak — yalnızca bir-iki kelimelik başlığı yazdırın, gerisini tasarım aracında ekleyin
- Baskı için çözünürlüğü kontrol etmemek — 300 DPI ister; A3 için yaklaşık 3500×4900 piksel
- Ürünü sıfırdan üretmek — kendi ürün fotoğrafınızın yalnızca arka planını değiştirin
- Prompt'ta yaşayan sanatçı adı kullanmak — tekniği tarif etmek hem güvenli hem daha kontrollü
- Web'e optimize edilmemiş PNG yüklemek — WebP'ye çevirin, sayfa hızı bir sıralama faktörüdür
Sık sorulan sorular
Yapay zekâ ile görsel oluşturmak ücretsiz mi?
Ücretsiz seçenekler var. Bing Image Creator tamamen ücretsizdir ve ödeme bilgisi istemez; Google Gemini ve Leonardo AI günlük yenilenen ücretsiz hak verir; Stable Diffusion kendi bilgisayarınıza kurulduğunda süresiz ücretsizdir. Midjourney'in ücretsiz katmanı yoktur.
Türkçe prompt yazabilir miyim?
Google Gemini ve DALL·E 3 Türkçe promptu doğrudan ve isabetli anlar; çeviriye gerek yoktur. Midjourney Türkçeyi anlar ama İngilizceye göre ayrıntı kaybı olur. Stable Diffusion neredeyse hiç anlamaz; İngilizce yazmak zorunludur. Görselin İÇİNE Türkçe yazı yazdırmak ayrı bir konudur ve hiçbir araçta tam güvenilir değildir.
Ürettiğim görselleri satabilir miyim?
Kullandığınız aracın koşulları izin veriyorsa evet — çoğu araç ücretli katmanda ticari kullanıma izin verir. Ancak tamamen yapay zekâ üretimi görseller çoğu ülkede telifle korunamaz; kullanabilirsiniz ama başkasının kullanmasını engelleyemeyebilirsiniz. Açık ağırlıklı modellerde lisansın sürümden sürüme değiştiğini de unutmayın.
Neden eller ve yazılar bozuk çıkıyor?
Modeller nesneleri anlamaz, istatistiksel örüntü öğrenir; elin beş parmaklı olması gerektiğini bir kural olarak bilmezler. Aynı şey harfler için de geçerlidir. Flux bu iki konuda belirgin biçimde daha iyidir; yazı için Ideogram en güvenilir seçenektir. Kısa metinler ve elleri kadraj dışında bırakan kadrajlar sorunun büyük kısmını çözer.
Hangi araçla başlamalıyım?
Türkçe yazmak istiyorsanız Google Gemini ile başlayın: ücretsiz, hızlı ve Türkçe promptu doğrudan anlıyor. Bir hafta sonra ne istediğinizi daha net bileceksiniz; o noktada kalite için Midjourney'e, ücretsiz düzenli üretim için Leonardo AI'ye ya da kontrol için Stable Diffusion'a geçmek anlamlı olur.