Görsel Üretim Modellerini Kendiniz Test Edin: 6 Modelde Aynı Prompt Denemesi
Liderlik tabloları yerine kendi gözünüzle karar vermek için basit bir test düzeni. Kullandığımız prompt seti, puanlama ölçütleri ve altı modelde gözlemlediğimiz eğilimler.

Görsel modellerini karşılaştıran tablolar genellikle iki şeyi ölçer: prompt'a sadakat ve insanların hangi görseli beğendiği. İkisi de önemli ama sizin işinizi ölçmüyor. Aşağıdaki düzen, bir öğleden sonra içinde altı modeli kendi ihtiyacınıza göre sıralamanızı sağlar.
Test edilen modeller
Açık taraftan FLUX Dev, Stable Diffusion 3.5 Large ve HiDream; kapalı taraftan Midjourney, Google Imagen ve OpenAI'ın görsel modeli. Hepsine aynı prompt'lar, her prompt için dört üretim.
Prompt seti
Beş kategori, her birinde iki prompt:
- Ürün fotoğrafı: beyaz zeminde cam parfüm şişesi; ahşap masada kahve fincanı ve kruvasan.
- İnsan portresi: stüdyo ışığında orta yaşlı kadın portresi; sokakta gülen genç adam, doğal ışık.
- Metin içeren görsel: "AÇILDIK" yazılı kafe tabelası; "%20 İNDİRİM" yazan poster.
- Karmaşık sahne: pazar yerinde beş kişi alışveriş yapıyor; yağmurlu gece, neon ışıklı sokak.
- Stil: suluboya illüstrasyon şehir manzarası; düz vektör ikon seti.
Puanlama ölçütleri
Her görsel 1-5 arasında dört ölçütte puanlanır: prompt'a uyum, anatomi ve fizik doğruluğu, metin okunabilirliği, estetik. Puanlamayı kör yapın: görselleri karıştırıp hangi modelden geldiğini bilmeden değerlendirin. İki kişi puanlarsa sonuç daha güvenilir olur.
Gözlemlenen eğilimler
- Metin: Türkçe karakterli kelimelerde tüm modeller zorlanıyor; "AÇILDIK" yerine "ACILDIK" veya bozuk harfler sık. FLUX ve OpenAI modeli en az hata yapıyor. Kısa ve büyük harfli metin her modelde daha iyi çıkıyor.
- Eller ve kalabalık: beş kişilik sahnede parmak ve yüz hataları hâlâ ortak sorun. Kapalı modeller daha az hata yapıyor ama sıfır değil. Kalabalık sahneyi iki üç kişiyle sınırlamak sonucu belirgin iyileştiriyor.
- Ürün fotoğrafı: açık modeller bu kategoride kapalı modellerle başa baş. Işık ve yansımalar FLUX'ta özellikle iyi.
- Stil: Midjourney estetikte önde, ancak prompt'tan sapma eğilimi var: istenen sade vektör ikon yerine daha süslü sonuç verebiliyor.
- Tutarlılık: aynı prompt'un dört üretimi arasındaki fark, modeller arasındaki farktan büyük olabiliyor. Tek örnekle karar vermeyin.
Sonuçları nasıl yorumlamalı
Toplam puan değil, sizin kategorinizdeki puan önemli. Ürün fotoğrafı çekiyorsanız portre sonuçları sizi ilgilendirmez. Ayrıca maliyet ve hız da tabloya girmeli: dört üretimin kaç saniye sürdüğü ve ne kadara mal olduğu. Yerel bir model, yüzde on daha düşük puanla ama sıfır maliyetle aylık yüzlerce görsel gerekiyorsa daha doğru seçim olabilir.
Testi güncel tutmak
Modeller birkaç ayda bir büyük sürüm alıyor. Prompt setini ve puan tablonuzu saklayın; yeni model çıktığında aynı seti çalıştırıp eskiyle karşılaştırın. Bu, her duyuruda yeniden karar vermek yerine kendi verinize dayalı bir tarih oluşturur.
Sanalisci AI ile içerik, görsel ve video üretimini yapay zekaya bırakın. Ürünü keşfedin →


