Görsel Üretim Modellerini Kendiniz Test Edin: 6 Modelde Aynı Prompt Denemesi

Liderlik tabloları yerine kendi gözünüzle karar vermek için basit bir test düzeni. Kullandığımız prompt seti, puanlama ölçütleri ve altı modelde gözlemlediğimiz eğilimler.

AI ile Üretim04 Eylül 20262 dk okuma
Görsel Üretim Modellerini Kendiniz Test Edin: 6 Modelde Aynı Prompt Denemesi

Görsel modellerini karşılaştıran tablolar genellikle iki şeyi ölçer: prompt'a sadakat ve insanların hangi görseli beğendiği. İkisi de önemli ama sizin işinizi ölçmüyor. Aşağıdaki düzen, bir öğleden sonra içinde altı modeli kendi ihtiyacınıza göre sıralamanızı sağlar.

Test edilen modeller

Açık taraftan FLUX Dev, Stable Diffusion 3.5 Large ve HiDream; kapalı taraftan Midjourney, Google Imagen ve OpenAI'ın görsel modeli. Hepsine aynı prompt'lar, her prompt için dört üretim.

Prompt seti

Beş kategori, her birinde iki prompt:

  • Ürün fotoğrafı: beyaz zeminde cam parfüm şişesi; ahşap masada kahve fincanı ve kruvasan.
  • İnsan portresi: stüdyo ışığında orta yaşlı kadın portresi; sokakta gülen genç adam, doğal ışık.
  • Metin içeren görsel: "AÇILDIK" yazılı kafe tabelası; "%20 İNDİRİM" yazan poster.
  • Karmaşık sahne: pazar yerinde beş kişi alışveriş yapıyor; yağmurlu gece, neon ışıklı sokak.
  • Stil: suluboya illüstrasyon şehir manzarası; düz vektör ikon seti.

Puanlama ölçütleri

Her görsel 1-5 arasında dört ölçütte puanlanır: prompt'a uyum, anatomi ve fizik doğruluğu, metin okunabilirliği, estetik. Puanlamayı kör yapın: görselleri karıştırıp hangi modelden geldiğini bilmeden değerlendirin. İki kişi puanlarsa sonuç daha güvenilir olur.

Gözlemlenen eğilimler

  • Metin: Türkçe karakterli kelimelerde tüm modeller zorlanıyor; "AÇILDIK" yerine "ACILDIK" veya bozuk harfler sık. FLUX ve OpenAI modeli en az hata yapıyor. Kısa ve büyük harfli metin her modelde daha iyi çıkıyor.
  • Eller ve kalabalık: beş kişilik sahnede parmak ve yüz hataları hâlâ ortak sorun. Kapalı modeller daha az hata yapıyor ama sıfır değil. Kalabalık sahneyi iki üç kişiyle sınırlamak sonucu belirgin iyileştiriyor.
  • Ürün fotoğrafı: açık modeller bu kategoride kapalı modellerle başa baş. Işık ve yansımalar FLUX'ta özellikle iyi.
  • Stil: Midjourney estetikte önde, ancak prompt'tan sapma eğilimi var: istenen sade vektör ikon yerine daha süslü sonuç verebiliyor.
  • Tutarlılık: aynı prompt'un dört üretimi arasındaki fark, modeller arasındaki farktan büyük olabiliyor. Tek örnekle karar vermeyin.

Sonuçları nasıl yorumlamalı

Toplam puan değil, sizin kategorinizdeki puan önemli. Ürün fotoğrafı çekiyorsanız portre sonuçları sizi ilgilendirmez. Ayrıca maliyet ve hız da tabloya girmeli: dört üretimin kaç saniye sürdüğü ve ne kadara mal olduğu. Yerel bir model, yüzde on daha düşük puanla ama sıfır maliyetle aylık yüzlerce görsel gerekiyorsa daha doğru seçim olabilir.

Testi güncel tutmak

Modeller birkaç ayda bir büyük sürüm alıyor. Prompt setini ve puan tablonuzu saklayın; yeni model çıktığında aynı seti çalıştırıp eskiyle karşılaştırın. Bu, her duyuruda yeniden karar vermek yerine kendi verinize dayalı bir tarih oluşturur.

#benchmark#görsel üretimi#FLUX#Midjourney#Imagen#test

Sanalisci AI ile içerik, görsel ve video üretimini yapay zekaya bırakın. Ürünü keşfedin →

İlgili yazılar