Prompttan Görüntüye (Prompt-to-Image)

Prompttan görüntüye, metinden görüntüye ve görüntü üretimi ile büyük ölçüde birbirinin yerine kullanılır, ancak bu ifade özellikle yazılı promptun kendisini, altta yatan difüzyon modelinden veya uygulama arayüzünden ziyade, bir kullanıcının görüntüler üretirken günlük olarak etkileşime girdiği, üzerinde yinelediği ve iyileştirdiği birincil yaratıcı kontrol yüzeyi olarak öne çıkarır — terim, etkili bir prompt oluşturmanın (konu, stil, ışıklandırma, kamera/lens detayları, sanatçı referansları, negatif promptlar ve `(anahtar kelime:1.3)` gibi ağırlıklandırma sözdizimi) basitçe bir görüntü üreticisini kara kutu bir araç olarak "kullanmaktan" ayrı, kendi başına öğrenilebilir, ayırt edici bir zanaat becerisi olarak ele alındığı Midjourney/Stable Diffusion uygulayıcı topluluğunda yaygındır. Prompttan görüntüye iş akışları tipik olarak temel metin açıklamasının üzerine birkaç ek kontrol katmanı ekler: negatif promptlar (açıkça hariç tutulacak şeyi belirtme, örneğin "metin yok, bulanık kenar yok, fazladan uzuv yok"), en boy oranı ve çözünürlük parametreleri, stil veya model seçimi (fotogerçekçi ile düz illüstrasyon ile daha dar bir veri kümesi üzerinde eğitilmiş anime ayarlı kontrol noktaları arasında), açıklamanın bir bölümünü diğerinden daha fazla vurgulamak için prompt segmenti ağırlıklandırma ve kullanıcının her yeniden üretim denemesinde tamamen farklı bir görüntü almak yerine belirli bir sonucu yeniden üretmesine veya küçük varyasyonlar yapmasına olanak tanıyan tohum (seed) değerleri. SaaS geliştiricileri için neden önemli: prompttan görüntüye üretim etrafında inşa edilen ürünler (Midjourney'nin kendisi, Leonardo.Ai ve Stable Diffusion/Flux API'leri üzerine inşa edilmiş birçok niş sarmalayıcı), "prompt sözdizimini" öğrenmek istemeyen son kullanıcılardan prompt mühendisliğini ne kadar iyi soyutladıklarına bağlı olarak başarılı veya başarısız olur — en başarılı tüketici yapay zeka görüntü ürünleri, teknik olmayan kullanıcılara ham bir metin kutusu sunmak yerine, arka planda iyi tasarlanmış bir promptu otomatik olarak oluşturmak için yapılandırılmış form girdileri (stil için açılır menüler, yaratıcılık için kaydırıcılar) kullanır. Somut bir örnek — rehberli bir görüntü üreteci olan bir pazarlama varlığı SaaS'ı: (1) boş bir prompt kutusu yerine, arayüz yapılandırılmış alanlar sunar: konu (serbest metin), stil (açılır menü: fotogerçekçi / düz illüstrasyon / 3D render), ruh hali (açılır menü) ve en boy oranı (geçiş: kare / yatay / hikaye); (2) gönderimde, arka uç bunları iyi biçimlendirilmiş bir prompt şablonunda birleştirir: "{konu}, {stil} stili, {ruh hali} ruh hali, profesyonel pazarlama fotoğrafçılığı, yüksek detay, metin yok, filigran yok"; (3) birleştirilmiş prompt, ilgili en boy oranı parametresiyle birlikte görüntü üretimi API'sine gönderilir; (4) ham prompt varsayılan olarak ortalama kullanıcıya asla gösterilmez, ancak ileri düzey kullanıcılar birleştirilmiş prompt metnini görmek ve doğrudan düzenlemek için bir "Gelişmiş" panelini açabilir, rehberli formu aştıklarında daha ince kontrol kazanır.

İlgili terimler

Sonraki adım

Midjourney

Konusu olan aracın dizinimizdeki sayfası — neyi iyi yapıyor, nerede yapmıyor.

Daha fazla Çıktı ve Medya terimi