Yapay zekâ ile görsel üretmek gerçekte nedir?
Bir metnin nasıl resme dönüştüğünün sade bir anlatımı ve bunun pratikte ne demek olduğu.
SamImageGenerator ·
Yapay zekâ görsel üretimi yazılı bir tarifi yeni bir kareye çeviriyor. Aranan bir kütüphane ve birleştirilen bir kolaj yok: model kelimelerle görüntüler arasındaki istatistiksel ilişkiyi öğrenmiş durumda ve istediğiniz şeye uyan taze bir piksel düzeni kuruyor. Aynı cümleyi iki kez koşturun, iki farklı kare alın — çünkü her koşu başka bir noktadan başlıyor.
Bunun pratikte önemi
Kare bulunmuyor kuruluyor olduğu için oyunun tamamı özgüllük. Kısa bir komut kararların çoğunu modele bırakıyor, o da bildiği en sıradan cevapla dolduruyor. Kesin bir komut o kararları geri alıyor. "İnsan olmasın"ın bir talimat olarak başarısız olmasının sebebi de bu — modelin çıkarma diye bir kavramı yok, yalnız andığınız şey var.
Aynı gerçek dürüst sınırları da açıklıyor. Görselin içindeki yazı güvenilmez. Eller ve sayılar yaklaşık. Gerçek bir kişinin yüzü fotoğraf olarak değil benzerlik olarak geri geliyor. Bunların hiçbiri daha iyi bir komutun düzelteceği kusurlar değil; işin nasıl yürüdüğünün özellikleri.
Gerçekte neyi denetliyorsunuz
| Denetim | Etkisi |
|---|---|
| Komut | Özne, ortam, ışık, çerçeveleme, bitiş |
| Stil | Komutunuzun önüne eklenen sabit bir cümle |
| En boy oranı | Kompozisyonun kurulduğu şekil |
| Çözünürlük | 1K ya da 2K; aynı kare, daha çok piksel |
| Parti boyutu | Bir seferde kaç varyant geldiği |
Nereden başlamalı
Öznesi, yeri ve ışığı olan tek bir düz cümle yazın, görselin gerçekten kullanılacağı oranı seçin ve bir yerine birkaç varyant üretin. Komut rehberi bu tavsiyenin uzun hâli, Keşfet bitmiş görselleri onları üreten komutla birlikte gösteriyor, fiyatlandırma da tek satırda söylenecek kadar sade: bir kredi, bir görsel.