T Harfi 👁 22 görüntülenme

Text-to-Image Generation

Yazılı bir açıklamadan özgün bir görsel üreten yapay zeka yeteneği.

Metinden görsele üretim, kullanıcının yazdığı bir açıklamayı (prompt) girdi olarak alıp bu tanıma uygun, özgün ve daha önce hiç var olmamış bir görsel üreten yapay zeka yeteneğidir. Bugünün önde gelen sistemlerinin çoğu difüzyon modeli mimarisine dayanır: model, tamamen rastgele gürültüden oluşan bir görüntüden başlayarak, metin promptunun yönlendirmesi altında bu gürültüyü adım adım anlamlı, tutarlı bir görsele dönüştürür. Midjourney, DALL-E ve Stable Diffusion gibi araçlar bu teknolojinin en bilinen uygulamalarıdır ve grafik tasarımdan reklamcılığa, konsept sanatından kişisel eğlenceye kadar çok geniş bir kullanıcı kitlesine ulaşmıştır. Üretilen görsellerin telif hakkı ve gerçek sanatçıların eserlerinin eğitimde kullanılması konuları hâlâ tartışmalıdır.