ANA SAYFA/BLOG/REHBERLER
Rehberler

Görselden Videoya: Yapay Zeka ile Adım Adım Workflow

Görselden videoya yapay zeka iş akışı: görseli hazırla, model seç, yalnızca hareketi anlat ve temiz bir klip çıkar. Tahmin yok, kredi israfı yok.

Egemen Küpçü19 Haziran 202613 dk okuma
Görselden Videoya: Yapay Zeka ile Adım Adım Workflow
Paylaş

Elinizde sevdiğiniz bir görsel var — bir ürün fotoğrafı, bir portre, bir illüstrasyon, bir manzara — ve onu hareket ettirmek istiyorsunuz. Yapay zekayla bir görseli videoya dönüştürmek, artık bir içerik üreticisinin sahip olabileceği en değerli becerilerden biri: modele durağan bir kare veriyorsunuz, istediğiniz hareketi anlatıyorsunuz ve model sahneyi canlandırıyor. Ama büyülü görünen bir kliple eriyen bir kabusu andıran bir klip arasındaki fark iş akışına bağlı. Bu rehber, görseldan videoya yapay zeka iş akışını başından sonuna ele alıyor — görsel hazırlığı, model seçimi, prompting, ayarlar ve dışa aktarma — tek bir kare kullanılabilir klip elde etmeniz için, tahminlere kredi harcamadan.

Bu rehber, sinematografi dilinin kendisine odaklanan yapay zeka video üreticilerine nasıl prompt yazılır yazımızın pratik, uçtan uca tamamlayıcısıdır. Burada tüm süreci kuşbakışı ele alıyoruz.

Görseldan Videoya Yapay Zeka Aslında Ne Yapar (ve Ne Yapmaz)

Başlamadan önce anlamanız gereken en işe yarar şey şu: görseldan videoya üretimde, görseliniz ilk karedir. Model sahnenizi sıfırdan yeniden çizmez — size verdiğiniz pikselleri alır ve sonraki birkaç saniyede bunların nasıl hareket etmesi gerektiğini tahmin eder. Çıktıda var olan her şey, girdide zaten var olandan büyür.

Bunun iki önemli sonucu var:

  • Girdi kalitesi sert bir tavandır. Bulanık, düşük çözünürlüklü veya ağır sıkıştırılmış bir görsel, bulanık ve düşük çözünürlüklü bir video üretir — çoğu zaman daha da kötüsünü, çünkü hareket her kusuru büyütür. Model orada olmayan ayrıntıyı icat edemez.
  • Model gördüğünü canlandırır, görmek istediğinizi değil. Özneniz karenin kenarında yarım kalmışsa, "tam vücut dönüşü" isteği işe yaramaz. Model yalnızca önündeki kompozisyonla çalışabilir.

Bu, bir sahneyi kelimelerle tarif ettiğinizde modelin her şeyi — kompozisyon dahil — oluşturduğu metin-to-video (t2v) ile temel farkıdır. Kaba bir kural olarak: zaten tam olarak istediğiniz görsel elinizde olduğunda (belirli bir ürün, gerçek bir yüz, tamamlanmış bir illüstrasyon) ve bunu tam anlamıyla korumak istediğinizde i2v kullanın; sahneyi modelin icat etmesini istediğinizde hâlâ keşfediyorsanız t2v kullanın. Hangi modellerin her birinde öne çıktığını görmek için 2026 yapay zeka video model karşılaştırmamıza bakabilirsiniz.

Oxava'da görseldan videoya üretim, stüdyoda iki modelle çalışır: Kling v3 ve Seedance 2.0. Her ikisi de durağan bir görsel ile birlikte bir hareket promptu alır ve kısa bir klip döndürür. Her birine ne zaman başvurmanız gerektiğini aşağıda ele alacağız.

Adım 1: Girdi Görselinin Hazırlanması

Girdi tavanınız olduğu için bu, çoğu kişinin atladığı ve en çok pişman olduğu adımdır. Buraya iki dakika ayırın, geri kalan iş akışı kolaylaşır.

Çözünürlük. Uzun kenarda en az 1024 piksel hedefleyin; 1K–2K arası en ideal aralıktır. 4K'ya çıkmak nadiren sonucu iyileştirir — çoğu model hareket üretimi için dahili olarak ölçek düşürür, dolayısıyla ekstra ayrıntıyı boşa harcarsınız. Kaynağınız ~1024 pikselin altındaysa önce büyütme yapın (Adım 5'te daha fazla bilgi var).

Format. PNG veya yüksek kaliteli JPEG kullanın. Küçük, ağır sıkıştırılmış JPEG olarak kaydedilmiş ekran görüntülerinden kaçının — durağan bir karede neredeyse görünmeyen sıkıştırma artifaktları, kare hareket etmeye başladığında sürünen ve titreyen gürültüye dönüşür.

Kompozisyon. Öznenizi kenarlarda biraz nefes alanı bırakarak kabaca ortada tutun. Modeller karenin merkezini en güvenilir biçimde canlandırır; kenar kırpmaları, fiziksel olarak mümkün olan hareket türünü sınırlar.

Işık. Yumuşak, eşit ışık temiz canlanır. Keskin kenarlı sert gölgeler, model hareketi interpole ederken titreme ya da bulanıklığa yol açar; çünkü nesneler kayarken gölgede gizli olanı tahmin etmek zorunda kalır.

Arka plan. Sade olan daha güvenlidir. Temiz veya sığ bir derinlikli arka plan, modelin yanlış yapacağı rekabet eden öğeleri azaltır; kalabalık ve dağınık sahneler bozulma ve kayma artifaktlarını davet eder.

En-boy oranı. Bunu şimdi kilitleyin, üretmeden önce. Son videonuzun Reels için 9:16 olması gerekiyorsa 9:16 bir görsel hazırlayın — 16:9 bir klibi sonradan kırpmak çözünürlük kaybına ve çoğu zaman kompozisyonu mahvetmeye neden olur.

Yüzler ve küçük metin. Bir yüz önemliyse tam görünür ve keskin odakta olduğundan emin olun. Ve şunu bilin: küçük metin — logolar, etiketler, altyazılar — animasyon sırasında bozulma eğilimindedir; görseliniz bunları içeriyorsa negatif promptunuzdaki bir kısıtlama ("metin bozulması yok, etiketi sabit tut") yardımcı olur; ama en güvenilir çözüm kritik metni hareketli alandan uzak tutmaktır.

Adım 2: Model ve Mod Seçimi

Oxava'daki iki modelin farklı karakterleri var; modeli görsel türünüze göre eşleştirmek yeniden üretim sayısını azaltır.

Kling v3, 1080p'ye kadar çıktı üretir ve güçlü karakter tutarlılığı ile çok çekimli harekette özneyi sabit tutma kapasitesiyle tanınır. İnsanlar, ürünler ve klip boyunca öznenin tanınabilir biçimde kendisi kalması gereken her şey için güvenilir bir seçimdir.

Seedance 2.0, çoklu referans iş akışlarına yönelik tasarlanmıştır — birden fazla referans girdisi alabilir ve belirli bir öğeyi tutarlı kılmak için nesne kilidi uygulayabilir. Birden fazla görsel öğeyi birleştirirken veya sabitlerken bu özellik öne çıkar.

Görsel türünden mantıklı bir başlangıç modeline hızlı bir harita:

Görsel türü Önerilen model Neden
Portre / insan Kling v3 Güçlü karakter + yüz tutarlılığı
Ürün (tek nesne) Kling v3 veya Seedance 2.0 Her ikisi de nesneyi tutar; Seedance referans kilidi ekler
İllüstrasyon / yapay zeka sanatı Kling v3 Gerçekçiliğe zorlamadan stilize görünümü korur
Manzara / ortam Her ikisi Affedici konu; her ikisi de ambiyans hareketini iyi yönetir
Çoklu referans sahnesi Seedance 2.0 Birden fazla referans + nesne kilidi için tasarlanmış

Kalite modu. Çoğu model Standart ve Profesyonel (veya daha yüksek) mod sunar. Profesyonel mod daha temiz ayrıntı ve daha istikrarlı hareket üretir, ancak daha fazla kredi harcar. Verimli alışkanlık: promptunuzu ve ayarlarınızı doğrulamak için Standart modda prototip oluşturun, ardından en iyi versiyonu Profesyonel modda yeniden çalıştırın. Zaten atacağınız bir kare için premium mod ücreti ödemenin anlamı yok.

Karar vermeden önce yetenekler ve maliyetler üzerine ayrıntılı bir karşılaştırma istiyorsanız model karşılaştırma yazımız daha derine iniyor.

Adım 3: Yalnızca Hareketi Anlatan Prompt Yazmak

Görseldan videoya prompting'in görsel prompting'den keskin biçimde ayrıştığı yer burasıdır ve en sık gördüğümüz hata da budur. Görselin içeriğini yeniden tarif etmenize gerek yok. Modelin zaten resmi var — bu ilk kare. Özneyi yeniden tanımlamak ("beyaz arka planda kırmızı bir spor ayakkabı") promptu boşa harcar ve hatta modeli sahneyi yeniden üretmeye çalışırken şaşırtabilir. Yalnızca hareketi anlatın.

Seedance 2.0 için, apiyi'nin Seedance 2.0 prompt referansı gibi kılavuzlarda aktarılan, model belgelerinin etrafında oluşan altı bölümlü bir yapı takip etmeye değer:

  1. Subject — kimin/neyin hareket ettiği (kısaca)
  2. Action — ana hareket
  3. Environment — çevrenin nasıl tepki verdiği
  4. Camera — tek bir ana kamera komutu
  5. Style — ruh hali/tempo ipuçları
  6. Constraints — kaçınılacaklar

Aynı kaynak, bunu yaklaşık 60–100 kelimede tutmayı ve tek bir ana kamera hareketi vermeyi önerir — bir prompta üç kamera komutu üst üste koymak, kaotik ve kaygan görüntülerin en hızlı yoludur.

Kling v3 için de benzer bir mantık geçerlidir; VicSee'nin Kling 3.0 prompt kılavuzunda belirtildiği biçimiyle: eylem için dinamik bir fiil + net bir kamera tekniği + öğelerin nasıl etkileşime girdiği. En güçlü fiille başlayın, ardından kamerayı belirtin.

Yapay zekanın ne kadar güvenilir sonuç verdiğine göre sıralanmış pratik kamera hareketi sözcüğü:

  • Kolay (yüksek başarı oranı): slow push-in, gentle pan left/right, static locked shot, slow zoom-out.
  • Orta: tracking shot, dolly forward, slow orbit around the subject.
  • Zor (yeniden üretim bekleyin): handheld shake, walking POV, birden fazla hareketi aynı anda birleştiren complex multi-axis moves.

Şüpheye düştüğünüzde kolay bir hareket seçin. Temiz bir slow push-in, bozuk bir orbit'ten her zaman daha iyidir.

Hareket yoğunluğu önemlidir. Çok fazla hareket istemek — bir kişinin kamera etrafında dönerken ve arka plan dönerken üç şey yaptığı — modeli aşırı yükler. Klip başına tek bir ana eylem ve tek bir kamera hareketi tutun.

Olağan başarısızlık modlarını kapsayan yeniden kullanılabilir bir negatif prompt şablonu:

distortion, warping, melting, extra limbs, deformed hands, flickering, text artifacts, sudden cuts, morphing

Ve tek bir atımdan fazlası için zaman damgalı beat yapısı, modelin kendisini zamanlamasına yardımcı olur — örneğin "0–2s: özne dönmeye başlar; 2–4s: kamera push-in yapar; 4–5s: özne yerleşir, bakışını tutar." Sinematik prompting rehberimiz bu zamansal dili çok daha ayrıntılı ele alıyor.

Adım 4: Süre, Çözünürlük ve En-Boy Oranı Ayarları

Ayarlar paneli sessiz sedasız klibin başarısına karar verir. Süreyi istediğinizin karmaşıklığıyla eşleştirin:

Süre En iyi kullanım
3–5 sn Tek bir eylem veya temiz bir döngü (push-in, ürün rotasyonu, rüzgarda saç)
6–8 sn İki aşamalı sekans (dönüş, ardından tepki; açılış, ardından yerleşme)
9–12 sn Karmaşık çok adımlı hareket — daha yüksek risk, daha fazla yeniden üretim

Sezgiye aykırı bir gerçek: daha uzun daha iyi değildir. Tek bir üretimden ne kadar çok saniye isterseniz, modelin kayma, bozulma ya da özneyi kaybetme ihtimali o kadar artar. Daha uzun bir final video için, bir mükemmel on iki saniyelik kare için savaşmak yerine, birkaç kısa ve temiz klip üretip düzenlemede birleştirin.

En-boy oranı hedefinize göre belirlenir:

Platform Oran
Web sitesi / YouTube 16:9
Reels / TikTok / Shorts / Hikayeler 9:16
Instagram feed 4:5 veya 1:1
LinkedIn 1:1 veya 16:9

Adım 1'de hazırladığınız görselle eşleşecek şekilde ayarlayın.

Çözünürlük ve kredi verimliliği. Hareketi ve çerçevelemeyi doğrulamak için önce Standart çözünürlükte test edin, ardından beğendiğiniz versiyonu Profesyonel/yüksek çözünürlükte yeniden üretin. Tüm iş akışındaki en büyük kredi tasarrufu budur.

Adım 5: Görsel Türüne Göre Değişenler

Genel bir iş akışının işe yaramaya başladığı yer burasıdır — bir portre ile bir manzara gerçekten farklı bir yaklaşım gerektirir. Görselin içeriğine göre her adımı nasıl uyarlayacağınız aşağıda.

Ürün fotoğrafları. Arka planı temiz tutun ve ürünün kendisinin bozulmasını istemek yerine harekete dayalı promptlara yaslanın (yavaş rotasyon, parallax, yumuşak bir kamera itiş). Seedance 2.0'ın nesne kilidi, ürünün şeklini ve etiketini sabit tutmaya yardımcı olur. Dikkat çekici sosyal medya içeriği istiyorsanız, yüzen ürün video efekti en yüksek performans gösteren formatlardan biri — havada asılı, yavaş bir orbit ile. Ürün videosu kendi başına derin bir konu olduğundan, hero-shot çerçeveleme ve reklama hazır çıktı dahil tüm süreci ürün fotoğraflarını videoya dönüştürme rehberimize koyduk.

İllüstrasyon ve yapay zeka sanatı. Gerçekçi fizik beklentinizi düşürün — stilize sanat gerçek dünya gibi hareket etmez; fotorealist hareket zorlamak kaynakla çatışır. Bunun yerine stili kilitleyin ve atmosferik hareket isteyin: kayan bulutlar, titreyen ışık, hafif bir parallax, rüzgarda saç veya kumaş. Bunlar illüstrasyonu hayata geçirir, görünümünü bozmadan.

Portreler. Burada Profesyonel modu kullanın — yüzler affetmez. Modeliniz öğe bağlama veya yüz/kimlik kilidi destekliyorsa etkinleştirin. El animasyonu konusunda dikkatli olun: eller, yapay zeka videosunda en yüksek riskli öğedir; öznenin jest yapması veya nesne tutması yerine kafa dönüşleri, ifade değişimleri ve hafif kamera hareketlerini tercih edin. Tam konuşan kafa, lip-sync çıktı istiyorsanız bu farklı bir kanal — yapay zeka avatarlarıyla UGC tarzı ürün videoları rehberimize bakın.

Manzara ve ortamlar. En affedici kategori. Bozulacak yüz veya el yok, bu yüzden hırslı olabilirsiniz: katmanlar arasında parallax, hareketli ışık ve gölge, su dalgalanmaları, yapraklar arasında rüzgar, sürüklenen sis. Ambiyans hareketi harika görünür ve nadiren bozulur.

Düşük çözünürlüklü girdiler. Canlandırmayın — önce büyütün. Hareket, küçük bir görseldeki yumuşaklığı ve artifaktları büyütür; bu yüzden i2v öncesinde hızlı bir büyütme sonucu dramatik biçimde iyileştirir. Görsel büyütme rehberimiz, video için temiz ve yüksek çözünürlüklü bir girdi hazırlamayı ele alıyor.

Adım 6: Kalite Kontrol Listesi ve Yaygın Hatalar

"Yapay zeka kötü" hayal kırıklığının büyük çoğunluğu aslında düzeltilebilir bir girdi ya da ayar sorunudur. En sık gördüğümüz başarısızlıklar ve nedenleri:

Belirti Olası neden Çözüm
Arka plan bozulması / kayması Kalabalık girdi görseli Daha temiz, sade bir arka plan kullanın
Özne yanlış şey yapıyor Belirsiz hareket promptu Tek net eylem fiili + tek kamera hareketi kullanın
Kırpma / siyah şerit Uyumsuz en-boy oranı Görsel ve çıktı oranını eşleştirin
Kaotik, sarsıntılı hareket Çok fazla eş zamanlı hareket Klip başına tek ana eylem
Yumuşak, belirsiz çıktı Düşük çözünürlüklü girdi Üretmeden önce büyütün
Özne yeniden üretiliyor / dönüşüyor Görsel içeriğini yeniden tarif etmek Yalnızca hareketi anlatan prompt yazın
Uzun çekimlerde kayma Tek klip çok uzun Daha kısa kliplere bölün

Üretmeden önce kısa bir ön kontrol:

  • Girdi ≥1024px, temiz format, ağır sıkıştırma yok
  • Özne kenar nefes alanıyla birlikte ortalanmış
  • En-boy oranı hedef platformla eşleşiyor
  • Prompt yalnızca hareketi anlatıyor — tek eylem, tek kamera hareketi
  • Negatif prompt bozulma/deformasyon içeriyor

Ürettikten sonra şunlar için gözden geçirin:

  • Yüz kararlılığı — yüz klip boyunca tutarlı ve tanınabilir kalıyor mu?
  • El bütünlüğü — ekstra parmak, erime veya dönüşme var mı?
  • Fizik — hareket, özne için makul görünüyor mu?
  • Logo / metin — etiketler veya kelimeler okunabilir kalıyor mu?
  • Döngü — döngü amaçlıysa son kare ilk kareye temiz dönüyor mu?

Bir kare bu kontrollerden birini geçemezse her şeyi yeniden yazmak yerine tek bir değişkeni değiştirip yeniden üretin — modelin neye tepki verdiğini bu şekilde öğrenirsiniz.

Adım 7: Dışa Aktarma ve Post-Prodüksiyon

Ham bir yapay zeka klibi nadiren bitmiş üründür — onu güçlü ham görüntü olarak ele alın, final kurgu olarak değil.

  • Zayıf kareleri kırpın. Yapay zeka klipleri, hareket rampa yaparken çoğu zaman yumuşak bir ilk veya son yarım saniyeye sahiptir. Bunları kırpın; klipler daha dinamik hale gelir.
  • Modelin ekleyemediği katmanı ekleyin. Altyazılar, seslendirme ve müzik, özellikle çoğu insanın sessiz izlediği sosyal platformlarda etkileşim açısından büyük iş yapar.
  • Platformun temposuna uyun. Web sitesinde yavaş hissettiren bir klip, hızlı döngülü bir Reel olarak mükemmel gelebilir. Platforma göre kurgulayın.
  • Marka kimliğini ekleyin. Modelin içine gömmesini ummak yerine logonuzu, renklerinizi veya kapanış kartınızı düzenlemede ekleyin.
  • Doğru codec'i seçin. MP4 / H.264 evrensel, her yere yüklenebilir seçimdir. Daha yoğun düzenleme yapıyorsanız ProRes süreç boyunca daha fazla kalite korur.

Oxava'da oluşturulan klipleri stüdyodan doğrudan indirebilir, istediğiniz editöre alıp kurguyu bitirebilirsiniz.

Sıkça Sorulan Sorular

Görseldan videoya için uzun ve ayrıntılı bir prompt gerekiyor mu? Hayır — üstelik uzun bir prompt zararlı bile olabilir. Görseliniz zaten ilk kare olduğundan, yalnızca hareketi anlatmanız gerekiyor: tek net bir eylem ve tek kamera hareketi. Odaklanmış 60–100 kelimelik bir hareket promptu, sahnedeki her şeyi yeniden tarif eden dağınık bir prompttan genellikle daha iyi sonuç verir.

Yüzlerim ve ellerim sürekli bozuluyor. Ne yapmalıyım? Yüzler ve eller, herhangi bir yapay zeka video modeli için en zorlu öğelerdir. Daha yüksek kalite modu (Profesyonel) kullanın, modelinizin sunduğu yüz/kimlik kilidini etkinleştirin ve negatif promptunuza "deformed hands, extra fingers, face warping" ekleyin. Ama en güvenilir çözüm, el ağırlıklı hareketten tamamen kaçınmaktır — el hareketleri yerine kafa dönüşleri, ifade değişimleri ve kamera hareketlerini tercih edin.

Klibim ne kadar uzun olmalı? Tek bir eylem veya döngü için 3–5 saniye idealdir. İki aşamalı bir sekans için 6–8 saniye. Tek bir üretimde bunun ötesine geçmek kayma ve bozulma ihtimalini artırır — daha uzun videolar için birkaç kısa, temiz klibi düzenlemede birleştirin.

Sadece fotoğrafları değil, illüstrasyon veya yapay zeka sanatını da canlandırabilir miyim? Evet. İllüstrasyon ve yapay zeka sanatı, gerçek dünya fiziği beklentisi taşımadığınız sürece iyi canlanır. Stili kilitleyin ve atmosferik hareket isteyin — süzülen ışık, parallax, hafif bir esinti — karmaşık gerçekçi hareket yerine. Stilize görünüm korunur ve sahne hayat bulur.

Kling v3 mü, Seedance 2.0 mu — hangisini seçmeliyim? Portreler ve karakter tutarlı hareket için Kling v3 ile başlayın. Çoklu referans sahneleri veya belirli bir nesnenin görünümünü kilitlemeniz gerektiğinde Seedance 2.0 bunun için tasarlanmıştır. Tek özneli kliplerin çoğunda her ikisi de işe yarar; görsel türünüze uyan modeliyle prototip oluşturun. Model karşılaştırmamız değiş tokuşları ayrıntılı biçimde ele alıyor.

Görselinizi Hayata Geçirin

Yapay zekayla bir görseli videoya dönüştürmeyi öğrenmek, sihirli bir prompt bulmak değil — tekrarlanabilir bir görseldan videoya yapay zeka iş akışıdır: temiz, yüksek çözünürlüklü bir girdi hazırlayın; görsel türünüze uyan modeli seçin; tek eylem ve tek kamera hareketiyle yalnızca hareketi anlatan bir prompt yazın; platformunuz için süre ve en-boy oranını ayarlayın; ve klibi düzenlemede bitirin. Bu adımları doğru yapın, geri kalanını model halleder.

Daha ileri gitmek için sinematik prompting rehberimiz zamansal ve kamera dilini derinlemesine ele alıyor; yapay zeka video model karşılaştırmamız ise her proje için doğru modeli seçmenize yardımcı oluyor.

Görselinizi canlandırmaya hazır mısınız? Oxava stüdyosunu açın, görselinizi yükleyin, Kling v3 veya Seedance 2.0 seçin ve ilk klibi üretin. Sevdiğiniz hareketi bulmak için Standart modda başlayın, ardından final dışa aktarma için Profesyonel modda yeniden çalıştırın — tek bir durağan kareden cilalı bir videoya ulaşmış olacaksınız.

KURUCU & YAZAR

Egemen Küpçü

Egemen Küpçü, Oxava'nın kurucusu; 3D ve görsel prodüksiyonda 10+ yıl saha deneyimine sahip. Yapay zekâ ile ürün, marka ve kampanya görselleri üretmenin zanaatı üzerine yazıyor.

Bültenimize abone ol

Yeni teknikler, model güncellemeleri ve yapay zekâ üretimine dair fikirleri ilk öğrenenlerden ol.