
Elinizde sevdiğiniz bir görsel var — bir ürün fotoğrafı, bir portre, bir illüstrasyon, bir manzara — ve onu hareket ettirmek istiyorsunuz. Yapay zekayla bir görseli videoya dönüştürmek, artık bir içerik üreticisinin sahip olabileceği en değerli becerilerden biri: modele durağan bir kare veriyorsunuz, istediğiniz hareketi anlatıyorsunuz ve model sahneyi canlandırıyor. Ama büyülü görünen bir kliple eriyen bir kabusu andıran bir klip arasındaki fark iş akışına bağlı. Bu rehber, görseldan videoya yapay zeka iş akışını başından sonuna ele alıyor — görsel hazırlığı, model seçimi, prompting, ayarlar ve dışa aktarma — tek bir kare kullanılabilir klip elde etmeniz için, tahminlere kredi harcamadan.
Bu rehber, sinematografi dilinin kendisine odaklanan yapay zeka video üreticilerine nasıl prompt yazılır yazımızın pratik, uçtan uca tamamlayıcısıdır. Burada tüm süreci kuşbakışı ele alıyoruz.
Başlamadan önce anlamanız gereken en işe yarar şey şu: görseldan videoya üretimde, görseliniz ilk karedir. Model sahnenizi sıfırdan yeniden çizmez — size verdiğiniz pikselleri alır ve sonraki birkaç saniyede bunların nasıl hareket etmesi gerektiğini tahmin eder. Çıktıda var olan her şey, girdide zaten var olandan büyür.
Bunun iki önemli sonucu var:
Bu, bir sahneyi kelimelerle tarif ettiğinizde modelin her şeyi — kompozisyon dahil — oluşturduğu metin-to-video (t2v) ile temel farkıdır. Kaba bir kural olarak: zaten tam olarak istediğiniz görsel elinizde olduğunda (belirli bir ürün, gerçek bir yüz, tamamlanmış bir illüstrasyon) ve bunu tam anlamıyla korumak istediğinizde i2v kullanın; sahneyi modelin icat etmesini istediğinizde hâlâ keşfediyorsanız t2v kullanın. Hangi modellerin her birinde öne çıktığını görmek için 2026 yapay zeka video model karşılaştırmamıza bakabilirsiniz.
Oxava'da görseldan videoya üretim, stüdyoda iki modelle çalışır: Kling v3 ve Seedance 2.0. Her ikisi de durağan bir görsel ile birlikte bir hareket promptu alır ve kısa bir klip döndürür. Her birine ne zaman başvurmanız gerektiğini aşağıda ele alacağız.
Girdi tavanınız olduğu için bu, çoğu kişinin atladığı ve en çok pişman olduğu adımdır. Buraya iki dakika ayırın, geri kalan iş akışı kolaylaşır.
Çözünürlük. Uzun kenarda en az 1024 piksel hedefleyin; 1K–2K arası en ideal aralıktır. 4K'ya çıkmak nadiren sonucu iyileştirir — çoğu model hareket üretimi için dahili olarak ölçek düşürür, dolayısıyla ekstra ayrıntıyı boşa harcarsınız. Kaynağınız ~1024 pikselin altındaysa önce büyütme yapın (Adım 5'te daha fazla bilgi var).
Format. PNG veya yüksek kaliteli JPEG kullanın. Küçük, ağır sıkıştırılmış JPEG olarak kaydedilmiş ekran görüntülerinden kaçının — durağan bir karede neredeyse görünmeyen sıkıştırma artifaktları, kare hareket etmeye başladığında sürünen ve titreyen gürültüye dönüşür.
Kompozisyon. Öznenizi kenarlarda biraz nefes alanı bırakarak kabaca ortada tutun. Modeller karenin merkezini en güvenilir biçimde canlandırır; kenar kırpmaları, fiziksel olarak mümkün olan hareket türünü sınırlar.
Işık. Yumuşak, eşit ışık temiz canlanır. Keskin kenarlı sert gölgeler, model hareketi interpole ederken titreme ya da bulanıklığa yol açar; çünkü nesneler kayarken gölgede gizli olanı tahmin etmek zorunda kalır.
Arka plan. Sade olan daha güvenlidir. Temiz veya sığ bir derinlikli arka plan, modelin yanlış yapacağı rekabet eden öğeleri azaltır; kalabalık ve dağınık sahneler bozulma ve kayma artifaktlarını davet eder.
En-boy oranı. Bunu şimdi kilitleyin, üretmeden önce. Son videonuzun Reels için 9:16 olması gerekiyorsa 9:16 bir görsel hazırlayın — 16:9 bir klibi sonradan kırpmak çözünürlük kaybına ve çoğu zaman kompozisyonu mahvetmeye neden olur.
Yüzler ve küçük metin. Bir yüz önemliyse tam görünür ve keskin odakta olduğundan emin olun. Ve şunu bilin: küçük metin — logolar, etiketler, altyazılar — animasyon sırasında bozulma eğilimindedir; görseliniz bunları içeriyorsa negatif promptunuzdaki bir kısıtlama ("metin bozulması yok, etiketi sabit tut") yardımcı olur; ama en güvenilir çözüm kritik metni hareketli alandan uzak tutmaktır.
Oxava'daki iki modelin farklı karakterleri var; modeli görsel türünüze göre eşleştirmek yeniden üretim sayısını azaltır.
Kling v3, 1080p'ye kadar çıktı üretir ve güçlü karakter tutarlılığı ile çok çekimli harekette özneyi sabit tutma kapasitesiyle tanınır. İnsanlar, ürünler ve klip boyunca öznenin tanınabilir biçimde kendisi kalması gereken her şey için güvenilir bir seçimdir.
Seedance 2.0, çoklu referans iş akışlarına yönelik tasarlanmıştır — birden fazla referans girdisi alabilir ve belirli bir öğeyi tutarlı kılmak için nesne kilidi uygulayabilir. Birden fazla görsel öğeyi birleştirirken veya sabitlerken bu özellik öne çıkar.
Görsel türünden mantıklı bir başlangıç modeline hızlı bir harita:
| Görsel türü | Önerilen model | Neden |
|---|---|---|
| Portre / insan | Kling v3 | Güçlü karakter + yüz tutarlılığı |
| Ürün (tek nesne) | Kling v3 veya Seedance 2.0 | Her ikisi de nesneyi tutar; Seedance referans kilidi ekler |
| İllüstrasyon / yapay zeka sanatı | Kling v3 | Gerçekçiliğe zorlamadan stilize görünümü korur |
| Manzara / ortam | Her ikisi | Affedici konu; her ikisi de ambiyans hareketini iyi yönetir |
| Çoklu referans sahnesi | Seedance 2.0 | Birden fazla referans + nesne kilidi için tasarlanmış |
Kalite modu. Çoğu model Standart ve Profesyonel (veya daha yüksek) mod sunar. Profesyonel mod daha temiz ayrıntı ve daha istikrarlı hareket üretir, ancak daha fazla kredi harcar. Verimli alışkanlık: promptunuzu ve ayarlarınızı doğrulamak için Standart modda prototip oluşturun, ardından en iyi versiyonu Profesyonel modda yeniden çalıştırın. Zaten atacağınız bir kare için premium mod ücreti ödemenin anlamı yok.
Karar vermeden önce yetenekler ve maliyetler üzerine ayrıntılı bir karşılaştırma istiyorsanız model karşılaştırma yazımız daha derine iniyor.
Görseldan videoya prompting'in görsel prompting'den keskin biçimde ayrıştığı yer burasıdır ve en sık gördüğümüz hata da budur. Görselin içeriğini yeniden tarif etmenize gerek yok. Modelin zaten resmi var — bu ilk kare. Özneyi yeniden tanımlamak ("beyaz arka planda kırmızı bir spor ayakkabı") promptu boşa harcar ve hatta modeli sahneyi yeniden üretmeye çalışırken şaşırtabilir. Yalnızca hareketi anlatın.
Seedance 2.0 için, apiyi'nin Seedance 2.0 prompt referansı gibi kılavuzlarda aktarılan, model belgelerinin etrafında oluşan altı bölümlü bir yapı takip etmeye değer:
Aynı kaynak, bunu yaklaşık 60–100 kelimede tutmayı ve tek bir ana kamera hareketi vermeyi önerir — bir prompta üç kamera komutu üst üste koymak, kaotik ve kaygan görüntülerin en hızlı yoludur.
Kling v3 için de benzer bir mantık geçerlidir; VicSee'nin Kling 3.0 prompt kılavuzunda belirtildiği biçimiyle: eylem için dinamik bir fiil + net bir kamera tekniği + öğelerin nasıl etkileşime girdiği. En güçlü fiille başlayın, ardından kamerayı belirtin.
Yapay zekanın ne kadar güvenilir sonuç verdiğine göre sıralanmış pratik kamera hareketi sözcüğü:
Şüpheye düştüğünüzde kolay bir hareket seçin. Temiz bir slow push-in, bozuk bir orbit'ten her zaman daha iyidir.
Hareket yoğunluğu önemlidir. Çok fazla hareket istemek — bir kişinin kamera etrafında dönerken ve arka plan dönerken üç şey yaptığı — modeli aşırı yükler. Klip başına tek bir ana eylem ve tek bir kamera hareketi tutun.
Olağan başarısızlık modlarını kapsayan yeniden kullanılabilir bir negatif prompt şablonu:
distortion, warping, melting, extra limbs, deformed hands, flickering, text artifacts, sudden cuts, morphing
Ve tek bir atımdan fazlası için zaman damgalı beat yapısı, modelin kendisini zamanlamasına yardımcı olur — örneğin "0–2s: özne dönmeye başlar; 2–4s: kamera push-in yapar; 4–5s: özne yerleşir, bakışını tutar." Sinematik prompting rehberimiz bu zamansal dili çok daha ayrıntılı ele alıyor.
Ayarlar paneli sessiz sedasız klibin başarısına karar verir. Süreyi istediğinizin karmaşıklığıyla eşleştirin:
| Süre | En iyi kullanım |
|---|---|
| 3–5 sn | Tek bir eylem veya temiz bir döngü (push-in, ürün rotasyonu, rüzgarda saç) |
| 6–8 sn | İki aşamalı sekans (dönüş, ardından tepki; açılış, ardından yerleşme) |
| 9–12 sn | Karmaşık çok adımlı hareket — daha yüksek risk, daha fazla yeniden üretim |
Sezgiye aykırı bir gerçek: daha uzun daha iyi değildir. Tek bir üretimden ne kadar çok saniye isterseniz, modelin kayma, bozulma ya da özneyi kaybetme ihtimali o kadar artar. Daha uzun bir final video için, bir mükemmel on iki saniyelik kare için savaşmak yerine, birkaç kısa ve temiz klip üretip düzenlemede birleştirin.
En-boy oranı hedefinize göre belirlenir:
| Platform | Oran |
|---|---|
| Web sitesi / YouTube | 16:9 |
| Reels / TikTok / Shorts / Hikayeler | 9:16 |
| Instagram feed | 4:5 veya 1:1 |
| 1:1 veya 16:9 |
Adım 1'de hazırladığınız görselle eşleşecek şekilde ayarlayın.
Çözünürlük ve kredi verimliliği. Hareketi ve çerçevelemeyi doğrulamak için önce Standart çözünürlükte test edin, ardından beğendiğiniz versiyonu Profesyonel/yüksek çözünürlükte yeniden üretin. Tüm iş akışındaki en büyük kredi tasarrufu budur.
Genel bir iş akışının işe yaramaya başladığı yer burasıdır — bir portre ile bir manzara gerçekten farklı bir yaklaşım gerektirir. Görselin içeriğine göre her adımı nasıl uyarlayacağınız aşağıda.
Ürün fotoğrafları. Arka planı temiz tutun ve ürünün kendisinin bozulmasını istemek yerine harekete dayalı promptlara yaslanın (yavaş rotasyon, parallax, yumuşak bir kamera itiş). Seedance 2.0'ın nesne kilidi, ürünün şeklini ve etiketini sabit tutmaya yardımcı olur. Dikkat çekici sosyal medya içeriği istiyorsanız, yüzen ürün video efekti en yüksek performans gösteren formatlardan biri — havada asılı, yavaş bir orbit ile. Ürün videosu kendi başına derin bir konu olduğundan, hero-shot çerçeveleme ve reklama hazır çıktı dahil tüm süreci ürün fotoğraflarını videoya dönüştürme rehberimize koyduk.
İllüstrasyon ve yapay zeka sanatı. Gerçekçi fizik beklentinizi düşürün — stilize sanat gerçek dünya gibi hareket etmez; fotorealist hareket zorlamak kaynakla çatışır. Bunun yerine stili kilitleyin ve atmosferik hareket isteyin: kayan bulutlar, titreyen ışık, hafif bir parallax, rüzgarda saç veya kumaş. Bunlar illüstrasyonu hayata geçirir, görünümünü bozmadan.
Portreler. Burada Profesyonel modu kullanın — yüzler affetmez. Modeliniz öğe bağlama veya yüz/kimlik kilidi destekliyorsa etkinleştirin. El animasyonu konusunda dikkatli olun: eller, yapay zeka videosunda en yüksek riskli öğedir; öznenin jest yapması veya nesne tutması yerine kafa dönüşleri, ifade değişimleri ve hafif kamera hareketlerini tercih edin. Tam konuşan kafa, lip-sync çıktı istiyorsanız bu farklı bir kanal — yapay zeka avatarlarıyla UGC tarzı ürün videoları rehberimize bakın.
Manzara ve ortamlar. En affedici kategori. Bozulacak yüz veya el yok, bu yüzden hırslı olabilirsiniz: katmanlar arasında parallax, hareketli ışık ve gölge, su dalgalanmaları, yapraklar arasında rüzgar, sürüklenen sis. Ambiyans hareketi harika görünür ve nadiren bozulur.
Düşük çözünürlüklü girdiler. Canlandırmayın — önce büyütün. Hareket, küçük bir görseldeki yumuşaklığı ve artifaktları büyütür; bu yüzden i2v öncesinde hızlı bir büyütme sonucu dramatik biçimde iyileştirir. Görsel büyütme rehberimiz, video için temiz ve yüksek çözünürlüklü bir girdi hazırlamayı ele alıyor.
"Yapay zeka kötü" hayal kırıklığının büyük çoğunluğu aslında düzeltilebilir bir girdi ya da ayar sorunudur. En sık gördüğümüz başarısızlıklar ve nedenleri:
| Belirti | Olası neden | Çözüm |
|---|---|---|
| Arka plan bozulması / kayması | Kalabalık girdi görseli | Daha temiz, sade bir arka plan kullanın |
| Özne yanlış şey yapıyor | Belirsiz hareket promptu | Tek net eylem fiili + tek kamera hareketi kullanın |
| Kırpma / siyah şerit | Uyumsuz en-boy oranı | Görsel ve çıktı oranını eşleştirin |
| Kaotik, sarsıntılı hareket | Çok fazla eş zamanlı hareket | Klip başına tek ana eylem |
| Yumuşak, belirsiz çıktı | Düşük çözünürlüklü girdi | Üretmeden önce büyütün |
| Özne yeniden üretiliyor / dönüşüyor | Görsel içeriğini yeniden tarif etmek | Yalnızca hareketi anlatan prompt yazın |
| Uzun çekimlerde kayma | Tek klip çok uzun | Daha kısa kliplere bölün |
Üretmeden önce kısa bir ön kontrol:
Ürettikten sonra şunlar için gözden geçirin:
Bir kare bu kontrollerden birini geçemezse her şeyi yeniden yazmak yerine tek bir değişkeni değiştirip yeniden üretin — modelin neye tepki verdiğini bu şekilde öğrenirsiniz.
Ham bir yapay zeka klibi nadiren bitmiş üründür — onu güçlü ham görüntü olarak ele alın, final kurgu olarak değil.
Oxava'da oluşturulan klipleri stüdyodan doğrudan indirebilir, istediğiniz editöre alıp kurguyu bitirebilirsiniz.
Görseldan videoya için uzun ve ayrıntılı bir prompt gerekiyor mu? Hayır — üstelik uzun bir prompt zararlı bile olabilir. Görseliniz zaten ilk kare olduğundan, yalnızca hareketi anlatmanız gerekiyor: tek net bir eylem ve tek kamera hareketi. Odaklanmış 60–100 kelimelik bir hareket promptu, sahnedeki her şeyi yeniden tarif eden dağınık bir prompttan genellikle daha iyi sonuç verir.
Yüzlerim ve ellerim sürekli bozuluyor. Ne yapmalıyım? Yüzler ve eller, herhangi bir yapay zeka video modeli için en zorlu öğelerdir. Daha yüksek kalite modu (Profesyonel) kullanın, modelinizin sunduğu yüz/kimlik kilidini etkinleştirin ve negatif promptunuza "deformed hands, extra fingers, face warping" ekleyin. Ama en güvenilir çözüm, el ağırlıklı hareketten tamamen kaçınmaktır — el hareketleri yerine kafa dönüşleri, ifade değişimleri ve kamera hareketlerini tercih edin.
Klibim ne kadar uzun olmalı? Tek bir eylem veya döngü için 3–5 saniye idealdir. İki aşamalı bir sekans için 6–8 saniye. Tek bir üretimde bunun ötesine geçmek kayma ve bozulma ihtimalini artırır — daha uzun videolar için birkaç kısa, temiz klibi düzenlemede birleştirin.
Sadece fotoğrafları değil, illüstrasyon veya yapay zeka sanatını da canlandırabilir miyim? Evet. İllüstrasyon ve yapay zeka sanatı, gerçek dünya fiziği beklentisi taşımadığınız sürece iyi canlanır. Stili kilitleyin ve atmosferik hareket isteyin — süzülen ışık, parallax, hafif bir esinti — karmaşık gerçekçi hareket yerine. Stilize görünüm korunur ve sahne hayat bulur.
Kling v3 mü, Seedance 2.0 mu — hangisini seçmeliyim? Portreler ve karakter tutarlı hareket için Kling v3 ile başlayın. Çoklu referans sahneleri veya belirli bir nesnenin görünümünü kilitlemeniz gerektiğinde Seedance 2.0 bunun için tasarlanmıştır. Tek özneli kliplerin çoğunda her ikisi de işe yarar; görsel türünüze uyan modeliyle prototip oluşturun. Model karşılaştırmamız değiş tokuşları ayrıntılı biçimde ele alıyor.
Yapay zekayla bir görseli videoya dönüştürmeyi öğrenmek, sihirli bir prompt bulmak değil — tekrarlanabilir bir görseldan videoya yapay zeka iş akışıdır: temiz, yüksek çözünürlüklü bir girdi hazırlayın; görsel türünüze uyan modeli seçin; tek eylem ve tek kamera hareketiyle yalnızca hareketi anlatan bir prompt yazın; platformunuz için süre ve en-boy oranını ayarlayın; ve klibi düzenlemede bitirin. Bu adımları doğru yapın, geri kalanını model halleder.
Daha ileri gitmek için sinematik prompting rehberimiz zamansal ve kamera dilini derinlemesine ele alıyor; yapay zeka video model karşılaştırmamız ise her proje için doğru modeli seçmenize yardımcı oluyor.
Görselinizi canlandırmaya hazır mısınız? Oxava stüdyosunu açın, görselinizi yükleyin, Kling v3 veya Seedance 2.0 seçin ve ilk klibi üretin. Sevdiğiniz hareketi bulmak için Standart modda başlayın, ardından final dışa aktarma için Profesyonel modda yeniden çalıştırın — tek bir durağan kareden cilalı bir videoya ulaşmış olacaksınız.
Yeni teknikler, model güncellemeleri ve yapay zekâ üretimine dair fikirleri ilk öğrenenlerden ol.