
Her birkaç haftada bir, her şeyi geride bıraktığını iddia eden bir lansman yazısıyla yeni bir video modeli çıkıyor. İlginç olan soru neredeyse hiçbir zaman "en iyisi mi?" değil — "geçen ay yapamadığım neyi şimdi yapabiliyorum?" Bu MiniMax H3 incelemesi, tam olarak o ikinci soru için yazıldı ve bugün üzerine hareket edebileceğiniz bir cevapla geliyor: H3 artık Oxava stüdyosunda canlı.
Kataloğumuzdaki hiçbir başka modelin yapmadığı somut bir şey var. MiniMax H3, Oxava kataloğundaki tek 4K yapay zeka video modeli — 2K ve 4K katmanları, seçicideki diğer tüm modellerin durduğu yerin, yani 1080p veya 720p'nin ötesine geçiyor. Ayrıca tek bir üretimde dokuza kadar görsel referans kabul ediyor ve platformdaki başka hiçbir modelin sunmadığı bir ayarı ortaya çıkarıyor. Ve lansman haberlerinin çoğunun üzerinden geçiştirdiği birkaç yıldız işaretiyle geliyor: manşetin ima ettiğinden daha ince bir arena sonucu, açıklanmaya değer bir "4K" rakamı ve bazı ülkelere diğerlerinden çok farklı davranan bir lisans.
Güncelleme · 27 Ağustos 2026: Bu yazının yayınlanmasından bir gün sonra MiniMax'ın aynı ailedeki üst sürümü H3 Max de Oxava'da canlıya alındı. Yeniden eğitilmiş bu sürüm prompt'a belirgin biçimde daha sadık ve daha hızlı üretiyor — ama aşağıda anlatılan iki özellik yalnız H3'te var: 2K/4K kademeleri ve dokuz görsel referans. Yani biri diğerinin yerine geçmiyor; en yüksek çözünürlük ya da çoklu referans gerekiyorsa H3, prompt'a sadakat ve hız önceliğinizse H3 Max. H3 Max 1 Eylül'e kadar tanıtım fiyatıyla sunuluyor; güncel kredi bedelini stüdyodaki model kartında görebilirsiniz.
İsimlendirmeyle başlayalım, çünkü insanların sürekli kafasını karıştırıyor. Hailuo, MiniMax'ın video ürün hattı. H3 ise onun üçüncü nesli. Aynı model, tüketici haberlerinde "Hailuo 3.0", geliştirici dokümantasyonunda ise "MiniMax H3" olarak karşınıza çıkıyor bu yüzden — tek model, iki etiket. Doğrudan öncülü, 28 Ekim 2025'te yayınlanan Hailuo 2.3. Ve inatçı bir arama-önerisi hayaletini de öldürelim: Hailuo 2.5 diye bir şey yok. Bir yerde geçtiğini gördüyseniz, bu yayınlanmış bir model değil.
Yayına alma süreci hızlı işledi. MiniMax, H3'ü 17 Temmuz 2026'da WAIC'te önizledi,
31 Temmuz 2026'da genel kullanıma açtı ve 3 Ağustos 2026'da MiniMax H3 Community
License adlı bir belge altında Hugging Face'te
(MiniMaxAI/MiniMax-H3) ve ModelScope'ta
açık ağırlıkları yayımladı. Sahne demosundan indirilebilir ağırlıklara üç hafta, öncü bir
video modeli için sıra dışı derecede agresif bir tempo.
Mimari açıdan, MiniMax'ın adlandırdığı dört bileşenden ikisi, modelin alışılmadık özelliklerini açıklıyor. Tokenizer olan H3-VAE, etkin dizi uzunluğunda büyük bir kazanım sağlamakla anılıyor — daha uzun, daha yoğun bağlamı mümkün kılan şey bu, kaynak materyali üretecin gerçekten dikkate alabileceği bir şeye sıkıştıran bir Contextual Omni Representation katmanıyla birlikte. (Üçüncü parça olan H3-Omni Transformer, anlama ile üretim iş yüklerini birbirinden ayırıyor; MiniMax bu ayrımdan uçtan uca eğitim verimliliğinde yaklaşık %30'luk bir kazanım olduğunu iddia ediyor — bu, doğrulanmış bir ölçüm değil, bir tedarikçi iddiası.) Dördüncüsü, In-Context Regeneration, düşük çözünürlüklü bir çıktıyı orijinal çok-modlu bağlama karşı yeniden render ederek ince detayın büyütülme sırasında hayatta kalmasını sağlıyor. Bu sonuncuyu aklınızda tutun — çözünürlük manşetinin dürüst açıklaması bu.
Bu, H3'ün en güçlü somut argümanı, o yüzden konuya kesin olarak girelim.
Oxava'da H3, dört çözünürlük katmanı sunuyor: 480P, 768P, 2K ve 4K. Video kataloğundaki başka hiçbir şey 1080p'nin ötesine geçmiyor — FLUX.3 ve Seedance 2.0 1080p'de tavan yapıyor, geri kalanların çoğu ise 720p'de. Büyük bir ekranda tutan, tam genişlikte render edilmiş bir sunumda kullanılacak ya da kurgu sırasında içine kırpacağınız bir kaynak olarak iş görecek bir klibe ihtiyacınız varsa, sizi oraya götürecek kart bu.
Şimdi yıldız işaretine, doğrudan modelin kendi barındırılan şemasından: 480P ve 768P yerel üretim modları, 2K ve 4K ise bir 768P taban sonucu büyütüyor (upscale). Yani elde ettiğiniz 4K, modelin sıfırdan 4K'da boyadığı bir kare değil, bir 768P render'ın yüksek kaliteli yeniden üretimi — işini yapan o In-Context Regeneration aşaması. Bu, bir kamera orijinaliyle karşılaştırma yapıyorsanız ya da ince doku üzerinde ağır post-prodüksiyon planlıyorsanız önem taşır. Bu, katmanı işe yaramaz kılmıyor: bağlam-farkında bir büyütme, genel amaçlı bir büyütmeden gerçekten daha iyidir ve fazladan pikseller gerçektir. Sadece sihir değil.
Bizim tarafımızda bilinçli bir tercih: kaynak model varsayılanı 2K olsa da, Oxava, H3'ü varsayılan olarak 768P'ye ayarlıyor. Kimsenin ilk üretiminde yanlışlıkla en pahalı katmana düşmesini istemedik. Panel, ayarları değiştirdikçe canlı kredi maliyetini gösteriyor, ve çekimin buna değdiğine karar verdikten sonra bir katman yukarı çıkmak tek tıkla oluyor.
H3 için en çok alıntılanan kanıt, 3 Ağustos 2026'da yayınlanan bir dizi Artificial Analysis arena sıralaması:
| Kategori | H3 sıralaması | Elo | En yakın karşılaştırma |
|---|---|---|---|
| Video düzenleme | #1 | 1130.25 | Gemini Omni Flash — 1121.85 |
| Metinden videoya | #2 | ~1239–1242 | Gemini Omni Flash — ~1244–1245 |
| Görselden videoya | #3 | — | Hem Seedance 2.0 hem Gemini Omni Flash'ın gerisinde |
Kurdeleye değil, şekle bakın. H3'ün net galibiyeti video düzenleme kategorisinde — çok-modlu koşullandırmasının, yalnızca üretim yapan bir modelden yapısal olarak farklı bir şey yaptığı kategori. Metinden videoya'da Gemini Omni Flash'ın birkaç Elo puanı gerisinde oturuyor, ki bu istatistiksel bir yazı-tura, bir yenilgi değil. Görselden videoya'da ise gerçekten geride kalıyor, ve MiniMax'ın hakkını vermek gerekirse şirket bu farkı kendisi de kabul ediyor.
Ve bu rakamların her birine eşlik etmesi gereken uyarı: MiniMax, karşılaştırma setini, örnek sayılarını ya da güven aralıklarını açıklayan sayısal bir kalite tablosu yayınlamadı; bu tek bir üçüncü-taraf arena koşusu, hakemli değil, ve çakışan güven aralıkları kesin bir galibiyet olarak okunmamalı. Bir arena, işinize benzeyebilecek ya da benzemeyebilecek bir prompt karışımı üzerinden insan tercihinin bir anlık görüntüsüdür. Yararlı bir sinyaldir, bir hüküm değil. Burada en çok önem taşıyan karşılaştırma için, Gemini Omni incelememiz, H3'ün bu üç satırın tamamında karşılaştırıldığı modeli ele alıyor.
Açık ağırlıklara göz dikenler için iki dürüst not. Bunlar pazarlamanın ima ettiğinden çok daha büyük: MiniMax, H3'ü "33B" bir model olarak satıyor, ama bağımsız bir inceleme (teardown) tüm çıkarım yığınını yaklaşık 69,2 milyar parametre ve 134+ GiB ağırlık olarak ölçtü — bu bir workstation değil, sunucu-sınıfı bir sorun. Ve lisans, telif hakkıyla ilgili düzenleyici belirsizlik nedeniyle Amerika Birleşik Devletleri, Avrupa Birliği, Birleşik Krallık ve Güney Kore'de yerel dağıtım için resmi izin gerektiren bir coğrafya maddesi taşıyor (4 Ağustos 2026'da SCMP tarafından bildirildi). Ücretli API erişimi küresel olarak kısıtlamasız, dolayısıyla bu kısıtlamanın Oxava'da H3 kullanımıyla hiçbir ilgisi yok — stüdyo, yerel ağırlıklar üzerinden değil, barındırılan API üzerinden çalışıyor.
İşte tıklama yolu.
Paket erişimi, açıkça söylenmiş: MiniMax H3, Pro ve üzerinde açık (Pro, Pro+ ve Premium). Starter'da kart görünür ama kilitli, bir kilit rozeti ve bir yükseltme ipucuyla — seçicide görürsünüz, onunla üretim yapamazsınız. Modeli gizlemek yerine size kilidi göstermeyi tercih ediyoruz.
Bu, içselleştirmeye değer bir kısım, çünkü stüdyodaki her şeyden farklı çalışıyor. Görselden videoya modunda, iki ya da daha fazla referans görsel eklediğiniz anda istek otomatik olarak H3'ün referanstan-videoya uç noktasına yönlendirilir. Tek bir görsel, normal bir görselden videoya üretimidir. İki ya da daha fazlası, çoklu-referans koşullandırmasıdır. Siz modu değiştirmezsiniz; mod kendi kendine değişir.
Tavan, dokuz referans görsel. Bir kapsam notu, çünkü bunu keşfetmek yerine bizden duymanızı tercih ederiz: kaynak H3 ayrıca referans video ve referans ses dosyaları da kabul ediyor. Her ikisini de bilinçli olarak Oxava entegrasyonunun dışında bıraktık — bu platformda H3'ü yalnızca görsellerle koşullandırıyorsunuz.
Bir açılış karesi ve bir kapanış karesi verin, H3 ikisi arasındaki yolu inşa etsin; bunun için ayrı bir kart yok, bitiş karesi görselden videoya modunun içinde birlikte geliyor. Açılışlar, dönüşümler ve ürün durumu değişimleri, doğru sonucu ummaya bırakılan bir metin promptundan çok, iki ucu da sabitlenmiş olarak çok daha tutarlı bir şekilde iniyor.
H3, Oxava'da prompt-zenginleştirme davranışını doğrudan size gösteren ilk model. Panelde "Prompt zenginleştirme" olarak geçiyor ve dört seçeneği var:
| Ayar | Ne yapar |
|---|---|
| Kapalı | Prompt'unuz aynen kullanılır — model hiç genişletmez. |
| Hızlı | Yaklaşık bir saniyede hafif genişletme. |
| Dengeli | Model her istekte kendi kararını verir (varsayılan). |
| Kalite | 30 saniyeye kadar sürebilir; en zengin, en ayrıntılı prompt. |
Prompt zenginleştirme fiyatı etkilemez. Burada hiçbir şey kredi harcamıyor, o yüzden seçiminizi yalnızca zanaat açısından yapın. Pratik tavsiye: zaten detaylı, bilinçli bir sinematik prompt yazdıysanız — kamera hareketi isimlendirilmiş, ışık belirlenmiş, tempo ayarlanmış — Kapalı'yı seçin, yoksa model niyetinizi kendi ifadesine göre yeniden yazar. Tek satırlık kabaca bir fikirle geliyorsanız, Kalite'yi seçin ve atladığınız işi model yapsın. Dengeli, arada kalan her şey için makul bir varsayılan.
H3'ün geniş kapsamdaki manşet özelliği, görüntüyle aynı geçişte üretilen yerel stereo ses. İşte Oxava'daki durumun tam hali, ve ifadeye dikkat edeceğiz çünkü bu yazıda yanlış anlaşılması en kolay şey bu: H3'ün üç barındırılan uç noktasının hiçbiri bir ses parametresi sunmuyor. Bu kartta ses açma-kapama kontrolü yok, ve bir ses parçasını yönlendirmenin, ayarlamanın ya da garanti etmenin bir yolu yok. Size ses ürettiğini söylemeyeceğiz, sessiz render ettiğini de söylemeyeceğiz — ikisi de size söz verebileceğimiz bir şey değil.
Söz verebileceğimiz şey şu: kontrol edilebilir bir ses parçası teslimatın bir parçasıysa, seçilecek kart H3 değil. Seedance 2.0 ailesi ve FLUX.3, ikisi de görüntüyle birlikte ses üretiyor, ikisinde de ses sürşarjı yok. H3'ü çözünürlük ve referans tutarlılığı için seçin, ses parçası modelinizi ise bilinçli olarak ayrı seçin.
Ücretler çıktının saniyesi başınadır, dolayısıyla aynı katmanda 15 saniyelik bir klip, 5 saniyelik birinin üç katına mal olur.
| Çözünürlük | Saniye başına | 5 saniye | 10 saniye | 15 saniye |
|---|---|---|---|---|
| 480P | 5 kredi | 25 kredi | 50 kredi | 75 kredi |
| 768P (varsayılan) | 6 kredi | 30 kredi | 60 kredi | 90 kredi |
| 2K | 13 kredi | 65 kredi | 130 kredi | 195 kredi |
| 4K | 16 kredi | 80 kredi | 160 kredi | 240 kredi |
Referans görseller ayrı ve yumuşak bir şekilde fiyatlandırılıyor: ilk beşi ücretsiz, her ek görsel ise 8 kredi. Dokuz görsellik tavanda bu, üretime eklenen en fazla 32 kredi demek — ve çoğu iş buna asla yaklaşmıyor.
Tabloyu okuyunca bir iş akışı hemen ortaya çıkıyor: 2K, 768P'nin iki katından fazlasına, 4K ise neredeyse üç katına mal oluyor. Bu fark, aşağıdaki döngünün tüm gerekçesi.
Teknik özellikler nelerin mümkün olduğunu söyler; prompt yazımı ise ne alacağınıza karar verir.
Bu, bu yazıdaki tek en yararlı şey, ve neredeyse kimse bundan bahsetmiyor: H3, referans görsellerinizden listedeki konumlarına göre, "Image 1", "Image 2" ve benzeri şekilde bahseder. Onları prompt içinde numarayla hitap edersiniz. Bir karakter portresi, sonra bir kumaş yakın çekimi, sonra bir mekan durağanı yüklerseniz, bunlar Image 1, Image 2 ve Image 3 olur — ve prompt her birine bir görev atayabilir.
İşte uyarlanacak bir iskelet. Bu sırayla yükleyin, sonra yapıştırıp düzenleyin:
Image 1 karakter — yüzünü, saçını ve oranlarını tam olarak gösterildiği gibi koru. Image 2 onun montu — rengi, dokusu ve düğme detayını tam olarak eşleştir. Image 3 mekan — mimarisini, yüzeylerini ve günün saatini eşleştir. Eylem: kadın, Image 2'deki montu giyerek Image 3'teki mekanda kameraya doğru yavaşça yürüyor, klip içinde tamamlanan tek bir kesintisiz hareket. Kamera: göğüs yüksekliğinde yavaş bir geri dolly, tek kesintisiz çekim, kesme yok. Işık ve renk: vitrinlerden gelen sıcak pratik ışık, serin mavi akşam atmosferi, sığ alan derinliği, hafif film grenli. Yapma: kıyafeti değiştirme, başka karakter ekleme, ekranda metin ekleme ya da başka bir açıya kesme.
Bunu çalıştıran dört şey var. Her referansa tam olarak bir görev veriliyor — kimlik, detay, mekan — böylece hiçbiri birbiriyle çakışmıyor. Süreklilik dili değişim dilinden önce geliyor ("tam olarak gösterildiği gibi koru" eylemden önce gelir), yoksa model referanslarınızı canlandırırken seve seve yeniden stilize eder. Tek eylem, tek kamera hareketi, çünkü tek bir üretime üç vuruş senaryolaştırmak, herhangi bir modelde tutarsız çıktının en hızlı yolu. Ve yeniden üretmekten daha ucuz olan açık bir "yapma" listesi.

Dokuz bir tavandır, bir hedef değil. Her referans bir talimattır, ve çelişen referanslar bulanık çıktı üretir. İyi davranan bir yığın genellikle şöyle görünür:
Bu, farklı görevler üstlenen dört ila altı dosya demek, ki bu ücretsiz beşin içinde ya da hemen ötesinde kalır — ve birbiriyle tartışan dokuz dosyadan çok daha güvenilirdir.
Altı oranlı seçici yalnızca metinden videoya modunda var. Görselden videoya modunda çıktı oranı kaynak görselinizden gelir, ve referans modunda model referanslara uyum sağlar. Yani Reels, TikTok ya da Shorts için üretim yapıyorsanız, sonradan 9:16 seçerek bunu düzeltemezsiniz — seçebileceğiniz bir seçici yok. Dikey bir kaynak görselle başlayın. Durağan görselinizi önce 9:16'ya üretin ya da kırpın, sonra canlandırın. Dikey video format rehberimiz, dikeyin neden kırpılarak değil, o formata göre kompoze edilerek elde edilmesi gerektiğini anlatıyor.
Bu, H3'ü uygun fiyatlı yapan maliyet disiplini, ve varsayılanımızın orada durmasının nedeni bu. Kompozisyon, kamera hareketi ve referans davranışı doğru olana kadar 768P'de yineleyin. Ancak o zaman 2K ya da 4K'da yeniden çalıştırın. Gerçekte test ettiğiniz her şey — prompt amaçladığınız çekimi üretiyor mu? referanslar tutuyor mu? — 768P'de tamamen görünür.
Bu döngü tanıdık geliyorsa, FLUX.3'ün Draft modu iş akışıyla aynı şekle sahip: fikri ucuz katmanda kanıtlayın, zirve fiyatları yalnızca işe yaradığını zaten bildiğiniz çekim için ödeyin. Bir uyarı da buraya taşınıyor — H3'te seed kontrolü yok, dolayısıyla 4K'da yeniden çalıştırma, aynı karelerin daha yüksek sadakatte hali değil, aynı fikrin yeni bir çekimidir. Sıçramadan sağ çıkan şey kompozisyon, kamera davranışı, tempo ve prompt dilinizdir. Hareket devreye girmeden önce belirli bir görünümün kilitlenmesi gerekiyorsa, önce o hero durağanı görsel olarak üretin ve referans olarak besleyin.
Buradaki temel zanaat H3'e özgü değil — kamera dili, ışık dili ve tempo bu neslin her modelinde geçerli. Yapay zeka video üreticilerine prompt yazma rehberimiz, o iskeletin üzerine oturduğu temeldir, ve sonsuza kadar şablonlarla kalıp eşleştirmek yerine bir kez düzgünce okumaya değer.
Bunların hiçbiri H3'ü zayıf bir model yapmıyor. Onu belirgin bir şekle sahip bir model yapıyor: çözünürlük için, çoklu-görsel tutarlılığı için ve bir çekimin iki ucunu sabitlemek için seçin. Yönlendirebileceğiniz bir ses, mevcut görüntünün bir düzenlemesi ya da on beş saniyeden uzun bir klip gerektiğinde başka bir şey seçin. Bir varsayılan seçmeden önce alanın geri kalanına kıyasla nerede durduğunu görmek için, metinden videoya model karşılaştırmamız bu nesli yan yana koyuyor, ve onu da tartıyorsanız Grok Imagine Video 1.5 incelememiz, 2026'nın bir diğer öne çıkan lansmanını ele alıyor.
Oxava stüdyosunu açın, video seçicide MiniMax grubunu bulun ve 4K'ya bir şey harcamadan önce 768P'de bir prompt çalıştırın. Artık aynı seçicide on iki video modeli bulunuyor, dolayısıyla bir çekim için doğrusunu seçmek size başka bir abonelik yerine sadece bir tık'a mal oluyor.
Evet. Hailuo, MiniMax'ın video ürün hattı ve H3 onun üçüncü nesli, dolayısıyla "MiniMax H3" ve "Hailuo 3.0" aynı modele işaret ediyor — ürün adını tüketici haberlerinde, model adını ise geliştirici dokümantasyonunda görürsünüz. Aynı anda netleştirmeye değer: Hailuo 2.5 diye bir şey yok. Doğrudan öncülü, 28 Ekim 2025'te yayınlanan Hailuo 2.3, ve hat doğrudan oradan H3'e geçti.
H3, bir ince ayar geçişinden çok bir yeniden-mimarileme: etkin dizi uzunluğunu keskin şekilde artıran yeni bir tokenizer, anlama ile üretim iş yüklerini birbirinden ayıran bir transformer, zengin çok-modlu koşullandırmayı pratik hale getiren bir sıkıştırma katmanı ve yüksek-çözünürlük katmanlarını mümkün kılan bir yeniden üretim aşaması. Günlük kullanımda bu, çok daha geniş referans koşullandırması — Oxava'da tek bir promptta dokuza kadar görsel — ve 2.3 neslinin sunduğunun ötesinde çözünürlük katmanları olarak karşımıza çıkıyor.
Yerel olarak değil, ve modelin kendi barındırılan şeması bunu söylüyor: 480P ve 768P yerel üretim modları, 2K ve 4K ise bir 768P taban sonucu büyütüyor. Büyütme bağlam-farkında — pikselleri germek yerine orijinal çok-modlu bağlama karşı yeniden render ediyor — dolayısıyla ince detay ve küçük metin, genel amaçlı bir büyütücüye kıyasla çok daha iyi hayatta kalıyor. Bu, yüksek kaliteli bir sonuç ve fazladan pikseller gerçek. Sadece modelin baştan 4K'da boyadığı bir kare değil.
Bu modelde ses kontrolü yok. H3'ün üç barındırılan uç noktasının hiçbiri bir ses parametresi sunmuyor, dolayısıyla kartta ses açma-kapama kontrolü yok ve bir ses parçasını yönlendiremez, ayarlayamaz ya da garanti edemezsiniz — ses ürettiğini iddia etmeyeceğiz, sessiz render ettiğini de iddia etmeyeceğiz. Teslim ettiğiniz şeyin bir parçası kontrol edilebilir bir ses parçasıysa, bunun yerine Seedance 2.0 ailesini ya da FLUX.3'ü kullanın; ikisi de görüntüyle birlikte ses üretiyor ve hiçbiri ses sürşarjı almıyor.
Pro ve üzeri — Pro, Pro+ ve Premium. Starter'da kart video seçicide görünür ama kilitlidir, bir kilit rozeti ve bir yükseltme ipucuyla, dolayısıyla onunla üretim yapamadan görebilirsiniz. Önce ucuz bir keşif döngüsü çalıştırmak isterseniz, FLUX.3 Draft, Starter dahil her pakette açık video modeli olmaya devam ediyor.
Doğrudan değil. Ağırlıklar Hugging Face ve ModelScope'ta, ama MiniMax H3 Community License, telif hakkıyla ilgili düzenleyici belirsizliği gerekçe göstererek Amerika Birleşik Devletleri, Avrupa Birliği, Birleşik Krallık ve Güney Kore'de yerel dağıtım için resmi izin gerektiriyor. Lisans kadar önemli iki pratik gerçek var: bağımsız bir inceleme, "33B" pazarlama rakamına rağmen tüm çıkarım yığınını yaklaşık 69,2 milyar parametre ve 134+ GiB ağırlık olarak ölçtü, ve yerel üretim modları 480P ve 768P — daha yüksek katmanlar yeniden üretim aşamasına bağlı. Ücretli API erişimi küresel olarak kısıtlamasız, bu yüzden bunların hiçbiri Oxava'da H3 kullanımını etkilemiyor.
MiniMax H3 hakkında en ilginç şey, liderlik tablosundaki sıralaması değil. Mimari bahis: koşullandırma yüzeyini genişleterek bir üretimin bir paragraf yerine bir görsel yığınıyla yönlendirilebilmesini sağlamak, ve yüksek çözünürlüğü daha büyük bir tuval olarak değil, bağlam-farkında bir yeniden üretim sorunu olarak ele almak. Bu bahis, Oxava'ya 1080p'nin ötesindeki ilk video kartını veren ve dokuz-görsel tutarlılığını tek bir promptta pratik hale getiren şey.
Ayrıca gerçek yıldız işaretleriyle geliyor. 4K katmanı, modelin kendi ifadesine göre bir 768P tabanı büyütüyor. "33B" rakamı, gerçek çıkarım yığınının kabaca yarısı. Arena sonucu, çakışan aralıklara sahip tek bir hakemli-olmayan koşuya dayanıyor. Ve bu platformda ses kontrolü, seed, çok-çekim ve video düzenleme yok — yalnızca görsel referanslar var.
Gözünüz açık şekilde benimserseniz yerini hak ediyor: seçicideki başka hiçbir kartın üretemeyeceği, referansla-koşullandırılmış, yüksek-çözünürlüklü çekimler. Çekimi 768P'de bulun, referanslarınızı numarayla adlandırın, tek bir eylem ve tek bir kamera hareketi tarif edin, sonra çekimin işe yaradığını zaten bildiğinizde çözünürlüğü satın alın.
Stüdyoyu açın, MiniMax grubuna kaydırın ve fikrinizin harekette nasıl göründüğünü öğrenmek için 30 kredi harcayın — sonra 4K'yı hak edip etmediğine karar verin.
Yeni teknikler, model güncellemeleri ve yapay zekâ üretimine dair fikirleri ilk öğrenenlerden ol.