
Elinizde bir ürün fotoğrafı, bir karakter konsepti ya da kabaca çizilmiş bir taslak var — ve bunu döndürebileceğiniz, bir oyun motoruna aktarabileceğiniz ya da mağazanızdaki bir AR görüntüleyicide çevirebileceğiniz gerçek bir 3D nesneye dönüştürmeniz gerekiyor. Üç boyutlu görünen bir resim değil. Geometrisi ve dokusu olan gerçek bir mesh. Yıllarca bunun anlamı bir 3D sanatçısı tutmak ya da Blender'da günlerce vertex itmekti. Artık görseli yapay zekâyla birkaç dakikada 3D modele dönüştürebilirsiniz ve çıktı, Blender'da, Unity'de ya da bir AR görüntüleyicide açabileceğiniz gerçek bir GLB dosyasıdır — ilk versiyonu almak için modelleme bilgisi gerekmez.
Bu yazı hem net bir inceleme hem de baştan sona bir uygulama rehberi. image-to-3D (ve text-to-3D) üretiminin gerçekte ne olduğunu, perde arkasında nasıl çalıştığını, gösterişli bir demonun ötesinde nerede gerçekten işe yaradığını ve Oxava'da — canlı olarak Hunyuan 3D v3.1 Pro çalıştıran platformda — ilk modelinizi adım adım nasıl üreteceğinizi ele alacağız. Ayrıca yapay zeka 3D'nin hâlâ nerelerde hata yaptığı konusunda dürüst olacağız, çünkü sınırları bilmek, kullanılabilir bir asset teslim etmekle bir öğleden sonrayı boşa harcamak arasındaki farktır.
Image-to-3D üretimi, bir nesnenin 2D görselini alır ve onu bir 3D mesh olarak yeniden inşa eder — poligonlardan (face'lerden) oluşan, bir doku ile kaplanmış ve 3D programların anlayacağı bir formatta kaydedilmiş bir yüzey. Buradaki standart çıktı GLB'dir: geometriyi ve dokusunu bir arada paketleyen, kompakt ve kendi kendine yeten bir dosya; Blender, Unity, Unreal, Godot ve çoğu AR/web görüntüleyicide doğrudan açılır. Text-to-3D de aynı şeyi yapar, ama bir fotoğraf yerine yazılı bir açıklamadan başlar — böylece referansınız olmayan bir nesneyi de üretebilirsiniz.
Burada en önemli kelime gerçek. Sonuç bir görsel değil — geometri. Onu tam 360° döndürebilir, herhangi bir açıdan ışıklandırabilir, ölçeklendirebilir ve gerçek derinliği görebilirsiniz, çünkü nesne dosyanın içinde gerçekten üç boyutlu olarak var. Bu ayrım kolayca bulanıklaşabiliyor, bu yüzden insanların bununla karıştırdığı iki komşu iş akışına karşı net bir çizgi çekmekte fayda var:

Kullanmak için matematiğini bilmenize gerek yok, ama hafif bir zihinsel model, nerede başarılı olacağını ve nerede zorlanacağını tahmin etmenize yardımcı olur. Hunyuan 3D gibi modern image-to-3D sistemleri, görsel üreticilerin arkasındaki aynı geniş aileden gelen diffusion tabanlı sistemlerdir — ama 2D bir resme doğru denoise etmek yerine, 3D bir şekle doğru denoise ederler.
Buradaki asıl hile multi-view anlayışıdır. Model, tek bir giriş fotoğrafınızdan yola çıkarak nesnenin diğer açılardan — arkadan, yanlardan, üstten — nasıl görüneceğini içsel olarak tahayyül eder ve ardından tüm bu görüş noktalarını aynı anda karşılayan tutarlı bir mesh oluşturur. Bu güçlü bir yaklaşımdır, ama aynı zamanda teknolojinin en büyük zayıflığının da kaynağıdır: kameranın göremediği her yüzeyi model tahmin etmek zorundadır (bununla ilgili daha fazlası sınırlar bölümünde).
Geometrinin üzerine sistem bir doku (texture) ve isteğe bağlı olarak tam bir PBR (physically based rendering) malzeme seti sentezler — base color, roughness, metallic ve normal map'ler. PBR, bir yüzeyin bir motor içinde ışığa doğru tepki vermesini sağlayan şeydir: metal metalik görünür, plastik mat görünür ve bir şeklin üzerine yapıştırılmış düz bir fotoğraf gibi görünmek yerine, ışığı etrafında hareket ettirdiğinizde nesne tutarlılığını korur. PBR'a ihtiyacınız olup olmadığı hedefinize bağlıdır, bunu aşağıda ele alacağız.
Dönen bir asset ekran kaydında harika görünür, ama bu teknolojinin önemli olmasının nedeni prodüksiyon. Hunyuan 3D'nin arkasındaki ekip olan Tencent, image-to-3D'yi gerçek pipeline'larında zaten kullanan çeşitli sektörlere işaret ediyor ve her biri somut bir işe karşılık geliyor:
Tencent ayrıca altta yatan modeller etrafında ciddi bir benimseme bildiriyor — Hugging Face'te milyonlarca indirme ve Unity ile tüketici 3D baskı ekosistemlerindeki araçlar dahil kurumsal ortaklar genelinde entegrasyonlar. Kesin rakamları satıcının kendi verileri olarak değerlendirin, ama yön net: bu, bir merak konusu olmaktan çıkıp günlük asset işine dönüşmüş durumda.
Oxava, /app/3d adresindeki stüdyoda Hunyuan 3D v3.1 Pro'yu canlı olarak çalıştırır; bu, Vertex Stage adı verilen ve henüz hiçbir şey indirmeden, sonuç bittiği anda etrafında dönebileceğiniz canlı bir 3D önizleme yüzeyidir. İşte tam akış.
Çöp girer, çöp çıkar prensibi burada 2D üretimden daha sert işler, çünkü model verdiğiniz görselden yola çıkarak nesnenin görünmeyen tüm yarısını çıkarım yoluyla tahmin ediyor. image-to-3D alanının genelinden derlenmiş en iyi uygulama kontrol listesi:
Üretmeden önce çıktıyı şekillendiren dört kontrol var. İşte her birinin ne yaptığı:
Üretimi çalıştırın, gizli yüzeyleri ve silüeti kontrol etmek için sonucu Vertex Stage'de döndürün ve indirin. Bir GLB mesh ile bir thumbnail elde edersiniz; pipeline'ınız bunları tercih ediyorsa ayrı OBJ / MTL / texture dosyalarını da alırsınız.
Fiyatlandırma, kredi cinsinden sabit ve öngörülebilir bir formüldür — tıklamadan önce maliyeti her zaman bilirsiniz:
| Seçenek | Ne yapar | Maliyet |
|---|---|---|
| Temel üretim | GLB mesh + thumbnail + OBJ/MTL/texture | 38 kredi |
| PBR malzemeler | Doğru ışıklandırma için physically based malzeme seti | +15 kredi |
| Multi-view | Ek açılı referans görsellerini kullanma (tek seferlik ücretlendirilir) | +15 kredi |
| Özel face count | 500 bin varsayılanının üstüne/altına çıkma (ör. High/1,5M) | +15 kredi |
Yani sade bir mesh 38 kredi, PBR + multi-view + özel face count ile tam donanımlı bir üretim ise 83 krediye ulaşır. Ölçümlü bir ek ücretlendirme ya da gizli değişken bir maliyet yok: gördüğünüz rakam, ödediğiniz rakamdır.
Gizlemeden açıkça belirtelim: 3D üretimi Pro ve Premium planlarında kullanılabilir, Starter'da ise kilitlidir. Starter'daysanız ve denemek istiyorsanız önce Pro veya Premium'a yükseltmeniz gerekir — ama özellik bir bekleme listesinin arkasında değil, doğrudan stüdyonun içinde duruyor.
Bazen elinizde bir referans görsel yoktur — ve kolayca çekemezsiniz de. İşte text-to-3D tam bunun için var. Aynı model, aynı çıktı formatları ve fiyatlandırma; sadece bir fotoğraf yüklemek yerine nesneyi en fazla 1.024 karakterlik bir prompt içinde tarif edersiniz.
Şu durumlarda text-to-3D'ye başvurun:
Prompt'u sıkı ve somut tutun. Güvenilir bir formül:
[nesne] + [malzeme/kaplama] + [stil] + [dikkat çekici detaylar] + [şekil/silüet]
Örneğin: "low-poly ahşap bir hazine sandığı, demir menteşeler ve kubbeli bir kapak, stilize game-asset görünümü, hafif yıpranmış kenarlar." Bir sahneyi ya da bir ruh halini değil, formu ve malzemeyi tarif edin — text-to-3D, ışığın nasıl hissettirdiğini değil, nesnenin ne olduğunu bilmek ister. Açıklamanız atmosfere doğru kayıyorsa, bir 3D prompt'u değil bir görsel prompt'u yazıyorsunuz demektir. Elinizde iyi bir fotoğraf varsa image-to-3D yine sadakat açısından üstündür, çünkü gerçek bir referans, tarif edilmiş birinden daha iyi sonuç verir — ama saf bir fikirden ilk mesh'e giden daha hızlı yol text-to-3D'dir.
Eklentiler tek tek ucuzdur, ama refleks olarak üçünü birden eklemek, kırılması gereken bir alışkanlıktır — bunların yarısı belirli bir iş için alakasızdır. Eklentiyi hedefe göre eşleştirin:
| Hedefiniz | PBR? | Multi-view? | Face count |
|---|---|---|---|
| Real-time oyun asset'i (Unity/Unreal) | Evet | Arka önemliyse | Standard (daha hafif) |
| AR / web ürün görüntüleyicisi | Evet | Evet (ürünün arkası görünüyorsa) | Standard |
| Hero render / yakın plan güzellik çekimi | Evet | Evet | High (1,5M) |
| 3D baskı taban formu | Hayır (Geometry) | Asimetrikse | Detay için High |
| Hızlı konsept / prototip | Hayır | Hayır | Standard |
Tablonun arkasındaki genel kurallar şöyle: PBR, model bir motorda ya da bir renderer'da ışıklandırıldığında 15 kredisini fazlasıyla hak eder — ama yalnızca düz bir önizlemeye ihtiyacınız varsa ya da dokusuz bir form basıyorsanız boşa gider. Multi-view, anlamlı, simetrik olmayan bir arkaya sahip herhangi bir nesne (bir ayakkabı, bir araba, bir karakter) için en yüksek etkiye sahip eklentidir; bir vazo gibi radyal simetrik bir şey için ise saf israftır. Yüksek face count, gerçekten yakından göreceğiniz detay içindir; real-time ve mobil için daha fazla poligon bir fayda değil, bir maliyettir — daha ağır dosyalar, daha kötü performans. Görüntüleyicinin fark edeceği yere harcayın.
Hunyuan 3D ailesinin bağımsız incelemeleri tutarlı ve adil bir sonuca varıyor: dikkat çekici bir teknoloji ve bir başlangıç noktası, nihai bir teslimat değil. Bu sınırları önceden bilmek, yanlış şeyi beklemekten sizi korur:
Bunların hiçbiri aracı atlamak için bir neden değil. Aracı doğru yere koymak için bir neden: yapay zeka 3D sizi dakikalar içinde sıfırdan sağlam bir taban mesh'e taşır, son adımı ise bir insan (ya da bir temizlik süreci) tamamlar. Bu, eskiden saf angarya olan %80'lik kısımda ciddi bir zaman tasarrufu — ama bitmiş, prodüksiyon kalitesinde bir asset'in tek tıkla yerine geçmiyor.
3D, birkaç modaliteden biridir ve akıllıca olan hamle, her şeyi tek bir modelden geçirmeye zorlamak yerine aracı teslim edilecek şeye göre eşleştirmektir. Sonuçta hedefiniz düz bir görselse — bir listeleme fotoğrafı, bir reklam, bir hero görsel — özel bir görsel üreticisi doğru tercihtir ve 2026'nın en iyi yapay zeka görsel üreticileri derlememiz bu alanın tamamını haritalandırıyor. Elinizde zaten geometri varsa ve güzel bir still görsele ihtiyacınız varsa, bu 3D-modelden-render'a iş akışıdır. Image-to-3D, özellikle gerçek, üzerinde işlem yapılabilir geometriye ihtiyacınız olduğunda kendi yerini kazanır — döndürebileceğiniz, ışıklandırabileceğiniz, basabileceğiniz ya da bir motora bırakabileceğiniz bir mesh — ve düz hiçbir şey bunun yerini tutmaz.
Oxava'da Hunyuan 3D v3.1 Pro, bir GLB mesh (geometri ve doku tek dosyada) artı ayrı OBJ / MTL / texture dosyaları ve bir thumbnail çıktısı verir. GLB, Blender, Unity, Unreal, Godot ve çoğu web/AR görüntüleyicide doğrudan açılır. Yerleşik bir STL, USDZ ya da FBX yoktur — 3D baskı için STL'ye dönüştürürsünüz (muhtemelen bir onarım süreci de çalıştırırsınız), iOS AR Quick Look için ise GLB'yi USDZ'ye dönüştürürsünüz. Her iki dönüşüm de ücretsiz araçlarla oldukça basittir.
Fiyatlandırma deterministiktir. Temel bir üretim, GLB mesh, thumbnail ve OBJ/MTL/texture dosyalarını içeren 38 kredidir. Üç isteğe bağlı eklenti her biri +15 krediye mal olur: PBR malzemeler, multi-view (ek açılı referans görsellerini kullanma) ve 500 bin varsayılanının dışında özel bir face count. Üçünü de içeren tam donanımlı bir model 83 kredidir. Ölçümlü bir ek ücret yoktur — gösterilen fiyat, ödenen fiyattır.
GLB çıktısı doğrudan Unity, Unreal, Godot ve Blender'a aktarılır, dolayısıyla oyun motoru kullanımı tam olarak bunun için tasarlanmıştır — animasyon gerektiren her şey için genellikle bir temizlik ya da retopoloji sürecinin ardından. Ticari haklar için, üretilen asset'leri müşteri işine ya da yayınlanan bir işe dahil etmeden önce, varsayılan lisansın her kullanımı kapsadığını varsaymak yerine planınız ve bölgeniz için geçerli güncel şartları kontrol edin.
Nesnenin temiz bir referans fotoğrafı elinizdeyse image-to-3D kullanın — gerçek bir referans, tarif edilmiş birinden daha yüksek sadakat üretir. Nesne hayaliyse, stilizeyse ya da basitçe fotoğraflamaya değmiyorsa, en fazla 1.024 karakterlik bir prompt içinde tarif ederek text-to-3D kullanın. İkisi de aynı model üzerinde, aynı çıktı formatları ve fiyatlandırmayla çalışır, dolayısıyla tek soru bir resimden mi yoksa bir fikirden mi yola çıktığınızdır.
Hayır — ilk bir modeli üretmek hiçbir 3D becerisi gerektirmez: temiz bir fotoğraf hazırlayın (ya da kısa bir prompt yazın), ayarlarınızı seçin ve GLB'yi indirin. Deneyimin işe yaradığı yer üretimden sonrasıdır: topolojiyi temizlemek, animasyon için retopolojize etmek ya da bir mesh'i 3D baskı için hazırlamak. Kaba bir önizleme, previz ya da bir sanatçıya teslim edilecek bir taban için, sıfır modelleme geçmişiyle görselden modele geçebilirsiniz.
Bir görseli yapay zekâyla 3D modele dönüştürmek, bir araştırma demosu olmaktan çıkıp gerçekten kullanışlı bir prodüksiyon kısayoluna dönüştü. Bir fotoğraf yükler (ya da bir açıklama yazarsınız), PBR'a, ek açılara ya da daha yüksek detaya ihtiyacınız olup olmadığını seçersiniz ve birkaç dakika sonra bir motora, bir AR görüntüleyiciye ya da bir baskı pipeline'ına bırakabileceğiniz gerçek bir GLB mesh'in etrafında dönüyor olursunuz. Size kusursuz, animasyona hazır bir hero asset vermez — gizli yüzeyler tahmin edilir, topoloji temizlik ister ve yerleşik bir STL yoktur — ama asset üretiminin yavaş ve yorucu %80'lik kısmını tek bir üretime sığdırır.
Hunyuan 3D v3.1 Pro, Oxava stüdyosunda /app/3d adresinde şu anda canlı — hem image-to-3D hem text-to-3D kullanılabilir, sonucu kesinleştirmeden önce inceleyebilmeniz için Vertex Stage önizlemesiyle birlikte. 3D üretimi Pro ve Premium planlarında çalışır, dolayısıyla Starter'daysanız önce yükseltme yapmanız gerekir. Yapay zeka 3D'nin iş akışınıza uyup uymadığını anlamanın en hızlı yolu, kendi ürün fotoğraflarınızdan ya da konseptlerinizden birini içinden geçirmektir — o yüzden bir görsel alın, stüdyoyu açın ve ilk mesh'inizi üretin.
Yeni teknikler, model güncellemeleri ve yapay zekâ üretimine dair fikirleri ilk öğrenenlerden ol.