Model Detayları
HunyuanImage 3.0 Instruct, mevcut bir görseli yazılı bir talimata göre düzenler. Bir ila üç referans görsel verin ve istediğiniz değişikliği tarif edin — "bu çizimi gerçekçi bir fotoğrafa dönüştür", "arka planı karlı bir sokakla değiştir", "ceketi kırmızı yap ve bir atkı ekle" — model de düzenlemenizi uygulayan yeni bir görsel döndürür. 80 milyar parametreli HunyuanImage 3.0 temel modelinin instruction-tuned checkpoint’idir; bu yüzden uzun, çok parçalı düzenleme yönergelerini okur ve render’dan önce değişikliği planlar, her talimatı tek geçişli bir düzenlemeye kıyasla daha sadık biçimde izler. Birden fazla referans görsel vermek, içeriği tek çağrıda bunlar arasında birleştirmesini ya da aktarmasını sağlar.
Kaynak görselleri `image_urls` alanında dizi olarak verin (en fazla 3). Prompt genişletme varsayılan olarak açıktır: bir dil modeli, düzenleme çalışmadan önce kısa talimatları detaylandırır — tam olarak yazdığınız ifadenin korunmasını istiyorsanız `enable_prompt_expansion` alanını `false` yapın. Modelin sonucu girdiye göre boyutlandırması için `image_size` alanını `auto` bırakın ya da bir hazır ayar (`square_hd`, `portrait_16_9`, `landscape_16_9`) veya açıkça bir `{width, height}` nesnesi vererek tuvali sabitleyin.
## En uygun olduğu işler - Mevcut bir görsele tarif edilen bir değişikliği uygulamak — yeniden tarzlamak, rengini değiştirmek, nesne eklemek ya da çıkarmak, arka planı değiştirmek - Çizimleri, eskizleri ya da render’ları fotogerçekçi görsellere çevirmek ve tersi - Basit bir düzenleme modelinin bir kısmını atlamaya eğilimli olduğu uzun, çok parçalı düzenleme talimatları - İki ya da üç referans görsel arasında içeriği tek düzenlemede birleştirmek ya da aktarmak - Düzenlemenin kesin yazılı yönergeleri izlemesi gereken editoryal ve ürün rötuşu
## Şu durumlarda başka bir model seçin - Kaynak görseliniz yoksa ve yalnızca metin prompt’undan üretmek istiyorsanız — HunyuanImage 3.0 Instruct text-to-image varyantını kullanın - Yalnızca çizilen bir bölgenin değiştiği, piksel hassasiyetinde maskeli inpainting gerekiyorsa — bu endpoint maske almaz, özel bir inpainting modeli kullanın - Bir görseli içeriğini değiştirmeden büyütmek ya da restore etmek istiyorsanız — bir upscaling ya da restorasyon modeli kullanın - Video gerekiyorsa — bir image-to-video modeli kullanın
## İpuçları - Düzenlemeyi, görselde ne olduğuna atıf yapan net bir talimat olarak yazın; muhakeme adımı anahtar kelime listelerinden çok eksiksiz ve yapılandırılmış yönergeleri ödüllendirir - Ana görseli `image_urls` içinde ilk sıraya koyun; modelin içerik ya da stil ödünç almasını istediğinizde en fazla iki referans daha ekleyin - Kısa talimatlarda `enable_prompt_expansion` alanını açık bırakın; talimatınız zaten kesinse ve kelimesi kelimesine korunmasını istiyorsanız `false` yapın - Girdinin oranlarını korumak için `image_size` alanını `auto` bırakın ya da belirli bir çıktı boyutunu sabitlemek için bir hazır ayar / `{width, height}` nesnesi verin - Her çıktı görseli megapiksel başına faturalanır; bu yüzden daha büyük boyutlar ve daha yüksek `num_images` daha pahalıya gelir
ModelRunner JavaScript client ile çalıştırmak için: ```js import { modelrunner } from "@modelrunner/client";
const result = await modelrunner.subscribe("tencent/hunyuan-image/v3/instruct/edit", { input: { prompt: "Turn this artwork into a realistic photograph", image_urls: ["https://media.modelrunner.ai/example-source.png"], num_images: 1, output_format: "png", }, }); ```





