Model Detayları
Stable Diffusion 3.5 Medium, bir metin prompt’unu yüksek kaliteli bir görsele dönüştürür. Stability AI’ın verimli, 2.5 milyar parametreli Multimodal Diffusion Transformer (MMDiT-X) modelidir ve 8B Large modelin daha küçük, daha hızlı kardeşidir. Standart tüketici donanımında iyi çalışacak şekilde ayarlanmıştır; bunu yaparken güçlü prompt anlama yeteneğini, doğru tipografiyi ve fotogerçekçilikten illüstrasyona uzanan çeşitli görsel stilleri korur. Betimleyici bir prompt verin ve bir görsel boyutu seçin; model tek bir görsel döndürür. Öne çıkan güçlü yanları hız ve megapiksel başına düşük fiyatla gelen maliyet verimliliğidir; bu da onu yüksek hacimli ya da bütçeye duyarlı text-to-image işleri için güçlü bir varsayılan seçenek yapar.
## En uygun olduğu işler - Metin açıklamasından büyük ölçekte hızlı ve düşük maliyetli görsel üretimi - Ayrıntılı bir prompt’tan fotogerçekçi sahneler ve portreler - Görsel içinde okunaklı metin, tabela ve tipografi basmak - Pek çok farklı estetikte konsept çizim, illüstrasyon ve stilize render’lar - Bir prompt’tan pazarlama görselleri, ürün mockup’ları ve sosyal medya görselleri
## Şu durumlarda başka bir model seçin - En yüksek sadakat ya da en karmaşık çok özneli prompt’larda uyum gerekiyorsa — 8 milyar parametreli Stable Diffusion 3.5 Large kullanın - Sıfırdan üretmek yerine mevcut bir görseli düzenlemek, yeniden tarzlamak ya da inpaint etmek istiyorsanız — bir görsel düzenleme modeli kullanın - Mevcut bir görseli büyütmek ya da ona detay eklemek gerekiyorsa — bir upscaling modeli kullanın - Video ya da animasyon gerekiyorsa — bir text-to-video modeli kullanın
## İpuçları - Özne, mekân, ışık ve stil konusunda net olun; SD 3.5 Medium ayrıntılı prompt’ların karşılığını verir - Prompt’a daha sıkı uyum için `guidance_scale` değerini (varsayılan 4.5) 5-7 aralığına doğru yükseltin; daha fazla yaratıcı serbestlik için düşürün - İstenmeyen öğeleri dışarıda bırakmak için `negative_prompt` kullanın (ör. "blurry, extra fingers, watermark") - `image_size` alanına bir hazır ayar ("square_hd", "portrait_16_9", "landscape_4_3", …) verin ya da özel bir `{ width, height }` nesnesi geçin - Özel `{ width, height }` boyutlarının hata vermek yerine desteklenen en yakın boyuta yuvarlanması için `auto_fix` seçeneğini açık bırakın (varsayılan)
ModelRunner JavaScript client ile çalıştırmak için: ```js import { modelrunner } from "@modelrunner/client";
const result = await modelrunner.subscribe("stability-ai/stable-diffusion-v3.5-medium", { input: { prompt: "a serene mountain lake at golden hour, mist over the water, photorealistic", image_size: "landscape_4_3", num_inference_steps: 40, guidance_scale: 4.5, }, }); ```





