Model Detayları
GPT Image 2 Edit, mevcut bir görseli metin talimatına göre dönüştürür. Bir ya da daha fazla referans görsel ve değişikliği tarif eden bir prompt verin; model, değiştirmesini istemediğiniz kısımları koruyan, istediğiniz değişiklikleri ise hassas biçimde uygulayan düzenlenmiş bir görsel döndürür. Güçlü yanları temel modelden gelir: düzenleme talimatlarını sadakatle izler — nesne sayıları, yerleşim ve çok parçalı talimatlar dahil — ve doğru, okunaklı metni doğrudan düzenlemenin içine basar; böylece bir başlığı değiştirebilir, bir ürünün etiketini yenileyebilir ya da bir açıklama yazısı ekleyebilir ve hepsini doğru yazılmış olarak alabilirsiniz. Öğeleri birleştirmek için en fazla 16 referans görsel, düzenlemeyi belirli bir bölgeyle sınırlamak için de isteğe bağlı bir maske verin.
## En uygun olduğu işler - Bir ürünü ya da sahneyi yeniden kurgulamak — özneyi olduğu gibi koruyarak arka planı, ışığı ya da mekânı değiştirmek - Tipografi değişiklikleri — bir başlığı, etiketi ya da tabelayı doğru yazılmış yeni kelimelerle değiştirmek - Kompozisyonun geri kalanını koruyarak bir fotoğrafa nesne eklemek ya da fotoğraftan nesne çıkarmak - Mevcut bir görselin rengini değiştirmek, onu yeniden tarzlamak ya da ona tutarlı bir görünüm kazandırmak - Birkaç referans görseldeki öğeleri tek bir düzenlenmiş sonuçta birleştirmek
## Şu durumlarda başka bir model seçin - Kaynak görseliniz yoksa ve yalnızca metin prompt’undan üretmek istiyorsanız — text-to-image modelini kullanın: `openai/gpt-image-2` - Bir görseli canlandırmanız ya da görselden video üretmeniz gerekiyorsa — bir image-to-video modeli kullanın - Yalnızca basit bir arka plan kaldırma ya da upscaling gerekiyorsa — bu işe özel bir arka plan kaldırma ya da upscaling modeli daha ucuz ve daha öngörülebilirdir
## İpuçları - Düzenlemeye basılmasını istediğiniz kelimeleri prompt’ta tırnak içine alın - Düzenlemeyi bir bölgeyle sınırlamak için `mask_url` kullanın — maskeli bölge değişikliğe izin verilen yeri işaretler, geri kalan her şeye dokunulmaz - Yalnızca neyin değişmesi gerektiğini tarif edin; model bahsedilmeyen alanları sabit tutar - Birkaç referanstan öğe almak için `image_urls` içinde birden fazla URL verin - `image_size` çıktının kadrajını belirler: adlandırılmış bir hazır ayar (`landscape_4_3` varsayılandır) ya da tam bir boyut için piksel cinsinden özel bir `{ "width", "height" }` nesnesi verin (ör. `{ "width": 1280, "height": 720 }`, kenar başına en fazla 14142 px)
## Sınırlamalar - Görsel içindeki çok uzun ve yoğun metin paragraflarında yine de ara sıra yazım hataları görülebilir - Üst üste binen çok sayıda bölgeye yayılan yoğun düzenlemeler, ince detaylarda özgün görselden sapabilir - Çok küçük ya da aşırı stilize metinler okunaklılığını yitirebilir
ModelRunner JavaScript client ile çalıştırmak için: ```js import { modelrunner } from "@modelrunner/client";
const result = await modelrunner.subscribe("openai/gpt-image-2/edit", { input: { prompt: 'replace the sign text with "OPEN 24 HOURS"', image_urls: ["https://media.modelrunner.ai/NbkAtbHqJhJOZAs9M4mxP.png"], image_size: "landscape_4_3", num_images: 1, output_format: "png", }, }); ```




