Model Detayları
GPT Image 2, bir metin prompt’unu yüksek kaliteli bir görsele dönüştürür; en belirgin iki güçlü yanı ise talimatları hassas biçimde izlemesi ve görselin içine doğru metin basmasıdır. Tek bir prompt’taki nesne sayılarını, mekânsal ilişkileri, stilleri ve çok parçalı istekleri güvenilir biçimde karşılar; okunaklı ve doğru yazılmış kelimeleri doğrudan görselin içine basar — çoğu görsel modelinin hâlâ zorlandığı bir iş. Bir poster, bir ürün etiketi, bir UI mockup’ı, bir infografik ya da tabelasında gerçek kelimeler yazan bir sahne tarif edin; model metni temiz biçimde yerleştirir ve kompozisyonu prompt’a sadık tutar.
## En uygun olduğu işler - Başlık metninin hatasız çıkması gereken posterler, el ilanları ve tebrik kartları - Marka adları ya da kısa metinler içeren ürün etiketleri, ambalajlar ve tabelalar - Gerçek ve okunaklı arayüz metni gerektiren UI mockup’ları ve uygulama ekranları - Yerleşimi, etiketleri ve öne çıkan veri notlarını bir araya getiren infografikler ve slaytlar - Birden fazla kısıt içeren sahneler ("ahşap bir masada üç kırmızı elma, logo sol üstte")
## Şu durumlarda başka bir model seçin - Prompt’tan üretmek yerine mevcut bir görseli düzenlemek ya da dönüştürmek istiyorsanız — bir image-to-image / görsel düzenleme modeli kullanın - Durağan görsel değil video gerekiyorsa — bir video modeli kullanın - Üretimi referans görsellerle yönlendirmek istiyorsanız; bu varyant görsel girdisi almaz, yalnızca metinden üretir
## İpuçları - Basılmasını istediğiniz kelimeleri prompt’ta tırnak içine yazın, ör. `the headline "VISIT JAPAN"` — tırnak, modele neyi harfi harfine yazacağını söyler - Yerleşim, renk ve stil konusunda net olun: öğelerin nerede duracağını ("logo sol üstte"), renk paletini ve görsel üslubu belirtin - Kısıtları tek bir prompt’ta birleştirin — sayılar, konumlar ve stiller birlikte karşılanır - Aynı prompt’un birkaç varyasyonunu tek çağrıda almak için `num_images` kullanın (en fazla 4)
## Görsel boyutu `image_size` alanı adlandırılmış bir hazır ayar ya da tam bir piksel boyutu kabul eder. Hazır ayarlar en-boy oranını ve kadrajı belirler: `square_hd` ya da `square` (1:1), `portrait_4_3` ya da `portrait_16_9` (boyu eninden uzun), `landscape_4_3` (varsayılan) ya da `landscape_16_9` (eni boyundan uzun). Özel bir boyut için bunun yerine bir nesne verin — `image_size: { "width": <px>, "height": <px> }` (kenar başına en fazla 14142 px), ör. `{ "width": 1280, "height": 720 }`. Yönelimi ya da tam boyutları görselin kullanılacağı yere göre seçin.
## Sınırlamalar - Görsel içindeki uzun ve yoğun metin paragraflarında yine de ara sıra yazım hataları görülebilir - Çok küçük ya da aşırı stilize metinler okunaklılığını yitirebilir - Çok sayıda nesne içeren son derece karmaşık sahneler, ince ayrıntılarda prompt’tan sapabilir
ModelRunner JavaScript client ile çalıştırmak için: ```js import { modelrunner } from "@modelrunner/client";
const result = await modelrunner.subscribe("openai/gpt-image-2", { input: { prompt: 'a vintage travel poster of Kyoto with the headline "VISIT JAPAN"', image_size: "landscape_4_3", num_images: 1, output_format: "png", }, }); ```




