Model Detayları
ElevenLabs Multilingual v2, yazılı metni doğal ve ifadeli bir konuşmaya dönüştürür ve barındırılan bir MP3 döndürür. Seslendirilmesini istediğiniz metni verip adıyla bir ses seçersiniz; tonlamayı, tempoyu ve telaffuzu model üstlenir, stabilite, benzerlik ve stil üzerinde ince kontrol sunar. 29 dili yüksek aksan doğruluğu ve tutarlı bir ses kimliğiyle desteklemesi onu anlatım, seslendirme, sesli kitaplar, IVR/telefon anonsları ve karakter diyalogları için güçlü bir varsayılan tercih haline getirir.
## En uygun olduğu işler - Videolar, açıklayıcı içerikler ve reklamlar için anlatım ve seslendirme - Tutarlı, net bir okuyuşun önemli olduğu sesli kitaplar ve uzun metinler - IVR, telefon menüleri ve otomatik anonslar - Stil kontrolüyle karakter diyalogları ve canlandırmalı okumalar - Doğru aksanlarla 29 dilde çok dilli içerik
## Şu durumlarda başka bir model seçin - Melodisi ve enstrümantasyonu olan bir müzik parçası istiyorsanız — bir müzik üretim modeli kullanın - Konuşma yerine genel ses efektleri ya da ortam sesi istiyorsanız — bir text-to-audio ses efekti modeli kullanın - Canlı bir çağrıda gerçek zamanlı, ultra düşük latency gerektiren streaming TTS gerekiyorsa — bu model token stream değil, bitmiş bir dosya döndürür - Konuşma üretmek yerine konuşmayı yazıya dökmeniz gerekiyorsa — bir speech-to-text modeli kullanın
## İpuçları - Konuşmacıyı seçmek için `voice` alanını ayarlayın. Varsayılan `Rachel`; diğer örnekler arasında `Aria`, `Roger`, `Sarah`, `Charlie`, `George`, `Callum`, `Charlotte`, `Alice`, `Matilda`, `Will`, `Jessica`, `Brian`, `Lily` ve `Bill` var. - Girdi metnini okunmasını istediğiniz gibi noktalayın — virgüller ve noktalar duraklamaları ve tonlamayı belirler. - Okuyuşun tutarlılığı için `stability` değerini ayarlayın (0–1, varsayılan 0.5): düşük değerler daha değişken ve ifadeli, yüksek değerler daha dengeli ve monoton bir okuyuş verir. - Çıktıyı seçilen sesin karakterine yakın tutmak için `similarity_boost` değerini ayarlayın (0–1, varsayılan 0.75); daha ifadeli, abartılı bir okuyuş için `style` değerini yükseltin (0–1, varsayılan 0).
## Gelişmiş Yapılandırma - `speed` (0.7–1.2, varsayılan 1): konuşma hızı; 1’in altı daha yavaş, 1’in üstü daha hızlıdır. - `language_code` (varsayılan otomatik): sentez dilini sabitleyen bir ISO 639-1 kodu (ör. `en`, `es`, `fr`, `de`, `ja`); boş bırakırsanız dili model kendisi belirler. Kod desteklenmiyorsa model hata verir. - `apply_text_normalization` (`auto`, `on`, `off`, varsayılan `auto`): sayılar ve kısaltmalar gibi metinlerin sentezden önce normalleştirilmesini kontrol eder. Normalleştirmeyi zorlamak için `on`, metni tam yazıldığı gibi okutmak için `off` kullanın. - `previous_text` / `next_text` (varsayılan olarak boş): komşu parçalardan gelen çevre metin; uzun içerik parça parça seslendirilirken prozodiyi tutarlı tutmak için süreklilik ipucu olarak kullanılır.
ModelRunner JavaScript client ile çalıştırmak için: ```js import { modelrunner } from "@modelrunner/client";
const result = await modelrunner.subscribe("elevenlabs/tts/multilingual-v2", { input: { text: "Welcome to ModelRunner. This is multilingual text to speech.", voice: "Rachel", stability: 0.5, similarity_boost: 0.75, }, }); ```
