Model Detayları
ElevenLabs Audio Isolation, bir kayıttaki arka plan gürültüsünü, müziği ve ortam sesini temizler; izole edilen konuşma sesini barındırılan bir MP3 olarak döndürür. Bir ses dosyasının URL’sini verin (mp3, ogg, wav, m4a, aac); model kaynakla aynı uzunlukta, stüdyo kalitesinde konuşma döndürür. Güçlü yanı, gürültülü saha kayıtlarından, podcast’lerden, röportajlardan ve ekran kayıtlarından elle gürültü temizliği yapmadan kullanılabilir diyalog kurtarmasıdır.
## En uygun olduğu işler - Gürültülü röportaj, podcast ya da sesli not kayıtlarını temizleyip net bir konuşmaya dönüştürmek - Arka plandaki müziği ya da ortam sesini kaldırıp yalnızca konuşan sesi bırakmak - Düşük kaliteli ya da mikrofona uzaktan alınmış kayıtlardan kullanılabilir diyalog kurtarmak - Saha kayıtlarını transkripsiyon ya da ses klonlama öncesinde ön işlemden geçirmek
## Şu durumlarda başka bir model seçin - Temizlenmiş ses yerine konuşmanın yazılı transkripti gerekiyorsa — bir speech-to-text modeli kullanın - Metinden sıfırdan yeni bir konuşma üretmek istiyorsanız — bir text-to-speech modeli kullanın - Klibiniz 4.6 saniyeden kısaysa — model bu minimum sürenin altındaki medyayı reddeder
## İpuçları - Kaydı `audio_url` olarak verin; girdi formatı ne olursa olsun çıktı MP3’tür - Girdi en az 4.6 saniye uzunluğunda olmalıdır, aksi halde istek reddedilir - Çıktının süresi girdiyle aynıdır; yalnızca bir bölüme ihtiyacınız varsa uzun dosyaları önce kırpın
## Sınırlamalar - Yoğun clipping içeren ya da çok kısık kaydedilmiş sesler, kalan gürültünün altında kısmen gömülü kalabilir - Üst üste konuşan kişiler birlikte izole edilir, ayrı parçalara bölünmez
ModelRunner JavaScript client ile çalıştırmak için: ```js import { modelrunner } from "@modelrunner/client";
const result = await modelrunner.subscribe("elevenlabs/audio-isolation", { input: { audio_url: "https://media.modelrunner.ai/Hw2F9odfnP4VgOvA-harvard-clean-speech.wav", }, }); ```
