Ana içeriğe geç
resemble-ai avatarı

Chatterbox Voice Conversion API

resemble-ai/chatterbox/speech-to-speech

Bir konuşma kaydını özgün sözleri, zamanlamayı ve okuyuşu koruyarak farklı bir hedef sese dönüştürün — speech-to-speech bir ses değiştirici.

üretilen ses için saniye başına 0.00025

Model girdisi

Input

The speech recording to convert. Its words, timing, and delivery are preserved while the speaker's voice is replaced. Provide a clean, single-speaker clip (WAV or MP3).

Optional reference clip of the voice to convert the source into. Provide a clean, single-speaker sample of the target voice; leave it unset to use the built-in default conversion voice.

You need to be logged in to run this model and view results.
Log in

Model çıktısı

Output

Loading
Generated in 6.717 seconds
Logs (1 lines)

Örnek istekler

Örnekler

Chatterbox Voice Conversion API

Chatterbox Voice Conversion is a sound AI model by resemble-ai. On ModelRunner it runs through a REST API or via MCP from any AI assistant, at $0.00025 per second of audio.

POST https://queue.modelrunner.run/resemble-ai/chatterbox/speech-to-speech

cURL

# Submit a request to the queue. Input fields go at the top level of the
# body. The optional reserved "metadata" object holds your own flat string
# tags — stored on the request, never sent to the model; filter later with
# GET https://queue.modelrunner.run/requests?metadata=<url-encoded JSON>.
curl -X POST https://queue.modelrunner.run/resemble-ai/chatterbox/speech-to-speech \
  -H "Authorization: Key $MRUN_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "source_audio_url": "https://media.modelrunner.ai/rR5rwAibwYgo9y3BCPYXp.mp3",
    "target_voice_audio_url": "https://media.modelrunner.ai/yKl0Lb3SJCG9UDYwpUObH.mp3",
    "metadata": {
      "project": "my-project"
    }
  }'
# → { "request_id": "...", "status_url": "...", "response_url": "..." }

# Poll status_url until "COMPLETED", then fetch the result
curl "https://queue.modelrunner.run/resemble-ai/chatterbox/speech-to-speech/requests/$REQUEST_ID/status" \
  -H "Authorization: Key $MRUN_API_KEY"
curl "https://queue.modelrunner.run/resemble-ai/chatterbox/speech-to-speech/requests/$REQUEST_ID" \
  -H "Authorization: Key $MRUN_API_KEY"

JavaScript

import { modelrunner } from "@modelrunner/client";

const result = await modelrunner.subscribe("resemble-ai/chatterbox/speech-to-speech", {
  input: {
    "source_audio_url": "https://media.modelrunner.ai/rR5rwAibwYgo9y3BCPYXp.mp3",
    "target_voice_audio_url": "https://media.modelrunner.ai/yKl0Lb3SJCG9UDYwpUObH.mp3"
  },
});
console.log(result);

Python

import os
import requests

headers = {"Authorization": f"Key {os.environ['MRUN_API_KEY']}"}

submitted = requests.post(
    "https://queue.modelrunner.run/resemble-ai/chatterbox/speech-to-speech",
    headers=headers,
    json={
      "source_audio_url": "https://media.modelrunner.ai/rR5rwAibwYgo9y3BCPYXp.mp3",
      "target_voice_audio_url": "https://media.modelrunner.ai/yKl0Lb3SJCG9UDYwpUObH.mp3"
    },
).json()

# Poll submitted["status_url"] until "COMPLETED", then:
result = requests.get(submitted["response_url"], headers=headers).json()

Input parameters

Input parameters of Chatterbox Voice Conversion
NameTypeRequiredDescription
source_audio_urlstring (uri)yesThe speech recording to convert. Its words, timing, and delivery are preserved while the speaker's voice is replaced. Provide a clean, single-speaker clip (WAV or MP3).
target_voice_audio_urlstringnoOptional reference clip of the voice to convert the source into. Provide a clean, single-speaker sample of the target voice; leave it unset to use the built-in default conversion voice.

Machine-readable: OpenAPI schema · llms.txt

Use Chatterbox Voice Conversion from Claude & Cursor (MCP)

Point Claude Code, Claude Desktop, Cursor, or any MCP client at the ModelRunner MCP server and Chatterbox Voice Conversion becomes a tool your assistant can call directly — it authorizes via OAuth (no API key in config) and runs this model with the run_model tool using the endpoint resemble-ai/chatterbox/speech-to-speech.

MCP client config (Claude Desktop, Cursor)

{
  "mcpServers": {
    "modelrunner": {
      "command": "npx",
      "args": ["-y", "mcp-remote", "https://mcp.modelrunner.run/mcp"]
    }
  }
}

Claude Code

claude mcp add --transport http modelrunner https://mcp.modelrunner.run/mcp

Then ask your assistant, for example: “Run resemble-ai/chatterbox/speech-to-speech on ModelRunner to generate sound”. MCP setup guide.

Model Detayları

Model Detayları

Chatterbox Voice Conversion, konuşan birinin kaydını alıp farklı bir hedef sesle yeniden seslendirir: özgün sözler, zamanlama ve okuyuş korunur, yalnızca konuşmacının ses tınısı değişir. Dönüştürmek istediğiniz klibi `source_audio_url` olarak verin; isteğe bağlı olarak `target_voice_audio_url` ile sonucun benzemesini istediğiniz sesin kısa, temiz bir örneğini de ekleyin. Hedefi boş bırakırsanız yerleşik varsayılan bir dönüştürme sesi kullanılır. Çıktı, barındırılan bir WAV dosyasıdır. Metinle değil doğrudan sesle çalıştığı için mevcut anlatımları, diyalogları ya da seslendirmeleri hiçbir şeyi yeniden kaydetmenize gerek kalmadan yeniden seslendirir.

## En uygun olduğu işler - Mevcut bir kaydı farklı bir hedef sesle yeniden seslendirmek ya da dublajlamak - Sözleri olduğu gibi bırakıp sesini değiştirerek bir konuşmacıyı anonimleştirmek - Bitmiş bir seslendirmenin sesini, metni yeniden kaydetmeden değiştirmek - Farklı kişilerin kaydettiği kliplerdeki anlatımı tek ve tutarlı bir seste birleştirmek

## Şu durumlarda başka bir model seçin - Mevcut bir kaydı dönüştürmek yerine yazılı metinden konuşma üretmek istiyorsanız — `resemble-ai/chatterbox/text-to-speech` gibi bir text-to-speech modeli kullanın - Sesi değiştirmek yerine konuşmayı metne dökmeniz gerekiyorsa — bir speech-to-text modeli kullanın - Melodisi ve enstrümantasyonu olan bir müzik parçası istiyorsanız — bir müzik üretim modeli kullanın - Konuşma yerine genel ses efektleri ya da ortam sesi istiyorsanız — bir text-to-audio ses efekti modeli kullanın

## İpuçları - `source_audio_url`, sözleri ve okuyuşu korunacak kayıttır — temiz, tek konuşmacılı bir klip verin. - `target_voice_audio_url`, kaydın DÖNÜŞTÜRÜLECEĞİ sestir; o sesin temiz, tek konuşmacılı bir örneğini verin. Yerleşik varsayılan dönüştürme sesini kullanmak için boş bırakın. - İki girdi de yaygın ses formatlarını (WAV, MP3) kabul eder; sonuç barındırılan bir WAV olarak döner.

ModelRunner JavaScript client ile çalıştırmak için: ```js import { modelrunner } from "@modelrunner/client";

const result = await modelrunner.subscribe("resemble-ai/chatterbox/speech-to-speech", { input: { source_audio_url: "https://media.modelrunner.ai/RThSDFY174fUmaVkxBj6X.mp3", target_voice_audio_url: "https://media.modelrunner.ai/DeW8piXP0W8Oa6hEmSGrQ.mp3", }, }); ```