
kling-custom-voiceKling Custom Voice creates a reusable custom voice from an audio sample — upload 5–30 seconds of clean, single-speaker audio (.mp3/.wav/.mp4/.mov) or reference a historical video ID. The resulting voice can be used in Kling TTS and the Kling Lip-Sync models, so a digital human or narration can speak in your proprietary voice and then be lip-synced to video.
Upload .mp3/.wav/.mp4/.mov samples
Use a historical video ID as source
Create reusable voice profiles
$0.006 per voice creation
Clean single voice, 5-30 seconds, no background noise
Create a custom voice to see the result
Kling Custom Voice é uma API de áudio e voz da Kling. O Kling Custom Voice cria uma voz personalizada reutilizável a partir de uma amostra de áudio: envie de 5 a 30 segundos de áudio limpo, de um único locutor (.mp3/.wav/.mp4/.mov) ou referencie o ID de um vídeo histórico. A voz resultante pode ser usada no Kling TTS e nos modelos Kling Lip-Sync, para que um humano digital ou uma narração possa falar com a sua voz proprietária e depois ser sincronizado labialmente ao vídeo. Pela plataforma API Models, você acessa este modelo por uma API unificada com preços transparentes de pagamento por uso. Preço atual: per call: $0.006.
Gere locuções de nível profissional para vídeos, animações e anúncios, com vozes variadas.
Produza rapidamente o áudio do seu podcast, com suporte a diálogos de vários personagens.
Converta texto em voz natural e fluida para produzir audiolivros.
Dublagem e tradução multilíngue com IA para alcançar audiências globais.
O Kling Custom Voice está disponível pela API Models a: per call: $0.006. A cobrança é por uso — você paga apenas pelo que gera.
Cadastre-se na API Models, obtenha sua chave de API e chame nosso endpoint unificado. Oferecemos documentação detalhada com exemplos em cURL, Python e Node.js.
A API Models oferece o mesmo modelo Kling Custom Voice pela nossa plataforma de agregação. Fornecemos uma interface de API unificada, então você não precisa de contas separadas por provedor: uma única chave para acessar todos os modelos.
Cria uma voz personalizada a partir de uma amostra de áudio: envie de 5 a 30 segundos de áudio limpo de um único locutor (.mp3/.wav/.mp4/.mov) ou referencie um ID de vídeo histórico. A voz resultante pode ser usada no Kling TTS e nos modelos de Lip-Sync.
Depois de clonada, selecione essa voz no Kling TTS ou no Kling Lip-Sync TTS para sintetizar a fala, fazendo com que um humano digital ou uma narração fale com a sua voz exclusiva, e então combine com o vídeo de sincronização labial.
Na API Models, o Kling Custom Voice roda junto com mais de 60 modelos usando uma única chave de API e um único saldo, então escolher é questão de adequação, não de dependência. Ele suporta Custom Voice, Audio Upload, Video Reference, For TTS/Lip Sync e você pode avaliá-lo em preço e capacidade frente a outros modelos de áudio e voz, trocando ao alterar uma única string com o nome do modelo — sem nova conta ou integração. Veja todas as opções de áudio e voz com preços ao vivo em apimodels.app/models.
O Kling Custom Voice suporta: Custom Voice, Audio Upload, Video Reference, For TTS/Lip Sync. Consulte a documentação da API Models para todos os parâmetros e exemplos de chamada.
Sim. A API Models expõe o Kling Custom Voice por uma única API unificada e uma só chave, sem contas separadas por provedor e sem precisar lidar com o acesso de rede regional de cada provedor.
Aceitamos Stripe (Visa, Mastercard e outros cartões internacionais) e Alipay. O saldo fica disponível imediatamente após o pagamento.