
ai-lip-sync-ttsKling Lip-Sync TTS is text-to-speech designed for lip-sync, with multi-language and multi-dialect support, speed control, emotion styles and voice cloning. It generates the voice track that feeds directly into Kling Lip-Sync Video for mouth alignment, so you can synthesize emotionally styled speech (optionally in a cloned voice) and sync it to a character's mouth in one workflow.
Chinese and English voices
Custom voice replication
0.8x to 2x playback speed
Multiple voice personas
Kling lip-sync is a 3-step flow — run them in order; intermediate values carry forward automatically.
Upload or paste a public video URL; recognition returns sessionId + faceId.
Trimmed audio must be ≥2s; the insert window must overlap the face window by ≥2s.
Kling Lip-Sync TTS — это API категории «аудио и речь» от Kling. Kling Lip-Sync TTS is text-to-speech designed for lip-sync, with multi-language and multi-dialect support, speed control, emotion styles and voice cloning. It generates the voice track that feeds directly into Kling Lip-Sync Video for mouth alignment, so you can synthesize emotionally styled speech (optionally in a cloned voice) and sync it to a character's mouth in one workflow. Через платформу APIMODELS доступ к этой модели идёт по единому API с прозрачной оплатой по факту использования. Текущая цена: per call: $0.01.
Профессиональная озвучка для видео, анимации и рекламы с большим выбором голосов.
Быстро собрать аудио для подкаста, в том числе с диалогом нескольких говорящих.
Превратить текст в естественную, связную речь для выпуска аудиокниг.
Дубляж и перевод на разные языки, чтобы контент дошёл до аудитории по всему миру.
Kling Lip-Sync TTS доступна через APIMODELS по цене: per call: $0.01. Оплата идёт по факту использования — вы платите только за то, что сгенерировали.
Зарегистрируйтесь на APIMODELS, получите API-ключ и обращайтесь к нашему единому эндпоинту. Есть подробная документация с примерами на cURL, Python и Node.js.
APIMODELS отдаёт ту же самую модель Kling Lip-Sync TTS через свою агрегирующую платформу. Мы предоставляем единый интерфейс API, поэтому отдельные аккаунты у каждого поставщика не нужны — один ключ открывает доступ ко всем моделям.
Это синтез речи, созданный специально для синхронизации губ: многоязычный и с поддержкой диалектов, с управлением скоростью, эмоциональными стилями и клонированием голоса. Сгенерированный голос сразу подаётся в Kling Lip-Sync Video для выравнивания с движением рта.
Для всех, кто генерирует звуковую дорожку для видео с синхронизацией губ: синтезируйте текст в эмоционально окрашенную речь нужного темпа (опционально клонированным голосом), затем выровняйте её с ртом персонажа на видео.
В APIMODELS Kling Lip-Sync TTS соседствует более чем с 60 моделями под одним API-ключом и общим балансом, поэтому выбор — это вопрос соответствия задаче, а не привязки к поставщику. Модель поддерживает Text to Speech, Multi-Language, Voice Clone, Speed Control; вы можете сравнить её по цене и возможностям с другими моделями категории «аудио и речь» и переключиться, изменив одну строку с именем модели — без нового аккаунта и без переписывания интеграции. Все варианты категории «аудио и речь» с актуальными ценами — на apimodels.app/models.
Kling Lip-Sync TTS поддерживает: Text to Speech, Multi-Language, Voice Clone, Speed Control. Полный список параметров и примеры вызовов — в документации APIMODELS.
Да. APIMODELS отдаёт Kling Lip-Sync TTS через единый API и один ключ — отдельные аккаунты у каждого поставщика не нужны, и вам не приходится самостоятельно решать вопросы регионального сетевого доступа к каждому из них.
Принимаем Stripe (Visa, Mastercard и другие международные карты) и Alipay. Баланс становится доступен сразу после оплаты.