digital-human«Цифровой человек» получает две ссылки и делает всю работу: в video_url вы кладёте ролик с человеком (mp4 или mov), в audio_url — озвучку (mp3, wav или m4a, до 30 минут), а на выходе получаете mp4 с попадающей в звук артикуляцией. Это не то же самое, что оживить одну фотографию: свет, движение, фон и работа камеры берутся из вашего же материала, модель заново анимирует только рот, поэтому в готовом ролике остаётся тот же человек из той же съёмки, а не насильно приведённый в движение снимок. Длительность всегда следует за звуком: если аудио длиннее видео, картинка автоматически продлевается (проверено на ролике 5 секунд с озвучкой 6,2 секунды), поэтому и счёт считается прямо по секундам аудио — $0.01 за секунду, то есть шестидесятисекундная озвучка стоит $0.60, ровно вдвое выгоднее покадрового липсинка по фотографии ai-lipsync ($0.02/с). Если видео у вас нет и есть только портретный снимок, нужен как раз ai-lipsync. Разрешение выходного файла повторяет исходное видео, принудительного даунскейла нет (проверяли на 1440×2560). Интерфейс асинхронный: POST на /api/v1/video/generations с model, video_url и audio_url возвращает task_id, дальше опрос; короткие ролики обычно готовы примерно за 2 минуты. На apimodels.app списываются только успешные задачи, результат хранится 30 дней. Используйте только на тех, кто дал согласие или чьи права у вас есть.
$0.01 per second of audio · if the audio outlasts the video, the footage is extended automatically
Your talking video will appear here
$0.01 per second of audio vs $0.02/s for the image-based ai-lipsync — when you already have footage of the person, this is the more affordable path
Lighting, motion, background and camera work come from your footage; only the mouth is re-animated to match the new audio
Audio longer than the video? The footage is extended automatically — verified with a 6.2s voiceover over a 5s clip
Output matches the source video resolution (tested at 1440×2560) — no forced downscale
POST /api/v1/video/generations with model digital-human, video_url and audio_url — poll the task id for the mp4
Digital Human — это API категории «генерация видео» от APIMODELS. «Цифровой человек» получает две ссылки и делает всю работу: в video_url вы кладёте ролик с человеком (mp4 или mov), в audio_url — озвучку (mp3, wav или m4a, до 30 минут), а на выходе получаете mp4 с попадающей в звук артикуляцией. Это не то же самое, что оживить одну фотографию: свет, движение, фон и работа камеры берутся из вашего же материала, модель заново анимирует только рот, поэтому в готовом ролике остаётся тот же человек из той же съёмки, а не насильно приведённый в движение снимок. Длительность всегда следует за звуком: если аудио длиннее видео, картинка автоматически продлевается (проверено на ролике 5 секунд с озвучкой 6,2 секунды), поэтому и счёт считается прямо по секундам аудио — $0.01 за секунду, то есть шестидесятисекундная озвучка стоит $0.60, ровно вдвое выгоднее покадрового липсинка по фотографии ai-lipsync ($0.02/с). Если видео у вас нет и есть только портретный снимок, нужен как раз ai-lipsync. Разрешение выходного файла повторяет исходное видео, принудительного даунскейла нет (проверяли на 1440×2560). Интерфейс асинхронный: POST на /api/v1/video/generations с model, video_url и audio_url возвращает task_id, дальше опрос; короткие ролики обычно готовы примерно за 2 минуты. На apimodels.app списываются только успешные задачи, результат хранится 30 дней. Используйте только на тех, кто дал согласие или чьи права у вас есть. Через платформу APIMODELS доступ к этой модели идёт по единому API с прозрачной оплатой по факту использования. Текущая цена: per second of audio: $0.01.
Быстро собрать промо-видео бренда под рекламные кампании и продвижение в соцсетях.
Короткие вертикальные ролики для TikTok, Instagram и YouTube.
Показать возможности продукта и снять обучающие ролики, которые повышают конверсию.
Объяснения к курсам, разборы тем и обучающие видео — недорого и на потоке.
Digital Human доступна через APIMODELS по цене: per second of audio: $0.01. Оплата идёт по факту использования — вы платите только за то, что сгенерировали.
Зарегистрируйтесь на APIMODELS, получите API-ключ и обращайтесь к нашему единому эндпоинту. Есть подробная документация с примерами на cURL, Python и Node.js.
APIMODELS отдаёт ту же самую модель Digital Human через свою агрегирующую платформу. Мы предоставляем единый интерфейс API, поэтому отдельные аккаунты у каждого поставщика не нужны — один ключ открывает доступ ко всем моделям.
В APIMODELS Digital Human соседствует более чем с 60 моделями под одним API-ключом и общим балансом, поэтому выбор — это вопрос соответствия задаче, а не привязки к поставщику. Модель поддерживает Video + Audio, Lip-Sync, Keeps Original Motion, Audio up to 30min, Per-Second Pricing; вы можете сравнить её по цене и возможностям с другими моделями категории «генерация видео» и переключиться, изменив одну строку с именем модели — без нового аккаунта и без переписывания интеграции. Все варианты категории «генерация видео» с актуальными ценами — на apimodels.app/models.
Digital Human поддерживает: Video + Audio, Lip-Sync, Keeps Original Motion, Audio up to 30min, Per-Second Pricing. Полный список параметров и примеры вызовов — в документации APIMODELS.
Да. APIMODELS отдаёт Digital Human через единый API и один ключ — отдельные аккаунты у каждого поставщика не нужны, и вам не приходится самостоятельно решать вопросы регионального сетевого доступа к каждому из них.
Принимаем Stripe (Visa, Mastercard и другие международные карты) и Alipay. Баланс становится доступен сразу после оплаты.