digital-human数字人视频接收两个地址就能干活:video_url 传一段人物视频(mp4 / mov),audio_url 传驱动音频(mp3 / wav / m4a,最长 30 分钟),还回来一条对好口型的 mp4。和「一张静态照片生成说话头」不是一回事 —— 这里的光影、动作、背景和运镜全部来自你自己的素材,模型只重新驱动嘴部,所以成片里的人看起来还是原来那条片子里的那个人,而不是一张被强行动起来的照片。成片长度永远跟着音频走:音频比视频长时,画面会自动延长补足(我们拿一段 5 秒视频配 6.2 秒旁白验过),所以计费也就直接按驱动音频的秒数算 —— $0.01 一秒,一段 60 秒的旁白 $0.60,正好是图片版 ai-lipsync($0.02/秒)的一半。反过来说,手上只有一张肖像照、根本没有视频素材时,才该去用 ai-lipsync。输出分辨率跟随源视频、不强制降采样(实测跑过 1440×2560)。接口是异步的:POST /api/v1/video/generations 传 model、video_url 和 audio_url 拿到 task_id,再轮询取成片,短片通常 2 分钟左右回来。只对成功的任务扣费,成片保留 30 天,请及时下载或转存。请仅对已获授权 / 已同意的对象使用。
$0.01 per second of audio · if the audio outlasts the video, the footage is extended automatically
Your talking video will appear here
$0.01 per second of audio vs $0.02/s for the image-based ai-lipsync — when you already have footage of the person, this is the more affordable path
Lighting, motion, background and camera work come from your footage; only the mouth is re-animated to match the new audio
Audio longer than the video? The footage is extended automatically — verified with a 6.2s voiceover over a 5s clip
Output matches the source video resolution (tested at 1440×2560) — no forced downscale
POST /api/v1/video/generations with model digital-human, video_url and audio_url — poll the task id for the mp4
Digital Human 是由 APIMODELS 提供的视频生成 API。数字人视频接收两个地址就能干活:video_url 传一段人物视频(mp4 / mov),audio_url 传驱动音频(mp3 / wav / m4a,最长 30 分钟),还回来一条对好口型的 mp4。和「一张静态照片生成说话头」不是一回事 —— 这里的光影、动作、背景和运镜全部来自你自己的素材,模型只重新驱动嘴部,所以成片里的人看起来还是原来那条片子里的那个人,而不是一张被强行动起来的照片。成片长度永远跟着音频走:音频比视频长时,画面会自动延长补足(我们拿一段 5 秒视频配 6.2 秒旁白验过),所以计费也就直接按驱动音频的秒数算 —— $0.01 一秒,一段 60 秒的旁白 $0.60,正好是图片版 ai-lipsync($0.02/秒)的一半。反过来说,手上只有一张肖像照、根本没有视频素材时,才该去用 ai-lipsync。输出分辨率跟随源视频、不强制降采样(实测跑过 1440×2560)。接口是异步的:POST /api/v1/video/generations 传 model、video_url 和 audio_url 拿到 task_id,再轮询取成片,短片通常 2 分钟左右回来。只对成功的任务扣费,成片保留 30 天,请及时下载或转存。请仅对已获授权 / 已同意的对象使用。 通过 APIMODELS 平台,您可以使用统一的 API 接口调用该模型,按量计费、价格透明。当前定价:per second of audio: $0.01。
快速生成品牌宣传视频,适用于广告投放和社交媒体推广。
为抖音、小红书等平台创建引人注目的短视频内容。
生成产品功能演示和使用教程视频,提升用户转化率。
制作课程讲解、知识科普等教育类视频,降低视频制作门槛。
Digital Human 通过 APIMODELS 平台调用,当前定价:per second of audio: $0.01。按量计费,用多少付多少。
在 APIMODELS 注册账号并获取 API Key,然后通过我们的统一 API 端点调用即可。我们提供详细的 API 文档和 cURL、Python、Node.js 代码示例。
APIMODELS 通过聚合平台提供与官方相同的 Digital Human 模型。我们提供统一的 API 接口,无需分别注册各平台账号,一个 API Key 即可调用所有模型。
在 APIMODELS,Digital Human 与 60+ 个模型共用一个 API Key、一个余额,所以选型只看合不合适,不存在锁定。它支持 Video + Audio、Lip-Sync、Keeps Original Motion、Audio up to 30min、Per-Second Pricing,你可以在价格和能力上把它和其它视频生成模型对比,换模型只需改一个模型名字符串——无需新账号、无需重新对接。所有视频生成模型与实时价格见 apimodels.app/models。
Digital Human 支持:Video + Audio、Lip-Sync、Keeps Original Motion、Audio up to 30min、Per-Second Pricing。完整参数与调用方式见 APIMODELS 的 API 文档。
可以。APIMODELS 提供可直接访问的统一 API,一个 API Key 即可调用 Digital Human,无需分别注册官方账号、也无需自行处理官方接口的网络访问。
我们支持 Stripe(Visa、Mastercard 等国际信用卡)和支付宝付款。充值后积分即时到账。