MiniMax 海螺 H3 是通用型多模态视频模型:文本、图片、视频、音频在同一次请求里一起读,一遍生成画面、运动与声音已对齐的成片(原生同步音频),不需要事后拼配音、对口型或运动迁移。纯 prompt 即文生视频;按需附加最多 9 张参考图、3 段参考视频、3 段参考音频来锁定角色、运镜和声音。时长 5-15 整秒任选,按秒计费:768P $0.097/秒,原生 2K $0.145/秒。
| 档位 | resolution | 每秒 | 5s | 10s | 15s |
|---|---|---|---|---|---|
| 原生 2K(默认) | 2k | $0.145 | $0.725 | $1.45 | $2.175 |
| 768P | 768p | $0.097 | $0.485 | $0.97 | $1.455 |
两档都带原生同步音频,区别只在分辨率。样片、信息流或小窗播放用 768P 能省三分之一;交付成片用原生 2K,不经任何放大步骤。仅成功扣费、失败退款。
别名:hailuo-h3 与 minimax-h3 指向同一个模型——Hailuo(海螺)是 MiniMax 视频模型线的产品名。
参考素材在输出秒数之外单独计价——参考视频按它自己的时长计,参考音频免费,参考图前 5 张免费。
| 素材 | 上限 | 计价 |
|---|---|---|
| images | 9 张 | 前 5 张免费,第 6 张起 $0.054/张 |
| video_list | 3 段,每段不超过 15 秒 | 按参考视频自身秒数:2K $0.135/秒,768P $0.081/秒 |
| audio_list | 3 段 | 免费 |
例:2K 输出 10 秒,带一段 7 秒的参考视频 → 10 × $0.145 + 7 × $0.135 = $2.395。再例:2K 输出 5 秒,带 8 张参考图 → 5 × $0.145 + 3 × $0.054 = $0.887。
超过 15 秒的参考视频在创建时就被拒绝:我们会读取每段参考视频的实际时长,超限直接返回明确的 400,不建任务、不冻结积分。
所有请求在 Header 携带 API Key:
Authorization: Bearer YOUR_API_KEY/api/v1/video/generations·GET/api/v1/video/generations?task_id=# Text-to-video (model: minimax-h3 — the alias hailuo-h3 also works)
curl -X POST https://api.apimodels.app/v1/video/generations \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "minimax-h3",
"prompt": "a lighthouse keeper climbs a spiral staircase at dusk, warm lamplight, waves crashing outside",
"resolution": "768p",
"ratio": "16:9",
"duration": 10
}'
# Poll until completed (result files are kept 7 days)
curl "https://api.apimodels.app/v1/video/generations?task_id=TASK_ID" \
-H "Authorization: Bearer YOUR_API_KEY"
# All reference inputs are optional — prompt alone is text-to-video.
# Attach images / video_list / audio_list to steer character, motion and voice
# in the same request (see the multimodal example in the Python / Node tabs).| 字段 | 必填 | 类型 | 说明 |
|---|---|---|---|
| model | 是 | string | minimax-h3(别名 hailuo-h3) |
| prompt | 是 | string | 提示词。用平实的语言描述画面,以及每份参考素材要提供什么(外貌、运镜、节奏、声音)。 |
| duration | 是 | number | 5-15 的整数秒。必填,且必须是整秒。 |
| resolution | 否 | string | 768p 或 2k,默认 2k。 |
| ratio | 否 | string | adaptive(默认)/ 21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16。也接受 aspect_ratio 这个字段名。 |
| images | 否 | string[] | 参考图,最多 9 张(公网 URL 或 base64)。前 5 张免费,第 6 张起 $0.054/张。也接受 reference_image_urls。 |
| video_list | 否 | string[] | 参考视频,最多 3 段、每段不超过 15 秒(公网 URL 或 base64),按自身秒数计价(2K $0.135/秒、768P $0.081/秒)。也接受 video_urls / reference_video_urls。 |
| audio_list | 否 | string[] | 参考音频,最多 3 段(公网 URL 或 base64),免费。也接受 audio_urls / reference_audio_urls。 |
| callback_url | 否 | string | 任务完成时我们向该地址 POST 结果;不传就轮询 GET 查询。 |
total = duration × per-second price
+ reference video seconds × input-video price
+ max(0, images − 5) × $0.054试一试:Playground
在 apimodels.app,768P $0.097/秒,原生 2K $0.145/秒(5 秒即 $0.485 / $0.725)。参考素材单独计价:参考视频按自身时长计,2K $0.135/秒、768P $0.081/秒;参考音频免费;参考图前 5 张免费,第 6 张起 $0.054/张。仅成功扣费,失败全额退款。
同一次请求可同时给文本、图片、视频、音频:最多 9 张参考图、3 段参考视频(每段不超过 15 秒)、3 段参考音频,全部可选、可自由组合。只传 prompt 就是纯文生视频。每份素材接受公网 URL 或 base64。
调 POST /api/v1/video/generations,model 设为 minimax-h3(别名 hailuo-h3 也可),传 prompt 和 duration(5-15 整秒)。按需加 resolution(768p 或 2k,默认 2k)、ratio、images、video_list、audio_list。返回 taskId 后轮询 GET /api/v1/video/generations?task_id=xxx,或传 callback_url 在完成时接收回调。apimodels.app 一把 API Key 通调全站模型。
两个分辨率档:768p 和原生 2k,都带同步音频。时长 5 到 15 整秒任选。比例:adaptive(默认)、21:9、16:9、4:3、1:1、3:4、9:16。