Wan 2.2 Spicy 图生视频:给一张首帧和一句提示词,产出 5 秒或 8 秒的片段;也可以再给一张尾帧,让模型在首尾之间补间。分辨率 480p 或 720p,按秒计价。这个模型只通过 API 提供,没有网页 Playground。
Authorization: Bearer YOUR_API_KEY| 分辨率 | 每秒 | 5 秒片 | 8 秒片 | 实际画面 |
|---|---|---|---|---|
| 480p | $0.03 | $0.15 | $0.24 | 832x480 |
| 720p | $0.06 | $0.30 | $0.48 | 1280x720 |
按你请求的 duration 计价(5 或 8 秒),与成片实际长度无关;首尾帧不额外收费。失败不扣费。
| 必须有首帧 | 这是图生视频,没有纯文生视频模式。不传 image 直接 400。 |
| 时长只有 5 秒和 8 秒 | 没有别的取值。传 6 或 10 会返回 400 并写明合法值,不会被改成最接近的合法值再照常收费。 |
| 分辨率只有 480p 和 720p | 实际出片 832x480 和 1280x720。没有 1080p、2K、4K,要更大请生成后再走视频超分。 |
| 成片没有音轨 | 返回的 MP4 是纯画面。需要声音请后期配音,或改用会生成音频的视频模型。 |
| 出片 35 到 75 秒 | 实测区间,随分辨率和时长上升;480p/5 秒约 35 秒,720p/8 秒约 72 秒。按异步任务设计你的轮询。 |
| 无水印 | 四个档位各出一片、逐个检查画面四角,没有任何水印或角标。 |
# ─── Image-to-video (first frame + prompt) ────────────────
curl -X POST https://api.apimodels.app/v1/video/generations \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "wan-2.2-i2v-spicy",
"image": "https://example.com/first-frame.jpg",
"prompt": "she slowly turns toward the camera, hair moving in the wind",
"duration": 5,
"resolution": "480p"
}'
# Response (async — a task is created):
# { "code": 200, "data": { "taskId": "clxxx", "state": "pending" } }
# ─── First + last frame (the model interpolates between them) ──
curl -X POST https://api.apimodels.app/v1/video/generations \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "wan-2.2-i2v-spicy",
"image": "https://example.com/first.jpg",
"last_image": "https://example.com/last.jpg",
"prompt": "smooth camera push-in",
"duration": 8,
"resolution": "720p",
"seed": 42
}'
# ─── Poll for the result ──────────────────────────────────
curl "https://api.apimodels.app/v1/video/generations?task_id=TASK_ID" \
-H "Authorization: Bearer YOUR_API_KEY"
# { "code": 200, "data": { "state": "completed", "resultUrls": ["https://r2.apimodels.app/..."] } }| 字段 | 必填 | 类型 | 说明 |
|---|---|---|---|
| model | 是 | string | wan-2.2-i2v-spicy |
| image | 是 | string | 首帧:公网图片 URL 或 base64。也收 image_url / first_frame_url。 |
| prompt | 是 | string | 描述画面怎么动 |
| last_image | 否 | string | 尾帧,给了就在首尾之间补间。也收 image_tail / last_frame_url。 |
| duration | 否 | number | 只能是 5 或 8,默认 5。其它值直接 400,不会被改成合法值。 |
| resolution | 否 | string | 只能是 480p 或 720p,默认 480p。没有 1080p/4K。 |
| seed | 否 | number | 随机种子(0 到 2147483647),不传则随机 |
| prompt_extend | 否 | boolean | 提示词自动优化,默认开启。详见下一节。 |
| callback_url | 否 | string | 任务完成后的回调 URL |
开启时,模型会先把你的提示词交给一个专门的改写服务扩写、补细节,再拿扩写后的版本去生成。它对「一句话提示词」帮助最大 —— 比如你只写「她转头」,扩写会补上镜头、光线、运动幅度这些模型爱看的描述。这个开关默认是开的。
传 prompt_extend: false 可以关掉,模型严格按你写的原文生成。已经写了长而精确的提示词、或者要做可复现的对照实验(配合 seed)时就该关掉 —— 否则每次扩写的结果不同,seed 固定也对不齐。
注意:提示词优化没有单独的接口,只能通过这个参数触发;它不改变计价 —— 价格只看分辨率和时长。
按你请求的时长计价:480p $0.03/秒、720p $0.06/秒。也就是 5 秒片 $0.15 或 $0.30,8 秒片 $0.24 或 $0.48。加尾帧不额外收费,失败不扣费。
时长只有 5 秒和 8 秒,分辨率只有 480p(832x480)和 720p(1280x720),没有别的取值。传其它值会返回 400 并说明合法范围,不会被静默改档后照常计费。
不会。返回的 MP4 没有音轨,需要声音请后期配音或改用会出声的视频模型。它也必须有首帧,没有纯文生视频模式;成片无水印。
它是提示词自动优化,默认开启:生成前先把你的提示词扩写,补上镜头、光线、运动幅度等细节,对一句话提示词帮助最大。传 prompt_extend: false 就严格按原文生成 —— 提示词已经写得精确、或要配合固定 seed 做可复现对照时应该关掉。提示词优化没有单独的接口,也不改变价格。