字节跳动 Doubao Seedance 2.5,火山 Ark 官方直连(上游 doubao-seedance-2-5-260628)。相比 2.0,它把时长拉到 30 秒、参考素材加到 50 份,并新增了视频编辑与视频延长两种任务,以及 mov 交付格式。分辨率只有 480p 和 720p——没有 1080p,也没有 4K。
| 模型 | model | 分辨率 | 计费(每秒) |
|---|---|---|---|
| Doubao Seedance 2.5 | seedance-2.5 | 480p / 720p | $0.134 / $0.300 |
| Seedance 2.0 Official | seedance-2.0-official | 480p / 720p / 1080p | $0.092 / $0.197 / $0.492 |
第二行是 Seedance 2.0 官方版,放在这里做对照:2.5 的 720p 比它贵约 52%,换来 30 秒时长、50 份参考素材和编辑/延长任务。上游按生成 token 结算,上表是折算出的每秒值,实际扣费以完成的 token 为准;仅成功扣费、失败退款。
带参考视频的任务(编辑、延长)按 (源片秒数 + 输出秒数) 计费,单价 480p $0.080 / 720p $0.180。
例:编辑一段 4.0 秒的 480p 视频,输出 3.7 秒 → (4.0 + 3.7) × $0.080 ≈ $0.62。
⚠️ 这不是折扣。每秒单价确实更低,但源片的每一秒也计费,所以编辑一段与输出等长的视频,比重新生成同样长度贵 20-25%。想省钱就直接生成,别用编辑绕。
创建任务时我们会读取源片时长并按实际秒数冻结积分,任务完成后按上游返回的真实 token 结算多退少补。源片时长读不出来时按 30 秒上限冻结,同样在完成时退回差额。
别名:seedance-2-5 / seedance-2.5-official / doubao-seedance-2-5-260628 都指向同一个模型,响应里回显的规范名是 seedance-2.5。
所有请求在 Header 携带 API Key:
Authorization: Bearer YOUR_API_KEY/api/v1/video/generations·GET/api/v1/video/generations?task_id=# Text-to-video (model: seedance-2.5)
curl -X POST https://apimodels.app/api/v1/video/generations \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "seedance-2.5",
"prompt": "a hummingbird hovering near a bright flower, slow motion",
"resolution": "720p",
"aspect_ratio": "16:9",
"duration": 8
}'
# Poll until completed (result files are kept 7 days)
curl "https://apimodels.app/api/v1/video/generations?task_id=TASK_ID" \
-H "Authorization: Bearer YOUR_API_KEY"
# "duration": -1 → the model picks the best length for the prompt.
# "output_format": "mov" → H.264 + yuv444p + PCM instead of the default mp4.
#
# Real person: register the face in the asset library first, then reference it —
# a RAW real face URL is rejected at create-time, asset:// passes:
# "reference_image_urls": ["asset://asset-2026...-xxxx"]| 字段 | 必填 | 类型 | 说明 |
|---|---|---|---|
| model | 是 | string | seedance-2.5(别名 seedance-2-5 / seedance-2.5-official / doubao-seedance-2-5-260628) |
| prompt | 视情况 | string | 提示词(文生视频必填;有视觉输入时可选) |
| resolution | 否 | string | 480p 或 720p,默认 720p。2.5 没有 1080p,也没有 4K。 |
| aspect_ratio | 否 | string | 21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16 / adaptive(默认)。编辑、延长、首帧/首尾帧只能是 adaptive,见下方任务类型约束。 |
| duration | 否 | number | 4-30 秒;传 -1 由模型自己挑最合适的长度。视频编辑只能传 -1(或干脆不传)。 |
| generate_audio | 否 | boolean | 原生同步音频,默认 true |
| output_format | 否 | string | mp4(默认)或 mov。mov 走 H.264 + yuv444p + PCM,色彩保真更高,适合后期调色与抠像;代价是部分播放器打不开。 |
| first_frame_url | 否 | string | 图生视频首帧(https:// 或 asset://)。用了首帧,比例强制 adaptive。 |
| last_frame_url | 否 | string | 图生视频尾帧,需与 first_frame_url 搭配 |
| reference_image_urls | 否 | string[] | 参考图,最多 30 张(https:// 或 asset://,真人用 asset://)。在提示词里按顺序引用为 图片1 / @image1。 |
| reference_video_urls | 否 | string[] | 参考视频,最多 10 段,每段 2-30 秒、合计不超过 30 秒。编辑与延长的源视频也放这里,引用为 视频1 / @video1。 |
| reference_audio_urls | 否 | string[] | 参考音频,最多 10 段,每段 2-30 秒、合计不超过 30 秒。2.5 允许只传音频(2.0 必须搭配图片或视频)。 |
| web_search | 否 | boolean | 联网搜索工具 |
| task_type | 否 | string | generate / edit / extend——直接声明任务类型,免得后端从提示词里推断(推断错了也用它纠正) |
一个任务最多带 50 份参考素材:30 张图片 + 10 段视频 + 10 段音频。素材在提示词里按顺序引用——reference_image_urls 的第一项是「图片1 / @image1」,reference_video_urls 的第一项是「视频1 / @video1」,音频同理。给每份素材写清「用它的什么、不用它的什么」,比堆素材有效得多。
| 素材 | 数量上限 | 时长限制 | Seedance 2.0 |
|---|---|---|---|
| reference_image_urls | 30 | — | 9 |
| reference_video_urls | 10 | 每段 2-30 秒,合计 ≤ 30 秒 | 3 |
| reference_audio_urls | 10 | 每段 2-30 秒,合计 ≤ 30 秒 | 3 |
2.5 可以只传音频当参考(比如只给一段人声,让它配画面);2.0 要求音频必须跟图片或视频一起传。
2.5 新增了视频编辑(替换 / 增加 / 删除画面里的物体,也能改音轨)和视频延长(向前或向后续写,可多轮接力)。这两类任务,加上首帧 / 首尾帧,都会锁死输出比例——输出跟随源素材,你改不了。
| 任务类型 | 怎么触发 | aspect_ratio | duration |
|---|---|---|---|
| 文生视频 / 多模态参考 | prompt (+ reference_*_urls) | 7 个值任选,默认 adaptive | 4-30 或 -1 |
| 图生视频(首帧 / 首尾帧) | first_frame_url (+ last_frame_url) | 强制 adaptive | 4-30 或 -1 |
| 视频编辑 | 源视频放 reference_video_urls + 编辑指令 | 强制 adaptive | 强制 -1 |
| 视频延长 | 源视频放 reference_video_urls + 续写指令 | 强制 adaptive | 4-30 或 -1 |
两类任务共用一条端点:把源视频放进 reference_video_urls,在提示词里用「视频1 / @video1」指代它,再写清楚要改什么或往下续什么。task_type 可以不传(后端会从提示词推断),但显式声明更稳。
# ── Video EDITING — replace / add / remove objects, or edit the audio track ──
# The source clip goes in reference_video_urls and is cited as 视频1 / @video1.
# Editing forces aspect_ratio "adaptive" AND duration -1 (the output keeps the
# source ratio and length). Send either one and you get an immediate 400.
curl -X POST https://apimodels.app/api/v1/video/generations \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "seedance-2.5",
"prompt": "把视频1改成夜晚雨景,保留人物动作和镜头运动",
"reference_video_urls": ["https://example.com/source.mp4"],
"task_type": "edit"
}'
# ── Video EXTENSION — continue the clip forwards or backwards, round after round ──
# Extension also forces aspect_ratio "adaptive", but duration is yours: 4-30 or -1.
curl -X POST https://apimodels.app/api/v1/video/generations \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "seedance-2.5",
"prompt": "续写视频1,人物继续向前走进地铁站",
"reference_video_urls": ["https://example.com/source.mp4"],
"duration": 10,
"task_type": "extend"
}'按上游真实 token 用量(usage.completion_tokens)计费,仅成功扣费、失败退款。火山的换算公式是:
tokens = (input video seconds + output seconds) × width × height × fps ÷ 1024带参考视频的任务单价更低,但计费秒数是「输入秒数 + 输出秒数」。盈亏平衡点在 输入 = 输出 × 0.667——也就是说,拿一段和成片等长的素材去编辑或延长,花的钱比从零生成同样长度还要多约 20%。这不是折扣档,别当折扣用。
模型档位表里的每秒价(480p $0.134、720p $0.300)是从上述公式折算出来的展示值,实际账单以完成的 token 为准。
试一试:Playground
480p $0.134/秒、720p $0.300/秒(apimodels.app)。上游按真实 token 用量结算,所以这是折算出的每秒值;仅成功扣费、失败退款。对照:Seedance 2.0 官方版 480p/720p/1080p 为 $0.092/$0.197/$0.492,2.5 的 720p 贵约 52%。
只有 480p 和 720p——2.5 没有 1080p,也没有 4K(2.0 标准版是有 1080p 的)。时长 4 到 30 秒,传 duration: -1 则由模型自己挑最合适的长度。比例支持 21:9、16:9、4:3、1:1、3:4、9:16 和 adaptive(默认)。
调 POST /api/v1/video/generations,把源视频放进 reference_video_urls(源片本身必须 4-30 秒),提示词里用「视频1 / @video1」指代它——编辑写「把视频1改成夜晚雨景」,延长写「续写视频1」。编辑强制 aspect_ratio "adaptive" 且 duration -1,延长强制 adaptive;传别的值我们在创建时就返回 400,不会让任务排到上游才失败。
单个任务最多 50 份:30 张图片 + 10 段视频 + 10 段音频(2.0 是 9 + 3 + 3)。每段参考素材 2-30 秒,视频合计、音频合计各不超过 30 秒。2.5 允许只传音频当参考,2.0 不行。
不便宜。带参考视频的任务单价更低,但计费秒数是输入秒数 + 输出秒数(tokens =(输入视频秒数 + 输出秒数)× 宽 × 高 × 帧率 ÷ 1024)。盈亏平衡点在 输入 = 输出 × 0.667,所以拿一段和成片等长的素材去编辑或延长,比从零生成同样长度还贵约 20%。