Opus 5.5 发布那一周,时间线上满是标着「用 Opus 5.5 做的」产品片和卡点短片。想复现的人需要知道底下发生了什么:模型写的是一个动画程序,由渲染器把程序变成视频。这让结果可复现、可修改 —— 想改某个镜头,按时间码让它改代码就行 —— 但也意味着需要一个渲染步骤,而且除非你自己加,否则没有声音。
对 claude-opus-5-5 流式调用一次,不限 max_tokens;因为模型先思考,回答的第一个字在 110 秒后出现。它返回的 HTML 渲染 360 帧零报错,四个检查帧第一次就和故事板对上:2.3 秒的混乱、3.5 秒的一把钥匙、7.2 秒的模型卡、11.3 秒的结尾卡。
| 项目 | 数值 |
|---|---|
| 模型 | claude-opus-5-5,经 api.apimodels.app |
| 首字 / 总耗时 | 110 秒 / 6 分 37 秒 |
| 输出 token | 31,786 |
| 实扣 | $0.368 |
| 渲染 | 无头 Chrome,360 帧 14 秒 |
| 成片 | 12 秒,1280x720,30 fps,1.8 MB MP4 |
左:最后一帧。右:四个检查帧与故事板对照。全部来自模型原样返回的 HTML。
完整 MP4、提示词原文、渲染和编码脚本以及 HTML 都在 Claude Opus 5.5 模型页上。
A 12-second promo for "APIMODELS" rendered by window.renderFrame(t) on a 1280x720 canvas, 120 BPM beat plan: clutter of API keys, snap into one glowing key, model cards lighting up per beat, end card "One key. Every model."
要的是程序而不是视频:一个 canvas、一个全局 renderFrame(t),每次从零画出第 t 秒那一帧,不读时钟、不用随机数,并固定时长和帧率。先按时间段讲故事,再讲风格,并给一个节拍让转场落在拍上。流式调用,max_tokens 给大或不传;第一个字要等一两分钟。
然后用无头浏览器打开页面,对每一帧调用 renderFrame(i / fps),把 canvas 存成 PNG,再用 ffmpeg 编码。配乐事后按你给模型的节拍合进去。评价成片前一定先看几帧:模型不会运行自己写的代码。
cURL
curl https://api.apimodels.app/v1/messages \
-H "x-api-key: $APIMODELS_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{"model": "claude-opus-5-5", "max_tokens": 16000,
"messages": [{"role": "user", "content": "Summarise the risks in this pull request: ..."}]}'不能直接生成视频文件。它写的是画出动画每一帧的代码,再由无头 Chrome 加 ffmpeg 这类渲染器变成 MP4。我们的实测中一次调用生成了 12 秒 1280x720 的短片,花费 $0.368。
没有。程序只画画面。音乐或配音事后用 ffmpeg 合进去;在提示词里给模型一个节拍,可以让转场对上鼓点。
我们的 12 秒短片用了一次调用,6 分 37 秒,首字 110 秒,31,786 个输出 token,在 apimodels.app 上按每百万 $2.40 / $12 计费 $0.368。渲染 360 帧在笔记本上用了 14 秒。
要真实画面的话是的:Seedance、Veo 这类文生视频模型能出类似实拍的片段。Opus 5.5 写代码渲染的视频适合动效设计、产品讲解、界面动画,以及文字、形状和时间都要精确可改的内容。