Replicate 自 2025 年 12 月起属于 Cloudflare,它其实是两个产品:一个按 GPU 时长计费的 5 万多个社区模型市场,和 100 多个按产出计费的「官方模型」,比如 Nano Banana Pro、Veo 3.1、可灵、Seedance。APIMODELS 只和后者竞争。如果你只调商用模型、从不部署自己的模型,要比的就是价格、接口形态,以及出问题时各家怎么处理,这一页比的正是这些。
Nano Banana Pro 1K–2K 这里每张 $0.08,Replicate 是 $0.15;4K 是 $0.13 对 $0.30。一条 8 秒带音频的 Veo 3.1,这里 $1.00,Replicate 按每秒 $0.40 算是 $3.20;Veo 3.1 Fast 是 $0.07 对 $1.20。可灵 3.0 pro 带音频每秒 $0.24 对 $0.336;medium 画质的 GPT Image 2 这里 1K $0.025、2K $0.03,Replicate $0.047。Replicate 的数字全部取自 2026 年 10 月 6 日它的模型页。
生产环境里有两个实际差别。Replicate 默认一小时后删除 API 输出,文件必须马上转存;这里的结果文件 30 天内都能下载。Replicate 只能用 GitHub 登录;APIMODELS 任意邮箱注册,不需要组织认证,中国大陆可直连,支持银行卡、PayPal、支付宝和 USDT。托管模型跑失败,两边都不收费。
Replicate 一列来自它的模型页、文档、定价页和服务条款,2026-10-06 核对,出处在本页末尾。
| APIMODELS | Replicate | |
|---|---|---|
| 定位 | 托管商用模型的多模型 API 网关 | 模型平台:社区模型按 GPU 时长、官方模型按产出计费,另有自定义部署 |
| 模型覆盖 | 149 个:图像 37、视频 40、大模型 49、音频 21、向量 2(2026 年 10 月) | 5 万+ 个模型,其中 100 多个是按产出计价的官方模型 |
| 计费 | 按张、按秒或按百万 token 固定价 | 官方模型按产出;其他模型按 GPU 秒(H100 每小时 $5.49) |
| 失败请求 | 一律不扣费 | 公开模型和官方模型不收费;私有模型和 Deployments 照常计费 |
| 接口形态 | 对话和图像端点兼容 OpenAI,原生 Anthropic Messages;视频异步、支持 callback_url | Predictions API,异步 + webhook,或 Prefer: wait 同步(最长 60 秒);文档里没有 OpenAI 兼容端点 |
| 输出保留 | 30 天 | API 输出默认 1 小时后删除 |
| 注册与认证 | 任意邮箱;不做组织或证件认证 | 只能 GitHub 登录;未提及证件认证 |
| 付款方式 | 银行卡(Stripe)、PayPal、支付宝、USDT;$10 起充 | 预付额度,银行卡或银行转账(1 年有效、不退款),或后付费 |
| 自定义模型 | 不提供 | Cog 打包、私有模型、可设最小 / 最大实例的 Deployments、微调 |
美元,2026-10-06 核对,对比的是 Replicate 官方模型的价格。这里的 Veo 每条 8 秒、1080p、带音轨。Replicate 的 GPT Image 2 每个画质档一个价、不分尺寸;它的 Grok Imagine Video 1.5 是只做图生视频的预览版,只有 480p 和 720p。大模型方面,Replicate 的 Claude Sonnet 5 按 Anthropic 官方价每百万 token $2 / $10 收,这里 $1.60 / $8;核对当天它没有 Claude Sonnet 5.5、Opus 5.5 和 GPT-6。
| 模型与单位 | APIMODELS | Replicate | 价格更低 |
|---|---|---|---|
| Nano Banana Pro,1K–2K / 4K,每张 | $0.08 / $0.13 | $0.15 / $0.30 | APIMODELS |
| GPT Image 2,medium 画质,1K / 2K,每张 | $0.025 / $0.03 | $0.047 | APIMODELS |
| GPT Image 2,high 画质,1K / 2K,每张 | $0.07 / $0.10 | $0.128 | APIMODELS |
| 可灵 3.0 标准 / pro,带音频,每秒 | $0.18 / $0.24 | $0.252 / $0.336 | APIMODELS |
| Veo 3.1,8 秒带音频,每条 | $1.00 | $3.20(每秒 $0.40) | APIMODELS |
| Veo 3.1 Fast,8 秒带音频,每条 | $0.07 | $1.20(每秒 $0.15) | APIMODELS |
| Grok Imagine Video 1.5,480p / 720p,每秒(Replicate 上为预览版、仅图生视频) | $0.045 / $0.0529 | $0.08 / $0.08 | APIMODELS |
要跑的模型不是商用 API,选 Replicate。任何模型都能用 Cog 打包、设为私有,通过可设最小和最大实例数的 Deployments 提供服务;按 Replicate 文档里的示例,FLUX 微调一次约 $1.46。APIMODELS 不能托管你的权重。
要开源模型的长尾,选 Replicate:5 万多个社区模型,从小众超分模型到研究用的检查点,都走同一个 predictions API,有 Node.js、Python、Swift、Go 的 SDK 和 MCP server。
fal.ai 适合想在同一家拿到托管模型和 Serverless GPU 部署的团队,它还提供 4K 的 Veo 3.1。
OpenRouter 适合以大模型为主、需要供应商路由和零数据保留控制的负载。
Kie.ai 适合会用到它 Suno V6 全套功能和 Runway 接口的用户。这三家各有一篇对比页,链接在页面底部。
把 replicate.run(...) 换成 APIMODELS,每个任务就是一次 HTTP 请求。Replicate 用路径(owner/name)指定模型、参数放在 input 对象里;APIMODELS 把模型作为 JSON 字段(veo-3.1、kling-v3、seedance-2.0、gemini-3-pro-image 等),和提示词、参数放在一起,发到 POST /v1/video/generations 或 /v1/images/generations。
Replicate 的 webhook 换成 callback_url。它的 Prefer: wait 同步模式,对应这里 OpenAI 风格的图像调用:传 1024x1024 这类 OpenAI 尺寸、不带 callback_url,响应里直接带图。视频则轮询 GET /v1/video/generations?task_id=… 直到 state 为 completed。这里结果保留 30 天,如果你有「一小时内必须转存」的步骤只是为了应付 Replicate 的保留期,可以放宽。
大模型调用改用 OpenAI SDK(base_url 为 https://api.apimodels.app/v1)或 Anthropic SDK(https://api.apimodels.app),模型名用 claude-sonnet-5、claude-sonnet-5-5 这类。
| 内容 | 出处 |
|---|---|
| 图像价格 | replicate.com/google/nano-banana-pro;replicate.com/openai/gpt-image-2 |
| 视频价格 | replicate.com/kwaivgi/kling-v3-video;/google/veo-3.1;/google/veo-3.1-fast;/xai/grok-imagine-video-1.5 |
| 大模型价格 | replicate.com/anthropic/claude-sonnet-5 |
| 计费、失败、预付额度 | replicate.com/docs/topics/billing;/docs/topics/billing/prepaid-credit;replicate.com/pricing;replicate.com/terms |
| 接口、webhook、保留期 | replicate.com/docs/topics/predictions/create-a-prediction;/docs/topics/predictions/data-retention |
| Cog、Deployments、微调 | replicate.com/docs/get-started/deploy-a-custom-model;/docs/topics/deployments;/docs/get-started/fine-tune-with-flux |
| 被 Cloudflare 收购、模型数量 | replicate.com/blog/replicate-cloudflare;blog.cloudflare.com/why-replicate-joining-cloudflare |
| APIMODELS 价格 | apimodels.app/pricing 与各模型页 |
cURL
# Before (Replicate): replicate.run("google/veo-3.1", input={"prompt": ...})
# After (APIMODELS): model goes in the body; 8 s, 1080p, with audio, $1.00 per clip
curl -X POST https://api.apimodels.app/v1/video/generations \
-H "Authorization: Bearer $APIMODELS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "veo-3.1",
"prompt": "A paper boat drifting down a rain-soaked street at dusk",
"aspect_ratio": "9:16",
"images": ["https://example.com/first-frame.jpg"]
}'
# images is optional: [first frame] or [first frame, last frame]
# poll: curl "https://api.apimodels.app/v1/video/generations?task_id=TASK_ID" -H "Authorization: Bearer $APIMODELS_API_KEY"Python
import requests, time
BASE = "https://api.apimodels.app/v1"
H = {"Authorization": "Bearer YOUR_APIMODELS_KEY"}
# Before (Replicate): replicate.run("kwaivgi/kling-v3-video", input={...})
task = requests.post(f"{BASE}/video/generations", headers=H, json={
"model": "kling-v3",
"prompt": "A barista pours latte art in a sunlit cafe, ambient chatter",
"mode": "pro", # std or pro
"duration": "10",
"sound": "on", # pro + audio: $0.24 per second
}).json()["data"]["taskId"]
while True:
s = requests.get(f"{BASE}/video/generations", headers=H,
params={"task_id": task}).json()["data"]
if s["state"] in ("completed", "failed"):
print(s.get("resultUrls")) # downloadable for 30 days
break
time.sleep(5)本页价格表里的模型,都是我们更低。2026 年 10 月 6 日核对:Nano Banana Pro 1K–2K 这里每张 $0.08,Replicate $0.15(4K 是 $0.13 对 $0.30);8 秒带音频的 Veo 3.1 $1.00 对 $3.20,Veo 3.1 Fast $0.07 对 $1.20;可灵 3.0 带音频每秒 $0.18 / $0.24(标准 / pro)对 $0.252 / $0.336;medium 画质的 GPT Image 2 这里 1K $0.025、2K $0.03,Replicate 一律 $0.047;Grok Imagine Video 1.5 在 480p / 720p 每秒 $0.045 / $0.0529,Replicate 的图生视频预览版是 $0.08。Replicate 官方模型按产出计价,建议按你实际用的分辨率和画质对比。
我们不公布可用率数字,所以比规则。APIMODELS 上生成失败一律不扣费,很多模型在不止一条上游线路之间自动切换,你的服务宕机时异步任务的回调会重试最长 30 分钟。Replicate 的文档写明,公开模型和官方模型跑失败不收费,私有模型和 Deployments 的失败、取消照常计费;它提供 webhook,以及最长 60 秒的 Prefer: wait 同步模式。保留期也要算进去:Replicate 默认一小时后删除 API 输出,错过一次 webhook 可能就丢了文件;这里结果 30 天内都能下载,任何任务都能用 task_id 重新查询。
把每个 replicate.run 或 predictions 调用换成一次 POST:视频模型发到 /v1/video/generations,图像模型发到 /v1/images/generations,模型写成 JSON 字段而不是路径 —— google/veo-3.1 变成 "model": "veo-3.1",kwaivgi/kling-v3-video 变成 "model": "kling-v3"。input 里的字段提到 JSON 顶层,具体字段名以各模型文档页为准,不同模型家族有差异。webhook 换成 callback_url,或者用返回的 task_id 轮询到 state 为 completed,再读 resultUrls。想同步拿图,就传 OpenAI 风格的 size、不带 callback_url。大模型代码把 OpenAI SDK 指向 https://api.apimodels.app/v1。用 Cog 打包的自定义模型迁不过来。
Replicate 要求先用银行卡或银行转账预购额度,已购额度 1 年有效、不退款,自动续充的门槛最低 $5、每次最少续 $15;大客户可以后付费。社区模型按 GPU 时长计费(H100 每小时 $5.49),官方模型按产出计费。APIMODELS 也是预付:$10 起充,支持 Stripe 银行卡、PayPal、支付宝、USDT,$50 起的档位另送 2–5%,银行卡付款自动开发票;每个模型按张、按秒或按百万 token 一个固定价,发请求之前就知道这一单多少钱。用常见邮箱新注册送 $0.10 试用。
不能。APIMODELS 只提供我们选好的托管模型,没有上传权重、打包容器或微调的入口。如果你依赖 Cog、私有模型或带常驻实例的 Deployments,这部分继续放在 Replicate,商用模型(Veo、可灵、Nano Banana Pro、GPT Image 2、Claude)走 APIMODELS。这里也有几个模型能覆盖以前要靠自定义检查点的需求:Nano Banana Pro 和 GPT Image 2 支持参考图编辑,Seedance 2.0 最多吃 9 张参考图外加参考视频和音频,可灵动作控制能把源视频里的动作迁移过来。
APIMODELS 不需要:任意邮箱注册、在控制台建 key 就能调用,不做组织、证件或人脸认证,中国大陆可直连,支持支付宝。Replicate 的登录页只提供 GitHub 登录,页面上没有提到证件认证。如果团队里不是人人都有 GitHub 账号,或者要用支付宝付款,这一点就能决定选择;如果团队本来就在用 GitHub 和 Cloudflare,Replicate 能直接融入现有体系。