fal.ai 是一个推理平台:除了 1,000 多个托管好的图像、视频、音频和 3D 模型,它还卖 Serverless GPU 部署、独占 GPU 和训练接口。APIMODELS 做的事更窄:用一把 key 调 GPT Image 2、Nano Banana Pro、Seedance、可灵、Veo、Claude、GPT 这类知名商用模型,按张、按秒或按百万 token 计价,什么都不用部署。如果你的需求是「调当下最好的模型、拿回一个文件」,两边高度重合;如果是「托管并微调我自己的模型」,那是 fal 的活,不是我们的。
两边都卖的模型里,差距最大的是 Google 和 OpenAI 的模型。GPT Image 2 在 1024×1024、medium 画质下,这里每张 $0.025,fal 是 $0.053(fal 默认 high 画质,$0.211)。一条 8 秒 1080p 带音频的 Veo 3.1,这里 $1.00,fal 按每秒 $0.40 算是 $3.20。Nano Banana Pro 每张 $0.08 对 $0.15,Seedance 2.0 720p 每秒 $0.197 对 $0.303。本页 fal 的每一个价格,都取自 2026 年 10 月 6 日 fal 自己的模型页。
判断一个网关,我们的顺序是先稳定、再价格。能核实的事实是:这里很多模型挂着不止一条上游线路,一条报错或过载时自动切换;生成失败一律不扣费;图像和视频任务支持 callback_url 回调,失败先重试 3 次,之后后台继续重试最长 30 分钟;任何一次调用的实扣金额都能用 GET /v1/records/{id} 查到。不需要组织认证,中国大陆可直连,可以用银行卡、PayPal、支付宝或 USDT 付款。
fal 一列的内容全部来自 fal 自己的定价页、文档和服务条款,2026-10-06 核对,出处列在本页末尾。
| APIMODELS | fal.ai | |
|---|---|---|
| 定位 | 托管商用模型的多模型 API 网关 | 推理平台:托管模型 + Serverless GPU、独占算力与训练 |
| 模型覆盖 | 149 个:图像 37、视频 40、大模型 49、音频 21、向量 2(2026 年 10 月) | 1,000+ 个图像、视频、音频和 3D 模型;大模型经一个基于 OpenRouter 的路由端点提供 |
| 计费单位 | 按张、按视频秒数、按百万 token、语音按千字符 | 按产出计费(张、秒、token);没有固定单价的模型按 GPU 秒计 |
| 失败请求 | 一律不扣费 | HTTP 5xx 不收费;HTTP 422 错误(含内容审核拒绝)可能计费 |
| 接口形态 | REST;对话和图像端点兼容 OpenAI,另有原生 Anthropic Messages | fal 自己的队列 API 与 SDK(Python、JS、Swift、Java、Kotlin、Dart);只有大模型路由兼容 OpenAI |
| 异步任务 | 创建后轮询,或 callback_url 回调(失败最长重试 30 分钟) | 队列轮询,或 webhook_url 回调(ED25519 签名) |
| 付款方式 | 银行卡(Stripe)、PayPal、支付宝、USDT;$10 起充 | 银行卡或 ACH,美元结算 |
| 发票 | 银行卡付款自动开票,可带公司税号 | 大用量客户可走发票结算 |
| 认证要求 | 无:邮箱注册,不做组织或证件认证 | 模型 API 未写认证要求;Serverless 部署需逐个账号审批 |
| 免费额度 | 常见邮箱注册送 $0.10,API 可用 | 免费额度只能在 Sandbox 和 Playground 用,不能走 API |
| 自定义模型与训练 | 不提供 | fal Serverless、独占 GPU(H100 $2.49/小时起)、LoRA 训练(FLUX LoRA 每次 $2) |
美元,2026-10-06 核对。fal 的价格取自 fal.ai 上各模型页,APIMODELS 的价格就是我们实际计费的价格。APIMODELS 的 Seedance 按 token 计费,表里的每秒价是 16:9 下的折算值。这里的 Veo 每条固定 8 秒、带音轨,所以 fal 一列用它的带音频每秒价乘以 8。
| 模型与单位 | APIMODELS | fal.ai | 价格更低 |
|---|---|---|---|
| GPT Image 2,1024×1024,medium 画质,每张 | $0.025 | $0.053 | APIMODELS |
| GPT Image 2,4K(3840×2160),medium 画质,每张 | $0.05 | $0.101 | APIMODELS |
| Nano Banana Pro(Gemini 3 Pro Image),1K–2K / 4K,每张 | $0.08 / $0.13 | $0.15 / $0.30 | APIMODELS |
| Seedance 2.0,720p / 1080p,每秒 | $0.197 / $0.492 | $0.303 / $0.682 | APIMODELS |
| Veo 3.1,8 秒,1080p,带音频,每条 | $1.00 | $3.20(每秒 $0.40) | APIMODELS |
| Veo 3.1 Fast,8 秒,1080p,带音频,每条 | $0.07 | $1.20(每秒 $0.15) | APIMODELS |
| Grok Imagine Video 1.5,480p / 720p / 1080p,每秒 | $0.045 / $0.0529 / $0.0882 | $0.08 / $0.14 / $0.25 | APIMODELS |
要跑你自己的模型,选 fal。fal Serverless 用 fal deploy 部署你的代码、按 runner 存活时间逐秒计费;它也出租独占 GPU(定价页写 H100 每小时 $2.49 起),还有 FLUX LoRA 快速训练(每次 $2)这类训练接口。APIMODELS 不能托管你的权重,也不提供训练和微调。
要 4K 的 Veo、长尾模型或实时推理,选 fal。fal 提供 4K 的 Veo 3.1,我们的 Veo 最高 1080p;fal 列出 1,000 多个模型,包括 3D 和大量开源权重的图像模型,支持流式和 WebSocket 推理,企业版还有私有模型托管、SOC 2 和 SSO。
Replicate 适合想用 Cog 打包自己的模型、和 5 万多个社区模型放在一起跑的团队;它的官方商用模型按产出计价。
OpenRouter 适合以大模型为主、希望每个模型在多家供应商之间路由的负载;它也有一个 29 个模型的异步视频 API。
Kie.ai 适合需要它的 Suno V6、Runway 接口的用户。
模型厂商自己的 API(Google、OpenAI、字节)适合需要只有直签才拿得到的合规文件和账户级产品的团队。前三个平台各有一篇对比页,链接在页面底部。
迁移一个 fal 接入要改三处:端点、模型名、取结果的字段。fal 通过 fal_client 或 https://queue.fal.run/<endpoint-id> 按 endpoint id 调模型;这里所有视频模型都走 POST https://api.apimodels.app/v1/video/generations,图像模型走 /v1/images/generations,模型是 JSON 里的一个字段:fal-ai/veo3.1 换成 veo-3.1,fal-ai/nano-banana-pro 换成 gemini-3-pro-image。
提示词、时长、比例、图片 URL 都能照搬,但不同模型家族的字段名不完全一样,以各模型的文档页为准。webhook_url 换成 callback_url,或者轮询 GET /v1/video/generations?task_id=… 直到 state 为 completed。成片地址在 resultUrls 里,30 天内可下载。
大模型代码只要换 base URL:OpenAI SDK 指向 https://api.apimodels.app/v1,Anthropic SDK 指向 https://api.apimodels.app,模型名用 claude-sonnet-5-5、gpt-6.1-sol 这类。GET https://api.apimodels.app/v1/models 不需要 key 就能列出全部模型名。
| 内容 | 出处 |
|---|---|
| GPT Image 2 按图折算表 | fal.ai/models/openai/gpt-image-2 |
| Nano Banana Pro | fal.ai/models/fal-ai/nano-banana-pro |
| Seedance 2.0 | fal.ai/models/bytedance/seedance-2.0/text-to-video |
| Veo 3.1 与 Veo 3.1 Fast | fal.ai/models/fal-ai/veo3.1 与 /veo3.1/fast |
| Grok Imagine Video 1.5 | fal.ai/models/xai/grok-imagine-video/v1.5/text-to-video |
| 计费、失败请求、免费额度 | fal.ai/docs/documentation/model-apis/pricing、/faq、/sandbox |
| 付款方式与额度过期 | fal.ai/legal/terms-of-service |
| Serverless、GPU、LoRA 训练 | fal.ai/docs/documentation/serverless/pricing、fal.ai/pricing、fal.ai/models/fal-ai/flux-lora-fast-training |
| APIMODELS 价格 | apimodels.app/pricing 与各模型页 |
cURL
# Before (fal): POST https://queue.fal.run/fal-ai/veo3.1 with "Authorization: Key $FAL_KEY"
# After (APIMODELS): one endpoint for every video model; the model is a body field
curl -X POST https://api.apimodels.app/v1/video/generations \
-H "Authorization: Bearer $APIMODELS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "veo-3.1",
"prompt": "Slow dolly shot of a lighthouse at dawn, waves breaking below",
"aspect_ratio": "16:9",
"callback_url": "https://your-app.example.com/hooks/video"
}'
# → {"data": {"taskId": "..."}} 8 s, 1080p, with audio, $1.00
# no webhook? poll: curl "https://api.apimodels.app/v1/video/generations?task_id=TASK_ID" -H "Authorization: Bearer $APIMODELS_API_KEY"Python
import requests, time
BASE = "https://api.apimodels.app/v1"
H = {"Authorization": "Bearer YOUR_APIMODELS_KEY"}
# Before (fal): fal_client.subscribe("fal-ai/nano-banana-pro", arguments={"prompt": ...})
# After: same model, called as gemini-3-pro-image ($0.08 at 1K/2K, $0.13 at 4K)
task = requests.post(f"{BASE}/images/generations", headers=H, json={
"model": "gemini-3-pro-image",
"prompt": "Studio photo of a ceramic teapot on linen, soft window light",
"aspect_ratio": "16:9",
"resolution": "2k",
}).json()["data"]["taskId"]
while True:
r = requests.get(f"{BASE}/images/generations", headers=H,
params={"task_id": task}).json()["data"]
if r["state"] in ("completed", "failed"):
print(r.get("resultUrls"), r.get("failMsg"))
break
time.sleep(3)本页价格表里的模型,都是我们更低(2026 年 10 月 6 日核对):GPT Image 2 在 1024×1024、medium 画质下每张 $0.025,fal 是 $0.053;Nano Banana Pro 每张 $0.08 对 $0.15;Seedance 2.0 720p 每秒 $0.197 对 $0.303;8 秒 1080p 带音频的 Veo 3.1 一条 $1.00 对 $3.20;Grok Imagine Video 1.5 720p 每秒 $0.0529 对 $0.14;GPT Image 2 4K medium 这里 $0.05,fal $0.101。差距大小因模型而异,建议只比你真正要用的那几个。
我们不公布可用率数字,下面只讲能核实的事实。APIMODELS 上很多模型挂着不止一条上游线路,某条线路报错或过载时,请求会自动切到另一条。生成失败一律不扣费;fal 的规则不同:HTTP 5xx 失败不收费,但它的文档写明 HTTP 422 错误(包括内容审核拒绝)仍可能计费。这里的异步任务支持 callback_url,你的服务没响应时会退避重试 3 次,之后后台继续重试最长 30 分钟;每次调用的最终扣费都能用 GET /v1/records/{id} 查到。有一点需要知道:我们的回调目前不带签名,而 fal 的 webhook 有签名,建议在回调地址里放一个随机 token,收到时自行校验。
多数接入只是一下午的改名,不用重写。图像和视频调用从 fal 的队列(fal_client 或 https://queue.fal.run/<endpoint-id>)换成两个 REST 端点 /v1/images/generations 和 /v1/video/generations,模型名写在 JSON 里:fal-ai/nano-banana-pro 换成 gemini-3-pro-image,fal-ai/veo3.1 换成 veo-3.1。提示词、时长、比例、图片 URL 都能照搬,但不同模型家族的字段名有差异,以各模型的文档页为准。webhook_url 改成 callback_url,或者用 task_id 轮询到 state 为 completed,成片地址在 resultUrls 里。大模型代码只要把 OpenAI 或 Anthropic SDK 指向我们的 base URL。迁不过来的只有一类:你在 fal Serverless 上自己部署的模型。
APIMODELS 支持 Stripe 银行卡、PayPal、支付宝和 USDT(TRC-20 / BEP-20),$10 起充,$50 / $100 / $500 / $1,000 档另送 2–5%。银行卡付款自动开发票,结账时勾选企业购买并填写公司名和税号,之后每张发票(包括自动充值)都会带上。用常见邮箱新注册的账号送 $0.10,可以直接在 API 上试。fal 的服务条款写的是银行卡或 ACH、美元结算,大用量客户可以走发票结算,购买的额度 365 天后过期;fal 的免费额度只能在它的 Sandbox 和 Playground 里用,不能走 API。
可以。apimodels.app 和 api.apimodels.app 在中国大陆可以直连,网站和文档都有中文,也能用支付宝付款(按下单时的汇率折算人民币)。同一把 key 能调 Claude、GPT、Gemini 文本模型,也能调 Veo、可灵、Seedance、GPT Image,国内团队不必在每家模型厂商分别开海外账号。fal 公开的地区限制针对的是受制裁地区,付款方式是银行卡或 ACH、美元结算;对国内团队来说,两边的实际差别主要在付款和网络,而不在模型本身。
不能。APIMODELS 只提供托管好的模型,不能上传权重、训练 LoRA 或部署容器。如果这些是你工作流的一部分,这部分继续用 fal(Serverless、独占 GPU、FLUX LoRA 快速训练每次 $2 这类训练接口)或 Replicate(Cog 与 Deployments),APIMODELS 用在上面价格表里的商用模型上,两者并用很常见。另外,这里不少模型支持参考图(Nano Banana Pro 可传多张,Seedance 2.0 最多 9 张),很多原本想靠 LoRA 解决的「角色、产品在多个镜头里保持一致」,用参考图就能做到。