
fish-s2.1-proFish Audio S2.1 Pro 是一个覆盖 83 个语种的语音合成模型,在我们这里最值钱的特点是语音克隆不要钱:传一段十秒以上的干净样本,二十秒内拿到一个音色 id,之后每次合成把这个 id 当 reference_id 传进去就行。我们连建三个音色实测,每个都是零扣费,上游文档里也没有任何音色数量上限。输出支持 mp3、wav、pcm、opus 四种格式,语速可在 0.5 到 2.0 之间调。 要特别留意的是计价单位:这个模型按【UTF-8 字节】收,而不是像站内其它语音模型那样按字符。一个汉字是 3 字节,一个拉丁字母是 1 字节——英文 1000 字符是 $0.03,中文 1000 字是 3000 字节、$0.09。做预算时请按字节算,不要按字数估。
Unlimited voice slots; a clone trains in under 20 seconds and is usable immediately
Not per character — Chinese text costs three times Latin text of the same length
No per-language endpoint or premium for non-English speech
fish-s2.1-pro for production; fish-s2.1-pro-free at a sixth of the price, slower and without guarantees
Fish Audio S2.1 Pro 是由 Fish Audio 提供的语音合成 API。Fish Audio S2.1 Pro 是一个覆盖 83 个语种的语音合成模型,在我们这里最值钱的特点是语音克隆不要钱:传一段十秒以上的干净样本,二十秒内拿到一个音色 id,之后每次合成把这个 id 当 reference_id 传进去就行。我们连建三个音色实测,每个都是零扣费,上游文档里也没有任何音色数量上限。输出支持 mp3、wav、pcm、opus 四种格式,语速可在 0.5 到 2.0 之间调。 要特别留意的是计价单位:这个模型按【UTF-8 字节】收,而不是像站内其它语音模型那样按字符。一个汉字是 3 字节,一个拉丁字母是 1 字节——英文 1000 字符是 $0.03,中文 1000 字是 3000 字节、$0.09。做预算时请按字节算,不要按字数估。 通过 APIMODELS 平台,您可以使用统一的 API 接口调用该模型,按量计费、价格透明。当前定价:standard, per 1K UTF-8 bytes: $0.03, evaluation tier, per 1K UTF-8 bytes: $0.005。
为视频、动画、广告等内容生成专业级配音,支持多种音色。
快速生成播客节目的语音内容,支持多角色对话。
将文本内容转化为自然流畅的语音,适用于有声书制作。
AI 驱动的多语言配音翻译,帮助内容触达全球受众。
Fish Audio S2.1 Pro 通过 APIMODELS 平台调用,当前定价:standard, per 1K UTF-8 bytes: $0.03, evaluation tier, per 1K UTF-8 bytes: $0.005。按量计费,用多少付多少。
在 APIMODELS 注册账号并获取 API Key,然后通过我们的统一 API 端点调用即可。我们提供详细的 API 文档和 cURL、Python、Node.js 代码示例。
APIMODELS 通过聚合平台提供与官方相同的 Fish Audio S2.1 Pro 模型。我们提供统一的 API 接口,无需分别注册各平台账号,一个 API Key 即可调用所有模型。
因为上游就是这么收的,把同一个单位透传下来,两边才不会各算各的。一个拉丁字母是 1 个 UTF-8 字节,一个汉字是 3 个,一个 emoji 是 4 个。所以英文 1000 字符是 1000 字节、$0.03;中文 1000 字是 3000 字节、$0.09。站内其它语音模型都是按千字符收,从那边切过来的话,中文量要重新按字节估,不能沿用字数。
不收,而且没发现音色数量上限。我们连着建了三个音色做实测,每一个的扣费都是零。传一段十秒以上的干净样本,大约五到二十秒拿到音色 id,之后合成时把这个 id 当 reference_id 传进去就行。你只为之后合成出来的语音按字节付费。
验证音色、跑原型用免费档(模型 id 是 fish-s2.1-pro-free),有人在等的场景用标准档。两档是同一个模型,音质没区别,但免费档是尽力而为:同样 2000 字节的文本,我们实测免费档 41 秒、标准档 17 秒。免费档还没有数据协议,也就是上游可能拿这些请求去改进模型,而且它的低价有公布的截止日期,已经被推迟过四次。
在 APIMODELS,Fish Audio S2.1 Pro 与 60+ 个模型共用一个 API Key、一个余额,所以选型只看合不合适,不存在锁定。它支持 83 Languages、Free Voice Cloning、mp3 / wav / pcm / opus、Speed 0.5-2.0,你可以在价格和能力上把它和其它语音合成模型对比,换模型只需改一个模型名字符串——无需新账号、无需重新对接。所有语音合成模型与实时价格见 apimodels.app/models。
Fish Audio S2.1 Pro 支持:83 Languages、Free Voice Cloning、mp3 / wav / pcm / opus、Speed 0.5-2.0。完整参数与调用方式见 APIMODELS 的 API 文档。
可以。APIMODELS 提供可直接访问的统一 API,一个 API Key 即可调用 Fish Audio S2.1 Pro,无需分别注册官方账号、也无需自行处理官方接口的网络访问。
我们支持 Stripe(Visa、Mastercard 等国际信用卡)和支付宝付款。充值后积分即时到账。