
gemini-3.8-flashGemini 3.8 Flash 是谷歌 2026 年 9 月 2 日发布的 Flash 模型,在 APIMODELS 上输入 $0.450、输出 $2.250 每 1M token,比谷歌自己的 $0.75 / $3.75 低 40%;那个价是限时价,2027 年 1 月 1 日起官方涨到 $1.50 / $7.50,届时这里的差价会拉到 70%。谷歌这一代明说是奔着编码和 agent 去的、不是冲最难的前沿推理,公开成绩也是这个走向:DeepSWE v1.1 登顶、Terminal-Bench 2.1 拿到 89.4%,并且在 HLE-Verified(54.9% 对 54.4%)、Vals Finance Agent v2(61.4% 对 58.6%)、Harvey 法律 agent(10.0% 对 6.7%)三项上压过 Claude Opus 5。规格是 1M token 上下文、64K 输出,输入支持文字、图片、音频、视频和 PDF,知识截止 2026 年 3 月。两个需要事先知道的实测短板:一是它比前几代明显更爱"想",而思考 token 按输出价计费 —— 我们自己探针里让它回一个两个词的答案,它烧掉了 83 个思考 token,所以实际账单会高于按可见输出估的数;二是 Artificial Analysis 测到的首字延迟约 13.3 秒(全站中位数是 2.99 秒),适合批处理和 agent 长跑,不适合要求秒回的交互式场景。如果是短请求、高并发、单价和延迟说了算,Gemini 3.1 Flash Lite($0.375 / $2.25)更合适。通过统一接口调用,一个 API Key 同时可用图片、视频、音频模型。
$0.450 / $2.250 against $0.75 / $3.75
89.4% on Terminal-Bench 2.1
Text, image, audio, video, PDF in
Thinking tokens bill at the output rate
View complete API reference with all parameters and examples.
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
Gemini 3.8 Flash 是由 Google 提供的大语言模型 API。Gemini 3.8 Flash 是谷歌 2026 年 9 月 2 日发布的 Flash 模型,在 APIMODELS 上输入 $0.450、输出 $2.250 每 1M token,比谷歌自己的 $0.75 / $3.75 低 40%;那个价是限时价,2027 年 1 月 1 日起官方涨到 $1.50 / $7.50,届时这里的差价会拉到 70%。谷歌这一代明说是奔着编码和 agent 去的、不是冲最难的前沿推理,公开成绩也是这个走向:DeepSWE v1.1 登顶、Terminal-Bench 2.1 拿到 89.4%,并且在 HLE-Verified(54.9% 对 54.4%)、Vals Finance Agent v2(61.4% 对 58.6%)、Harvey 法律 agent(10.0% 对 6.7%)三项上压过 Claude Opus 5。规格是 1M token 上下文、64K 输出,输入支持文字、图片、音频、视频和 PDF,知识截止 2026 年 3 月。两个需要事先知道的实测短板:一是它比前几代明显更爱"想",而思考 token 按输出价计费 —— 我们自己探针里让它回一个两个词的答案,它烧掉了 83 个思考 token,所以实际账单会高于按可见输出估的数;二是 Artificial Analysis 测到的首字延迟约 13.3 秒(全站中位数是 2.99 秒),适合批处理和 agent 长跑,不适合要求秒回的交互式场景。如果是短请求、高并发、单价和延迟说了算,Gemini 3.1 Flash Lite($0.375 / $2.25)更合适。通过统一接口调用,一个 API Key 同时可用图片、视频、音频模型。 通过 APIMODELS 平台,您可以使用统一的 API 接口调用该模型,按量计费、价格透明。当前定价:Input: $0.450, Output: $2.250 per 1M tokens。
构建智能对话系统,自动回答用户问题,提升客户服务效率。
自动撰写文章、邮件、广告文案等文本内容,提高内容产出效率。
辅助代码编写、调试和代码审查,加速软件开发流程。
理解和分析非结构化数据,提取关键信息并生成报告摘要。
Gemini 3.8 Flash 通过 APIMODELS 平台调用,当前定价:Input: $0.450, Output: $2.250 per 1M tokens。按量计费,用多少付多少。
在 APIMODELS 注册账号并获取 API Key,然后通过我们的统一 API 端点调用即可。我们提供详细的 API 文档和 cURL、Python、Node.js 代码示例。
APIMODELS 通过聚合平台提供与官方相同的 Gemini 3.8 Flash 模型。我们提供统一的 API 接口,无需分别注册各平台账号,一个 API Key 即可调用所有模型。
3.8 Flash 是 2026 年 9 月 2 日发布的最新一代,谷歌明说是为编码和 agent 调的:DeepSWE v1.1 登顶、Terminal-Bench 2.1 89.4%。在 APIMODELS 上 $0.450 / $2.250,比 3.6 Flash($0.662 / $3.302)便宜约 32%,所以"更新 + 更便宜"这两点它同时占了。但如果你的活是短请求、高并发、要求秒回,Gemini 3.1 Flash Lite($0.375 / $2.25)输入更便宜、延迟低得多,更合适 —— 3.8 Flash 的首字延迟实测约 13.3 秒。
因为思考 token 也按输出价计费,而这一代明显比前几代更爱"想"。我们自己的探针里,让它回一个两个词的答案,它烧掉了 83 个思考 token —— 可见输出只有 1 个 token。独立评测(Artificial Analysis)跑完整套题时它产出 1.2 亿输出 token,而全站中位数是 7100 万。所以估算成本时不能只按你看得见的回答长度算,要按 usageMetadata 里 candidatesTokenCount + thoughtsTokenCount 的总和算。如果任务不需要深度推理,把 maxOutputTokens 压低或改用 3.1 Flash Lite 更划算。
谷歌官方现价是 $0.75 / $3.75 每 1M token,我们是 $0.450 / $2.250,低 40%。谷歌那个价是限时价,官方公告写明 2027 年 1 月 1 日起涨到 $1.50 / $7.50 —— 到那时同样的价差会拉到 70%。我们这边失败请求不计费,没有最低充值和订阅,1M 上下文按同一档输入价计,没有长上下文加价。
输入支持文字、图片、音频、视频和 PDF,输出是文字。上下文 1M token,单次最多输出 64K token,知识截止 2026 年 3 月。函数调用(function calling)、结构化输出、流式都支持,走原生 Gemini 格式 POST /v1beta/models/gemini-3.8-flash:generateContent,也可以用 OpenAI 兼容的 /v1/chat/completions —— 两个端点同一个 API Key。
该用:多轮 agent 长跑、跨文件的编码任务、需要长上下文的文档与代码库分析、可以批量跑的离线任务 —— 这些正是它的成绩单强的地方,而且 13 秒的首字延迟摊在几分钟的任务里不算什么。不该用:面向用户的实时聊天、自动补全、语音助手这类要求秒回的场景,以及短 prompt 的高频分类打标 —— 后者用 Gemini 3.1 Flash Lite,单价更低、延迟更小、也不会额外烧思考 token。
在 APIMODELS,Gemini 3.8 Flash 与 60+ 个模型共用一个 API Key、一个余额,所以选型只看合不合适,不存在锁定。它支持 40% Below Official、Agentic Coding、1M Context、Multimodal Input,你可以在价格和能力上把它和其它大语言模型模型对比,换模型只需改一个模型名字符串——无需新账号、无需重新对接。所有大语言模型模型与实时价格见 apimodels.app/models。
Gemini 3.8 Flash 支持:40% Below Official、Agentic Coding、1M Context、Multimodal Input。完整参数与调用方式见 APIMODELS 的 API 文档。
可以。APIMODELS 提供可直接访问的统一 API,一个 API Key 即可调用 Gemini 3.8 Flash,无需分别注册官方账号、也无需自行处理官方接口的网络访问。
我们支持 Stripe(Visa、Mastercard 等国际信用卡)和支付宝付款。充值后积分即时到账。