
gemini-3.8-flashGemini 3.8 Flash 是谷歌 2026 年 9 月 2 日发布的 Flash 模型,在 APIMODELS 上输入 $0.450、输出 $2.250 每 1M token,比谷歌自己的 $0.75 / $3.75 低 40%;那个价是限时价,2027 年 1 月 1 日起官方涨到 $1.50 / $7.50,届时这里的差价会拉到 70%。谷歌这一代明说是奔着编码和 agent 去的、不是冲最难的前沿推理,公开成绩也是这个走向:DeepSWE v1.1 登顶、Terminal-Bench 2.1 拿到 89.4%,并且在 HLE-Verified(54.9% 对 54.4%)、Vals Finance Agent v2(61.4% 对 58.6%)、Harvey 法律 agent(10.0% 对 6.7%)三项上压过 Claude Opus 5。规格是 1M token 上下文、64K 输出,输入支持文字、图片、音频、视频和 PDF,知识截止 2026 年 3 月。两个需要事先知道的实测短板:一是它比前几代明显更爱"想",而思考 token 按输出价计费 —— 我们自己探针里让它回一个两个词的答案,它烧掉了 83 个思考 token,所以实际账单会高于按可见输出估的数;二是 Artificial Analysis 测到的首字延迟约 13.3 秒(全站中位数是 2.99 秒),适合批处理和 agent 长跑,不适合要求秒回的交互式场景。如果是短请求、高并发、单价和延迟说了算,Gemini 3.1 Flash Lite($0.375 / $2.25)更合适。通过统一接口调用,一个 API Key 同时可用图片、视频、音频模型。
View complete API reference with all parameters and examples.
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
$0.450 / $2.250 against $0.75 / $3.75
89.4% on Terminal-Bench 2.1
Text, image, audio, video, PDF in
Thinking tokens bill at the output rate
Gemini 3.8 Flash 是由 Google 提供的大语言模型 API。Gemini 3.8 Flash 是谷歌 2026 年 9 月 2 日发布的 Flash 模型,在 APIMODELS 上输入 $0.450、输出 $2.250 每 1M token,比谷歌自己的 $0.75 / $3.75 低 40%;那个价是限时价,2027 年 1 月 1 日起官方涨到 $1.50 / $7.50,届时这里的差价会拉到 70%。谷歌这一代明说是奔着编码和 agent 去的、不是冲最难的前沿推理,公开成绩也是这个走向:DeepSWE v1.1 登顶、Terminal-Bench 2.1 拿到 89.4%,并且在 HLE-Verified(54.9% 对 54.4%)、Vals Finance Agent v2(61.4% 对 58.6%)、Harvey 法律 agent(10.0% 对 6.7%)三项上压过 Claude Opus 5。规格是 1M token 上下文、64K 输出,输入支持文字、图片、音频、视频和 PDF,知识截止 2026 年 3 月。两个需要事先知道的实测短板:一是它比前几代明显更爱"想",而思考 token 按输出价计费 —— 我们自己探针里让它回一个两个词的答案,它烧掉了 83 个思考 token,所以实际账单会高于按可见输出估的数;二是 Artificial Analysis 测到的首字延迟约 13.3 秒(全站中位数是 2.99 秒),适合批处理和 agent 长跑,不适合要求秒回的交互式场景。如果是短请求、高并发、单价和延迟说了算,Gemini 3.1 Flash Lite($0.375 / $2.25)更合适。通过统一接口调用,一个 API Key 同时可用图片、视频、音频模型。 通过 APIMODELS 平台,您可以使用统一的 API 接口调用该模型,按量计费、价格透明。当前定价:Input: $0.450, Output: $2.250 per 1M tokens。
构建智能对话系统,自动回答用户问题,提升客户服务效率。
自动撰写文章、邮件、广告文案等文本内容,提高内容产出效率。
辅助代码编写、调试和代码审查,加速软件开发流程。
理解和分析非结构化数据,提取关键信息并生成报告摘要。
Gemini 3.8 Flash 通过 APIMODELS 平台调用,当前定价:Input: $0.450, Output: $2.250 per 1M tokens。按量计费,用多少付多少。
在 APIMODELS 注册账号并获取 API Key,然后通过我们的统一 API 端点调用即可。我们提供详细的 API 文档和 cURL、Python、Node.js 代码示例。
APIMODELS 通过聚合平台提供与官方相同的 Gemini 3.8 Flash 模型。我们提供统一的 API 接口,无需分别注册各平台账号,一个 API Key 即可调用所有模型。
3.8 Flash 是 2026 年 9 月 2 日发布的最新一代,谷歌明说是为编码和 agent 调的:DeepSWE v1.1 登顶、Terminal-Bench 2.1 89.4%。在 APIMODELS 上 $0.450 / $2.250,比 3.6 Flash($0.662 / $3.302)便宜约 32%,所以"更新 + 更便宜"这两点它同时占了。但如果你的活是短请求、高并发、要求秒回,Gemini 3.1 Flash Lite($0.375 / $2.25)输入更便宜、延迟低得多,更合适 —— 3.8 Flash 的首字延迟实测约 13.3 秒。
因为思考 token 也按输出价计费,而这一代明显比前几代更爱"想"。我们自己的探针里,让它回一个两个词的答案,它烧掉了 83 个思考 token —— 可见输出只有 1 个 token。独立评测(Artificial Analysis)跑完整套题时它产出 1.2 亿输出 token,而全站中位数是 7100 万。所以估算成本时不能只按你看得见的回答长度算,要按 usageMetadata 里 candidatesTokenCount + thoughtsTokenCount 的总和算。如果任务不需要深度推理,把 maxOutputTokens 压低或改用 3.1 Flash Lite 更划算。
谷歌官方现价是 $0.75 / $3.75 每 1M token,我们是 $0.450 / $2.250,低 40%。谷歌那个价是限时价,官方公告写明 2027 年 1 月 1 日起涨到 $1.50 / $7.50 —— 到那时同样的价差会拉到 70%。我们这边失败请求不计费,没有最低充值和订阅,1M 上下文按同一档输入价计,没有长上下文加价。
输入支持文字、图片、音频、视频和 PDF,输出是文字。上下文 1M token,单次最多输出 64K token,知识截止 2026 年 3 月。函数调用(function calling)、结构化输出、流式都支持,走原生 Gemini 格式 POST /v1beta/models/gemini-3.8-flash:generateContent,也可以用 OpenAI 兼容的 /v1/chat/completions —— 两个端点同一个 API Key。
该用:多轮 agent 长跑、跨文件的编码任务、需要长上下文的文档与代码库分析、可以批量跑的离线任务 —— 这些正是它的成绩单强的地方,而且 13 秒的首字延迟摊在几分钟的任务里不算什么。不该用:面向用户的实时聊天、自动补全、语音助手这类要求秒回的场景,以及短 prompt 的高频分类打标 —— 后者用 Gemini 3.1 Flash Lite,单价更低、延迟更小、也不会额外烧思考 token。
在 APIMODELS,Gemini 3.8 Flash 与 60+ 个模型共用一个 API Key、一个余额,所以选型只看合不合适,不存在锁定。它支持 40% Below Official、Agentic Coding、1M Context、Multimodal Input,你可以在价格和能力上把它和其它大语言模型模型对比,换模型只需改一个模型名字符串——无需新账号、无需重新对接。所有大语言模型模型与实时价格见 apimodels.app/models。
Gemini 3.8 Flash 支持:40% Below Official、Agentic Coding、1M Context、Multimodal Input。完整参数与调用方式见 APIMODELS 的 API 文档。
可以。APIMODELS 提供可直接访问的统一 API,一个 API Key 即可调用 Gemini 3.8 Flash,无需分别注册官方账号、也无需自行处理官方接口的网络访问。
我们支持 Stripe(Visa、Mastercard 等国际信用卡)和支付宝付款。充值后积分即时到账。