
gemini-3.8-flashGemini 3.8 Flash は Google が 2026 年 9 月 2 日に公開した Flash モデルです。APIMODELS では入力 100 万トークン $0.450、出力 $2.250 で、Google 自身の価格($0.75 / $3.75)より 40% 安価です。しかもその価格は導入価格で、2027 年 1 月 1 日から公式価格は $1.50 / $7.50 になり、差は 70% に広がります。Google はこの世代を「最難関の推論ではなくコーディングとエージェント向けに調整した」と明言しており、公開値もその通りです:DeepSWE v1.1 で首位、Terminal-Bench 2.1 で 89.4%、さらに HLE-Verified(54.9% 対 54.4%)、Vals Finance Agent v2(61.4% 対 58.6%)、Harvey's Legal Agent(10.0% 対 6.7%)の 3 つで Claude Opus 5 を上回りました。コンテキストは 100 万トークン、出力は最大 64K、入力はテキスト・画像・音声・動画・PDF に対応し、知識のカットオフは 2026 年 3 月です。事前に知っておきたい実測ベースの注意点が 2 つあります。ひとつは、この世代は以前より明らかに「考える」量が多く、思考トークンは出力レートで課金される点 —— 当社のプローブでは 2 語の回答に 83 個の思考トークンを使いました。もうひとつは、Artificial Analysis 計測の最初のトークンまでの時間が約 13.3 秒(全体の中央値は 2.99 秒)である点で、バッチ処理や長時間のエージェント実行には向きますが、対話型チャットには向きません。短いリクエストで価格と応答速度が決め手になる用途は Gemini 3.1 Flash Lite($0.375 / $2.25)のほうが有利です。キャッシュ入力は 100 万トークン $0.172、失敗したリクエストは課金されません。
View complete API reference with all parameters and examples.
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
$0.450 / $2.250 against $0.75 / $3.75
89.4% on Terminal-Bench 2.1
Text, image, audio, video, PDF in
Thinking tokens bill at the output rate
Gemini 3.8 Flash は Google の大規模言語モデル API です。Gemini 3.8 Flash は Google が 2026 年 9 月 2 日に公開した Flash モデルです。APIMODELS では入力 100 万トークン $0.450、出力 $2.250 で、Google 自身の価格($0.75 / $3.75)より 40% 安価です。しかもその価格は導入価格で、2027 年 1 月 1 日から公式価格は $1.50 / $7.50 になり、差は 70% に広がります。Google はこの世代を「最難関の推論ではなくコーディングとエージェント向けに調整した」と明言しており、公開値もその通りです:DeepSWE v1.1 で首位、Terminal-Bench 2.1 で 89.4%、さらに HLE-Verified(54.9% 対 54.4%)、Vals Finance Agent v2(61.4% 対 58.6%)、Harvey's Legal Agent(10.0% 対 6.7%)の 3 つで Claude Opus 5 を上回りました。コンテキストは 100 万トークン、出力は最大 64K、入力はテキスト・画像・音声・動画・PDF に対応し、知識のカットオフは 2026 年 3 月です。事前に知っておきたい実測ベースの注意点が 2 つあります。ひとつは、この世代は以前より明らかに「考える」量が多く、思考トークンは出力レートで課金される点 —— 当社のプローブでは 2 語の回答に 83 個の思考トークンを使いました。もうひとつは、Artificial Analysis 計測の最初のトークンまでの時間が約 13.3 秒(全体の中央値は 2.99 秒)である点で、バッチ処理や長時間のエージェント実行には向きますが、対話型チャットには向きません。短いリクエストで価格と応答速度が決め手になる用途は Gemini 3.1 Flash Lite($0.375 / $2.25)のほうが有利です。キャッシュ入力は 100 万トークン $0.172、失敗したリクエストは課金されません。 APIMODELS のプラットフォーム経由なら、統一 API と明朗な従量課金でこのモデルを呼び出せます。 現在の料金: Input: $0.450, Output: $2.250 per 1M tokens。
問い合わせに自動で答える対話システムを構築し、対応の効率を上げます。
記事、メール、広告コピーなどの文章を自動で書き、制作の手数を減らします。
コードの記述、デバッグ、レビューを補助し、開発を前に進めます。
非構造化データを読み解き、要点を抽出して要約レポートにまとめます。
Gemini 3.8 Flash は APIMODELS 経由で Input: $0.450, Output: $2.250 per 1M tokens で利用できます。課金は従量制で、生成した分だけの支払いです。
APIMODELS に登録して API キーを取得し、統一エンドポイントを呼ぶだけです。cURL / Python / Node.js のサンプルを含む詳しいドキュメントを用意しています。
APIMODELS は同じ Gemini 3.8 Flash を集約プラットフォーム経由で提供します。統一された API インターフェースなので、プロバイダごとにアカウントを作る必要はありません。キー 1 本ですべてのモデルに届きます。
入力 100 万トークン $0.450、出力 $2.250 で、Google 自身の価格($0.75 / $3.75)より 40% 安価です。Google のその価格は導入価格で、2027 年 1 月 1 日から公式価格は $1.50 / $7.50 になり、差は 70% に広がります。キャッシュ入力は 100 万トークン $0.172。従量課金でサブスクリプションも最低チャージもなく、失敗したリクエストは課金されません。100 万トークンのコンテキスト全体が同じ入力レートです。
3.8 Flash は 2026 年 9 月 2 日の新モデルで、Google はコーディングとエージェント向けに調整したと明言しています(DeepSWE v1.1 首位、Terminal-Bench 2.1 で 89.4%)。当サイトでは $0.450 / $2.250 で、3.6 Flash($0.662 / $3.302)より約 32% 安く、新しさと安さを同時に満たします。ただし短いリクエストを大量に、しかも即答で処理する用途なら Gemini 3.1 Flash Lite($0.375 / $2.25)のほうが適します。入力単価が安く、最初のトークンまでが圧倒的に速いためです —— 3.8 Flash はそこが約 13.3 秒です。
思考トークンが出力レートで課金され、この世代は以前より明らかに多く思考するためです。当社のプローブでは 2 語の回答に 83 個の思考トークンを使い、見えている出力は 1 トークンだけでした。Artificial Analysis の計測でも、ベンチマーク一式で 1.2 億出力トークン(中央値は 7100 万)を消費しています。コストは usageMetadata の candidatesTokenCount と thoughtsTokenCount の合計で見積もってください。深い推論が不要なら maxOutputTokens を絞るか、3.1 Flash Lite を使うほうが得です。
APIMODELS では Gemini 3.8 Flash が 60 以上のモデルと同じ API キー・同じ残高の上に並んでいるので、選択は「相性」の問題であって「囲い込み」の問題ではありません。40% Below Official、Agentic Coding、1M Context、Multimodal Input に対応しており、他の大規模言語モデルモデルと価格・機能を並べて評価できます。乗り換えはモデル名の文字列を 1 つ書き換えるだけ。新しいアカウントも追加の実装も要りません。大規模言語モデルの選択肢と最新価格は apimodels.app/models で確認できます。
Gemini 3.8 Flash は次に対応しています: 40% Below Official、Agentic Coding、1M Context、Multimodal Input。パラメータの全一覧と呼び出し例は APIMODELS のドキュメントをご覧ください。
はい。APIMODELS は Gemini 3.8 Flash を単一の統一 API とキー 1 本で提供します。プロバイダごとのアカウントも、各社の地域ごとのネットワーク経路を自分で面倒みる必要もありません。
Stripe(Visa、Mastercard などの国際カード)と Alipay に対応しています。支払い後、残高はすぐ反映されます。