
glm-5.3Zhipu GLM-5.3 — Z.ai's newest reasoning model, built for long-horizon agent work and complex software engineering, with a 1M-token context window and improved coding and token efficiency over GLM-5.2. Served via the OpenAI-compatible chat-completions endpoint. Supports prompt caching, with cache hits billed at $0.247 / 1M input tokens.
Built for multi-step agent workflows
Fits entire codebases in one request
Reliable function calling for agents
Cache hits billed at $0.247 / 1M input
View complete API reference with all parameters and examples.
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
GLM-5.3 は Zhipu の大規模言語モデル API です。GLM-5.3 は Z.ai(智譜)が 2026 年 8 月に公開した推論モデルです。GLM-5.2 と比べてコーディングとトークン効率が特に向上しており、狙いは長丁場のエージェント処理と複雑なソフトウェアエンジニアリング —— 何十ターンも続く作業、コードベースを横断して修正を動く状態まで持っていくような用途です。コンテキストウィンドウは 100 万トークンあり、リポジトリ 1 つを丸ごと 1 回のリクエストに載せられます。ツール呼び出しとストリーミングは当社チャネルで実測しました:enum を含む入れ子スキーマは標準の tool_calls 構造で返り、引数はそのままパースでき、ストリーミングは 22 個の SSE フレームを正常に返しました。料金は入力 100 万トークン $1.33、出力 $4.18、キャッシュ入力 $0.247 —— Z.ai 公式($1.40 / $4.40 / $0.26)より 3 区分すべてで 5% 安く、長文コンテキストの追加料金もありません。OpenAI 互換の /v1/chat/completions で呼び出し、/v1/responses にも対応します。智譜のアカウントは不要で、失敗したリクエストは課金されません。コスト面の実務的なコツ:システムプロンプトとリポジトリのコンテキストという繰り返し部分をターン間で変えないでおくとキャッシュに当たり、$1.33 ではなく $0.247 で課金されます —— 5.4 分の 1 です。 APIMODELS のプラットフォーム経由なら、統一 API と明朗な従量課金でこのモデルを呼び出せます。 現在の料金: Input: $1.33, Output: $4.18 per 1M tokens。
問い合わせに自動で答える対話システムを構築し、対応の効率を上げます。
記事、メール、広告コピーなどの文章を自動で書き、制作の手数を減らします。
コードの記述、デバッグ、レビューを補助し、開発を前に進めます。
非構造化データを読み解き、要点を抽出して要約レポートにまとめます。
GLM-5.3 は APIMODELS 経由で Input: $1.33, Output: $4.18 per 1M tokens で利用できます。課金は従量制で、生成した分だけの支払いです。
APIMODELS に登録して API キーを取得し、統一エンドポイントを呼ぶだけです。cURL / Python / Node.js のサンプルを含む詳しいドキュメントを用意しています。
APIMODELS は同じ GLM-5.3 を集約プラットフォーム経由で提供します。統一された API インターフェースなので、プロバイダごとにアカウントを作る必要はありません。キー 1 本ですべてのモデルに届きます。
入力 100 万トークンあたり $1.33、出力 $4.18、キャッシュ入力 $0.247 です。Z.ai 公式は $1.40 / $4.40 / $0.26 なので、3 つの区分すべてで 5% 安価になります。従量課金で最低利用額もサブスクもなく、失敗したリクエストは課金されません。
GLM-5.3 は新世代で、コーディングとトークン効率が向上し、コンテキストは 100 万トークン。多段階のエージェントやコードベース全体にまたがる作業向けです。GLM-5.2 は安価($0.9 / $3.15 対 $1.33 / $4.18)で、短いタスクや大量処理に向きます。エンドポイントは共通なので、切り替えは model フィールドの変更だけです。
APIMODELS では GLM-5.3 が 60 以上のモデルと同じ API キー・同じ残高の上に並んでいるので、選択は「相性」の問題であって「囲い込み」の問題ではありません。Reasoning、Tool Calling、1M Context、OpenAI-compatible、Prompt Cache に対応しており、他の大規模言語モデルモデルと価格・機能を並べて評価できます。乗り換えはモデル名の文字列を 1 つ書き換えるだけ。新しいアカウントも追加の実装も要りません。大規模言語モデルの選択肢と最新価格は apimodels.app/models で確認できます。
GLM-5.3 は次に対応しています: Reasoning、Tool Calling、1M Context、OpenAI-compatible、Prompt Cache。パラメータの全一覧と呼び出し例は APIMODELS のドキュメントをご覧ください。
はい。APIMODELS は GLM-5.3 を単一の統一 API とキー 1 本で提供します。プロバイダごとのアカウントも、各社の地域ごとのネットワーク経路を自分で面倒みる必要もありません。
Stripe(Visa、Mastercard などの国際カード)と Alipay に対応しています。支払い後、残高はすぐ反映されます。