
claude-haiku-5-5Claude Haiku 5.5 は Anthropic の Claude 5.5 ファミリーの Haiku クラスで、2026 年 10 月 7 日に公開されました。APIMODELS では入力 100 万トークン $0.09、出力 100 万トークン $0.45 で、公式定価 $0.10 / $0.50 より 10% 安く、キャッシュ読み取り $0.009、書き込み $0.1125 です。Anthropic はこのモデルを、大量かつコストが重視される処理向けと位置づけています。要約、コンテキスト圧縮、データベースクエリ、分類、大きなエージェントシステム内のサブエージェント、ライブのカスタマーサポート、ブラウザ操作などです。Anthropic が公開した Claude Haiku 5.5 のベンチマーク(effort max、5 回平均)は Haiku 4.5 から大きく伸びています。GDPval-AA は 1620 対 735、コンピューター操作の OSWorld 2.1 は 72.4% 対 15.7%、Terminal-Bench 4.0 は 39.2% 対 0.0%、Humanity's Last Exam(ツールなし)は 45.9% 対 10.2%、Chartography は 46.4% 対 6.4%。当サイトで同じ料金の OpenAI の大量処理向けモデル GPT-6 Luna と比べると、両方にスコアがある項目はすべて Haiku 5.5 が上です(GDPval-AA 1620 対 1437、AA-Briefcase 1578 対 1336、OSWorld 2.1 72.4% 対 48.9%、Terminal-Bench 4.0 39.2% 対 16.4%、FrontierCode 1.1 46.4% 対 42.4%、Chartography 46.4% 対 29.1%)。ただし Luna の数字は Anthropic の比較と第三者の測定によるもので、OpenAI の発表ではありません。Anthropic 自身も、複雑なエージェント型コーディングには Sonnet 5.5 や Opus 5.5 が向くと明言しています。仕様はコンテキスト 100 万トークン、最大出力 128K、テキストと画像の入力、知識カットオフ 2026 年 6 月、キャッシュできる最小プロンプト 512 トークン。トークナイザーは同じ文章で Haiku 4.5 より約 30% 多いトークンを出します。Anthropic の料金表と同じく、プロンプトが 100,000 トークンを超えるリクエストは全単価が 5 倍(入力 $0.45、出力 $2.25)になります。適応的思考は既定でオン、effort の既定は medium(low〜max)。思考をオフにできるのは effort が high 以下のときだけで、budget_tokens は受け付けられません。1 つのキーで /v1/messages と OpenAI 互換の /v1/chat/completions から呼び出せ、失敗したリクエストは課金されません。
View complete API reference with all parameters and examples.
Enable real-time streaming responses with Server-Sent Events.
{
"model": "claude-haiku-5-5",
"stream": true,
"max_tokens": 1024,
"messages": [...]
}Enable Claude to use tools and call functions.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"tools": [{
"name": "get_weather",
"description": "Get current weather for a location",
"input_schema": {
"type": "object",
"properties": {
"location": {"type": "string", "description": "City name"}
},
"required": ["location"]
}
}],
"tool_choice": {"type": "auto"},
"messages": [{"role": "user", "content": "What's the weather in Tokyo?"}]
}Analyze PDF documents by sending them as base64 encoded content.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"messages": [{
"role": "user",
"content": [{
"type": "document",
"source": {
"type": "base64",
"media_type": "application/pdf",
"data": "<base64_encoded_pdf>"
}
}, {
"type": "text",
"text": "Summarize this document."
}]
}]
}Get structured JSON responses that match your schema.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"output_format": {
"type": "json_schema",
"schema": {
"type": "object",
"properties": {
"name": {"type": "string"},
"age": {"type": "integer"}
},
"required": ["name", "age"]
}
},
"messages": [{"role": "user", "content": "Extract info: John is 30 years old"}]
}Enable Claude to search the web for up-to-date information.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"tools": [{
"type": "web_search_20250305",
"name": "web_search",
"max_uses": 5
}],
"messages": [{"role": "user", "content": "What's the latest news about AI?"}]
}| Parameter | Type | Required | Description |
|---|---|---|---|
| model | string | Yes | Model identifier (e.g., claude-haiku-5-5) |
| messages | array | Yes | Array of message objects with role and content |
| max_tokens | integer | Yes | Maximum tokens in the response (1 - 128000) |
| system | string | No | System prompt to set context |
| stream | boolean | No | Enable streaming responses (SSE) |
| temperature | number | No | Sampling temperature (0.0 - 1.0) |
| top_p | number | No | Nucleus sampling threshold (0.0 - 1.0) |
| top_k | integer | No | Top-k sampling (0 - infinity) |
| stop_sequences | array | No | Sequences that stop generation |
| tools | array | No | Function calling tools definition |
| tool_choice | object | No | Tool selection strategy (auto/any/tool) |
| thinking | object | No | Enable extended thinking mode |
| output_format | object | No | Structured output with JSON schema |
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
100 万トークン $0.09 / $0.45(定価 $0.10 / $0.50)、キャッシュ読み取り $0.009・書き込み $0.1125
Anthropic、effort max:GDPval-AA 1620(Haiku 4.5 は 735)、OSWorld 2.1 72.4%(15.7%)、Terminal-Bench 4.0 39.2%(0.0%)
共通の全項目で上回る:GDPval-AA 1620 対 1437、OSWorld 2.1 72.4% 対 48.9%、Terminal-Bench 4.0 39.2% 対 16.4%
Anthropic:要約、コンテキスト圧縮、分類、DB クエリ、サブエージェント、ライブサポート、ブラウザ操作
テキストと画像を入力;知識カットオフ 2026 年 6 月;10 万トークン超のプロンプトは全単価 5 倍
effort は low〜max;effort が high 以下なら思考をオフにできる;budget_tokens はエラー
Claude Haiku 5.5 は Anthropic の大規模言語モデル API です。Claude Haiku 5.5 は Anthropic の Claude 5.5 ファミリーの Haiku クラスで、2026 年 10 月 7 日に公開されました。APIMODELS では入力 100 万トークン $0.09、出力 100 万トークン $0.45 で、公式定価 $0.10 / $0.50 より 10% 安く、キャッシュ読み取り $0.009、書き込み $0.1125 です。Anthropic はこのモデルを、大量かつコストが重視される処理向けと位置づけています。要約、コンテキスト圧縮、データベースクエリ、分類、大きなエージェントシステム内のサブエージェント、ライブのカスタマーサポート、ブラウザ操作などです。Anthropic が公開した Claude Haiku 5.5 のベンチマーク(effort max、5 回平均)は Haiku 4.5 から大きく伸びています。GDPval-AA は 1620 対 735、コンピューター操作の OSWorld 2.1 は 72.4% 対 15.7%、Terminal-Bench 4.0 は 39.2% 対 0.0%、Humanity's Last Exam(ツールなし)は 45.9% 対 10.2%、Chartography は 46.4% 対 6.4%。当サイトで同じ料金の OpenAI の大量処理向けモデル GPT-6 Luna と比べると、両方にスコアがある項目はすべて Haiku 5.5 が上です(GDPval-AA 1620 対 1437、AA-Briefcase 1578 対 1336、OSWorld 2.1 72.4% 対 48.9%、Terminal-Bench 4.0 39.2% 対 16.4%、FrontierCode 1.1 46.4% 対 42.4%、Chartography 46.4% 対 29.1%)。ただし Luna の数字は Anthropic の比較と第三者の測定によるもので、OpenAI の発表ではありません。Anthropic 自身も、複雑なエージェント型コーディングには Sonnet 5.5 や Opus 5.5 が向くと明言しています。仕様はコンテキスト 100 万トークン、最大出力 128K、テキストと画像の入力、知識カットオフ 2026 年 6 月、キャッシュできる最小プロンプト 512 トークン。トークナイザーは同じ文章で Haiku 4.5 より約 30% 多いトークンを出します。Anthropic の料金表と同じく、プロンプトが 100,000 トークンを超えるリクエストは全単価が 5 倍(入力 $0.45、出力 $2.25)になります。適応的思考は既定でオン、effort の既定は medium(low〜max)。思考をオフにできるのは effort が high 以下のときだけで、budget_tokens は受け付けられません。1 つのキーで /v1/messages と OpenAI 互換の /v1/chat/completions から呼び出せ、失敗したリクエストは課金されません。 APIMODELS のプラットフォーム経由なら、統一 API と明朗な従量課金でこのモデルを呼び出せます。 現在の料金: Input: $0.09, Output: $0.45 per 1M tokens。
問い合わせに自動で答える対話システムを構築し、対応の効率を上げます。
記事、メール、広告コピーなどの文章を自動で書き、制作の手数を減らします。
コードの記述、デバッグ、レビューを補助し、開発を前に進めます。
非構造化データを読み解き、要点を抽出して要約レポートにまとめます。
Claude Haiku 5.5 は APIMODELS 経由で Input: $0.09, Output: $0.45 per 1M tokens で利用できます。課金は従量制で、生成した分だけの支払いです。
APIMODELS に登録して API キーを取得し、統一エンドポイントを呼ぶだけです。cURL / Python / Node.js のサンプルを含む詳しいドキュメントを用意しています。
APIMODELS は同じ Claude Haiku 5.5 を集約プラットフォーム経由で提供します。統一された API インターフェースなので、プロバイダごとにアカウントを作る必要はありません。キー 1 本ですべてのモデルに届きます。
入力 100 万トークン $0.09、出力 100 万トークン $0.45、キャッシュ読み取り $0.009、書き込み $0.1125 で、Anthropic の定価 $0.10 / $0.50、$0.01、$0.125 より 10% 安くなります。公式の料金表と同じく、1 回のリクエストのプロンプト(新しい入力とキャッシュの読み書きの合計)が 100,000 トークンを超えると、そのリクエストの全単価が 5 倍になります。入力 $0.45、出力 $2.25、キャッシュ読み取り $0.045、書き込み $0.5625 で、定価では $0.50 / $2.50 / $0.05 / $0.625 です。実際のトークン数で課金し、失敗したリクエストは無料、月額の最低料金もありません。
Anthropic の発表時の表(effort は max、5 回の平均)では、知識労働の GDPval-AA v2.1 が 1620(Haiku 4.5 は 735)、AA-Briefcase v1.1 が 1578(614)、コンピューター操作の OSWorld 2.1 オフライン版が 72.4%(15.7%)、Terminal-Bench 4.0 が 39.2%(0.0%)、Humanity's Last Exam がツールなし 45.9%・ツールあり 57.4%(10.2%・18.7%)、FrontierCode 1.1 が 46.4%、Chartography(ツールなし)が 46.4%(6.4%)です。システムカードには SWE-Bench Pro 64.8 もあります。注意点は 2 つ。API の既定は medium effort で、この設定では GDPval-AA は 1620 ではなく 1277 です。またエージェント型コーディングでは Sonnet 5.5(Terminal-Bench 4.0 70.6%)が依然として大きく上回ります。
両方に公開スコアがある項目では、すべて Haiku 5.5 が上です。GDPval-AA 1620 対 1437、AA-Briefcase 1578 対 1336、OSWorld 2.1 72.4% 対 48.9%、Terminal-Bench 4.0 39.2% 対 16.4%、FrontierCode 1.1 46.4% 対 42.4%、Chartography 46.4% 対 29.1%、PhysicianBench 43.0% 対 33.6%。ただし Luna 側の数字は慎重に読む必要があります。どれも OpenAI 自身の発表ではありません。GDPval-AA と AA-Briefcase は Artificial Analysis、OSWorld と PhysicianBench は Anthropic が OpenAI の API 経由で測定し、Terminal-Bench は公開リーダーボード、FrontierCode は Cognition、Chartography は Surge AI の公表値です。OpenAI の発表で Luna に付いている数字は DeepSWE v1.1 66.6% の 1 つだけで、Haiku 5.5 にはこの項目のスコアがありません。
APIMODELS ではどちらも 100 万トークン $0.09 / $0.45、キャッシュ読み取り $0.009 なので、定価ではなく用途で選びます。エージェントのサブタスク、コンピューターやブラウザの操作、知識労働なら Haiku 5.5。ベンチマークの差がいちばん大きい領域です。プロンプトが 10 万〜27.2 万トークンなら GPT-6 Luna。Haiku 5.5 はこの範囲を 5 倍で課金しますが、Luna の長文加算は 272K を超えてから(入力 2 倍、出力 1.5 倍)です。Luna は reasoning effort を none にして推論を完全に切ることもできます。トークナイザーが違うので同じ文章でもトークン数は一致しません。自分のプロンプトで計測してください。複雑なエージェント型コーディングには、Anthropic 自身が Sonnet 5.5(当サイトで $1.20 / $6.00)を勧めています。
どちらも使えます。Anthropic ネイティブの POST https://api.apimodels.app/v1/messages か、OpenAI 互換の /v1/chat/completions に、model を claude-haiku-5-5、Authorization: Bearer に apimodels のキーを付けて送ります。ストリーミング、ツール呼び出し、画像入力、プロンプトキャッシュ(cache_control、最小 512 トークン)に対応し、Claude Code や Anthropic SDK は base URL を https://api.apimodels.app に、キーを apimodels のものに替えるだけです。Haiku 4.5(当サイトで $0.353 / $1.765)からの移行はモデル名を claude-haiku-5-5 に変えるだけで、OpenAI 形式の reasoning_effort は Anthropic の effort に変換されます。
コンテキスト 100 万トークン、1 回の出力は最大 128K トークン、入力はテキストと画像、知識カットオフは 2026 年 6 月です。Anthropic が定める Haiku 5.5 のルールとして、適応的思考は既定でオン、effort の既定は medium。thinking を disabled にできるのは effort が high 以下のときだけで、budget_tokens はエラーになります。temperature は 1、top_p は 0.99 に固定され、Anthropic 公式 API では他の値がエラーになりますが、当サイトの OpenAI 互換エンドポイントはこの 2 つを送らないので、一般的なクライアントはそのまま動きます。また同じ文章でも Haiku 4.5 よりトークン数が約 30% 多くなります。
APIMODELS では Claude Haiku 5.5 が 60 以上のモデルと同じ API キー・同じ残高の上に並んでいるので、選択は「相性」の問題であって「囲い込み」の問題ではありません。10% Below Official、High Volume、1M Context、Adaptive Thinking に対応しており、他の大規模言語モデルモデルと価格・機能を並べて評価できます。乗り換えはモデル名の文字列を 1 つ書き換えるだけ。新しいアカウントも追加の実装も要りません。大規模言語モデルの選択肢と最新価格は apimodels.app/models で確認できます。
Claude Haiku 5.5 は次に対応しています: 10% Below Official、High Volume、1M Context、Adaptive Thinking。パラメータの全一覧と呼び出し例は APIMODELS のドキュメントをご覧ください。
はい。APIMODELS は Claude Haiku 5.5 を単一の統一 API とキー 1 本で提供します。プロバイダごとのアカウントも、各社の地域ごとのネットワーク経路を自分で面倒みる必要もありません。
Stripe(Visa、Mastercard などの国際カード)と Alipay に対応しています。支払い後、残高はすぐ反映されます。
How to get access, regional availability, and how this model compares with its alternatives.