
claude-haiku-5-5Claude Haiku 5.5 是 Anthropic Claude 5.5 家族的 Haiku 档,2026 年 10 月 7 日发布。在 APIMODELS 上输入 $0.09、输出 $0.45 每 1M token,比 Anthropic 官方 $0.10 / $0.50 低 10%,缓存读 $0.009、缓存写 $0.1125。Anthropic 把它定位在大批量、对成本敏感的工作:摘要、上下文压缩、数据库查询、分类,大型智能体系统里的子智能体,以及在线客服和浏览器操作。Anthropic 公布的 Claude Haiku 5.5 跑分(max effort,五次取平均)比 Haiku 4.5 大幅提升:GDPval-AA 知识工作 1620 对 735,OSWorld 2.1 操作电脑 72.4% 对 15.7%,Terminal-Bench 4.0 39.2% 对 0.0%,Humanity's Last Exam 不用工具 45.9% 对 10.2%,Chartography 46.4% 对 6.4%。Haiku 5.5 对比 GPT-6 Luna(OpenAI 的大批量档,在我们这里同价):双方都有成绩的项目 Haiku 5.5 全部领先 —— GDPval-AA 1620 对 1437、AA-Briefcase 1578 对 1336、OSWorld 2.1 72.4% 对 48.9%、Terminal-Bench 4.0 39.2% 对 16.4%、FrontierCode 1.1 46.4% 对 42.4%、Chartography 46.4% 对 29.1%;不过 Luna 的数字来自 Anthropic 的对比和第三方评测,不是 OpenAI 自己公布的。Anthropic 也直说,复杂的智能体编码 Sonnet 5.5 和 Opus 5.5 仍是更好的选择。规格:100 万 token 上下文、128K 最大输出、文字和图片输入、知识截止 2026 年 6 月,最小可缓存提示词 512 token;分词器对同一段文字比 Haiku 4.5 多出约 30% 的 token。和官方价格表一致,提示词超过 100,000 token 的请求所有单价按 5 倍计(输入 $0.45、输出 $2.25)。自适应思考默认开、effort 默认 medium(可选 low 到 max);只有 effort 为 high 及以下时才能关闭思考,budget_tokens 会被拒绝。一个 key 即可通过 /v1/messages 或 OpenAI 兼容的 /v1/chat/completions 调用,失败的请求不收钱。
View complete API reference with all parameters and examples.
Enable real-time streaming responses with Server-Sent Events.
{
"model": "claude-haiku-5-5",
"stream": true,
"max_tokens": 1024,
"messages": [...]
}Enable Claude to use tools and call functions.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"tools": [{
"name": "get_weather",
"description": "Get current weather for a location",
"input_schema": {
"type": "object",
"properties": {
"location": {"type": "string", "description": "City name"}
},
"required": ["location"]
}
}],
"tool_choice": {"type": "auto"},
"messages": [{"role": "user", "content": "What's the weather in Tokyo?"}]
}Analyze PDF documents by sending them as base64 encoded content.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"messages": [{
"role": "user",
"content": [{
"type": "document",
"source": {
"type": "base64",
"media_type": "application/pdf",
"data": "<base64_encoded_pdf>"
}
}, {
"type": "text",
"text": "Summarize this document."
}]
}]
}Get structured JSON responses that match your schema.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"output_format": {
"type": "json_schema",
"schema": {
"type": "object",
"properties": {
"name": {"type": "string"},
"age": {"type": "integer"}
},
"required": ["name", "age"]
}
},
"messages": [{"role": "user", "content": "Extract info: John is 30 years old"}]
}Enable Claude to search the web for up-to-date information.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"tools": [{
"type": "web_search_20250305",
"name": "web_search",
"max_uses": 5
}],
"messages": [{"role": "user", "content": "What's the latest news about AI?"}]
}| Parameter | Type | Required | Description |
|---|---|---|---|
| model | string | Yes | Model identifier (e.g., claude-haiku-5-5) |
| messages | array | Yes | Array of message objects with role and content |
| max_tokens | integer | Yes | Maximum tokens in the response (1 - 128000) |
| system | string | No | System prompt to set context |
| stream | boolean | No | Enable streaming responses (SSE) |
| temperature | number | No | Sampling temperature (0.0 - 1.0) |
| top_p | number | No | Nucleus sampling threshold (0.0 - 1.0) |
| top_k | integer | No | Top-k sampling (0 - infinity) |
| stop_sequences | array | No | Sequences that stop generation |
| tools | array | No | Function calling tools definition |
| tool_choice | object | No | Tool selection strategy (auto/any/tool) |
| thinking | object | No | Enable extended thinking mode |
| output_format | object | No | Structured output with JSON schema |
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
$0.09 / $0.45 每 1M token,Anthropic 官方 $0.10 / $0.50;缓存读 $0.009、写 $0.1125
Anthropic,max effort:GDPval-AA 1620(Haiku 4.5 为 735),OSWorld 2.1 72.4%(15.7%),Terminal-Bench 4.0 39.2%(0.0%)
双方都有成绩的项目全部领先:GDPval-AA 1620 对 1437,OSWorld 2.1 72.4% 对 48.9%,Terminal-Bench 4.0 39.2% 对 16.4%
Anthropic:摘要、上下文压缩、分类、数据库查询、子智能体、在线客服与浏览器操作
文本与图像输入;知识截止 2026 年 6 月;提示词超过 10 万 token 时所有单价 ×5
effort 可选 low 到 max;effort 为 high 及以下时可关闭思考;budget_tokens 会报错
Claude Haiku 5.5 是由 Anthropic 提供的大语言模型 API。Claude Haiku 5.5 是 Anthropic Claude 5.5 家族的 Haiku 档,2026 年 10 月 7 日发布。在 APIMODELS 上输入 $0.09、输出 $0.45 每 1M token,比 Anthropic 官方 $0.10 / $0.50 低 10%,缓存读 $0.009、缓存写 $0.1125。Anthropic 把它定位在大批量、对成本敏感的工作:摘要、上下文压缩、数据库查询、分类,大型智能体系统里的子智能体,以及在线客服和浏览器操作。Anthropic 公布的 Claude Haiku 5.5 跑分(max effort,五次取平均)比 Haiku 4.5 大幅提升:GDPval-AA 知识工作 1620 对 735,OSWorld 2.1 操作电脑 72.4% 对 15.7%,Terminal-Bench 4.0 39.2% 对 0.0%,Humanity's Last Exam 不用工具 45.9% 对 10.2%,Chartography 46.4% 对 6.4%。Haiku 5.5 对比 GPT-6 Luna(OpenAI 的大批量档,在我们这里同价):双方都有成绩的项目 Haiku 5.5 全部领先 —— GDPval-AA 1620 对 1437、AA-Briefcase 1578 对 1336、OSWorld 2.1 72.4% 对 48.9%、Terminal-Bench 4.0 39.2% 对 16.4%、FrontierCode 1.1 46.4% 对 42.4%、Chartography 46.4% 对 29.1%;不过 Luna 的数字来自 Anthropic 的对比和第三方评测,不是 OpenAI 自己公布的。Anthropic 也直说,复杂的智能体编码 Sonnet 5.5 和 Opus 5.5 仍是更好的选择。规格:100 万 token 上下文、128K 最大输出、文字和图片输入、知识截止 2026 年 6 月,最小可缓存提示词 512 token;分词器对同一段文字比 Haiku 4.5 多出约 30% 的 token。和官方价格表一致,提示词超过 100,000 token 的请求所有单价按 5 倍计(输入 $0.45、输出 $2.25)。自适应思考默认开、effort 默认 medium(可选 low 到 max);只有 effort 为 high 及以下时才能关闭思考,budget_tokens 会被拒绝。一个 key 即可通过 /v1/messages 或 OpenAI 兼容的 /v1/chat/completions 调用,失败的请求不收钱。 通过 APIMODELS 平台,您可以使用统一的 API 接口调用该模型,按量计费、价格透明。当前定价:Input: $0.09, Output: $0.45 per 1M tokens。
构建智能对话系统,自动回答用户问题,提升客户服务效率。
自动撰写文章、邮件、广告文案等文本内容,提高内容产出效率。
辅助代码编写、调试和代码审查,加速软件开发流程。
理解和分析非结构化数据,提取关键信息并生成报告摘要。
Claude Haiku 5.5 通过 APIMODELS 平台调用,当前定价:Input: $0.09, Output: $0.45 per 1M tokens。按量计费,用多少付多少。
在 APIMODELS 注册账号并获取 API Key,然后通过我们的统一 API 端点调用即可。我们提供详细的 API 文档和 cURL、Python、Node.js 代码示例。
APIMODELS 通过聚合平台提供与官方相同的 Claude Haiku 5.5 模型。我们提供统一的 API 接口,无需分别注册各平台账号,一个 API Key 即可调用所有模型。
输入 $0.09、输出 $0.45 每百万 token,缓存读 $0.009、缓存写 $0.1125,比 Anthropic 官方的 $0.10 / $0.50、$0.01、$0.125 都低 10%。和官方价格表一样,单次请求的提示词(新输入加缓存读写)超过 100,000 token 时,整单所有单价按 5 倍计:输入 $0.45、输出 $2.25、缓存读 $0.045、缓存写 $0.5625,官方对应是 $0.50 / $2.50 / $0.05 / $0.625。按实际 token 扣费,失败的请求不收钱,没有月费门槛。
Anthropic 发布时的成绩(max effort,五次取平均):GDPval-AA v2.1 知识工作 1620 分(Haiku 4.5 为 735),AA-Briefcase v1.1 1578(614),OSWorld 2.1 离线子集操作电脑 72.4%(15.7%),Terminal-Bench 4.0 39.2%(0.0%),Humanity's Last Exam 不用工具 45.9%、用工具 57.4%(10.2%、18.7%),FrontierCode 1.1 46.4%,Chartography 不用工具 46.4%(6.4%)。系统卡另给出 SWE-Bench Pro 64.8。两点要注意:API 默认是 medium effort,这一档 GDPval-AA 是 1277 而不是 1620;智能体编码上 Sonnet 5.5(Terminal-Bench 4.0 70.6%)仍明显领先。
两边都有公开成绩的项目上,Haiku 5.5 全部领先:GDPval-AA 1620 对 1437,AA-Briefcase 1578 对 1336,OSWorld 2.1 72.4% 对 48.9%,Terminal-Bench 4.0 39.2% 对 16.4%,FrontierCode 1.1 46.4% 对 42.4%,Chartography 46.4% 对 29.1%,PhysicianBench 43.0% 对 33.6%。Luna 这一侧要谨慎看:这些数字都不是 OpenAI 自己公布的 —— GDPval-AA 和 AA-Briefcase 由 Artificial Analysis 跑,OSWorld 和 PhysicianBench 是 Anthropic 通过 OpenAI API 跑的,Terminal-Bench 取自公开榜单,FrontierCode 由 Cognition 跑,Chartography 由 Surge AI 公布。OpenAI 发布文里 Luna 只有一个成绩:DeepSWE v1.1 66.6%,Haiku 5.5 没有这一项。
在 APIMODELS 上两者都是每百万 token $0.09 / $0.45、缓存读 $0.009,所以按任务选,不按标价选。智能体子任务、操作电脑和浏览器、知识类工作选 Haiku 5.5,这几项它的跑分领先最多。提示词在 10 万到 27.2 万 token 之间的选 GPT-6 Luna:Haiku 5.5 这一段整单按 5 倍计,Luna 的长提示加价要超过 272K 才开始(输入 2 倍、输出 1.5 倍)。Luna 还能把 reasoning effort 设成 none 完全不推理;两者分词器不同,同一段文字的 token 数并不相等,最好用自己的提示词实测。复杂的智能体编码,Anthropic 自己推荐 Sonnet 5.5(这里 $1.20 / $6.00)。
两种都行:Anthropic 原生 POST https://api.apimodels.app/v1/messages,或 OpenAI 兼容的 /v1/chat/completions,model 填 claude-haiku-5-5,Authorization: Bearer 你的 apimodels key。流式、工具调用、图片输入和提示词缓存(cache_control,最少 512 token)都支持;Claude Code、Anthropic SDK 只需把 base URL 换成 https://api.apimodels.app、key 换成 apimodels 的。从 Haiku 4.5(这里 $0.353 / $1.765)迁过来,把模型名改成 claude-haiku-5-5 即可;OpenAI 接口的 reasoning_effort 会映射成 Anthropic 的 effort。
上下文 100 万 token、单次最多输出 128K token,输入支持文字和图片,知识截止 2026 年 6 月。Anthropic 对 Haiku 5.5 的规定:自适应思考默认开、effort 默认 medium;thinking 只有在 effort 为 high 及以下时才能传 disabled,传 budget_tokens 会报错;temperature 固定为 1、top_p 固定为 0.99,在 Anthropic 官方 API 上传别的值会报错 —— 我们的 OpenAI 兼容接口会自动去掉这两个参数,常见客户端不用改;另外分词器对同一段文字比 Haiku 4.5 多出约 30% 的 token。
在 APIMODELS,Claude Haiku 5.5 与 60+ 个模型共用一个 API Key、一个余额,所以选型只看合不合适,不存在锁定。它支持 10% Below Official、High Volume、1M Context、Adaptive Thinking,你可以在价格和能力上把它和其它大语言模型模型对比,换模型只需改一个模型名字符串——无需新账号、无需重新对接。所有大语言模型模型与实时价格见 apimodels.app/models。
Claude Haiku 5.5 支持:10% Below Official、High Volume、1M Context、Adaptive Thinking。完整参数与调用方式见 APIMODELS 的 API 文档。
可以。APIMODELS 提供可直接访问的统一 API,一个 API Key 即可调用 Claude Haiku 5.5,无需分别注册官方账号、也无需自行处理官方接口的网络访问。
我们支持 Stripe(Visa、Mastercard 等国际信用卡)和支付宝付款。充值后积分即时到账。
接入方式、地区可用性,以及和同类模型的横向对比。