模型简介
Claude Haiku 4.5 是 Anthropic 面向低延迟和规模化调用的紧凑模型,适合实时交互、分类、提取和常规自动化。
模型能力
规格来自已列明的模型资料;目录标签用于快速判断接入能力,精确限制以来源文档为准。
已核验规格
- 官方定位
- 快速、紧凑的 Claude 模型
- 上下文窗口
- 200,000 tokens
- 最大输出
- 64,000 tokens
- 输入 / 输出
- 文本、图像 / 文本
模型价格和接入方式
价格直接读取 MoleAPI 控制台目录,并按当前计费分组与上下文档位展示。
实际结算价格以控制台中的账户分组为准。
实时价格来源
价格表
USD / 1M tokens标准x1default输入 $1 · 输出 $5
输入
$1 / 1M tokens
输出
$5 / 1M tokens
缓存读取
$0.1 / 1M tokens
缓存写入
$1.25 / 1M tokens
接入协议
可用计费分组: 标准
- openai
- POST
- /v1/chat/completions
claude-haiku-4.5 模型介绍
以下介绍经过重新组织与本地化表达,并与所列模型资料交叉核验。
Claude Haiku 4.5 是 Anthropic 面向低延迟和规模化调用的紧凑模型,适合实时交互、分类、提取和常规自动化。
核心优势
- 响应快、成本较低,适合用户直接感知延迟的产品。
- 支持文本与图像输入、扩展思考和工具调用。
- 200K 上下文足以覆盖多数文档和对话任务。
使用限制
- 高难度推理、复杂代码和长时间代理任务应考虑 Sonnet 或 Opus。
- 追求极低延迟时应关闭不必要的扩展思考。
选型与上线评估
选择 claude-haiku-4.5 时,先把官方定位映射到真实任务:实时客服、内容审核、移动端助手、邮件分类、会议摘要和高频工具调用。 第一轮评测应同时覆盖它的主要优势“响应快、成本较低,适合用户直接感知延迟的产品。”和已知限制“高难度推理、复杂代码和长时间代理任务应考虑 Sonnet 或 Opus。”,而不是只比较一次通用问答的主观观感。
接入层面,MoleAPI 当前为这款 Anthropic 模型列出 openai 协议和 标准 计费分组;默认价格摘要为 输入 $1 / 1M tokens · 输出 $5 / 1M tokens。价格、协议与可用分组来自实时目录,正式上线前仍应按自己的上下文长度、输出规模和缓存命中率计算代表性请求成本。
目前没有展示与该精确模型 ID 和推理档位完全匹配的独立排名,因此不使用相近型号推断分数。上线前应固定模型 ID、提示词和样本集,记录正确率、结构化输出合格率、工具调用成功率与超时率,再与候选模型做同条件比较。
本页模型资料最近核验于 2026-07-24。当上游模型卡、上下文限制或工具支持发生变化时,应先更新来源与双语事实,再调整推荐结论;MoleAPI 的实时价格变化则由目录自动同步,不与静态能力描述混在一起。
代码示例
示例使用 MoleAPI 的 OpenAI 兼容地址;替换 API Key 后即可运行。
curl https://api.moleapi.com/v1/chat/completions \
-H "Authorization: Bearer $MOLEAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-4.5",
"messages": [{"role": "user", "content": "Hello"}]
}'常见问题
claude-haiku-4.5 怎么计费?
本页价格从 MoleAPI 控制台接口动态读取,并随模型价格、上下文档位和账户分组更新。
claude-haiku-4.5 支持哪些接入方式?
本页协议和接口来自 MoleAPI 模型目录的 supported_endpoint_types 字段。
如何在现有项目中切换到 claude-haiku-4.5?
保留 MoleAPI 的 API 地址和密钥,把请求中的 model 参数替换为本页模型 ID;再按照对应协议检查参数差异。
claude-haiku-4.5 的模型资料来自哪里?
模型能力与限制已根据 B.AI 等页面核验;价格和可用协议只采用 MoleAPI 控制台数据。