模型简介
Claude Sonnet 5 是 Anthropic 面向编码、代理和企业工作流的均衡旗舰,主打速度与智能的组合,并默认启用自适应思考。
模型能力
规格来自已列明的模型资料;目录标签用于快速判断接入能力,精确限制以来源文档为准。
已核验规格
- 官方定位
- 速度与智能的最佳组合
- 上下文窗口
- 1,000,000 tokens
- 最大输出
- 128,000 tokens
- 思考模式
- 默认自适应思考
资料来源: Anthropic Claude Sonnet 5 更新说明
独立能力评测
仅展示与精确模型 ID 和推理档位相符的公开测评,不用相近型号替代。
智能指数
53
同类排名 #12 / 186
输出速度
83.9 tok/s
同类排名 #69 / 186
首字延迟
191.88s
自适应推理,最大投入
综合分数接近顶级模型且输出速度不错,但最大投入会带来很长的思考等待和大量 token。
测评档位: 自适应推理,最大投入. Artificial Analysis · 评测方法
模型价格和接入方式
价格直接读取 MoleAPI 控制台目录,并按当前计费分组与上下文档位展示。
实际结算价格以控制台中的账户分组为准。
实时价格来源
价格表
USD / 1M tokens标准x1default输入 $2 · 输出 $10
输入
$2 / 1M tokens
输出
$10 / 1M tokens
缓存读取
$0.2 / 1M tokens
缓存写入
$2.5 / 1M tokens
特价x0.8discount输入 $1.6 · 输出 $8
输入
$1.6 / 1M tokens
输出
$8 / 1M tokens
缓存读取
$0.16 / 1M tokens
缓存写入
$2 / 1M tokens
转接x0.3relay输入 $0.6 · 输出 $3
输入
$0.6 / 1M tokens
输出
$3 / 1M tokens
缓存读取
$0.06 / 1M tokens
缓存写入
$0.75 / 1M tokens
接入协议
可用计费分组: 标准, 特价, 转接
- anthropic
- POST
- /v1/messages
- openai
- POST
- /v1/chat/completions
完整模型指南
基于厂商资料整理,并经过独立审稿。 · 2026-07-28
Claude Sonnet 5 是 Anthropic Sonnet 系列的新一代模型,定位为兼顾速度与智能的模型,也是 Claude Sonnet 4.6 的直接升级版本。官方称其相较 Sonnet 4.6 的主要提升集中在编程和智能体任务。 [1]
模型定位与核心能力
Claude Sonnet 5 面向编程、工具使用与智能体工作负载,Anthropic 将其描述为 Sonnet 系列中智能体能力最强的模型。模型可用于任务规划,并可结合浏览器、终端等工具执行多步骤流程。 [8][9]
Anthropic 将 Sonnet 系列定位于实时智能体和高吞吐量工作负载;Sonnet 5 则将此前通常需要更大模型的编程、工具使用与日常工作能力带入 Sonnet 级别。 [8][9]
能力与规格
Claude Sonnet 5 提供 100 万 token 上下文窗口和 12.8 万 token 最大输出,默认启用自适应思考。 [1]
| 规格 | 内容 |
|---|---|
| 上下文窗口 | 1,000,000 tokens,默认值与最大值相同。 [1] |
| 最大输出 | 128,000 tokens。 [1] |
| 思考模式 | 默认启用自适应思考,可通过 thinking: {type: "disabled"} 关闭。 [1] |
| 输出预算 | max_tokens 同时限制思考 token 与最终回答 token 的总量。 [1] |
| 服务层级 | 不支持 Priority Tier。 [1] |
自适应思考以 effort 参数控制推理强度,原有的手动思考预算配置 thinking: {type: "enabled", budget_tokens: N} 已不再支持。 [1]
使用场景
Claude Sonnet 5 的能力重点覆盖代码开发与智能体流程,可用于复杂代码修改、调试、重构,以及需要规划和工具协作的任务。 [1][9]
模型面向需要浏览器或终端工具参与的智能体工作负载,也覆盖高频率的日常知识工作与自动化流程。 [8][9]
100 万 token 上下文窗口适用于需要在单次请求中保留大量上下文信息的任务;其最大输出长度也支持生成较长的代码、分析或任务结果。 [1]
重要限制
Claude Sonnet 5 不接受非默认的 temperature、top_p 或 top_k 参数,设置这些参数会返回 HTTP 400。 [1]
助手消息预填充不受支持,相关请求会返回 HTTP 400。 [1]
该模型采用新的分词器,相同文本相较 Sonnet 4.6 约会产生多 30% 的 token,具体差异取决于内容。这个变化会影响上下文容量估算、输出预算与同等文本量对应的 token 消耗。 [1]
涉及被禁止或高风险网络安全主题的请求可能被拒绝;此类响应仍返回 HTTP 200,但 stop_reason 为 refusal。 [1]
来源
代码示例
示例使用 MoleAPI 的 OpenAI 兼容地址;替换 API Key 后即可运行。
curl https://api.moleapi.com/v1/chat/completions \
-H "Authorization: Bearer $MOLEAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-sonnet-5",
"messages": [{"role": "user", "content": "Hello"}]
}'常见问题
claude-sonnet-5 怎么计费?
本页价格从 MoleAPI 控制台接口动态读取,并随模型价格、上下文档位和账户分组更新。
claude-sonnet-5 支持哪些接入方式?
本页协议和接口来自 MoleAPI 模型目录的 supported_endpoint_types 字段。
如何在现有项目中切换到 claude-sonnet-5?
保留 MoleAPI 的 API 地址和密钥,把请求中的 model 参数替换为本页模型 ID;再按照对应协议检查参数差异。
claude-sonnet-5 的模型资料来自哪里?
模型能力与限制已根据 Anthropic 等页面核验;价格和可用协议只采用 MoleAPI 控制台数据。