AA v4.2 max 45;仅表示这一综合评测,不等同全部实际任务能力。
Anthropic均衡执行型号核验 2026-07-23
Claude Sonnet 5
边界明确的日常执行、完整应用、速度与能力平衡
- 上下文
- 1M
- 默认推理
- high
- API 输入
- $2 / M
- API 输出
- $10 / M
- 开放权重
- 否
- 判断把握
- 高
从实际任务看
这款模型擅长哪些具体工作
以下结论来自全站同一份任务数据;点击后可查看首选、替代方案、组合流程和证据限制。性价比替代代码审查与上线前复核
常规 PR 审查更经济;复杂问题再升级 Opus 5 或换 Sol。
中等:长任务表现与交叉复核方法 · 判断把握 中高性价比替代从一句需求做完整应用产品完成度好,价格低于 Fable,适合日常迭代。
较强:完整应用 + 模糊多文件任务 · 判断把握 高性价比替代前端视觉、动效与响应式界面完成度和日常迭代平衡更好。
中高:Arena WebDev / React 初榜 + 应用分榜 · 判断把握 中高性价比替代需求梳理与产品方案日常需求文档、用户故事和交互说明更经济。
编辑判断:由工程与应用证据推导 · 判断把握 中通用候选中文写作与润色日常表达、长文编辑和成品感较平衡。
编辑判断:建议用个人语料盲测 · 判断把握 中性价比替代英文写作、方案与专业表达日常邮件、方案和说明文档更均衡。
编辑判断 + 人类偏好信号 · 判断把握 中高集中查看
这个模型的主要判断
完整应用很好;仓库修复和最高难度低于 Fable/Sol
更高 effort 可能增加输出和等待;max 的成功任务成本不一定低于 Opus,应按自有任务复测。
当前 $2 / $10 标准价;原定 9 月涨价取消