AA v4.2 max 46(估算);当前方法下尚非完整独立实测,只作历史或专项参考。
Anthropic成熟高端基线核验 2026-07-23
Claude Opus 4.8
开放式架构、可靠长任务、范围控制、代码复核与企业工作
- 上下文
- 1M
- 默认推理
- high
- API 输入
- $5 / M
- API 输出
- $25 / M
- 开放权重
- 否
- 判断把握
- 高
集中查看
这个模型的主要判断
完整应用表现强;终端代理通常弱于 Sol
Opus 5 已成为同价位新一代默认候选;4.8 更适合保留成熟旧流程和连续观测基线,不应把旧成绩直接继承给新版。
已有跨来源证据,最近核验 2026-07-23