AA v4.2 max 43(估算);当前方法下尚非完整独立实测,只作历史或专项参考。
Z.AI上一代开放权重基线核验 2026-08-29
GLM-5.2
中文任务、MIT 开放权重部署、工具代理与成本可控的企业工作流
- 上下文
- 1M
- 默认推理
- high
- API 输入
- $1.40 / M
- API 输出
- $4.4 / M
- 开放权重
- MIT
- 判断把握
- 中高
集中查看
这个模型的主要判断
DeepSWE 为 44%±2、CursorBench max 为 55.0%;适合部署与生态,不应按 Sol、Opus 或 Grok 的代码上限估计
推理输出偏长;厂商自报代码分与独立长程结果存在差距。保留既有中文、部署和成本流程的历史参考,不再参与正式推荐。
已有跨来源证据,最近核验 2026-08-29