模型决策报告2026 前沿模型指南

像提问一样搜索

你想完成什么,或卡在哪里?

不需要知道模型名,直接说任务或疑问

先给你最可能有用的入口;需要原文细节时,再继续显示正文中的对应段落。

EN第 1.36.1 版 · 构建 2329c88v1.36.1
更多目录

Z.AI上一代开放权重基线核验 2026-08-29

GLM-5.2

中文任务、MIT 开放权重部署、工具代理与成本可控的企业工作流

已有跨来源证据

AA v4.2 max 43(估算);当前方法下尚非完整独立实测,只作历史或专项参考。

AA v4.243 · max · 估算,等待独立评测 · 核验 2026-09-05

上下文
1M
默认推理
high
API 输入
$1.40 / M
API 输出
$4.4 / M
开放权重
MIT
判断把握
中高

集中查看

这个模型的主要判断

综合能力

AA v4.2 max 43(估算);当前方法下尚非完整独立实测,只作历史或专项参考。

实际编程

DeepSWE 为 44%±2、CursorBench max 为 55.0%;适合部署与生态,不应按 Sol、Opus 或 Grok 的代码上限估计

使用限制

推理输出偏长;厂商自报代码分与独立长程结果存在差距。保留既有中文、部署和成本流程的历史参考,不再参与正式推荐。

当前状态

已有跨来源证据,最近核验 2026-08-29