模型决策报告2026 前沿模型指南

像提问一样搜索

你想完成什么,或卡在哪里?

不需要知道模型名,直接说任务或疑问

先给你最可能有用的入口;需要原文细节时,再继续显示正文中的对应段落。

EN第 1.36.1 版 · 构建 2329c88v1.36.1
更多目录

xAI上一代 Grok 基线核验 2026-08-13

Grok 4.5

复现基于 Grok 4.5 的旧工作流与升级前后对照

已有跨来源证据

AA v4.2 high 45;仅表示这一综合评测,不等同全部实际任务能力。

AA v4.245 · high · 原页未标估算 · 核验 2026-09-05

上下文
500K
默认推理
high
API 输入
$2 / M
API 输出
$6 / M
开放权重
判断把握

集中查看

这个模型的主要判断

综合能力

AA v4.2 high 45;仅表示这一综合评测,不等同全部实际任务能力。

实际编程

旧版 Cursor 与代理数据只用于历史对照,不能当作 Grok 4.6 的成绩

使用限制

输入超过 200K 后整次请求按 $4 / $12 计费;独立测试显示幻觉控制仍需特别复核。

当前状态

已由 Grok 4.6 接替;保留旧流程、旧榜单和迁移对照