模型决策报告2026 前沿模型指南

像提问一样搜索

你想完成什么,或卡在哪里?

不需要知道模型名,直接说任务或疑问

先给你最可能有用的入口;需要原文细节时,再继续显示正文中的对应段落。

EN第 1.36.1 版 · 构建 2329c88v1.36.1
更多目录

Google上一代 Gemini 基线核验 2026-08-15

Gemini 3.6 Flash

复现基于 Gemini 3.6 Flash 的旧测试、价格快照与工作流

已有跨来源证据

AA v4.2 high 40;仅表示这一综合评测,不等同全部实际任务能力。

AA v4.240 · high · 原页未标估算 · 核验 2026-09-05

上下文
1M
默认推理
medium
API 输入
$1.50 / M
API 输出
$7.5 / M
开放权重
判断把握
中高

集中查看

这个模型的主要判断

综合能力

AA v4.2 high 40;仅表示这一综合评测,不等同全部实际任务能力。

实际编程

旧版独立结果只用于迁移对照;不能代替 Gemini 3.7 的 DeepSWE 与 CursorBench 数据

使用限制

保留历史基线;新项目优先评估 Gemini 3.8/3.7,工具与缓存费用另算。

当前状态

已由 Gemini 3.7 Flash 接替;保留旧项目、旧价格与迁移对照

直接核对

本页的关键来源

官方来源确认型号、规格与可用性;独立来源只回答各自测试覆盖的问题。