AA v4.2 high 42(估算);当前方法下尚非完整独立实测,只作历史或专项参考。
Google上一代多模态基线核验 2026-07-23
Gemini 3.5 Flash
复现基于 Gemini 3.5 Flash 的旧测试、价格快照与工作流
- 上下文
- 1M
- 默认推理
- medium
- API 输入
- $1.50 / M
- API 输出
- $9 / M
- 开放权重
- 否
- 判断把握
- 中高
集中查看
这个模型的主要判断
官方 Terminal-Bench 2.1 为 76.2%;独立综合位置低于 Opus 5 / Sol / Fable,但代理循环速度很有优势
保留历史基线;新项目优先评估 Gemini 3.8/3.7,估算综合分不等于重新实测。
已先后由 Gemini 3.6、3.7 Flash 接替;保留用于复现旧结论