模型决策报告2026 前沿模型指南

像提问一样搜索

你想完成什么,或卡在哪里?

不需要知道模型名,直接说任务或疑问

先给你最可能有用的入口;需要原文细节时,再继续显示正文中的对应段落。

EN第 1.36.1 版 · 构建 2329c88v1.36.1
更多目录

OpenAI轻量高吞吐核验 2026-07-31

GPT-5.6 Luna

计划已明确的批量实现、快速小改、后台助手与低成本长上下文

已有跨来源证据

AA v4.2 max 43;低单价适合可验收批量工作,复杂规划、来源冲突和最终判断仍交强模型。

AA v4.243 · max · 原页未标估算 · 核验 2026-09-05

上下文
1.05M
默认推理
medium
API 输入
$0.20 / M
API 输出
$1.20 / M
开放权重
判断把握
中高

集中查看

这个模型的主要判断

综合能力

AA v4.2 max 43;低单价适合可验收批量工作,复杂规划、来源冲突和最终判断仍交强模型。

实际编程

在 Vals Terminus 2 中表现超出价格档;其他 harness 不一定高于 Terra

使用限制

2026-07-30 起 API 单价降低 80%,但能力没有随价格改变;关键判断仍应由 Sol / Claude 等强模型负责。输入超过 272K 后按 $0.40 / $1.80 计价。

当前状态

已有跨来源证据,最近核验 2026-07-31

直接核对

本页的关键来源

官方来源确认型号、规格与可用性;独立来源只回答各自测试覆盖的问题。