{"schemaVersion":"1.0","kind":"ai-model-decision-site-index","site":{"name":"AI 大模型决策报告","url":"https://llmcp.edlab.top/","language":["zh-CN","en"],"version":"v1.36.1","snapshotDate":"2026-09-05","description":"面向普通用户和开发者的 AI 模型决策网站，按具体任务解释模型能力、推理强度、编程表现、API 成本、会员套餐和专项工具。"},"readingGuide":["先读目标页面或小节的 summary，再打开 URL 核对完整结论、证据范围和限制。","型号、价格、可用性和评测都是带日期的快照；verifiedAt 是该条结论最近核验日期。","官方资料可确认产品事实，厂商自报分数不能单独证明横向排名；强结论应结合不同方法的独立来源。","不同榜单回答的问题不同，不能把综合分数、真实仓库通过率、主观偏好和专项能力混成一个智力百分比。","语音误识别和常见错拼只用于站内检索容错，不是正式型号或官方别名。"],"documents":[{"id":"home","type":"page","title":"AI 大模型选择器","summary":"按任务、效果、成本和使用入口快速选择模型，并查看四条分轨结论。","url":"https://llmcp.edlab.top/","language":"zh-CN","verifiedAt":"2026-09-05"},{"id":"workflows","type":"page","title":"模型、推理档与多代理工作流","summary":"对照 Astra、Fable 5.1 与 Sol 的推理档、成本、前端游戏表现，以及便宜模型执行、子代理和 worktree 的实际用法。","url":"https://llmcp.edlab.top/workflows/","language":"zh-CN","verifiedAt":"2026-09-05"},{"id":"plans","type":"page","title":"主流 AI 会员套餐与搭配","summary":"按功能门槛、真实用量和已有订阅选择 Kimi、ChatGPT、Claude、Google AI、SuperGrok 等套餐。","url":"https://llmcp.edlab.top/plans/","language":"zh-CN","verifiedAt":"2026-09-05"},{"id":"compare","type":"page","title":"多模型直接对比","summary":"一次选择 2—4 个模型，在同一口径下比较能力、价格、适用任务和限制。","url":"https://llmcp.edlab.top/compare/","language":"zh-CN","verifiedAt":"2026-09-05"},{"id":"specialists","type":"page","title":"专项 AI 工具地图","summary":"按 X 调研、图像、视频生成、视频换语言、配音和字幕等具体任务选择首选与达标低价方案。","url":"https://llmcp.edlab.top/specialists/","language":"zh-CN","verifiedAt":"2026-09-05"},{"id":"model-health","type":"page","title":"模型状态与能力变化","summary":"把官方服务故障、滚动能力观测和社区体感分开，避免把一次波动直接叫作降智。","url":"https://llmcp.edlab.top/model-health/","language":"zh-CN","verifiedAt":"2026-09-05"},{"id":"directory","type":"page","title":"全站目录","summary":"浏览全部主要页面、重点段落和模型资料入口。","url":"https://llmcp.edlab.top/directory/","language":"zh-CN","verifiedAt":"2026-09-05"},{"id":"auto-update-lab","type":"page","title":"零 Token 数据观察室","summary":"查看带日期的数据快照、来源状态和历史样例；观察数据不会自动改写正式结论。","url":"https://llmcp.edlab.top/auto-update-lab/","language":"zh-CN","verifiedAt":"2026-09-05"},{"id":"english","type":"page","title":"English AI model decision guide","summary":"A concise English guide to the site's model, workflow, cost, and evidence tracks.","url":"https://llmcp.edlab.top/en/","language":"en","verifiedAt":"2026-09-05"},{"id":"model-fable51","type":"model-profile","title":"Claude Fable 5.1","summary":"高难任务旗舰。高难规划、含糊多文件实现、长程专业工作与异家复核。","url":"https://llmcp.edlab.top/models/claude-fable-5-1/","language":"zh-CN","provider":"Anthropic","verifiedAt":"2026-09-05"},{"id":"model-astra","type":"model-profile","title":"GPT-6 Astra","summary":"高难任务旗舰。复杂推理、代码与终端闭环、资料分析、少返工的端到端任务。","url":"https://llmcp.edlab.top/models/gpt-6-astra/","language":"zh-CN","provider":"OpenAI","verifiedAt":"2026-09-05"},{"id":"model-gemini38","type":"model-profile","title":"Gemini 3.8 Flash","summary":"高性价比多模态执行。多模态资料、Google 工具、有验收的多文件开发和长程代码执行。","url":"https://llmcp.edlab.top/models/gemini-3-8-flash/","language":"zh-CN","provider":"Google","verifiedAt":"2026-09-05"},{"id":"model-muse13","type":"model-profile","title":"Meta Muse Spark 1.3","summary":"新品观察。专业工作与长代理新品观察；先核对可用版本和账户入口。","url":"https://llmcp.edlab.top/models/meta-muse-spark-1-3/","language":"zh-CN","provider":"Meta","verifiedAt":"2026-09-05"},{"id":"model-fable","type":"model-profile","title":"Claude Fable 5","summary":"上一代 Fable 基线。完整应用、模糊需求、多文件长任务、独立复核。","url":"https://llmcp.edlab.top/models/claude-fable-5/","language":"zh-CN","provider":"Anthropic","verifiedAt":"2026-08-13"},{"id":"model-opus5","type":"model-profile","title":"Claude Opus 5","summary":"高端实用与复核。复杂代理编程、开放式架构、长链路企业任务与高质量成品。","url":"https://llmcp.edlab.top/models/claude-opus-5/","language":"zh-CN","provider":"Anthropic","verifiedAt":"2026-07-31"},{"id":"model-mythos","type":"model-profile","title":"Claude Mythos 5","summary":"受限研究参考。仅适用于获批组织的高权限安全、生命科学与网络研究。","url":"https://llmcp.edlab.top/models/claude-mythos-5/","language":"zh-CN","provider":"Anthropic","verifiedAt":"2026-07-23"},{"id":"model-sol","type":"model-profile","title":"GPT-5.6 Sol","summary":"成熟高端与成本路线。仓库修复、终端执行、复杂架构与主力编程。","url":"https://llmcp.edlab.top/models/gpt-5-6-sol/","language":"zh-CN","provider":"OpenAI","verifiedAt":"2026-08-29"},{"id":"model-terra","type":"model-profile","title":"GPT-5.6 Terra","summary":"均衡型号。有测试兜底的日常多文件开发、能力与成本平衡。","url":"https://llmcp.edlab.top/models/gpt-5-6-terra/","language":"zh-CN","provider":"OpenAI","verifiedAt":"2026-07-31"},{"id":"model-luna","type":"model-profile","title":"GPT-5.6 Luna","summary":"轻量高吞吐。计划已明确的批量实现、快速小改、后台助手与低成本长上下文。","url":"https://llmcp.edlab.top/models/gpt-5-6-luna/","language":"zh-CN","provider":"OpenAI","verifiedAt":"2026-07-31"},{"id":"model-gpt55","type":"model-profile","title":"GPT-5.5","summary":"上一代基线。旧项目兼容、稳定 Codex 工作流。","url":"https://llmcp.edlab.top/models/gpt-5-5/","language":"zh-CN","provider":"OpenAI","verifiedAt":"2026-07-31"},{"id":"model-gpt55pro","type":"model-profile","title":"GPT-5.5 Pro","summary":"高成本研究参考。极难研究、证明、长分析和高价值一次性任务。","url":"https://llmcp.edlab.top/models/gpt-5-5-pro/","language":"zh-CN","provider":"OpenAI","verifiedAt":"2026-07-31"},{"id":"model-opus48","type":"model-profile","title":"Claude Opus 4.8","summary":"成熟高端基线。开放式架构、可靠长任务、范围控制、代码复核与企业工作。","url":"https://llmcp.edlab.top/models/claude-opus-4-8/","language":"zh-CN","provider":"Anthropic","verifiedAt":"2026-07-23"},{"id":"model-sonnet5","type":"model-profile","title":"Claude Sonnet 5","summary":"均衡执行型号。边界明确的日常执行、完整应用、速度与能力平衡。","url":"https://llmcp.edlab.top/models/claude-sonnet-5/","language":"zh-CN","provider":"Anthropic","verifiedAt":"2026-07-23"},{"id":"model-grok46","type":"model-profile","title":"Grok 4.6","summary":"低价前沿旗舰。低价前沿编程、工具代理、知识工作，以及需要 X 搜索的实时信息调研。","url":"https://llmcp.edlab.top/models/grok-4-6/","language":"zh-CN","provider":"xAI","verifiedAt":"2026-08-15"},{"id":"model-grok45","type":"model-profile","title":"Grok 4.5","summary":"上一代 Grok 基线。复现基于 Grok 4.5 的旧工作流与升级前后对照。","url":"https://llmcp.edlab.top/models/grok-4-5/","language":"zh-CN","provider":"xAI","verifiedAt":"2026-08-13"},{"id":"model-muse12","type":"model-profile","title":"Meta Muse Spark 1.2","summary":"法律金融与长代理专项。法律、金融、医疗与税务等专业工作流，以及可恢复的长时间后台代理。","url":"https://llmcp.edlab.top/models/meta-muse-spark-1-2/","language":"zh-CN","provider":"Meta","verifiedAt":"2026-08-15"},{"id":"model-muse11","type":"model-profile","title":"Meta Muse Spark 1.1","summary":"上一代代理基线。尚未迁移的 Muse 旧流程与 1.2 升级前后对照。","url":"https://llmcp.edlab.top/models/meta-muse-spark-1-1/","language":"zh-CN","provider":"Meta","verifiedAt":"2026-07-17"},{"id":"model-gemini37","type":"model-profile","title":"Gemini 3.7 Flash","summary":"效率价值与成熟流程。高速多模态理解、Google 搜索与地图工具、长流程代理、高频编程循环和金融研究。","url":"https://llmcp.edlab.top/models/gemini-3-7-flash/","language":"zh-CN","provider":"Google","verifiedAt":"2026-08-15"},{"id":"model-gemini36","type":"model-profile","title":"Gemini 3.6 Flash","summary":"上一代 Gemini 基线。复现基于 Gemini 3.6 Flash 的旧测试、价格快照与工作流。","url":"https://llmcp.edlab.top/models/gemini-3-6-flash/","language":"zh-CN","provider":"Google","verifiedAt":"2026-08-15"},{"id":"model-gemini35","type":"model-profile","title":"Gemini 3.5 Flash","summary":"上一代多模态基线。复现基于 Gemini 3.5 Flash 的旧测试、价格快照与工作流。","url":"https://llmcp.edlab.top/models/gemini-3-5-flash/","language":"zh-CN","provider":"Google","verifiedAt":"2026-07-23"},{"id":"model-glm53","type":"model-profile","title":"GLM-5.3","summary":"开放权重前沿旗舰。复杂代码、长程 Agent、中文专业任务，以及有大型推理基础设施的开放权重部署。","url":"https://llmcp.edlab.top/models/glm-5-3/","language":"zh-CN","provider":"Z.AI","verifiedAt":"2026-08-29"},{"id":"model-glm53flash","type":"model-profile","title":"GLM-5.3-Flash","summary":"低价合格执行者。强模型已写清计划后的批量实现、可回滚代码支线、结构化抽取与有引用的低风险知识工作。","url":"https://llmcp.edlab.top/models/glm-5-3-flash/","language":"zh-CN","provider":"Z.AI","verifiedAt":"2026-08-29"},{"id":"model-glm52","type":"model-profile","title":"GLM-5.2","summary":"上一代开放权重基线。中文任务、MIT 开放权重部署、工具代理与成本可控的企业工作流。","url":"https://llmcp.edlab.top/models/glm-5-2/","language":"zh-CN","provider":"Z.AI","verifiedAt":"2026-08-29"},{"id":"model-qwen38","type":"model-profile","title":"Qwen 3.8 Max","summary":"国产强第二梯队旗舰。中文复杂任务、视觉与长上下文、阿里云生态，以及需要统一国内 API 入口的团队。","url":"https://llmcp.edlab.top/models/qwen-3-8-max/","language":"zh-CN","provider":"Alibaba","verifiedAt":"2026-08-29"},{"id":"model-qwen38preview","type":"model-profile","title":"Qwen 3.8 Max Preview","summary":"已结束的预览基线。复现预览期的 Token Plan 工作流与正式版迁移前后对照。","url":"https://llmcp.edlab.top/models/qwen-3-8-max-preview/","language":"zh-CN","provider":"Alibaba","verifiedAt":"2026-08-13"},{"id":"model-qwen37max","type":"model-profile","title":"Qwen 3.7 Max","summary":"上一代千问基线。尚未迁移的 Qwen 3.7 应用与 3.8 升级前后复测。","url":"https://llmcp.edlab.top/models/qwen-3-7-max/","language":"zh-CN","provider":"Alibaba","verifiedAt":"2026-08-13"},{"id":"model-qwen37plus","type":"model-profile","title":"Qwen 3.7 Plus","summary":"中文成本型号。中文日常、低价 coding tools、规模化调用。","url":"https://llmcp.edlab.top/models/qwen-3-7-plus/","language":"zh-CN","provider":"Alibaba","verifiedAt":"2026-07-17"},{"id":"model-deepseek-pro","type":"model-profile","title":"DeepSeek V4 Pro 0813","summary":"低价长程代码专项。Max 档下有测试兜底的长程代码、批量仓库任务和极度成本敏感的企业试点。","url":"https://llmcp.edlab.top/models/deepseek-v4-pro/","language":"zh-CN","provider":"DeepSeek","verifiedAt":"2026-08-29"},{"id":"model-deepseek-flash","type":"model-profile","title":"DeepSeek V4 Flash 0731","summary":"低成本可验收候选。Max 档下可验收的批量抽取、分类、草稿与低风险客服试点。","url":"https://llmcp.edlab.top/models/deepseek-v4-flash/","language":"zh-CN","provider":"DeepSeek","verifiedAt":"2026-08-29"},{"id":"model-kimi3","type":"model-profile","title":"Kimi K3","summary":"通用旗舰 · 新发布。网页与 React 原型、长资料、并行调研、图片 / 视频理解、长程 Agent，以及具备大型推理基础设施的开放权重部署。","url":"https://llmcp.edlab.top/models/kimi-k3/","language":"zh-CN","provider":"Moonshot","verifiedAt":"2026-08-15"},{"id":"model-kimi26","type":"model-profile","title":"Kimi K2.6","summary":"上一代通用开放权重型号。Kimi 通用聊天、复杂推理与多模态理解。","url":"https://llmcp.edlab.top/models/kimi-k2-6/","language":"zh-CN","provider":"Moonshot","verifiedAt":"2026-07-17"},{"id":"model-minimaxm3","type":"model-profile","title":"MiniMax M3","summary":"国产代码与代理专项。代码代理、多模态工具任务、低成本长上下文。","url":"https://llmcp.edlab.top/models/minimax-m3/","language":"zh-CN","provider":"MiniMax","verifiedAt":"2026-07-13"},{"id":"model-kimi27","type":"model-profile","title":"Kimi K2.7 Code","summary":"Kimi 编程专项。开放权重代码代理、MCP 工具调用、中文编程生态。","url":"https://llmcp.edlab.top/models/kimi-k2-7-code/","language":"zh-CN","provider":"Moonshot","verifiedAt":"2026-07-17"}],"sections":[{"id":"k3-kivine-identity","type":"section","category":"证据与来源","title":"Kivine 身份尚未确认","summary":"Moonshot 与 Arena 尚未公开确认匿名测试名 Kivine 就是正式 Kimi K3；相关样本只作检索线索，不并入 K3 排名或社区计数。","url":"https://llmcp.edlab.top/models/kimi-k3/#independent-evidence","verifiedAt":"2026-07-17"},{"id":"k3-preliminary","type":"section","category":"相关专题","title":"60 秒看懂 Kimi K3：适合谁、怎么试、什么时候别用","summary":"网页与 React、长资料和 Agent 任务值得试；只是聊天先免费，事实任务要核对来源，速度或本地部署优先时先比较其他选择。","url":"https://llmcp.edlab.top/models/kimi-k3/#quick-read","verifiedAt":"2026-07-26"},{"id":"k3-official","type":"section","category":"证据与来源","title":"Kimi K3 官方规格、API 与价格","summary":"2.8T、100 万上下文、图片与视频输入、动态工具加载；API 与 Kimi Code 均支持 low / high / max，默认分别为 max 与 high；缓存 $0.30/M、输入 $3/M、输出 $15/M。","url":"https://llmcp.edlab.top/models/kimi-k3/#official-facts","verifiedAt":"2026-07-26"},{"id":"k3-256k","type":"section","category":"相关专题","title":"Kimi Code 日常选 k3-256k 还是 1M k3","summary":"256K 内使用同一 K3，官方称结果相同；k3-256k 更省额度，1M k3 约耗两倍额度，只有超长资料或视频输入才更需要后者。","url":"https://llmcp.edlab.top/models/kimi-k3/#context-guide","verifiedAt":"2026-07-26"},{"id":"k3-extra-usage","type":"section","category":"相关专题","title":"Kimi 额度用完后的 Extra Usage 怎么用","summary":"订阅额度先扣，网页与 Kimi Code 共用 Extra Usage 余额，最后按量兜底；可设月度消费上限，余额不失效但一般不可退。","url":"https://llmcp.edlab.top/models/kimi-k3/#membership-guide","verifiedAt":"2026-07-26"},{"id":"k3-agent-swarm","type":"section","category":"相关专题","title":"普通 K3 还是 K3 集群：按任务分流","summary":"目标连贯、步骤互相依赖时用普通 K3；能拆成至少 3 条独立支线，而且节省等待值得多花额度时再开集群。","url":"https://llmcp.edlab.top/models/kimi-k3/#mode-guide","verifiedAt":"2026-07-26"},{"id":"k3-cluster-billing","type":"section","category":"相关专题","title":"K3 集群“约 3 倍额度”到底怎么算","summary":"credits 按所有子 Agent 的实际 Token 合计；App 的约 3 倍不是固定公式，官方 3—4.5× 说的是大规模搜索速度，不是额度倍率。","url":"https://llmcp.edlab.top/models/kimi-k3/#cluster-billing","verifiedAt":"2026-07-26"},{"id":"k3-cluster-quality","type":"section","category":"相关专题","title":"K3 集群会不会提高编程项目质量","summary":"可并行的模块审计、实现、测试与复核更可能扩大覆盖；共享核心、串行调试和模糊需求可能因冲突反而变差。","url":"https://llmcp.edlab.top/models/kimi-k3/#mode-guide","verifiedAt":"2026-07-26"},{"id":"k3-context-guide","type":"section","category":"相关专题","title":"K3 的 1M 上下文什么时候开","summary":"只有资料接近 256K、压缩会破坏跨文件关系时再开；少量文件、单个 Bug 和普通问答先用精选上下文。","url":"https://llmcp.edlab.top/models/kimi-k3/#context-guide","verifiedAt":"2026-07-26"},{"id":"k3-websites","type":"section","category":"继续操作","title":"Kimi Websites 能做什么","summary":"K3 驱动的全栈建站入口，可从自然语言、截图或录屏生成前后端，并提供数据库、鉴权、版本、预览、部署和代码导出。","url":"https://llmcp.edlab.top/models/kimi-k3/#software-guide","verifiedAt":"2026-07-26"},{"id":"k3-independent","type":"section","category":"证据与来源","title":"Kimi K3 独立榜单进度","summary":"AA、Vals、Arena、DeepSWE 与 CursorBench 已从综合、经济任务、偏好、原创长程代码和模糊多文件工程交叉收录；AISI 另给出网络安全专项边界。","url":"https://llmcp.edlab.top/models/kimi-k3/#independent-evidence","verifiedAt":"2026-07-31"},{"id":"k3-research-gaps","type":"section","category":"证据与来源","title":"Kimi K3 还有哪些问题没证据","summary":"权重、许可证和技术报告已补齐；继续跟踪不同硬件的独立部署成本、订阅成功任务成本、中文大型仓库稳定性和事实性。","url":"https://llmcp.edlab.top/models/kimi-k3/#research-gaps","verifiedAt":"2026-07-31"},{"id":"k3-open-weights","type":"section","category":"相关专题","title":"Kimi K3 能不能本地部署","summary":"完整权重已经发布，但 96 个权重分片合计约 1.42 TiB，并使用带商业条件的 Kimi K3 License；可下载不等于普通电脑能跑。","url":"https://llmcp.edlab.top/models/kimi-k3/#official-facts","verifiedAt":"2026-07-31"},{"id":"k3-community","type":"section","category":"证据与来源","title":"Kimi K3 论坛与开发者实测","summary":"十余个可复查样本显示前端、创意、规划和工具使用有潜力；额度消耗、超长思考和客户端稳定性仍反复出现。","url":"https://llmcp.edlab.top/models/kimi-k3/#community-signals","verifiedAt":"2026-07-26"},{"id":"k3-membership","type":"section","category":"相关专题","title":"Kimi 会员怎么选","summary":"先按 Agent 集群、Kimi Claw 和 K3 编程等功能门槛排除，再用一个月真实用量决定升档、降档、年付或不续。","url":"https://llmcp.edlab.top/models/kimi-k3/#membership-guide","verifiedAt":"2026-07-26"},{"id":"k3-software","type":"section","category":"继续操作","title":"用 Kimi 工作或编程应该下载什么","summary":"快速聊天用网页，大规模研究用 K3 集群，全栈原型用 Kimi Websites，知识工作用 Kimi Work，代码仓库优先用 Kimi Code CLI。","url":"https://llmcp.edlab.top/models/kimi-k3/#software-guide","verifiedAt":"2026-07-26"},{"id":"k3-product-comparison","type":"section","category":"相关专题","title":"Kimi、ChatGPT 与 Claude 会员产品对比","summary":"比较 Kimi Work / Code、ChatGPT / Codex 与 Claude / Claude Code 的产品组合、独特优势和限制。","url":"https://llmcp.edlab.top/models/kimi-k3/#product-comparison","verifiedAt":"2026-07-26"},{"id":"k3-membership-faq-1","type":"section","category":"相关专题","title":"还是不知道选哪档，最快怎么排除？","summary":"先只看功能门槛：只用 K2.6 可先从免费版开始；要 Agent 集群或在 Kimi Code 里用 K3，最低是 Moderato ¥99；要 Kimi Claw 或 K3 最高 1M，最低是 Allegretto ¥199。没有明确命中这些功能时，不必为了“可能会用”买更高档。","url":"https://llmcp.edlab.top/models/kimi-k3/#membership-faq-1","verifiedAt":"2026-07-26"},{"id":"k3-membership-faq-2","type":"section","category":"相关专题","title":"担心以后买不到或不能升级，要不要现在先锁年包？","summary":"没有可靠证据支持因限售传闻提前锁定年包。当前官方规则允许在订阅页升级，并按剩余价值折算、当天生效；未来供应和规则没人能保证，购买当天再核对官方页，比为未证实的变化预付一年更稳妥。","url":"https://llmcp.edlab.top/models/kimi-k3/#membership-faq-2","verifiedAt":"2026-07-26"},{"id":"k3-membership-faq-3","type":"section","category":"相关专题","title":"这几天没空用，开通是不是很亏？","summary":"先把情绪换成算术：月费 ÷ 30。Andante、Moderato、Allegretto、Allegro 分别约为 ¥1.6、¥3.3、¥6.6、¥23.3/天。用“闲置天数 × 日均成本”判断可接受损失，再决定今天开还是等真正要用时再开。","url":"https://llmcp.edlab.top/models/kimi-k3/#membership-faq-3","verifiedAt":"2026-07-26"},{"id":"k3-membership-faq-4","type":"section","category":"相关专题","title":"怕忘记关自动续费，怎样把风险降到最低？","summary":"开通后即可在 Kimi「设置 → 订阅管理」或微信、支付宝、Apple ID 的自动扣款管理中取消续费；取消后当前周期权益仍保留到到期日。支付渠道是否提醒取决于你的通知设置，最好同时在扣款渠道复查一次。","url":"https://llmcp.edlab.top/models/kimi-k3/#membership-faq-4","verifiedAt":"2026-07-26"},{"id":"k3-membership-faq-5","type":"section","category":"相关专题","title":"买错了怎么办？","summary":"付费虚拟服务原则上不可退费，但从低档升级会按剩余价值折算并立即生效；降档不能在周期中途完成，需要先取消续费，到期后再订低档。因此第一次从满足功能的最低档包月开始，通常比一步到位更稳。","url":"https://llmcp.edlab.top/models/kimi-k3/#membership-faq-5","verifiedAt":"2026-07-26"},{"id":"k3-membership-faq-6","type":"section","category":"相关专题","title":"套餐额度用完，必须立刻升级吗？","summary":"不一定。可以等待每 7 天或月度额度恢复，也可给订阅账户开启 Extra Usage 按实际用量继续。先设月度消费上限；如果连续多周都靠 Extra Usage 补量，再比较升级套餐是否更便宜。Extra Usage 余额一般不可退，但不会过期。","url":"https://llmcp.edlab.top/models/kimi-k3/#membership-faq-6","verifiedAt":"2026-07-26"},{"id":"k3-membership-faq-7","type":"section","category":"相关专题","title":"已经有 ChatGPT、Claude 或其他 AI 会员，还值得买吗？","summary":"先买一个月的最低可用档，并记录 Kimi 实际替代了哪些现有订阅用量：聊天、研究、Office、Agent 还是 Code。只有替代关系和额度消耗连续可见后，再决定长期保留、升级、转年付，或停掉其中一个订阅。","url":"https://llmcp.edlab.top/models/kimi-k3/#membership-faq-7","verifiedAt":"2026-07-26"},{"id":"k3-faq-1","type":"section","category":"相关专题","title":"我已经会用 Codex 或 Claude Code，第一次应该下载哪个 Kimi 产品？","summary":"编程直接从 Kimi Code CLI 开始；本地文档、网页操作和定时任务用 Kimi Work；只是聊天或研究先用网页。不要为了试 K3 同时安装全部客户端。","url":"https://llmcp.edlab.top/models/kimi-k3/#kimi-faq-1","verifiedAt":"2026-07-26"},{"id":"k3-faq-2","type":"section","category":"相关专题","title":"为什么付费后仍然不能在 Kimi Code 里调用 K3？","summary":"K3 的 Code 权限从 Moderato 开始。Moderato 最高 256K 上下文；Allegretto 及以上才有最高 1M。请求超出套餐权限时可能返回 401，重复重试不会解决。","url":"https://llmcp.edlab.top/models/kimi-k3/#kimi-faq-2","verifiedAt":"2026-07-26"},{"id":"k3-faq-3","type":"section","category":"相关专题","title":"新用户应该优先装 VS Code 扩展吗？","summary":"目前不建议。官方说明新版 TypeScript CLI 用户暂不支持新装 VS Code 扩展，老 Python CLI 用户和既有扩展用户可以继续使用。新用户先装官方 CLI 最稳。","url":"https://llmcp.edlab.top/models/kimi-k3/#kimi-faq-3","verifiedAt":"2026-07-26"},{"id":"k3-faq-4","type":"section","category":"相关专题","title":"K3、K2.7 Code 和 HighSpeed 应该怎么选？","summary":"复杂推理、3D、游戏和超长上下文先试 K3；常规工程优先成熟的 K2.7 Code；只在需要快速迭代时用 HighSpeed。HighSpeed 编码能力相同，输出约快 5—6 倍，但额度约按 3 倍消耗。","url":"https://llmcp.edlab.top/models/kimi-k3/#kimi-faq-4","verifiedAt":"2026-07-26"},{"id":"k3-faq-5","type":"section","category":"相关专题","title":"为什么 Kimi Code 的额度看起来掉得很快？","summary":"K3 的长思考、长上下文，以及切换模型或推理档后的缓存失效都会增加消耗。日常先用 k3-256k + high；官方称 1M k3 约耗两倍额度。尽量在同一会话保持型号和 effort 不变，并在订阅页、Code 控制台或 /usage 查看实际用量。","url":"https://llmcp.edlab.top/models/kimi-k3/#kimi-faq-5","verifiedAt":"2026-07-26"},{"id":"k3-faq-6","type":"section","category":"相关专题","title":"会员和开放平台 API 是一回事吗？","summary":"不是。会员更适合个人在 Kimi 网页、Work、Agent 和 Kimi Code 中使用；开放平台 API 按 token 计费，适合把模型接进自己的产品。比较成本时必须分开。","url":"https://llmcp.edlab.top/models/kimi-k3/#kimi-faq-6","verifiedAt":"2026-07-26"},{"id":"k3-faq-7","type":"section","category":"相关专题","title":"能不能继续使用 Claude Code 等熟悉的工具？","summary":"可以。Kimi Code 提供 Anthropic 与 OpenAI 兼容接口和专用 API Key，第三方工具仍会消耗 Kimi 会员额度。密钥只应放在本机环境变量或工具的安全配置中，不能写进仓库。","url":"https://llmcp.edlab.top/models/kimi-k3/#kimi-faq-7","verifiedAt":"2026-07-26"},{"id":"k3-faq-8","type":"section","category":"相关专题","title":"让 Kimi Work 读本地文件安全吗？","summary":"Kimi Work 对修改文件和运行代码提供“操作前询问”，但这不替代备份和权限管理。首次使用先给一个副本文件夹，只开放完成任务需要的最小范围，不要直接提供生产密钥。","url":"https://llmcp.edlab.top/models/kimi-k3/#kimi-faq-8","verifiedAt":"2026-07-26"},{"id":"k3-faq-9","type":"section","category":"相关专题","title":"App 说 K3 集群可能消耗普通模式的 3 倍，到底是什么意思？","summary":"它更接近任务开始前的经验估算，不是固定结算公式。官方公开规则是按所有子 Agent 的实际 Token 合计，复杂度和子 Agent 数不同，总消耗也不同；所以通常不只是“扣得快三倍、最终总量不变”，而是同一目标可能花掉更多总额度。官方所说 3—4.5× 主要是大规模搜索关键步骤和完成时间的加速，也不是额度倍率。","url":"https://llmcp.edlab.top/models/kimi-k3/#kimi-faq-9","verifiedAt":"2026-07-26"},{"id":"k3-faq-10","type":"section","category":"相关专题","title":"做编程项目时，集群一定比普通 K3 质量更好吗？","summary":"不一定。全仓库按模块审计、独立组件并行实现、测试与代码审查可以同时推进时，集群更可能提高覆盖面和速度；修一个 Bug、改共享核心或需要连续调试时，普通 K3 更容易保持一致。当前没有找到 K3 普通与集群在同一真实项目上的独立受控质量对照。","url":"https://llmcp.edlab.top/models/kimi-k3/#kimi-faq-10","verifiedAt":"2026-07-26"},{"id":"k3-faq-11","type":"section","category":"相关专题","title":"K3 的 1M 上下文什么时候应该开？","summary":"只有资料接近或超过 256K，而且必须一次保留跨文件、跨文档关系时再开。少量文件、单个 Bug 和普通问答先用 k3-256k；1M 不会自动提高智力，官方还称在 Kimi Code 中约耗两倍额度。Allegretto 及以上才可用最高 1M。","url":"https://llmcp.edlab.top/models/kimi-k3/#kimi-faq-11","verifiedAt":"2026-07-26"},{"id":"k3-faq-12","type":"section","category":"相关专题","title":"Kimi Code 的 k3 和 k3-256k 有什么区别？","summary":"在 256K 以内，两者使用同一 K3 模型，官方称结果相同。k3-256k 更省额度，适合日常问答、补全、常规功能和少量文件；k3 能扩到 1M 并支持视频输入。已有会话从 1M 往 256K 切时先 compact，避免超长历史或视频导致切换失败。","url":"https://llmcp.edlab.top/models/kimi-k3/#kimi-faq-12","verifiedAt":"2026-07-26"},{"id":"task-repo-bugfix","type":"section","category":"相关专题","title":"修真实仓库 Bug","summary":"Astra、Opus 5、Sol 与 Gemini 3.8 在原创长程工程中处于同一领先区间；Cursor 内的模糊多文件任务可优先试 Fable 5.1，不能把不同工作台的分数混排。","url":"https://llmcp.edlab.top/?task=repo-bugfix#task-map","verifiedAt":"2026-09-05"},{"id":"task-large-refactor","type":"section","category":"相关专题","title":"大型重构与技术迁移","summary":"这类任务更看规划、执行和复核的组合，不适合只押一个模型一次做完。","url":"https://llmcp.edlab.top/?task=large-refactor#task-map","verifiedAt":"2026-09-05"},{"id":"task-code-review","type":"section","category":"相关专题","title":"代码审查与上线前复核","summary":"先换模型家族，再要求真实测试与可复现证据。Fable 5.1 的 CodeRabbit 测试没有显示加大推理就更好，Astra 尚缺同版本直接审查测试。","url":"https://llmcp.edlab.top/?task=code-review#task-map","verifiedAt":"2026-09-05"},{"id":"task-terminal-devops","type":"section","category":"相关专题","title":"终端、DevOps 与长链路执行","summary":"Vals Terminal-Bench 2.1 中 Astra max 87.27%、Sol max 85.77%、Fable 5.1 max 85.02%；先试 Astra，预算敏感保留 Sol，不把小差距当现实任务保证。","url":"https://llmcp.edlab.top/?task=terminal-devops#task-map","verifiedAt":"2026-09-05"},{"id":"task-full-app","type":"section","category":"相关专题","title":"从一句需求做完整应用","summary":"Fable 5.1 与 Astra 都值得做完整应用首轮对照：前者的发布记录与 Cursor 模糊任务更强，后者在当前 VibeCode 页面与工程验收中表现突出；不跨日期强排第一。","url":"https://llmcp.edlab.top/?task=full-app#task-map","verifiedAt":"2026-09-05"},{"id":"task-frontend-visual","type":"section","category":"相关专题","title":"前端视觉、动效与响应式","summary":"Fable 5.1、Astra 与 K3 适合进入同素材视觉试做；完整应用榜只能辅助判断，最终仍看截图、交互和维护质量。","url":"https://llmcp.edlab.top/?task=frontend-visual#task-map","verifiedAt":"2026-09-05"},{"id":"task-requirements-product","type":"section","category":"相关专题","title":"需求梳理与产品方案","summary":"可用 Fable 5.1 整理模糊需求、Astra 检查可实现性，也可以互换；这是由应用与工程证据推导的分工，不是固定职业能力。","url":"https://llmcp.edlab.top/?task=requirements-product#task-map","verifiedAt":"2026-09-05"},{"id":"task-complex-analysis","type":"section","category":"相关专题","title":"复杂分析与高价值判断","summary":"Astra 与 Fable 5.1 可交叉分析；AA v4.2 和 Vals 支持两者进入前沿，但单项排序不同，不能把最高总分变成所有问题的唯一答案。","url":"https://llmcp.edlab.top/?task=complex-analysis#task-map","verifiedAt":"2026-09-05"},{"id":"task-web-research","type":"section","category":"相关专题","title":"联网检索与带引用报告","summary":"不应该。推荐单位是模型 + 搜索工具 + 来源规则；Gemini 3.8 可作多模态检索入口，Astra / Fable 5.1 做二次分析，3.7 保留效率优先路线。","url":"https://llmcp.edlab.top/?task=web-research#task-map","verifiedAt":"2026-09-05"},{"id":"task-math-science","type":"section","category":"相关专题","title":"数学、科学与闭式推理","summary":"优先使用前沿推理模型，再用不同家族复算；能用代码、符号工具或实验验证时不要只靠文字答案。","url":"https://llmcp.edlab.top/?task=math-science#task-map","verifiedAt":"2026-09-05"},{"id":"task-chinese-writing","type":"section","category":"相关专题","title":"中文写作与润色","summary":"Sonnet、Qwen 与 Kimi 都值得试，但缺少足够公开同口径中文写作榜，不宣布唯一冠军。","url":"https://llmcp.edlab.top/?task=chinese-writing#task-map","verifiedAt":"2026-07-17"},{"id":"task-professional-writing","type":"section","category":"相关专题","title":"英文写作、方案与专业表达","summary":"复杂长交付可试 Fable 5.1，并保留 Opus 5 的成本对照；日常文稿先用 Sonnet 5。新版写作直接体验正反都有，仍需按自己的受众盲测。","url":"https://llmcp.edlab.top/?task=professional-writing#task-map","verifiedAt":"2026-09-05"},{"id":"task-long-multimodal","type":"section","category":"相关专题","title":"超长资料、PDF 与多模态理解","summary":"Gemini 3.8 适合音视频与混合资料，K3 保留超长文本、图片与视频路线；复杂 PDF 可加 Astra 复核。容量不等于每一处都能准确召回。","url":"https://llmcp.edlab.top/?task=long-multimodal#task-map","verifiedAt":"2026-09-05"},{"id":"task-office-data","type":"section","category":"相关专题","title":"表格、PPT 与 Office 成品","summary":"不应该。文件工具和执行环境比纯模型名更重要；模型负责内容，工具负责成品，人工负责公式与排版验收。","url":"https://llmcp.edlab.top/?task=office-data#task-map","verifiedAt":"2026-09-05"},{"id":"task-browser-agent","type":"section","category":"相关专题","title":"浏览器操作与联网代理","summary":"优先看工作台的浏览器能力、权限边界和失败恢复；Gemini 3.8 与 Astra 都是候选，基础模型成绩不代表浏览器里每一步都可靠。","url":"https://llmcp.edlab.top/?task=browser-agent#task-map","verifiedAt":"2026-09-05"},{"id":"task-multi-tool-agent","type":"section","category":"相关专题","title":"跨工具、多代理与超长任务","summary":"先让一款前沿模型当总负责人，写清接口、验收和升级条件；再让合格低价模型执行独立支线。只有支线理解错或前沿模型仍失败，才升级到最强档或另一家前沿模型。","url":"https://llmcp.edlab.top/?task=multi-tool-agent#task-map","verifiedAt":"2026-09-05"},{"id":"task-budget-batch","type":"section","category":"相关专题","title":"低成本批处理与规模化调用","summary":"Gemini 3.8 已成为长程工程的低成本强候选；Grok 保留低价前沿判断，GLM-5.3 Flash 用于强计划、强测试下的低价执行，Luna 和 DeepSeek 按任务补位。","url":"https://llmcp.edlab.top/?task=budget-batch#task-map","verifiedAt":"2026-09-05"},{"id":"task-private-deployment","type":"section","category":"相关专题","title":"开放权重与私有部署","summary":"GLM-5.3 与 K3 都是开放能力上限候选，GLM-5.3 Flash 和 K2.7 Code 是更轻的试点路线；先核对许可、硬件、吞吐和日志，不能把“可下载”写成“普通电脑能跑”。","url":"https://llmcp.edlab.top/?task=private-deployment#task-map","verifiedAt":"2026-09-05"},{"id":"task-mainland-use","type":"section","category":"相关专题","title":"中国大陆访问、支付与中文生态","summary":"Kimi、Qwen 与 GLM 各有不同入口；先确认产品、地区和支付，再比较基础模型分数。","url":"https://llmcp.edlab.top/?task=mainland-use#task-map","verifiedAt":"2026-08-29"},{"id":"task-legal-sensitive","type":"section","category":"相关专题","title":"合法但容易误拒的专业任务","summary":"目前不发布“低拒答冠军”。先把授权、范围和安全边界写清，再用不同供应商或受控开放权重模型验证。","url":"https://llmcp.edlab.top/?task=legal-sensitive#task-map","verifiedAt":"2026-08-29"},{"id":"model-fable51","type":"section","category":"模型资料","title":"Claude Fable 5.1","summary":"高难任务旗舰。高难规划、含糊多文件实现、长程专业工作与异家复核。","url":"https://llmcp.edlab.top/models/claude-fable-5-1/","verifiedAt":"2026-09-05"},{"id":"compare-fable51","type":"section","category":"继续操作","title":"直接对比 Fable 5.1","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=fable51,astra"},{"id":"cost-fable51","type":"section","category":"继续操作","title":"查看 Fable 5.1 的 API 成本","summary":"挂牌输入 $10/M、输出 $50/M；进入成本计算器估算具体任务。 价格口径：标准 API 每百万 Token；缓存读取 $0.25，5 分钟缓存写入 $12.50，1 小时写入 $20。会员额度另计。。","url":"https://llmcp.edlab.top/?model=fable51&q=Claude%20Fable%205.1#cost"},{"id":"evidence-fable51","type":"section","category":"证据与来源","title":"核对 Fable 5.1 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-09-05。","url":"https://llmcp.edlab.top/?q=Claude%20Fable%205.1#evidence","verifiedAt":"2026-09-05"},{"id":"model-astra","type":"section","category":"模型资料","title":"GPT-6 Astra","summary":"高难任务旗舰。复杂推理、代码与终端闭环、资料分析、少返工的端到端任务。","url":"https://llmcp.edlab.top/models/gpt-6-astra/","verifiedAt":"2026-09-05"},{"id":"compare-astra","type":"section","category":"继续操作","title":"直接对比 Astra","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=astra,fable51"},{"id":"cost-astra","type":"section","category":"继续操作","title":"查看 Astra 的 API 成本","summary":"挂牌输入 $10/M、输出 $50/M；进入成本计算器估算具体任务。 价格口径：标准 API 每百万 Token；>272K 输入时整请求输入/缓存翻倍、输出 1.5 倍；缓存写入为普通输入 1.25 倍。Batch/Flex 半价，Fast 2 倍；会员额度另计。。","url":"https://llmcp.edlab.top/?model=astra&q=GPT-6%20Astra#cost"},{"id":"evidence-astra","type":"section","category":"证据与来源","title":"核对 Astra 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-09-05。","url":"https://llmcp.edlab.top/?q=GPT-6%20Astra#evidence","verifiedAt":"2026-09-05"},{"id":"model-gemini38","type":"section","category":"模型资料","title":"Gemini 3.8 Flash","summary":"高性价比多模态执行。多模态资料、Google 工具、有验收的多文件开发和长程代码执行。","url":"https://llmcp.edlab.top/models/gemini-3-8-flash/","verifiedAt":"2026-09-05"},{"id":"compare-gemini38","type":"section","category":"继续操作","title":"直接对比 Gemini 3.8","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=gemini38,sol"},{"id":"cost-gemini38","type":"section","category":"继续操作","title":"查看 Gemini 3.8 的 API 成本","summary":"挂牌输入 $0.75/M、输出 $3.75/M；进入成本计算器估算具体任务。 价格口径：2026 年底前介绍价；音频输入、缓存、工具和后续标准价按官方对应项目计费。。","url":"https://llmcp.edlab.top/?model=gemini38&q=Gemini%203.8%20Flash#cost"},{"id":"evidence-gemini38","type":"section","category":"证据与来源","title":"核对 Gemini 3.8 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-09-05。","url":"https://llmcp.edlab.top/?q=Gemini%203.8%20Flash#evidence","verifiedAt":"2026-09-05"},{"id":"model-muse13","type":"section","category":"模型资料","title":"Meta Muse Spark 1.3","summary":"新品观察。专业工作与长代理新品观察；先核对可用版本和账户入口。","url":"https://llmcp.edlab.top/models/meta-muse-spark-1-3/","verifiedAt":"2026-09-05"},{"id":"compare-muse13","type":"section","category":"继续操作","title":"直接对比 Muse 1.3","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=muse13,muse12"},{"id":"cost-muse13","type":"section","category":"继续操作","title":"查看 Muse 1.3 的 API 成本","summary":"挂牌输入 $1.25/M、输出 $4.25/M；进入成本计算器估算具体任务。 价格口径：公开 xhigh 报价为输入 $1.25、输出 $4.25、缓存命中 $0.15 / M；限预览 max 的准入和计价不继承这一行。。","url":"https://llmcp.edlab.top/?model=muse13&q=Meta%20Muse%20Spark%201.3#cost"},{"id":"evidence-muse13","type":"section","category":"证据与来源","title":"核对 Muse 1.3 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-09-05。","url":"https://llmcp.edlab.top/?q=Meta%20Muse%20Spark%201.3#evidence","verifiedAt":"2026-09-05"},{"id":"model-fable","type":"section","category":"模型资料","title":"Claude Fable 5","summary":"上一代 Fable 基线。完整应用、模糊需求、多文件长任务、独立复核。","url":"https://llmcp.edlab.top/models/claude-fable-5/","verifiedAt":"2026-08-13"},{"id":"compare-fable","type":"section","category":"继续操作","title":"直接对比 Fable 5","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=fable,sol"},{"id":"cost-fable","type":"section","category":"继续操作","title":"查看 Fable 5 的 API 成本","summary":"挂牌输入 $10/M、输出 $50/M；进入成本计算器估算具体任务。","url":"https://llmcp.edlab.top/?model=fable&q=Claude%20Fable%205#cost"},{"id":"evidence-fable","type":"section","category":"证据与来源","title":"核对 Fable 5 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-08-13。","url":"https://llmcp.edlab.top/?q=Claude%20Fable%205#evidence","verifiedAt":"2026-08-13"},{"id":"model-opus5","type":"section","category":"模型资料","title":"Claude Opus 5","summary":"高端实用与复核。复杂代理编程、开放式架构、长链路企业任务与高质量成品。","url":"https://llmcp.edlab.top/models/claude-opus-5/","verifiedAt":"2026-07-31"},{"id":"compare-opus5","type":"section","category":"继续操作","title":"直接对比 Opus 5","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=opus5,sol"},{"id":"cost-opus5","type":"section","category":"继续操作","title":"查看 Opus 5 的 API 成本","summary":"挂牌输入 $5/M、输出 $25/M；进入成本计算器估算具体任务。","url":"https://llmcp.edlab.top/?model=opus5&q=Claude%20Opus%205#cost"},{"id":"evidence-opus5","type":"section","category":"证据与来源","title":"核对 Opus 5 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-07-31。","url":"https://llmcp.edlab.top/?q=Claude%20Opus%205#evidence","verifiedAt":"2026-07-31"},{"id":"model-mythos","type":"section","category":"模型资料","title":"Claude Mythos 5","summary":"受限研究参考。仅适用于获批组织的高权限安全、生命科学与网络研究。","url":"https://llmcp.edlab.top/models/claude-mythos-5/","verifiedAt":"2026-07-23"},{"id":"compare-mythos","type":"section","category":"继续操作","title":"直接对比 Mythos 5","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=mythos,sol"},{"id":"cost-mythos","type":"section","category":"继续操作","title":"查看 Mythos 5 的 API 成本","summary":"挂牌输入 $10/M、输出 $50/M；进入成本计算器估算具体任务。","url":"https://llmcp.edlab.top/?model=mythos&q=Claude%20Mythos%205#cost"},{"id":"evidence-mythos","type":"section","category":"证据与来源","title":"核对 Mythos 5 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-07-23。","url":"https://llmcp.edlab.top/?q=Claude%20Mythos%205#evidence","verifiedAt":"2026-07-23"},{"id":"model-sol","type":"section","category":"模型资料","title":"GPT-5.6 Sol","summary":"成熟高端与成本路线。仓库修复、终端执行、复杂架构与主力编程。","url":"https://llmcp.edlab.top/models/gpt-5-6-sol/","verifiedAt":"2026-08-29"},{"id":"compare-sol","type":"section","category":"继续操作","title":"直接对比 Sol","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=sol,astra"},{"id":"cost-sol","type":"section","category":"继续操作","title":"查看 Sol 的 API 成本","summary":"挂牌输入 $4/M、输出 $20/M；进入成本计算器估算具体任务。 价格口径：OpenAI 官方促销价，至少持续至 2026-11-21；输入超过 272K 后整次请求按 $8 / $30 计费，缓存写入按普通输入价的 1.25 倍计费。","url":"https://llmcp.edlab.top/?model=sol&q=GPT-5.6%20Sol#cost"},{"id":"evidence-sol","type":"section","category":"证据与来源","title":"核对 Sol 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-08-29。","url":"https://llmcp.edlab.top/?q=GPT-5.6%20Sol#evidence","verifiedAt":"2026-08-29"},{"id":"model-terra","type":"section","category":"模型资料","title":"GPT-5.6 Terra","summary":"均衡型号。有测试兜底的日常多文件开发、能力与成本平衡。","url":"https://llmcp.edlab.top/models/gpt-5-6-terra/","verifiedAt":"2026-07-31"},{"id":"compare-terra","type":"section","category":"继续操作","title":"直接对比 Terra","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=terra,sol"},{"id":"cost-terra","type":"section","category":"继续操作","title":"查看 Terra 的 API 成本","summary":"挂牌输入 $2/M、输出 $12/M；进入成本计算器估算具体任务。","url":"https://llmcp.edlab.top/?model=terra&q=GPT-5.6%20Terra#cost"},{"id":"evidence-terra","type":"section","category":"证据与来源","title":"核对 Terra 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-07-31。","url":"https://llmcp.edlab.top/?q=GPT-5.6%20Terra#evidence","verifiedAt":"2026-07-31"},{"id":"model-luna","type":"section","category":"模型资料","title":"GPT-5.6 Luna","summary":"轻量高吞吐。计划已明确的批量实现、快速小改、后台助手与低成本长上下文。","url":"https://llmcp.edlab.top/models/gpt-5-6-luna/","verifiedAt":"2026-07-31"},{"id":"compare-luna","type":"section","category":"继续操作","title":"直接对比 Luna","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=luna,sol"},{"id":"cost-luna","type":"section","category":"继续操作","title":"查看 Luna 的 API 成本","summary":"挂牌输入 $0.2/M、输出 $1.2/M；进入成本计算器估算具体任务。","url":"https://llmcp.edlab.top/?model=luna&q=GPT-5.6%20Luna#cost"},{"id":"evidence-luna","type":"section","category":"证据与来源","title":"核对 Luna 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-07-31。","url":"https://llmcp.edlab.top/?q=GPT-5.6%20Luna#evidence","verifiedAt":"2026-07-31"},{"id":"model-gpt55","type":"section","category":"模型资料","title":"GPT-5.5","summary":"上一代基线。旧项目兼容、稳定 Codex 工作流。","url":"https://llmcp.edlab.top/models/gpt-5-5/","verifiedAt":"2026-07-31"},{"id":"compare-gpt55","type":"section","category":"继续操作","title":"直接对比 GPT-5.5","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=gpt55,sol"},{"id":"cost-gpt55","type":"section","category":"继续操作","title":"查看 GPT-5.5 的 API 成本","summary":"挂牌输入 $5/M、输出 $30/M；进入成本计算器估算具体任务。","url":"https://llmcp.edlab.top/?model=gpt55&q=GPT-5.5#cost"},{"id":"evidence-gpt55","type":"section","category":"证据与来源","title":"核对 GPT-5.5 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-07-31。","url":"https://llmcp.edlab.top/?q=GPT-5.5#evidence","verifiedAt":"2026-07-31"},{"id":"model-gpt55pro","type":"section","category":"模型资料","title":"GPT-5.5 Pro","summary":"高成本研究参考。极难研究、证明、长分析和高价值一次性任务。","url":"https://llmcp.edlab.top/models/gpt-5-5-pro/","verifiedAt":"2026-07-31"},{"id":"compare-gpt55pro","type":"section","category":"继续操作","title":"直接对比 5.5 Pro","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=gpt55pro,sol"},{"id":"cost-gpt55pro","type":"section","category":"继续操作","title":"查看 5.5 Pro 的 API 成本","summary":"挂牌输入 $30/M、输出 $180/M；进入成本计算器估算具体任务。","url":"https://llmcp.edlab.top/?model=gpt55pro&q=GPT-5.5%20Pro#cost"},{"id":"evidence-gpt55pro","type":"section","category":"证据与来源","title":"核对 5.5 Pro 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-07-31。","url":"https://llmcp.edlab.top/?q=GPT-5.5%20Pro#evidence","verifiedAt":"2026-07-31"},{"id":"model-opus48","type":"section","category":"模型资料","title":"Claude Opus 4.8","summary":"成熟高端基线。开放式架构、可靠长任务、范围控制、代码复核与企业工作。","url":"https://llmcp.edlab.top/models/claude-opus-4-8/","verifiedAt":"2026-07-23"},{"id":"compare-opus48","type":"section","category":"继续操作","title":"直接对比 Opus 4.8","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=opus48,sol"},{"id":"cost-opus48","type":"section","category":"继续操作","title":"查看 Opus 4.8 的 API 成本","summary":"挂牌输入 $5/M、输出 $25/M；进入成本计算器估算具体任务。","url":"https://llmcp.edlab.top/?model=opus48&q=Claude%20Opus%204.8#cost"},{"id":"evidence-opus48","type":"section","category":"证据与来源","title":"核对 Opus 4.8 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-07-23。","url":"https://llmcp.edlab.top/?q=Claude%20Opus%204.8#evidence","verifiedAt":"2026-07-23"},{"id":"model-sonnet5","type":"section","category":"模型资料","title":"Claude Sonnet 5","summary":"均衡执行型号。边界明确的日常执行、完整应用、速度与能力平衡。","url":"https://llmcp.edlab.top/models/claude-sonnet-5/","verifiedAt":"2026-07-23"},{"id":"compare-sonnet5","type":"section","category":"继续操作","title":"直接对比 Sonnet 5","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=sonnet5,sol"},{"id":"cost-sonnet5","type":"section","category":"继续操作","title":"查看 Sonnet 5 的 API 成本","summary":"挂牌输入 $2/M、输出 $10/M；进入成本计算器估算具体任务。","url":"https://llmcp.edlab.top/?model=sonnet5&q=Claude%20Sonnet%205#cost"},{"id":"evidence-sonnet5","type":"section","category":"证据与来源","title":"核对 Sonnet 5 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-07-23。","url":"https://llmcp.edlab.top/?q=Claude%20Sonnet%205#evidence","verifiedAt":"2026-07-23"},{"id":"model-grok46","type":"section","category":"模型资料","title":"Grok 4.6","summary":"低价前沿旗舰。低价前沿编程、工具代理、知识工作，以及需要 X 搜索的实时信息调研。","url":"https://llmcp.edlab.top/models/grok-4-6/","verifiedAt":"2026-08-15"},{"id":"compare-grok46","type":"section","category":"继续操作","title":"直接对比 Grok 4.6","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=grok46,sol"},{"id":"cost-grok46","type":"section","category":"继续操作","title":"查看 Grok 4.6 的 API 成本","summary":"挂牌输入 $2/M、输出 $6/M；进入成本计算器估算具体任务。","url":"https://llmcp.edlab.top/?model=grok46&q=Grok%204.6#cost"},{"id":"evidence-grok46","type":"section","category":"证据与来源","title":"核对 Grok 4.6 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-08-15。","url":"https://llmcp.edlab.top/?q=Grok%204.6#evidence","verifiedAt":"2026-08-15"},{"id":"model-grok45","type":"section","category":"模型资料","title":"Grok 4.5","summary":"上一代 Grok 基线。复现基于 Grok 4.5 的旧工作流与升级前后对照。","url":"https://llmcp.edlab.top/models/grok-4-5/","verifiedAt":"2026-08-13"},{"id":"compare-grok45","type":"section","category":"继续操作","title":"直接对比 Grok 4.5","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=grok45,sol"},{"id":"cost-grok45","type":"section","category":"继续操作","title":"查看 Grok 4.5 的 API 成本","summary":"挂牌输入 $2/M、输出 $6/M；进入成本计算器估算具体任务。","url":"https://llmcp.edlab.top/?model=grok45&q=Grok%204.5#cost"},{"id":"evidence-grok45","type":"section","category":"证据与来源","title":"核对 Grok 4.5 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-08-13。","url":"https://llmcp.edlab.top/?q=Grok%204.5#evidence","verifiedAt":"2026-08-13"},{"id":"model-muse12","type":"section","category":"模型资料","title":"Meta Muse Spark 1.2","summary":"法律金融与长代理专项。法律、金融、医疗与税务等专业工作流，以及可恢复的长时间后台代理。","url":"https://llmcp.edlab.top/models/meta-muse-spark-1-2/","verifiedAt":"2026-08-15"},{"id":"compare-muse12","type":"section","category":"继续操作","title":"直接对比 Muse 1.2","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=muse12,sol"},{"id":"cost-muse12","type":"section","category":"继续操作","title":"查看 Muse 1.2 的 API 成本","summary":"挂牌输入 $1.25/M、输出 $4.25/M；进入成本计算器估算具体任务。","url":"https://llmcp.edlab.top/?model=muse12&q=Meta%20Muse%20Spark%201.2#cost"},{"id":"evidence-muse12","type":"section","category":"证据与来源","title":"核对 Muse 1.2 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-08-15。","url":"https://llmcp.edlab.top/?q=Meta%20Muse%20Spark%201.2#evidence","verifiedAt":"2026-08-15"},{"id":"model-muse11","type":"section","category":"模型资料","title":"Meta Muse Spark 1.1","summary":"上一代代理基线。尚未迁移的 Muse 旧流程与 1.2 升级前后对照。","url":"https://llmcp.edlab.top/models/meta-muse-spark-1-1/","verifiedAt":"2026-07-17"},{"id":"compare-muse11","type":"section","category":"继续操作","title":"直接对比 Muse 1.1","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=muse11,sol"},{"id":"cost-muse11","type":"section","category":"继续操作","title":"查看 Muse 1.1 的 API 成本","summary":"挂牌输入 $1.25/M、输出 $4.25/M；进入成本计算器估算具体任务。","url":"https://llmcp.edlab.top/?model=muse11&q=Meta%20Muse%20Spark%201.1#cost"},{"id":"evidence-muse11","type":"section","category":"证据与来源","title":"核对 Muse 1.1 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-07-17。","url":"https://llmcp.edlab.top/?q=Meta%20Muse%20Spark%201.1#evidence","verifiedAt":"2026-07-17"},{"id":"model-gemini37","type":"section","category":"模型资料","title":"Gemini 3.7 Flash","summary":"效率价值与成熟流程。高速多模态理解、Google 搜索与地图工具、长流程代理、高频编程循环和金融研究。","url":"https://llmcp.edlab.top/models/gemini-3-7-flash/","verifiedAt":"2026-08-15"},{"id":"compare-gemini37","type":"section","category":"继续操作","title":"直接对比 Gemini 3.7","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=gemini37,sol"},{"id":"cost-gemini37","type":"section","category":"继续操作","title":"查看 Gemini 3.7 的 API 成本","summary":"挂牌输入 $0.75/M、输出 $3.75/M；进入成本计算器估算具体任务。 价格口径：官方介绍价至 2026-12-31；2027-01-01 起输入 / 输出 / 缓存升至 $1.50 / $7.50 / $0.15。","url":"https://llmcp.edlab.top/?model=gemini37&q=Gemini%203.7%20Flash#cost"},{"id":"evidence-gemini37","type":"section","category":"证据与来源","title":"核对 Gemini 3.7 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-08-15。","url":"https://llmcp.edlab.top/?q=Gemini%203.7%20Flash#evidence","verifiedAt":"2026-08-15"},{"id":"model-gemini36","type":"section","category":"模型资料","title":"Gemini 3.6 Flash","summary":"上一代 Gemini 基线。复现基于 Gemini 3.6 Flash 的旧测试、价格快照与工作流。","url":"https://llmcp.edlab.top/models/gemini-3-6-flash/","verifiedAt":"2026-08-15"},{"id":"compare-gemini36","type":"section","category":"继续操作","title":"直接对比 Gemini 3.6","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=gemini36,sol"},{"id":"cost-gemini36","type":"section","category":"继续操作","title":"查看 Gemini 3.6 的 API 成本","summary":"挂牌输入 $1.5/M、输出 $7.5/M；进入成本计算器估算具体任务。","url":"https://llmcp.edlab.top/?model=gemini36&q=Gemini%203.6%20Flash#cost"},{"id":"evidence-gemini36","type":"section","category":"证据与来源","title":"核对 Gemini 3.6 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-08-15。","url":"https://llmcp.edlab.top/?q=Gemini%203.6%20Flash#evidence","verifiedAt":"2026-08-15"},{"id":"model-gemini35","type":"section","category":"模型资料","title":"Gemini 3.5 Flash","summary":"上一代多模态基线。复现基于 Gemini 3.5 Flash 的旧测试、价格快照与工作流。","url":"https://llmcp.edlab.top/models/gemini-3-5-flash/","verifiedAt":"2026-07-23"},{"id":"compare-gemini35","type":"section","category":"继续操作","title":"直接对比 Gemini 3.5","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=gemini35,sol"},{"id":"cost-gemini35","type":"section","category":"继续操作","title":"查看 Gemini 3.5 的 API 成本","summary":"挂牌输入 $1.5/M、输出 $9/M；进入成本计算器估算具体任务。","url":"https://llmcp.edlab.top/?model=gemini35&q=Gemini%203.5%20Flash#cost"},{"id":"evidence-gemini35","type":"section","category":"证据与来源","title":"核对 Gemini 3.5 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-07-23。","url":"https://llmcp.edlab.top/?q=Gemini%203.5%20Flash#evidence","verifiedAt":"2026-07-23"},{"id":"model-glm53","type":"section","category":"模型资料","title":"GLM-5.3","summary":"开放权重前沿旗舰。复杂代码、长程 Agent、中文专业任务，以及有大型推理基础设施的开放权重部署。","url":"https://llmcp.edlab.top/models/glm-5-3/","verifiedAt":"2026-08-29"},{"id":"compare-glm53","type":"section","category":"继续操作","title":"直接对比 GLM-5.3","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=glm53,kimi3"},{"id":"cost-glm53","type":"section","category":"继续操作","title":"查看 GLM-5.3 的 API 成本","summary":"挂牌输入 $1.4/M、输出 $4.4/M；进入成本计算器估算具体任务。 价格口径：Z.AI 官方国际 API 挂牌价；缓存存储目前限时免费。","url":"https://llmcp.edlab.top/?model=glm53&q=GLM-5.3#cost"},{"id":"evidence-glm53","type":"section","category":"证据与来源","title":"核对 GLM-5.3 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-08-29。","url":"https://llmcp.edlab.top/?q=GLM-5.3#evidence","verifiedAt":"2026-08-29"},{"id":"model-glm53flash","type":"section","category":"模型资料","title":"GLM-5.3-Flash","summary":"低价合格执行者。强模型已写清计划后的批量实现、可回滚代码支线、结构化抽取与有引用的低风险知识工作。","url":"https://llmcp.edlab.top/models/glm-5-3-flash/","verifiedAt":"2026-08-29"},{"id":"compare-glm53flash","type":"section","category":"继续操作","title":"直接对比 GLM-5.3 Flash","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=glm53flash,glm53"},{"id":"cost-glm53flash","type":"section","category":"继续操作","title":"查看 GLM-5.3 Flash 的 API 成本","summary":"挂牌输入 $0.15/M、输出 $0.5/M；进入成本计算器估算具体任务。 价格口径：本站计算器使用长期 list price；官方 50% 限时价为 $0.075 / $0.25、缓存 $0.015，至 2026-09-09 24:00（UTC+8）。","url":"https://llmcp.edlab.top/?model=glm53flash&q=GLM-5.3-Flash#cost"},{"id":"evidence-glm53flash","type":"section","category":"证据与来源","title":"核对 GLM-5.3 Flash 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-08-29。","url":"https://llmcp.edlab.top/?q=GLM-5.3-Flash#evidence","verifiedAt":"2026-08-29"},{"id":"model-glm52","type":"section","category":"模型资料","title":"GLM-5.2","summary":"上一代开放权重基线。中文任务、MIT 开放权重部署、工具代理与成本可控的企业工作流。","url":"https://llmcp.edlab.top/models/glm-5-2/","verifiedAt":"2026-08-29"},{"id":"compare-glm52","type":"section","category":"继续操作","title":"直接对比 GLM-5.2","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=glm52,sol"},{"id":"cost-glm52","type":"section","category":"继续操作","title":"查看 GLM-5.2 的 API 成本","summary":"挂牌输入 $1.4/M、输出 $4.4/M；进入成本计算器估算具体任务。","url":"https://llmcp.edlab.top/?model=glm52&q=GLM-5.2#cost"},{"id":"evidence-glm52","type":"section","category":"证据与来源","title":"核对 GLM-5.2 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-08-29。","url":"https://llmcp.edlab.top/?q=GLM-5.2#evidence","verifiedAt":"2026-08-29"},{"id":"model-qwen38","type":"section","category":"模型资料","title":"Qwen 3.8 Max","summary":"国产强第二梯队旗舰。中文复杂任务、视觉与长上下文、阿里云生态，以及需要统一国内 API 入口的团队。","url":"https://llmcp.edlab.top/models/qwen-3-8-max/","verifiedAt":"2026-08-29"},{"id":"compare-qwen38","type":"section","category":"继续操作","title":"直接对比 Qwen 3.8 Max","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=qwen38,sol"},{"id":"cost-qwen38","type":"section","category":"继续操作","title":"查看 Qwen 3.8 Max 的 API 成本","summary":"中国端点当前为输入 ¥12 / M、输出 ¥36 / M、缓存命中 ¥1.50 / M；本站美元计算器不混用人民币价格；先查看模型资料与官方入口。","url":"https://llmcp.edlab.top/?model=qwen38&q=Qwen%203.8%20Max#cost"},{"id":"evidence-qwen38","type":"section","category":"证据与来源","title":"核对 Qwen 3.8 Max 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-08-29。","url":"https://llmcp.edlab.top/?q=Qwen%203.8%20Max#evidence","verifiedAt":"2026-08-29"},{"id":"model-qwen38preview","type":"section","category":"模型资料","title":"Qwen 3.8 Max Preview","summary":"已结束的预览基线。复现预览期的 Token Plan 工作流与正式版迁移前后对照。","url":"https://llmcp.edlab.top/models/qwen-3-8-max-preview/","verifiedAt":"2026-08-13"},{"id":"compare-qwen38preview","type":"section","category":"继续操作","title":"直接对比 Qwen 3.8 预览","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=qwen38preview,sol"},{"id":"cost-qwen38preview","type":"section","category":"继续操作","title":"查看 Qwen 3.8 预览 的 API 成本","summary":"目前仅 Token Plan 个人版可用；套餐按 Credits 与窗口扣量，尚无普通按量 API 挂牌价；先查看模型资料与官方入口。","url":"https://llmcp.edlab.top/?model=qwen38preview&q=Qwen%203.8%20Max%20Preview#cost"},{"id":"evidence-qwen38preview","type":"section","category":"证据与来源","title":"核对 Qwen 3.8 预览 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-08-13。","url":"https://llmcp.edlab.top/?q=Qwen%203.8%20Max%20Preview#evidence","verifiedAt":"2026-08-13"},{"id":"model-qwen37max","type":"section","category":"模型资料","title":"Qwen 3.7 Max","summary":"上一代千问基线。尚未迁移的 Qwen 3.7 应用与 3.8 升级前后复测。","url":"https://llmcp.edlab.top/models/qwen-3-7-max/","verifiedAt":"2026-08-13"},{"id":"compare-qwen37max","type":"section","category":"继续操作","title":"直接对比 Qwen 3.7 Max","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=qwen37max,sol"},{"id":"cost-qwen37max","type":"section","category":"继续操作","title":"查看 Qwen 3.7 Max 的 API 成本","summary":"挂牌输入 $2.5/M、输出 $7.5/M；进入成本计算器估算具体任务。 价格口径：新加坡国际端点 list price；促销价不作为长期基准。","url":"https://llmcp.edlab.top/?model=qwen37max&q=Qwen%203.7%20Max#cost"},{"id":"evidence-qwen37max","type":"section","category":"证据与来源","title":"核对 Qwen 3.7 Max 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-08-13。","url":"https://llmcp.edlab.top/?q=Qwen%203.7%20Max#evidence","verifiedAt":"2026-08-13"},{"id":"model-qwen37plus","type":"section","category":"模型资料","title":"Qwen 3.7 Plus","summary":"中文成本型号。中文日常、低价 coding tools、规模化调用。","url":"https://llmcp.edlab.top/models/qwen-3-7-plus/","verifiedAt":"2026-07-17"},{"id":"compare-qwen37plus","type":"section","category":"继续操作","title":"直接对比 Qwen 3.7 Plus","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=qwen37plus,sol"},{"id":"cost-qwen37plus","type":"section","category":"继续操作","title":"查看 Qwen 3.7 Plus 的 API 成本","summary":"挂牌输入 $0.4/M、输出 $1.6/M；进入成本计算器估算具体任务。 价格口径：新加坡国际端点 list price；促销价不作为长期基准。","url":"https://llmcp.edlab.top/?model=qwen37plus&q=Qwen%203.7%20Plus#cost"},{"id":"evidence-qwen37plus","type":"section","category":"证据与来源","title":"核对 Qwen 3.7 Plus 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-07-17。","url":"https://llmcp.edlab.top/?q=Qwen%203.7%20Plus#evidence","verifiedAt":"2026-07-17"},{"id":"model-deepseek-pro","type":"section","category":"模型资料","title":"DeepSeek V4 Pro 0813","summary":"低价长程代码专项。Max 档下有测试兜底的长程代码、批量仓库任务和极度成本敏感的企业试点。","url":"https://llmcp.edlab.top/models/deepseek-v4-pro/","verifiedAt":"2026-08-29"},{"id":"compare-deepseek-pro","type":"section","category":"继续操作","title":"直接对比 V4 Pro 0813","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=deepseek-pro,sol"},{"id":"cost-deepseek-pro","type":"section","category":"继续操作","title":"查看 V4 Pro 0813 的 API 成本","summary":"挂牌输入 $1.32/M、输出 $3.96/M；进入成本计算器估算具体任务。 价格口径：本站计算器按峰时安全上限估算；工作日 UTC 01:00—04:00、06:00—10:00 为峰时，其余时段非峰价 $0.66 / $1.98、缓存 $0.022。","url":"https://llmcp.edlab.top/?model=deepseek-pro&q=DeepSeek%20V4%20Pro%200813#cost"},{"id":"evidence-deepseek-pro","type":"section","category":"证据与来源","title":"核对 V4 Pro 0813 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-08-29。","url":"https://llmcp.edlab.top/?q=DeepSeek%20V4%20Pro%200813#evidence","verifiedAt":"2026-08-29"},{"id":"model-deepseek-flash","type":"section","category":"模型资料","title":"DeepSeek V4 Flash 0731","summary":"低成本可验收候选。Max 档下可验收的批量抽取、分类、草稿与低风险客服试点。","url":"https://llmcp.edlab.top/models/deepseek-v4-flash/","verifiedAt":"2026-08-29"},{"id":"compare-deepseek-flash","type":"section","category":"继续操作","title":"直接对比 V4 Flash 0731","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=deepseek-flash,sol"},{"id":"cost-deepseek-flash","type":"section","category":"继续操作","title":"查看 V4 Flash 0731 的 API 成本","summary":"挂牌输入 $0.44/M、输出 $1.32/M；进入成本计算器估算具体任务。 价格口径：本站计算器按峰时安全上限估算；工作日 UTC 01:00—04:00、06:00—10:00 为峰时，其余时段非峰价 $0.22 / $0.66、缓存 $0.007。","url":"https://llmcp.edlab.top/?model=deepseek-flash&q=DeepSeek%20V4%20Flash%200731#cost"},{"id":"evidence-deepseek-flash","type":"section","category":"证据与来源","title":"核对 V4 Flash 0731 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-08-29。","url":"https://llmcp.edlab.top/?q=DeepSeek%20V4%20Flash%200731#evidence","verifiedAt":"2026-08-29"},{"id":"model-kimi3","type":"section","category":"模型资料","title":"Kimi K3","summary":"通用旗舰 · 新发布。网页与 React 原型、长资料、并行调研、图片 / 视频理解、长程 Agent，以及具备大型推理基础设施的开放权重部署。","url":"https://llmcp.edlab.top/models/kimi-k3/","verifiedAt":"2026-08-15"},{"id":"compare-kimi3","type":"section","category":"继续操作","title":"直接对比 Kimi K3","summary":"把已进入正式旗舰轨道的 K3 与 Opus 5、Sol、Fable 等模型逐项对照。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=kimi3,sol"},{"id":"cost-kimi3","type":"section","category":"继续操作","title":"查看 Kimi K3 的 API 成本","summary":"挂牌输入 $3/M、输出 $15/M；进入成本计算器估算具体任务。 价格口径：官方统一价；100 万上下文不另设长上下文阶梯。","url":"https://llmcp.edlab.top/?model=kimi3&q=Kimi%20K3#cost"},{"id":"evidence-kimi3","type":"section","category":"证据与来源","title":"核对 Kimi K3 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-08-15。","url":"https://llmcp.edlab.top/?q=Kimi%20K3#evidence-kimi","verifiedAt":"2026-08-15"},{"id":"model-kimi26","type":"section","category":"模型资料","title":"Kimi K2.6","summary":"上一代通用开放权重型号。Kimi 通用聊天、复杂推理与多模态理解。","url":"https://llmcp.edlab.top/models/kimi-k2-6/","verifiedAt":"2026-07-17"},{"id":"compare-kimi26","type":"section","category":"继续操作","title":"直接对比 Kimi K2.6","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=kimi26,sol"},{"id":"cost-kimi26","type":"section","category":"继续操作","title":"查看 Kimi K2.6 的 API 成本","summary":"挂牌输入 $0.95/M、输出 $4/M；进入成本计算器估算具体任务。","url":"https://llmcp.edlab.top/?model=kimi26&q=Kimi%20K2.6#cost"},{"id":"evidence-kimi26","type":"section","category":"证据与来源","title":"核对 Kimi K2.6 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-07-17。","url":"https://llmcp.edlab.top/?q=Kimi%20K3#evidence-kimi","verifiedAt":"2026-07-17"},{"id":"model-minimaxm3","type":"section","category":"模型资料","title":"MiniMax M3","summary":"国产代码与代理专项。代码代理、多模态工具任务、低成本长上下文。","url":"https://llmcp.edlab.top/models/minimax-m3/","verifiedAt":"2026-07-13"},{"id":"compare-minimaxm3","type":"section","category":"继续操作","title":"直接对比 MiniMax M3","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=minimaxm3,sol"},{"id":"cost-minimaxm3","type":"section","category":"继续操作","title":"查看 MiniMax M3 的 API 成本","summary":"挂牌输入 $0.3/M、输出 $1.2/M；进入成本计算器估算具体任务。 价格口径：当前标准结算价；超过 512K 使用长上下文阶梯。","url":"https://llmcp.edlab.top/?model=minimaxm3&q=MiniMax%20M3#cost"},{"id":"evidence-minimaxm3","type":"section","category":"证据与来源","title":"核对 MiniMax M3 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-07-13。","url":"https://llmcp.edlab.top/?q=MiniMax%20M3#evidence","verifiedAt":"2026-07-13"},{"id":"model-kimi27","type":"section","category":"模型资料","title":"Kimi K2.7 Code","summary":"Kimi 编程专项。开放权重代码代理、MCP 工具调用、中文编程生态。","url":"https://llmcp.edlab.top/models/kimi-k2-7-code/","verifiedAt":"2026-07-17"},{"id":"compare-kimi27","type":"section","category":"继续操作","title":"直接对比 Kimi K2.7 Code","summary":"在同一张表中查看能力、价格、推理档、适用任务和限制。","url":"https://llmcp.edlab.top/compare?track=practical-default&models=kimi27,sol"},{"id":"cost-kimi27","type":"section","category":"继续操作","title":"查看 Kimi K2.7 Code 的 API 成本","summary":"挂牌输入 $0.95/M、输出 $4/M；进入成本计算器估算具体任务。","url":"https://llmcp.edlab.top/?model=kimi27&q=Kimi%20K2.7%20Code#cost"},{"id":"evidence-kimi27","type":"section","category":"证据与来源","title":"核对 Kimi K2.7 Code 的证据","summary":"查看官方事实、独立测试、编辑判断和当前局限。最近核验 2026-07-17。","url":"https://llmcp.edlab.top/?q=Kimi%20K3#evidence-kimi","verifiedAt":"2026-07-17"},{"id":"frontier-visual-games","type":"section","category":"相关专题","title":"Fable 5.1 和 Astra 谁做前端、游戏美术更强？","summary":"网页和浏览器游戏首稿先试 Fable 5.1；Astra 尚未入 Arena 同榜，不能据此判败。完整应用差距小；代码绘图、3D 美术、游戏工程分开验收，含两家实际配合流程。","url":"https://llmcp.edlab.top/workflows/#frontier-visual","verifiedAt":"2026-09-05"},{"id":"frontier-effort-current","type":"section","category":"相关专题","title":"Astra、Fable 5.1 各档相当于 Sol 哪档？","summary":"AA v4.2 中 Astra low 接近 Sol high/xhigh、medium 接近 Sol max；Fable 低四档是估算，实际 Cursor 编程另作对照。含五档成本、最高档、回退和 Ultra 的限制。","url":"https://llmcp.edlab.top/workflows/#frontier-refresh","verifiedAt":"2026-09-05"},{"id":"frontier-matched-cost","type":"section","category":"相关专题","title":"能力接近时，Astra 与 Sol 怎么选、花多少？","summary":"按 AA v4.2 的相邻综合点位，拿相同任务试用 Astra low 与 Sol high、Astra medium 与 Sol max（A/B 对照）；只据评测平均任务费，不把 1 分写成智力百分比或跨任务等效。","url":"https://llmcp.edlab.top/workflows/#frontier-matched-cost","verifiedAt":"2026-09-05"},{"id":"aa-v42-method-change","type":"section","category":"证据与来源","title":"为什么 AA 分数变低了，是模型降智吗？","summary":"2026 年 9 月 4 日 AA 从 v4.1.1 改为 v4.2，调整题目和计分。旧分数不能和新分数相减；估算分、服务端回退也须单独标明。","url":"https://llmcp.edlab.top/workflows/#frontier-refresh","verifiedAt":"2026-09-05"},{"id":"topic-plans","type":"section","category":"相关专题","title":"主流 AI 会员与套餐怎么选","summary":"比较 Kimi、千问 Token Plan、ChatGPT、Claude、Google AI 与 Grok / SuperGrok，并按任务组合一个或两个付费入口。","url":"https://llmcp.edlab.top/plans/","verifiedAt":"2026-08-15"},{"id":"topic-qwen-token-plan","type":"section","category":"相关专题","title":"千问 Token Plan 怎么选、能不能给程序后台用","summary":"Lite ¥39 起；按 5 小时、7 天和并发 Agent 看升级。个人版只限交互式编程与智能体工具，不能用于 API 脚本、自建后端或无人值守批处理。","url":"https://llmcp.edlab.top/plans/#plan-qwen-token","verifiedAt":"2026-07-27"},{"id":"topic-specialists","type":"section","category":"相关专题","title":"专项 AI 工具地图","summary":"只看在 X 调研、图像、语音、视频生成、跨语言配音与字幕等具体领域效果领先，或达到质量线后明显更省的工具；新品先进入观察位。","url":"https://llmcp.edlab.top/specialists/","verifiedAt":"2026-08-09"},{"id":"topic-video-task-types","type":"section","category":"相关专题","title":"文生、图生、视频编辑、换语言和字幕有什么区别","summary":"先看你有文字、图片还是已有视频，再判断要生成镜头、修改画面、保留音色翻译还是做字幕；这些任务不能混成一个总冠军。","url":"https://llmcp.edlab.top/specialists/#video-task-guide","verifiedAt":"2026-08-09"},{"id":"topic-text-to-video","type":"section","category":"证据与来源","title":"文生有声视频：Gemini 和 MiniMax H3 怎么选","summary":"Gemini 当前点位更靠前且公开估算更省；H3 与它处于同一误差区间，只在参考控制、2K 或你的真实盲测更好时换上。","url":"https://llmcp.edlab.top/specialists/#text-to-video","verifiedAt":"2026-08-09"},{"id":"topic-image-to-video","type":"section","category":"证据与来源","title":"图生有声视频：Seedance、Gemini 和 H3 怎么选","summary":"Seedance 2.0 是当前点估计首选；Gemini 与它处于同一合理区间且公开估算更省，H3 留在证据说明中而不挤成第三个推荐。","url":"https://llmcp.edlab.top/specialists/#image-to-video","verifiedAt":"2026-08-09"},{"id":"topic-h3-video-editing","type":"section","category":"证据与来源","title":"MiniMax H3、Gemini 与 Seedance 怎么选","summary":"修改已有视频时 H3 与 Gemini 同属领先档；图生视频中 Seedance、H3、Gemini 误差重叠，按入口、素材和成功成片成本决定。","url":"https://llmcp.edlab.top/specialists/#video-editing","verifiedAt":"2026-08-09"},{"id":"topic-seedance-2-5-watch","type":"section","category":"证据与来源","title":"Seedance 2.5 发布后，2.0 的排名还能沿用吗","summary":"2.5 已有正式 API 和公开价格，但当前独立榜仍测 2.0；新版本可以生产试用，不能继承旧分数。","url":"https://llmcp.edlab.top/specialists/#seedance-2-5","verifiedAt":"2026-08-09"},{"id":"topic-seedance-2-5-tools","type":"section","category":"相关专题","title":"Seedance 2.5 在哪里用、API 多少钱","summary":"普通创作者先在 Dreamina / 即梦账号中核对是否已开放 2.5；开发者可用 fal.ai 的文生、图生和多参考接口，720p 有声约 US$0.473 / 秒。","url":"https://llmcp.edlab.top/specialists/#seedance-tools","verifiedAt":"2026-08-09"},{"id":"topic-video-localization","type":"section","category":"相关专题","title":"中文视频变英文并保留相似音色","summary":"人物出镜且嘴型也要同步先试 HeyGen；只要求声音、节奏和情绪相近时先试更便宜的 ElevenLabs Dubbing。","url":"https://llmcp.edlab.top/specialists/#video-localization","verifiedAt":"2026-08-09"},{"id":"topic-subtitle-localization","type":"section","category":"相关专题","title":"中英双语字幕与多语言 SRT 怎么做","summary":"普通用户用剪映 / CapCut 一键识别和翻译；需要免费、本地识别与标准字幕文件时用 Subtitle Edit + Whisper。","url":"https://llmcp.edlab.top/specialists/#subtitle-localization","verifiedAt":"2026-08-09"},{"id":"topic-image-tools","type":"section","category":"相关专题","title":"图片生成与编辑：效果最好和更便宜的选择","summary":"当前效果先试 GPT Image 2；Reve 2.1 是文生图低价候选，但单图编辑仍需项目复测。","url":"https://llmcp.edlab.top/specialists/#image-generation-editing","verifiedAt":"2026-07-27"},{"id":"topic-text-to-speech","type":"section","category":"相关专题","title":"文字转语音：Qwen Audio 3.0 和 Simba 3.2 怎么选","summary":"两者在当前原生音色盲测中同属领先区间；Qwen 偏高品质与控制，Simba 偏低成本生产。","url":"https://llmcp.edlab.top/specialists/#text-to-speech","verifiedAt":"2026-07-27"},{"id":"topic-model-health","type":"section","category":"相关专题","title":"模型有没有降智：先看状态观测","summary":"先看快照日期，再把官方服务故障、Claude Code 与 Codex 的能力观测拆开；一次波动不能直接叫作降智。","url":"https://llmcp.edlab.top/model-health/","verifiedAt":"2026-07-25"},{"id":"topic-task-map","type":"section","category":"相关专题","title":"按具体任务找最擅长的模型","summary":"从仓库修复、前端视觉、联网研究、长文档、浏览器代理等具体任务进入能力地图。","url":"https://llmcp.edlab.top/#task-map","verifiedAt":"2026-07-17"},{"id":"topic-decision","type":"section","category":"相关专题","title":"按用途快速选模型","summary":"按使用渠道、任务类型和优先条件，在 30 秒内获得一套可执行建议。","url":"https://llmcp.edlab.top/#decision"},{"id":"topic-faq","type":"section","category":"相关专题","title":"选模型前最常见的九个问题","summary":"会员与 API、工具与模型、推理档位、敏感资料和第二模型复核。","url":"https://llmcp.edlab.top/#faq"},{"id":"topic-equivalence","type":"section","category":"相关专题","title":"相当于哪一档 GPT 与 Claude","summary":"分别按旗舰上限、日常实用、成本价值和专项能力查看等效区间。","url":"https://llmcp.edlab.top/#equivalence"},{"id":"topic-reasoning","type":"section","category":"相关专题","title":"Sol、Terra、Luna 与各推理档怎么选","summary":"先看日常默认结论，再分别比较 medium、high、xhigh、max、Ultra 的能力、成功率、成本、耗时和工作流。","url":"https://llmcp.edlab.top/workflows/","verifiedAt":"2026-07-23"},{"id":"topic-practical-gap","type":"section","category":"相关专题","title":"AA 相差 1 分，实际体感有多大","summary":"不能把综合指数换算成智商百分比；用 100 个同类任务大约多完成几个，再同时比较费用、等待和失败返工。","url":"https://llmcp.edlab.top/workflows/#practical-gap","verifiedAt":"2026-07-23"},{"id":"topic-clear-boundaries","type":"section","category":"相关专题","title":"边界清楚、验收测试明确是什么意思","summary":"用大白话拆成要改什么、哪里能改、怎样算做完、什么时候停；还给出语音需求从聊天到执行的流程。","url":"https://llmcp.edlab.top/workflows/#clear-boundaries","verifiedAt":"2026-07-23"},{"id":"topic-coding-voice","type":"section","category":"相关专题","title":"Codex 和 Claude Code 的语音功能有什么区别","summary":"Codex 更接近边说边指挥代理；Claude Code 当前主要把说话转成可检查的文字提示词；普通 Claude 的双向语音另算一种入口。","url":"https://llmcp.edlab.top/workflows/#voice-tools","verifiedAt":"2026-07-24"},{"id":"topic-glm53-frontier","type":"section","category":"证据与来源","title":"GLM-5.3 进入第一梯队了吗","summary":"AA max 60、DeepSWE 69%±3 已支持开放权重前沿定位；与 K3 同点并接近 Sol / Opus，但误差重叠时不排固定名次。","url":"https://llmcp.edlab.top/models/glm-5-3/#model-equivalence","verifiedAt":"2026-08-29"},{"id":"topic-glm53-flash-reality","type":"section","category":"证据与来源","title":"GLM-5.3 Flash 为什么分很高，体感却可能没那么强","summary":"AA 57 是九类评测加权点位，不是所有任务成功率；DeepSWE max 为 63%±4，比 Sol max 点估计低 10 个百分点。真正优势是过可用线后非常便宜。","url":"https://llmcp.edlab.top/models/glm-5-3-flash/#model-equivalence","verifiedAt":"2026-08-29"},{"id":"topic-strong-plan-cheap-execute","type":"section","category":"相关专题","title":"强模型规划、便宜模型执行，失败后怎么升级","summary":"一个强模型先写清目标、边界和测试；GLM-5.3 Flash / Luna 等只接可回滚支线；认真尝试仍理解错就交回强模型，高风险结论再做一次独立复核。","url":"https://llmcp.edlab.top/workflows/#cross-vendor","verifiedAt":"2026-08-29"},{"id":"topic-sol-promo-price","type":"section","category":"相关专题","title":"Sol 当前促销后还要不要为了省钱换 Terra","summary":"Sol 当前为 $4 / $20，至少持续至 2026-11-21；旧榜单账单不能直接当今天价格。边界和测试明确时 Terra 仍值得 A/B，但不再默认一定更省。","url":"https://llmcp.edlab.top/workflows/#sol-high-terra-max","verifiedAt":"2026-08-29"},{"id":"topic-qwen-flash-next-watch","type":"section","category":"证据与来源","title":"Qwen3.8-Flash-Next 值得进入正式榜单吗","summary":"官方已发布开放权重架构预览，6B 激活、262K 原生上下文并计划 $0.16 / $0.47 API；当前仍缺可靠第三方同版本测试，因此只观察、不正式排名。","url":"https://llmcp.edlab.top/models/qwen-3-8-max/","verifiedAt":"2026-08-29"},{"id":"topic-deepseek-vision-exp","type":"section","category":"证据与来源","title":"DeepSeek V4 Flash Vision Exp 是升级版吗","summary":"它是加入图片输入的实验分支，AA 综合点位约 51、与文字版约 52 接近；需要看图时可试，但没有证据把它当通用能力升级或单独进入正式排名。","url":"https://llmcp.edlab.top/models/deepseek-v4-flash/","verifiedAt":"2026-08-29"},{"id":"topic-deepseek-k3","type":"section","category":"证据与来源","title":"DeepSeek V4 Pro 0813 真的比 Kimi K3 强吗","summary":"DeepSWE max 63%±6 与 Vals SWE-bench 96.4%支持它进入低价代码专项，官方也已发布 MIT 权重；当前公开成本已高于同点位的 GLM-5.3 Flash，而且没有同版本通用综合证据，仍不能写成全面超过 K3。","url":"https://llmcp.edlab.top/models/deepseek-v4-pro/","verifiedAt":"2026-08-15"},{"id":"topic-deepseek-flash-use","type":"section","category":"相关专题","title":"DeepSeek V4 Flash 0731 能做客服、知识库或批处理吗","summary":"当前只按 Max 档比较：AA 与 DeepSWE 支持低成本执行，Vals high 只补充版本信号；原创工程任务约 53%±4，峰时 API 为 $0.44 / $1.32，不适合作为架构或最终批准主脑。","url":"https://llmcp.edlab.top/models/deepseek-v4-flash/#deepseek-use-cases","verifiedAt":"2026-08-29"},{"id":"topic-deepseek-flash-cases","type":"section","category":"证据与来源","title":"DeepSeek V4 Flash 真实案例：大家拿它做什么","summary":"查看插件合并、Django 功能、Ghidra 逆向、连续 API 编程和代理路由案例，并同时看计划漏项、长上下文取回、视觉与推理档映射等失败边界。","url":"https://llmcp.edlab.top/models/deepseek-v4-flash/#deepseek-real-cases","verifiedAt":"2026-08-15"},{"id":"topic-grok46-frontier","type":"section","category":"证据与来源","title":"Grok 4.6 真的进入第一梯队了吗","summary":"AA、Vals、CursorBench 与 DeepSWE 四种方法支持低价前沿；Cursor 多文件进入最高组，原创长程工程则与 GPT-5.5 xhigh / Luna max 同点位，因此不宣布全面冠军。","url":"https://llmcp.edlab.top/models/grok-4-6/#model-equivalence","verifiedAt":"2026-08-15"},{"id":"topic-gemini37-level","type":"section","category":"证据与来源","title":"Gemini 3.7 Flash 相当于哪个常用模型","summary":"DeepSWE high 65%±2，接近 GPT-5.5 xhigh / Luna max；CursorBench high 61.6%，接近 Terra max、K3 max。优势在速度、多模态、Google 工具和介绍价，不负责高风险终审。","url":"https://llmcp.edlab.top/models/gemini-3-7-flash/#model-equivalence","verifiedAt":"2026-08-15"},{"id":"topic-grok-plans-bot","type":"section","category":"相关专题","title":"SuperGrok、Grok Build、Grok Bot 和 2× 用量怎么理解","summary":"付费功能共享一个周额度池；Grok Bot 是带云端电脑的 AI 队友，不是赠送实体电脑；2× included usage 是 Grok 4.6 发布首周活动，不是永久套餐承诺。","url":"https://llmcp.edlab.top/plans/#plan-grok-x","verifiedAt":"2026-08-15"},{"id":"topic-muse12-specialist","type":"section","category":"证据与来源","title":"Muse 1.2 为什么只进专业专项，不进通用前三","summary":"Vals 法律与金融任务进入领先组，DeepSWE 长程代码为 55%±2。它适合专业工作流和可恢复后台代理，但没有证据成为通用或代码总冠军。","url":"https://llmcp.edlab.top/models/meta-muse-spark-1-2/","verifiedAt":"2026-08-15"},{"id":"topic-qwen38-ga","type":"section","category":"证据与来源","title":"Qwen 3.8 Max 正式版到了什么水平","summary":"综合思考约在 Sol high—xhigh / Opus 5 medium；长程代码更接近 Sonnet 5 max / GPT-5.4 xhigh 的公开区间。适合中文、视觉和阿里生态，但不是单一意义上的 Sol xhigh 等价物。","url":"https://llmcp.edlab.top/models/qwen-3-8-max/#model-equivalence","verifiedAt":"2026-08-13"},{"id":"topic-terra-luna-price-cut","type":"section","category":"相关专题","title":"Terra 和 Luna 降价后，模型该怎么重新选","summary":"Terra API 降价 20%，Luna 降价 80%，Codex / ChatGPT Work 扣量同步下降；Sol 仍负责模糊需求和关键决策，Luna 新增“计划明确、测试可验收的批量执行”路线。","url":"https://llmcp.edlab.top/workflows/#luna-adequacy","verifiedAt":"2026-07-31"},{"id":"topic-sol-medium-terra-xhigh","type":"section","category":"相关专题","title":"Sol medium 和 Terra xhigh 的效果与成本差多少","summary":"两者并非效果相同：比较 AA 综合分、Radar 通过率、当前单题成本和等待，并说明何时选谁。","url":"https://llmcp.edlab.top/workflows/#sol-medium-terra-xhigh","verifiedAt":"2026-07-23"},{"id":"topic-sol-high-terra-max","type":"section","category":"相关专题","title":"日常编程用 Sol high 还是 Terra max","summary":"Sol high 更省心、更快，当前促销又缩小了价差；测试成熟且愿等待时，Terra max 仍可能在特定仓库轨道通过更多，但需用自己的 token 和成功率重算成本。","url":"https://llmcp.edlab.top/workflows/#sol-high-terra-max","verifiedAt":"2026-07-23"},{"id":"topic-effort-escalation","type":"section","category":"相关专题","title":"High、xhigh、Max 应该逐级升，还是直接跳档","summary":"比较每次升档带来的能力、通过率、成本与等待，并用一次失败的返工损失决定是否直接 Max。","url":"https://llmcp.edlab.top/workflows/#sol-escalation","verifiedAt":"2026-07-23"},{"id":"topic-luna-adequacy","type":"section","category":"相关专题","title":"Luna medium / high 读文档和扫仓库够不够","summary":"Medium 负责抽取与目录，high 负责只读分析；计划明确、测试可验收时，降价后的 xhigh / max 可试批量实现，但没有证据把 Luna high 换算成 GPT-5.4 / 5.5 high。","url":"https://llmcp.edlab.top/workflows/#luna-adequacy","verifiedAt":"2026-07-23"},{"id":"topic-luna-workflow","type":"section","category":"相关专题","title":"Luna 什么时候用：子代理、任务、worktree 与自动化","summary":"把 Luna 用作低价资料助手；只有计划冻结、测试可验收且可回滚时才执行批量改动，并分清新任务、独立工作树、定时任务和关键写入的边界。","url":"https://llmcp.edlab.top/workflows/#luna-workflows","verifiedAt":"2026-07-23"},{"id":"topic-gpt55-effort","type":"section","category":"相关专题","title":"GPT-5.5 high 与 xhigh 到底差多少","summary":"查看同口径综合分、真实仓库通过率、任务成本、等待时间和迁移到 5.6 的建议。","url":"https://llmcp.edlab.top/workflows/#key-differences","verifiedAt":"2026-07-23"},{"id":"topic-cross-vendor-workflow","type":"section","category":"相关专题","title":"Codex 与 Claude Code 怎么搭配干活","summary":"按任务在 Codex 与 Claude 间分配计划、实现、只读审查和并行助手；额度都充足时也没有固定角色。","url":"https://llmcp.edlab.top/workflows/#cross-vendor","verifiedAt":"2026-07-23"},{"id":"topic-opus-sonnet","type":"section","category":"相关专题","title":"Claude Opus 5、Fable 5、Sonnet 5 和 Opus 4.8 怎么选","summary":"Opus 5 high 已是 Claude 严肃工作的默认起点；Sonnet 负责边界明确的性价比执行，Fable 改为需用自己的任务证明价值的高价 A/B，4.8 只作旧流程基线。","url":"https://llmcp.edlab.top/workflows/#claude-code","verifiedAt":"2026-07-26"},{"id":"topic-opus-sol-task-router","type":"section","category":"相关专题","title":"Opus 5 和 Sol 到底各适合什么任务","summary":"按产品构思、后端与终端、前端视觉、Debug、无人值守和代码审查分类；两者在长程代码测试中同档，不使用“产品经理对工程师”的绝对标签。","url":"https://llmcp.edlab.top/workflows/#claude-task-router","verifiedAt":"2026-07-26"},{"id":"topic-orchestration","type":"section","category":"相关专题","title":"线程、子代理、worktree、Agent team 有什么区别","summary":"分别解释上下文隔离、工作分派、文件隔离和并行协作，并给出一套从语音需求到审核交付的流程。","url":"https://llmcp.edlab.top/workflows/#orchestration","verifiedAt":"2026-07-23"},{"id":"topic-enterprise-routing","type":"section","category":"相关专题","title":"把模型接进网站或企业流程时怎么选","summary":"先设质量底线，再计算调用、重试、返工和等待在内的成功任务成本；按风险决定是否用强模型或双模型。","url":"https://llmcp.edlab.top/workflows/#enterprise-routing","verifiedAt":"2026-07-23"},{"id":"topic-coding","type":"section","category":"相关专题","title":"不同编程任务的模型分榜","summary":"分别查看仓库修复、完整应用、终端长任务和 Cursor 多文件任务。","url":"https://llmcp.edlab.top/#coding"},{"id":"topic-cost","type":"section","category":"相关专题","title":"API 成本与价格计算器","summary":"按输入和输出 token 估算单次任务费用，并查看更便宜的替代选择。","url":"https://llmcp.edlab.top/#cost"},{"id":"topic-sources","type":"section","category":"证据与来源","title":"第三方榜单是否可信","summary":"了解 Artificial Analysis、Vals、LiveBench、Arena 等来源适合回答什么。","url":"https://llmcp.edlab.top/#sources"},{"id":"topic-writing","type":"section","category":"相关专题","title":"日常工作、写作与长文处理","summary":"从会员入口、写作质量、长文档和知识工作角度选择模型。","url":"https://llmcp.edlab.top/?q=%E6%97%A5%E5%B8%B8%E4%B8%8E%E5%86%99%E4%BD%9C#decision"},{"id":"topic-open","type":"section","category":"相关专题","title":"开放权重与本地部署","summary":"区分开放权重、许可证、硬件成本和私有部署条件。","url":"https://llmcp.edlab.top/?q=%E5%BC%80%E6%94%BE%E6%9D%83%E9%87%8D#equivalence"},{"id":"topic-shadow","type":"section","category":"继续操作","title":"零 Token 数据观察室","summary":"查看带日期的数据快照、来源健康和历史样例；先判断变化是否值得继续核对，不把它当实时榜单。","url":"https://llmcp.edlab.top/auto-update-lab"},{"id":"destination-workflow-prompt","type":"section","category":"继续操作","title":"把方案复制给你的 AI","summary":"回答 5 个小问题，生成一段可交给 Codex 或 Claude Code 的安全配置指令。","url":"https://llmcp.edlab.top/workflows/#workflow-prompt"},{"id":"destination-compare","type":"section","category":"继续操作","title":"直接对比","summary":"把 2—4 个模型放到同一口径下比较能力、价格和限制。","url":"https://llmcp.edlab.top/compare/"},{"id":"destination-method","type":"section","category":"证据与来源","title":"研究口径","summary":"了解官方事实、独立测试、社区信号分别能证明什么。","url":"https://llmcp.edlab.top/#method"},{"id":"destination-evidence","type":"section","category":"证据与来源","title":"完整证据与来源","summary":"查看型号、价格、独立数据、编辑判断和当前限制。","url":"https://llmcp.edlab.top/#evidence"},{"id":"destination-lab","type":"section","category":"证据与来源","title":"零 Token 数据观察室","summary":"查看带日期的数据快照、来源健康和历史样例。","url":"https://llmcp.edlab.top/auto-update-lab/"},{"id":"destination-directory","type":"section","category":"证据与来源","title":"浏览全站目录","summary":"一次查看全部主要页面、重点段落和模型资料入口。","url":"https://llmcp.edlab.top/directory/"},{"id":"destination-english","type":"section","category":"继续操作","title":"English overview","summary":"Open the concise English decision guide.","url":"https://llmcp.edlab.top/en/"},{"id":"destination-effort-comparison","type":"section","category":"继续操作","title":"自选模型与推理档对比","summary":"一次选择 1—6 个模型档位，比较能力、通过率、成本和等待。","url":"https://llmcp.edlab.top/workflows/#comparison-workbench"},{"id":"destination-plan-families","type":"section","category":"继续操作","title":"核对主流 AI 套餐","summary":"分别查看 Kimi、ChatGPT、Claude、Google AI 与 Grok / SuperGrok。","url":"https://llmcp.edlab.top/plans/#plan-families"},{"id":"destination-plan-bundles","type":"section","category":"继续操作","title":"不同套餐怎么搭配","summary":"让第二个订阅解决第一家解决不了的检索、实现、复核或成片任务。","url":"https://llmcp.edlab.top/plans/#bundle-routes"},{"id":"destination-specialist-picks","type":"section","category":"继续操作","title":"当前专项推荐","summary":"只查看已经达到质量线、并有清楚证据和成本边界的专项首选。","url":"https://llmcp.edlab.top/specialists/#current-picks"},{"id":"destination-service-status","type":"section","category":"证据与来源","title":"官方服务是否故障","summary":"查看 OpenAI、Claude 与 Kimi 官方状态，不把宕机叫作降智。","url":"https://llmcp.edlab.top/model-health/#service-status"},{"id":"destination-capability-status","type":"section","category":"证据与来源","title":"模型能力是否变化","summary":"按 Codex 与 Claude 具体模型查看滚动能力观测和证据限制。","url":"https://llmcp.edlab.top/model-health/#capability-status"},{"id":"destination-lab-status","type":"section","category":"证据与来源","title":"数据快照历史","summary":"查看最近一次检查日期、来源状态、候选变化和失败原因。","url":"https://llmcp.edlab.top/auto-update-lab/#monitoring-status"}]}