2026 下半年 AI 编程模型
怎么选:完整格局
不是「哪个最强」,是「你的场景该选哪个」。2026 年 9 月头三天三家连发:Claude Fable 5.1(09-01)、Gemini 3.8 Flash(09-02)、GPT-6 Astra(09-03),顶配档的格局被重排了一次。这里是预算/任务复杂度/上下文三维度的决策框架,三大阵营的现状速览,以及本站全部选型内容的统一入口。
同一端点切换型号,成本按 token 自己算;可调型号以 /models 为准。
- 按 token 计费,实时单价见 /models
- 支付宝、微信支付、信用卡、加密货币均可付款
- 充值后自助开通、立刻生效
更新于 2026-10-08
Claude(Opus 5.5 / Opus 5 / Fable 5.1)与 OpenAI(GPT-6 Astra、GPT-6 Sol、GPT-5.6 Sol / Terra)均在 QCode 上线;QCode 暂不提供 gpt-6-luna 与 gpt-5.6-luna(均已从 /models 下线),请使用其他 GPT 模型,例如 gpt-6.1-sol、gpt-6-sol 或 gpt-5.6-terra。把 2026-09-18 之后各家的官方发布都数上,是六次:Anthropic 的 Opus 5.5(2026-09-22)与 Sonnet 5.5(claude-sonnet-5-5,2026-09-28 发布,2026-09-29 起在 QCode 可用)、OpenAI 的 GPT-6 Sol 与 Luna(2026-09-22)与 gpt-6.1-sol(2026-09-29 发布,自 2026-09-30 起在 QCode 可调)、xAI 的 Grok 4.7(2026-09-21,QCode 不提供 Grok)。开源线 DeepSeek 已经换到 deepseek-v4.1-flash(2026-09-10)与 deepseek-v4-pro(08-13 GA,峰谷计价),GLM-5.3(08-14)、Kimi K3(07-16,权重 07-27 开源)在售。Google 侧目录已列 Gemini 3.8 Flash 与 3.8 Live,而 Gemini 4 Pro 只确认 2026-07-21 开始预训练,官方从未给过日期。
格局截至:2026-09-29。
决策框架:三个维度
选模型前先回答这三个问题,比直接比基准分数更有效。
| 维度 | 问自己 | 偏向档位 | 典型场景 | 说明 |
|---|---|---|---|---|
| 预算敏感度 | 这个任务量大到需要认真控成本吗? | 预算紧 → deepseek-v4.1-flash / Sonnet 5;预算宽松 → Sol / Fable 5 | 批量补全、CI 脚本、轻量分类 | Luna 标价约为 Sol 的 1/25;DeepSeek 的 V4.1-Flash 低谷 $0.15/$0.6、高峰翻倍,海量执行场景差价显著 |
| 任务复杂度 | 这是长程重构 / 高难度推理,还是常规功能开发? | 高难度 → Sol / Fable 5;常规 → Terra / Sonnet 5 | 跨仓库重构、复杂调试、架构决策 | 对最难的一小部分任务,旗舰档的成功率差距远超价差 |
| 上下文需求 | 单次任务要塞进多少上下文? | Astra / Sol / Terra / Luna(1.05M)· Fable 5.1(1M)· Gemini 3.8 Flash | 长文档问答、跨文件大范围重构 | 三大阵营当前在售旗舰上下文窗口相近,不是主要分野 |
三大阵营现状速览
Claude(Anthropic)
Fable 5.1:现役最高档(2026-09-01 发布,$10/$50,1M 上下文、128K 输出,可靠知识截止 2026 年 6 月,思考为 Adaptive 常时开启)。Opus 5:官方价 $5/$25,1M 上下文,在 QCode 仍可调;但官方 2026-09-22 发布 Opus 5.5(claude-opus-5-5,$4/$20,缓存读 $0.20)后,它已不是最新一档,官方模型总览的起点句也改成「不确定的话从 Claude Opus 5.5 开始」,Fable 5.1 仍留给要求高的推理与长链路智能体工作。Sonnet 5:$2/$10,均衡主力;官方 2026-09-28 发布的 Sonnet 5.5 与它同价,claude-sonnet-5-5 已于 2026-09-29 在 QCode 开放。Haiku 4.5:$1/$5,最快一档。
OpenAI
GPT-6 Astra:2026-09-03 发布的最高档(模型 id gpt-6-astra,上下文 1,050,000、输出上限 128,000 含推理 token,标价 $10/$50,推理档 low–max 无 none);官方 2026-09-22 的发布文仍写着它是最强的一档。GPT-6 Sol($2/$10)与 GPT-6 Luna($0.10/$0.50):官方 2026-09-22 发布,官方称价格比 GPT-5.6 的促销价低 50%。GPT-5.6 三档:Sol(官方定价页当前 $4/$20,注明促销价至少持续到 2026-11-21)、Terra(均衡 $2/$12)、Luna(极速 $0.20/$1.20)。GPT-5.6 Sol 与 Astra 的上下文窗口和输出上限完全相同,分野在推理档与知识截止。另有审核制的 GPT-5.6-Cyber(Daybreak Red 层级,普通渠道不可得)。
Gemini 3.8 Flash 与 3.8 Flash Cyber 于 2026-09-02 发布,官方入门价每 1M token(百万)输入 $0.75、输出 $3.75,写明是优惠价、到 2026-12-31 为止,2027-01-01 起为 $1.50/$7.50;Cyber 版限 Fairwind 计划的受信任防御方。此前的 3.6 Flash(07-21)与 3.7 Flash(08-13 GA)仍在。Gemini 3.5 Pro 至今未广泛提供 —— 官方可核的表述只有「与合作伙伴测试中,准备好就广泛提供」,从未给过日期,此前流传的 7 月与 8-12 两个日期均已跳票,请勿当作既成事实。
开源阵营(DeepSeek / GLM / Kimi)
DeepSeek 的现役两档是 deepseek-v4.1-flash(2026-09-10,发布稿称它是「新架构家族里最小的模型」、带原生视觉理解;1M / 384K、MIT、官方低谷 $0.15/$0.6)与 deepseek-v4-pro(2026-08-13 GA,发布时 $0.435/$0.87)。2026-09-10 起 deepseek-v4-flash 与 vision-exp 退役,同名请求由 V4.1-Flash 应答并按 Flash 价计费(changelog);changelog 的 2026-09-10 条目推翻「V4 Pro 改道」,确认 V4 Pro 继续提供、计费不变。GLM-5.3(2026-08-14)与 Kimi K3(2026-07-16)仍在。对比见 /deepseek-v4-1-flash-vs-v4-pro,定价见 /deepseek-v4-1-flash-pricing。
相关内容的导航
本页是站内选型内容的枢纽——以下链接覆盖全部新增与更新的选型文章。
GPT-5.4 下线迁移指南
8/31 前该切到哪个档位
Fable 5 vs GPT-5.6 Sol
两大旗舰规格价格对比
Mythos 5 和 Fable 5 什么关系
普通用户能用到的是哪个
Fable 5 定价完全指南
官方单价与订阅制成本
Fable 5 的 SWE-Bench Pro 80.3%
分数来源与争议解读
Sol / Terra / Luna 怎么选
三档基准价格与场景对比(已刷新)
GPT-5.6 完整指南
基准、定价与接入方式
Gemini 3.5 Pro 发布追踪
传闻与已确认事实(已更新 8/12 传闻)
GPT-5.6 定价完全指南
三档价格、缓存计价与成本估算
2026 AI 模型雷达
每款前沿模型的实时可用性状态
GPT-5.4 下线迁移指南
GPT-5.6 三档怎么分工,以及什么活值得升到 GPT-6 Astra。
Claude Fable 5 vs GPT-5.6 Sol
两大旗舰规格、价格、SWE-Bench Pro 分数并排对比。
Claude Mythos 5 和 Fable 5 是什么关系
普通用户实际能用到的是 Fable 5,Mythos 5 无公开商用通路。
近期时间线
三大阵营近两个月内的关键节点。
GPT-5.6 三档全面开放
Sol、Terra、Luna 通过 API 与 Codex 向所有人开放,QCode 同步接入(截至 2026-10-08,QCode 暂不提供 Luna)。
GPT-5.6 降价
Luna 降 80% 至 $0.20/$1.20,Terra 降 20% 至 $2/$12,Sol 价格不变。
8 月密集发布周
GLM-5.3 发布(与 5.2 同基座,后训练 Scaling,编程 +50%);Qwen3.8-Max 于 08-03 发布、08-12 首次开源 Max 级权重;GPT-5.6-Cyber 于 08-10 进入 Daybreak Red 审核制层级。
三天三家连发,顶配档重排
09-01 Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1;09-02 Google 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber;09-03 OpenAI 发布 GPT-6 Astra。其中 Astra 与 Fable 5.1 的标价完全相同($10/$50),上下文与输出上限也接近,是 2026 年下半年第一次出现同价位的跨阵营正面对撞。
DeepSeek 换档:V4.1-Flash 上线,0731 版退役
2026-09-10 官方发布 V4.1-Flash 并下调 Flash 档价格,同时退役 deepseek-v4-flash 与 deepseek-v4-flash-vision-exp;changelog 的 2026-09-10 条目应需求推翻 V4 Pro 改道。同期官方 API 目录还列出了 Gemini 3.8 Live(id gemini-3.8-live)。
关于本页
本页是决策框架与内容导航枢纽,各模型的完整一手事实核查见下方专题页。本页涉及的 2026 年 9 月发布日期与旗舰价格均已回各家官方文档核对(OpenAI 模型文档与定价页、Anthropic 模型总览、Google 模型目录、DeepSeek news260910 发布稿 / changelog),抓取日期 2026-09-18;2026-09-21 至 2026-09-29 新增的条目核于 2026-09-29。其余历史条目沿用各专题页的既有出处。
常见问题
现在选 AI 编程模型,第一步该看什么?
先别急着比基准分数,先回答三个问题:预算敏感度、任务复杂度、单次任务的上下文需求。三个维度定完,候选范围通常只剩 1-2 档,再去看具体基准分数做最终决定。
GPT-5.4 用户是不是都要迁移?
不是。官方写明自 2026-08-31 起的下线只覆盖 ChatGPT 登录态会话(2026-08-30 复核仍是 starting August 31)。API 或 Codex 密钥访问不在这次公告范围内;可以继续用,也可以迁到 GPT-5.6 对应档。
Gemini 3.5 Pro 现在能用了吗?
还不能。截至 2026-08-22 它仍处于受限预览;此前传闻的 7 月与 8 月 12 日两个发布日期都已跳票,Google 未确认任何新日期——请当作传闻对待,不要当作决策依据。
这页和「2026 AI 模型雷达」有什么区别?
雷达页做的是「哪些模型已可用/预览/受限」的现状速览;本页做的是「你的场景该选哪个」的决策框架,并汇总站内新增与更新的选型深度内容。两页目的不同,可以配合看。
相关阅读
2026 AI 模型雷达
每款前沿模型的实时可用性状态追踪,与本页的选型决策框架互补。
SWE-Bench Pro 上的 Claude Fable 5
80.3% 这个分数是怎么来的,以及它的参考价值和局限。
Claude Fable 5 定价完全指南
官方单价、缓存计价、订阅制真实成本。
本页汇总的价格、基准分数与发布日期均已交叉核实,Gemini 3.5 Pro 的发布日期为未经 Google 证实的传闻。信息随时可能变化,请以各厂商官方发布为准。