# 「我闻到了恐惧的味道」——GPT-5.6 全面开放，但真正让 Anthropic 紧张的，可能不是跑分

> 作者/来源: admin
> 发布时间: 2026-08-13T10:15:36.399Z
> 分类: AI专区
> 标签: GPT-5.6, OpenAI, Anthropic, Codex, 定价
> 原文链接: http://117.50.162.249:3000/yun/articles/2695

---

**北京时间 7 月 10 日凌晨，OpenAI 按下了那颗所有人都在等的按钮：GPT-5.6 系列面向全球全量开放。旗舰 Sol、均衡 Terra、经济 Luna 三档模型同步上线。**

**与此同时，独立编码工具 Codex 正式并入 ChatGPT 桌面应用，Chat、Work、Codex 三个入口装进了同一个 App。**

这不是一次普通的模型发布。

定价上，Sol 每百万 token 输入 5 美元、输出 30 美元；Terra 直接砍半，2.5⁄15 美元；Luna 压到 1⁄6 美元。横向对比，Claude Fable 5 的定价是输入 10 美元、输出 50 美元——Sol 的输入价格只有后者一半，输出价格低 40%。

效率数据更激进。据 OpenAI 技术报告，Sol 在编程任务中输出 token 效率提升 54%，编程智能体指数冲到 80 分，超越 Fable 5，而完成同等任务的成本约为后者的三分之一到四分之一。

Anthropic 的反应比任何评测数据都更能说明问题：连夜重置 Fable 5 用户的使用额度，并延长免费期限至 7 月 12 日。其产品负责人甚至在社交平台留言：「我闻到了恐惧的味道。」

但真正值得讨论的，不是一场跑分战的胜负，而是藏在这次发布背后的三件事。

## 一、为什么合并 Codex，比 GPT-5.6 本身更重要？

很多人把注意力放在 Sol 的跑分上，但这次发布真正的结构性变化，是 Codex 被并进了 ChatGPT。

不是加个入口跳转那种「整合」。是 Codex 彻底变成了 ChatGPT 桌面应用里的一个标签页，和 Chat、Work 并列。老用户的代码项目、对话记录、自定义配置全部无缝迁移。旧版客户端更名为 ChatGPT Classic 保留使用。[1]

OpenAI 为什么要这么做？

据《财经》报道，此前 ChatGPT 周活跃用户已超 10 亿，但独立 Codex 应用仅超 500 万。产品力分散，两个入口互相稀释。[2] 而 Anthropic 凭借 Claude Code 在编程赛道的口碑，已经在 2026 年初于收入和估值上反超 OpenAI——据 SEMIANALYSIS 数据，Anthropic 的 ARR 绝大部分来自 API 业务，编程场景是核心营收引擎。

合并 Codex 不是产品层面的小调整，是一次战略收拢：把最强的编程能力装进最大的用户入口，用一个 App 同时覆盖聊天、办公智能体和代码开发三个场景。

更重要的是，Codex 每周 500 万用户中，超过 100 万人用它做的根本不是软件开发。[4] 写代码需要的那套能力——理解目标、拆解任务、调用工具、检查结果、自己纠错——恰好就是干任何知识工作需要的能力。Codex 没有被砍掉，是被泛化了。

Anthropic 半年前就走过了这条路：今年 1 月，Claude 桌面端里出现了第三个标签页 Cowork，用 Claude Code 的架构做编码之外的知识工作。Anthropic 自己的数据也验证了这个方向——120 万次 Cowork 会话里，写代码只占 8.7%，占比最高的是对账、做报表这类业务流程。[4]

区别在于：Cowork 至今是付费功能，OpenAI 直接把 Work 放进了免费版。

## 二、GPT-5.6 的主叙事不是「更强」，是「更省」

OpenAI 这次在官方文档里开篇就把话挑明了：GPT-5.6 的目标是「每个 token 带来更多智能、更强的每美元性能」。

翻译成大白话：不是来跟你比谁更聪明，是来比谁更省钱。

Sol 与上一代 GPT-5.5 同价，但能力提升明显。第三方机构 Artificial Analysis 的评测显示，GPT-5.6 完成任务时消耗的 token 明显更少，推理 token 少得尤其夸张——「单位 token 产出的效率高得离谱」。

速度也是一个被低估的亮点：Sol 最高可达每秒 750 个 token，约合每秒 500 到 700 个汉字。这意味着思考和生成部分被大幅压缩，普通聊天场景下会带来明显的秒回感。[2]

三档模型的定位也很清晰：复杂任务交给 Sol，日常任务交给 Terra，高频轻量任务交给 Luna。不是所有事情都要请最贵的专家来做——一个足够稳定、足够便宜的模型，才是 Agent 工作流真正跑起来的关键。

同一天发布的 xAI Grok 4.5（输入 2 美元、输出 6 美元）和 Meta 刚推出的 Muse Spark 1.1（输入 1.25 美元、输出 4.25 美元），走的是同一条路。[2] 拼智商的边际收益在收窄，前沿模型的竞争正在从「谁更强」变成「谁足够强、足够便宜、能被大规模调用」。

## 三、企业级客户，才是这场战争的真正战场

GPT-5.6 的开放日期不是 OpenAI 自己定的。

6 月 2 日，特朗普签署行政令，要求 AI 公司在全面发布前向政府提供前沿模型做能力评估。6 月 26 日 GPT-5.6「发布」，但只向约 20 家报备机构开放。商务部下属的 AI 标准与创新中心评估了两周，7 月 8 日放行，才有了 7 月 10 日的全面开放。

引来审查的是 Sol 在网络安全和生物领域的能力。OpenAI 的系统卡片写得坦率：它能找到漏洞和攻击的「零件」，但在测试条件下没能自主拼出一条完整的攻击链。

管控也下沉到了产品层。部分 API 调用可能被拦截，甚至在生成到一半时被暂停。但 OpenAI 留了逃生门：在 ChatGPT 和 Codex 里，被拦下的请求可以一键换低能力模型重试。

Anthropic 这边也不轻松。几周前，Fable 5 和 Mythos 5 因一纸出口管制指令下架，Fable 5 已恢复，Mythos 5 至今只对一小批美国机构开放。

两家最头部的 AI 公司在同一个月内先后经历「模型做好了、但不能随便卖」——这不是巧合，更可能是新常态的开端。

而在中国市场，工信部 NVDB 已对 Claude Code 发布安全后门风险提示，阿里从 7 月 10 日起全面禁用 Claude。这意味着中国市场的 AI 编程工具格局，正在被重新定义。

三件事叠加在一起——GPT-5.6 全量开放、Anthropic 连夜应对、中国市场安全审查升级——结论不是「OpenAI 赢了」，而是企业级 AI 的竞争正在变成一场多维博弈：价格、合规、生态、地缘风险，每一项都比跑分更重要。

## 写在最后

GPT-5.6 这一波更新，表面看是模型迭代，底层是一场战略重组。

Codex 并入 ChatGPT，是入口收拢。三档定价压到竞品一半以下，是价格战。ChatGPT Work 免费开放，是用户基数扩张。每一步都指向同一个目标：把足够强、足够便宜、足够好用的 AI 装进尽可能多的人的桌面。

Anthropic 产品负责人那句「我闻到了恐惧的味道」——与其说是对 GPT-5.6 跑分的忌惮，不如说是对 OpenAI 这套「入口+定价+智能体」组合拳的警觉。

对普通用户来说，最实际的变化是门槛消失了。一个此前只属于开发者和重度付费用户的东西，一夜之间放到了所有人面前。打开那个 App，里面坐着的，不再只是一个会聊天的框。

真正的好戏才刚开始。

**下一期作者会出一个专业的测评，一起看看真实的GPT-5.6 表现。**

*参考来源：*

[1] 快科技/PChome，《GPT-5.6系列发布：Codex、ChatGPT Work智能体三合一》，2026年7月10日 

[2] 钛媒体/字母AI，《GPT-5.6全量放送，Codex正式并入ChatGPT》，2026年7月10日 

[3] github AI 讯息追踪项目 big_model_radar，2026年7月 

[4] 极客公园，《GPT-5.6 发布之夜，Codex/ChatGPT 合二为一》，2026年7月10日

*声明：本文基于公开信息整理分析，部分观点为作者个人判断，欢迎理性讨论。*