GPT-5.6 上线,Codex 并入 ChatGPT:实测好用的点和坑

GPT-5.6 一口气发三款模型(Sol/Terra/Luna,命名对标 Claude Opus/Sonnet/Haiku),Codex 正式并入 ChatGPT 变成 Work/Codex 双模式;作者实测总结出模型档位选择建议,并从 PM 视角提炼”模型从卷参数变成卷完成任务和性价比""做产品要借用认知而非创造认知”两个判断。

基本信息

  • 来源类型:文章(人人都是产品经理)
  • 原文位置:raw/articles/2026-07-14-120644-tg-98c230.md
  • 原文 URLhttps://www.woshipm.com/it/6428459.html
  • 作者:AI产品经理四月(十年产品,专注 AI Agent 智能体)
  • 发布日期:2026-07-13
  • 消化日期:2026-07-14

核心观点

  1. GPT-5.6 一次上线三款模型,命名对标 Claude 家族:Sol(太阳,旗舰型,性能最强,解决难题/复杂开发)、Terra(地球,均衡型,日常办公提效)、Luna(月亮,轻量型,高频重复任务/图快图便宜)。命名逻辑与 Claude 家族 Opus/Sonnet/Haiku 高度相似。单从数据看 GPT-5.6 Sol 各项都很强,作者称”基本已经超过 Fable 5”,且官方定价”比 Fable 5 便宜一半”。

  2. Codex 正式并入 ChatGPT,界面变为 Work/Codex 双模式:更新后 Codex “变成了 ChatGPT”,连 logo 都变了(可勾选保留 Codex 应用图标)。客户端左上角新增 Work 和 Codex 两种模式切换,网页端也新增 Work 模式。Work 面向日常办公提效,Codex 更面向开发(写代码、编程项目),界面区别不大,主要引导不同使用场景。

  3. 推理强度只需开到”高”就够用,“极高”才会先规划确认:GPT-5.6 比 5.5 强很多、速度也快,推理强度开到”高”就挺好用。“极高”以下它干活基本不跟你确认、直接开干;开到”极高”会先思考规划、跟你确认再一步步执行——代价是更费 token、更烧套餐额度。

  4. 新增”站点(Sites)“:一句话生成网页并部署发布:让它整理收集一批信息就能做成网页,直接部署到 OpenAI 自己的服务器并分配域名,把链接发出去别人就能看到。分析数据、分析用户评论都能这么干,最后给一个可交互页面。对不懂技术的人非常友好。缺点是设计审美没啥提升。

  5. 坑:顶配烧额度极猛 + 触发审核会清空上下文:Sol 的”极高(Ultra)+ 快速”模式烧额度很猛,Pro 套餐实测 3 分钟烧掉 20% 的 5 小时额度。模型能力越强越容易撞审核机制,一旦触发要么干等要么切模型;而切换模型会导致之前做的东西全部清零、从头再来。

实操内容保留

模型档位选择建议(作者踩坑后总结)

  • 日常办公、普通任务 → 选 Terra + 高,就够了
  • 稍微复杂点的任务 → 开 Sol + 高,就行
  • 做大型、复杂的开发 → 才值得上 Sol + 极高(更快消耗使用额度 Ultra)+ 快速

网页聊天与客户端双向打通用法

  • 原来 Codex 里的”项目”和”对话”,现在”对话”改成了”任务”,又把网页版 ChatGPT 的”对话”搬进来叫”聊天”
  • 开干之前先用”聊天”(像平时用 GPT 一样搜索查资料、整理内容、分析文档);等真要做图表/海报/写代码/做网站,再把它添加进任务,节省消耗 Codex 额度
  • 跑任务过程中遇到不懂的,可直接选中内容点”更多详情”,用”聊天”解答,不耽误执行任务
  • 官网明确提示:用量不包括 Chat 对话(即原来的网页聊天),聊天额度不与任务额度共用
  • 当前不完善:点”聊天”弹窗浮在 Codex 界面上,聊完文件还下载不了,得回网页去下

预览区可编辑

  • 原来 Codex 预览区不能编辑;更新后生成的代码、Markdown 都能在预览区直接改,不用切到别的编辑器。生成产品需求、操作手册等文档后可就地修改。

关键概念

  • GPT-5.6 — 本文主角,OpenAI 新一代模型家族(Sol/Terra/Luna 三档)
  • Codex — 从独立产品并入 ChatGPT,成为客户端的 Codex 模式
  • ChatGPT — 合并后新增 Work/Codex 双模式与”站点”能力
  • Fable 5 — 作者用作 GPT-5.6 Sol 的性能/定价对标标杆
  • 借用认知 — 作者从 Codex/ChatGPT 合并中提炼的产品方法论(借势而非教育用户)
  • AI商业化趋势 — 模型竞争焦点从”卷参数”转向”卷完成任务和性价比”

与其他素材的关联

原文精彩摘录

Sol 的「极高(更快消耗使用额度,也就是官方说的 Ultra)+ 快速」模式烧额度是真的猛,我开着 Pro 套餐实测,3 分钟就烧掉了 20% 的 5 小时额度,看得我心疼。

你有没有发现,现在的模型发布几乎不怎么提参数了?也没人专门记参数。不是参数不重要,是它不再是「叙事的重点」。现在大家比的是「能完成什么任务、花多少成本」……Agent 时代,比「谁最强」更重要的,是「谁够用、够便宜、能被大量调用」。

Codex 再火,今年 6 月的周活也就 500 万左右;而 ChatGPT 光每周活跃用户就有约 9 亿……OpenAI 干脆不去教育用户认识「Codex」,而是把它并进大家早就熟悉的 ChatGPT,让老用户自然发现「原来还能这么用」。这让我想起金枪大叔在《借势》里写的:不要创造认知,要借用认知。

相关页面