抱歉,测完最新的 GPT-5.6 Sol,我又老老实实切回了 5.5...

抱歉,测完最新的 GPT-5.6 Sol,我又老老实实切回了 5.5...

文档更新 · 2026-07-135 min read
大家好!我是瓜哥。前互联网技术副总裁,现在带队死磕 AI 编程。

OpenAI 推了工具和模型更新,大家的 Codex 都能用上 GPT-5.6 系列模型了吧。

Codex 桌面版的模型列表里,依然出现最新的 5.6 系列模型。

Codex CLI(命令行)需要从先升级到 v0.144.1 版本,才能看到新模型。

code
npm install -g @openai/codex

版本升级后就能在 /model 里看到最新的 GPT-5.6 系列模型了。

v0.143.0v0.144.1

新鲜出炉的 GPT-5.6 Sol,咱也是用上了。

近期正在搓应用,我第一时间拿 GPT-5.6 Sol 跑了几个实测,最大的感受是:确实有点东西,同时 Token 消耗明显增加。

一起来看看,最新的 GPT-5.6 Sol 的实测表现。


01 | GPT-5.6 Sol 实测表现

这次 OpenAI 特别强调了,新模型在设计方面实现了质的飞跃。

一起来看下,到底怎么个事。

① 像素风格 Macbook

第一版,在不使用前端设计 Skill 的情况下的表现。

第二版,在借助 frontend-design skill能力下,增强了城市层次、动态交通、玻璃雨痕、桌面反射、金属材质、菜单栏、Dock和入场动画 。

图片已被安全策略阻止

总的来说,在纯 web 前端页面的设计上还可以,但算不上惊艳。

② MacOS 的桌面模拟器

可以看得出来 GPT-5.6 Sol,表现还是非常不错的。

接下来,我们来用经典的 SVG 项目,看一下代码绘图的能力。

③ 变形虫吞噬细胞

使用 React + Tailwind CSS 纯内联 SVG 编写一个 “微观变形虫吞噬细菌(Phagocytosis)” 的流体动画。

最后放到真实项目开发里,来看下考察下 bug 修复和功能开发。

④ Bug 修复

我正在开发一款名为 TpyeFlow AI 的内容创作平台,有一个文章配图功能,当前正在报错。

直接给错误代码,GPT-5.6 Sol 一把就定位到问题并完成修复。

02 | Token 消耗怎么样?

GPT-5.6 Sol,在评分上数值挺高的,但在 Token 消耗上表现更 “不错” 。

同一个任务,使用 GPT-5.6 Sol 会比使用 GPT-5.5 多消耗 2 倍的积分。

重度使用,明显感觉 Token 燃烧速度变快,有点顶不住。

做完测试后,我又老老实实的切回 GPT-5.5 了。

03 | 工具的最新变化

① 产品名真乱

昨天官方已经将 Codex 并入到 ChatGPT。我个人的感觉,OpenAI 是希望整合产品入口,形成一个产品通过不同模式来覆盖和满足不同用户的使用场景和需求。

今天又改回来了。

也不知道官方在想什么,来回在产品名称上折腾什么,产品名称上最忌讳的就是改来改去,让用户无所适从。

希望 OpenAI 把精力都放在产品能力打磨上,被在名称上搞来搞去了,哎...

② 最新的三种模式

  • Chat:简单问题,快速对话,一次性生成回复内容
  • Work:写文档、做表格、生成PPT、原型Demo
  • Codex:代码开发,包括Web全栈开发、小程序、App开发

③ 内置浏览器升级

  • 支持已认证站点
  • 支持多标签页
  • 文件下载

④ 输出前增强检测

在结果输出前,工具新增了一道 “自我检测”。

具体为更好的整合了 ComputerUse,能检查和完善渲染结果,在最终返回结果之前,会自查并优化收尾。

我在 Codex CLI 跑测试的时候,执行过程里看见它在截图检查,也就是除了原本的代码生成以外,它开始对生成结果进行 截图-识别-检查-优化

非常清楚的能看到,它在调用 playwright 截图,并识别图片确认结果。点击图片链接可直接打开 Codex 的截图,如下:

确实没吹牛,这一步,能有效提升任务执行的质量。

⑤ 新升级的 Chrome 扩展

据官方介绍对 Chrome 扩展进行了新的升级,我装上了,还没深入使用,回头再来跟大家汇报。

⑥ 其他升级

  • 支持直接编辑文件,包括MD文档和代码
  • 应用内可查看和审查PR
  • 全新的 Ultra mode,处理最复杂的任务
  • 升级后,可保留 Codex 图标

04 | 写在最后

面对一波 OpenAI 的工具更新和模型更新,老实说并没有太大的惊喜感。

工具层面,最大的变化是做了入口整合,将 Codex 整合到 ChatGPT 里,说实话有点不习惯。今天升级一看又改回来了,真不知道是在干啥呢。其他的一些能力升级,也都是优化层面的,并没有突破性的新功能。

模型层面,就我个人目前体验来说,我会更注重在模型能力和 Token 消耗的平衡。当前对我来说,GPT-5.4,还能再战 3 个月。

喜欢最新 GPT-5.6 系列,Token 无限的土豪们,可以尽量烧起来了。

你觉得最新的 GPT-5.6 系列,好用不?

评论区

暂无公开评论

还没有公开评论。

提交反馈

图文抱歉,测完最新的 GPT-5.6 Sol,我又老老实实切回了 5.5...

请等待管理员审核,通过后将显示在评论区。

0 / 500