再见Fable 5,OpenAI出手了!GPT-5.6真香~

作者:AI袋鼠帝日期:2026/7/10

大家好,我是袋鼠帝

我最近在疯狂使用Fable 5,好用是好用,就是太贵啦!

不过不是在Claude 官方使用的,因为我最新的一个号,在7月1号又tm被封了,服了都(已经记不清是第几个了)

天下苦A社久矣..

所以,我最近都是在Cursor上用的Fable 5,虽然我下血本充了200$的订阅,但跑了两天Fable 5,总用量就已经超过48%了。。。

整的我都有点不敢用了,除非核心任务,其他时候我都只敢开启auto模式(自动选择模型)

就是这么憋屈。

然后今天凌晨,OpenAI终于出手了!

GPT-5.6,正式发布。

*我都好久没有熬夜跟模型了,但这次的GPT-5.6直接给我看兴奋了。
*

我看完官方blog的数据,笑出了声🤣

Fable 5,可以跟你说拜拜了👋

PS:OpenAI太良心了,本来这周我Codex Pro额度昨天都没了,发布新模型,又给我重置额度了,爽!!

**GPT-5.6有多强?
**

这次的GPT-5.6模型,OpenAI在6月就开始小范围发布预热了,不容小觑,感觉不是小更新。

三个模型:Sol(旗舰)、Terra(均衡)、Luna(最便宜)

先说下跑分吧,直接上数据。

Agents' Last Exam,这个测的是55个专业领域的长链路任务。GPT-5.6 Sol拿了53.6分,Claude Fable 5是40.5分。

Fable 5差了13分。

这不是以前挤牙膏式的小超越,是直接打穿了那种!

而且Sol在medium推理模式下就已经超过Fable 5了,成本大概是它的四分之一。

编程能力更夸张:

Artificial Analysis Coding Agent Index,Sol拿了80分,Fable 5是77.2。

看起来差距不大对吧?但Sol的token用量只有Fable 5的一半,完成时间也只有一半,价格还便宜三分之一。

Sol干得更好,还更快更省~

Terminal-Bench、DeepSWE这些测真实代码库的长链路工程任务,Sol也全是新的最高分。

然后我又翻了其他方向:科研、网络安全、浏览器任务、电脑操作。

基本上每个类别,Sol要么是第一,要么接近第一,而且几乎都是用更少的token、更短的时间做到的。🐂🍺

说实话,以前每次OpenAI发新模型,我看跑分表总有几项被Claude压住。

但这次翻了一圈,Claude Fable 5能赢的地方真的不多了🤔

**GPT-5.6做真实产品怎么样?
**

除了跑分,我们还是得看实际用起来怎么样。

Lovable应该不少人用过吧,就是那个AI建站工具。

他们联合创始人表示:GPT-5.6接进去之后,用户构建应用的步骤少了25%,工具调用少了35-48%,卡住的情况减少了15%。

Qodo做代码审查的,他们测下来GPT-5.6是最强的code review模型,token用量比GPT-5.5少了3倍,响应延迟降了一半。

**设计能力终于提升上来了
**

之前GPT-5.5,总是听见朋友们都在吐槽,诟病它的前端审美太烂了。

但这次GPT-5.6的前端和设计能力让我比较意外。

我翻官方Demo的时候看到几个作品:

帆船游戏、博物馆网站、钟表村庄游戏、室内设计展示。全都是只给了一句Prompt生成的可交互作品。

而且,它不只是生成代码就完事了。

它还会用computer use去看渲染出来的实际效果,发现视觉问题或交互bug会自己修。

在新出的ChatGPT Work(其实就是在codex里面加了个work模式)里面,它还能直接生成交互式可视化,螺线图、波干涉模拟、tokenizer原理解释器这些,效果挺nice的。

注意,这是在对话框里面直出的哦,过去都是在右边预览。

这个交互方式,还是第一次出现吧🤔,挺新颖的。而且效果确实挺好,也更方便了,估计很快各大agent都会跟风。

不过GPT-5.6生成的PPT依然很丑:

做PPT大家就可以完全不用考虑GPT-5.6了。

不过虽然样子很丑,但貌似抓数据啥的挺准的,可能国外注重数据/展示,也不在乎PPT好不好看吧。

**价格如何?
**

这才是重头戏。

GPT-5.6的这三个型号:Sol(旗舰)、Terra(均衡)、Luna(轻量)。

定价是这样的:

Sol:5输入/5 输入 / 5输入/30 输出(每百万token)

Terra:2.50输入/2.50 输入 / 2.50输入/15 输出

Luna:1输入/1 输入 / 1输入/6 输出

Terra和Luna有多🐂🍺呢?OpenAI原话是这样说的:

Terra和Luna在某些评测上打过了Fable 5,但成本大概是它的十六分之一。

十六分之一!!

用过Fable 5的人应该都能体会这几个字的分量。

我之前在Cursor上跑两天就烧掉48%额度,总感觉后续使用起来束手束脚的,如果切到Terra或者Luna,直接可以爽用了。

说真的,性能强于Fable 5,价格又比它便宜,还更快,而且更容易用上。

应该没人会用Fable 5 了吧🤔,欢迎评论区聊聊,发表一下你的看法。

**怎么用上?
**

ChatGPT Plus和Pro用户今天就能用GPT-5.6 Sol了,medium及以上effort设置就行。

如果你用API,三个模型今天全部开放。

ChatGPT Work和Codex里面,Free和Go用户默认用Terra,Plus以上的可以手动切Sol、Terra、Luna,还能调effort级别。

还有个ultra模式挺有意思,它会同时跑4个agent并行处理,适合特别复杂的任务。

Pro和Enterprise用户可以用。不过还没体验,这个我打算后面单独写一篇聊,今天先不展开。

**「最后」
**

以前我在Claude和GPT之间来回横跳,说到底是因为GPT不够争气,很多场景下确实是Claude更好用。

但GPT-5.6这次,性能全面超了,价格还便宜这么多。

感觉这把OpenAI是把Anthropic按在地上摩擦了

其实我更希望OpenAI的模型远超Anthropic的,让A社封闭去吧。

欢迎有实测GPT-5.6的朋友在评论区交流一下感受~

困了🥱,睡觉💤,明天见。

我是袋鼠帝,一个致力于帮你把AI变成生产力的博主。我们下期见~*
*

能看到这里的都是凤毛麟角的存在!

如果觉得不错,随手点个赞、在看、转发三连吧~

如果想第一时间收到推送,也可以给我个星标⭐

谢谢你耐心看完我的文章~


再见Fable 5,OpenAI出手了!GPT-5.6真香~》 是转载文章,点击查看原文


相关推荐


从零构建ReAct智能体:让AI学会边想边做
树獭非懒2026/7/2

前言 大语言模型已经能写诗、编程、做数学题,但它有一个根本性的短板:无法与外部世界交互。你问它"今天深圳天气怎么样",它只能诚恳地告诉你"我的知识截止到某某日期"——不是它不想回答,是它根本没有"看天气"这个动作能力。 这就是智能体(Agent)要解决的核心问题:让 LLM 不仅能想,还能做。 业界现有的智能体框架(LangChain、LlamaIndex 等)已经将这套机制封装得非常完善,但它们的高度抽象也让很多人停留在"调包侠"阶段,对背后的运行机制一知半解。本文的目标,是带你从零构建一个


Swift 还让你 Excited 吗?-- 肘子的 Swift 周报 #141
东坡肘子2026/6/23

Swift 还让你 Excited 吗? 上周,Reddit 上一篇题为《Is anyone else excited by Swift progress as the language?》的帖子引发了不少讨论。WWDC 2026 上,Apple 明确表示,Swift 已被用于 WebKit 关键组件、QUIC 网络栈、字体渲染、驱动与固件。发帖者据此认为,Swift 正在向核心操作系统内核迈进,并将这一幕视为 2014 年"高级系统编程语言"承诺的兑现。评论区的讨论则很快从“是否兑现了承诺”,


别再让业务层裸奔 CarPropertyManager 了!谈谈汽车车载核心服务的架构封装
潜龙勿用之化骨龙2026/6/15

前言 Android Automotive 项目中,CarPropertyManager 几乎是访问一切车辆状态的入口。但在真实项目里,如果直接在 ViewModel 或业务层大量使用它,代码会变得难以维护、难以测试,也完全不符合 现代Android 架构 的分层思想。 本文将从零开始,梳理一套基于 Clean Architecture 的 CarPropertyManager 封装方案,涵盖: 为什么不能直接用 如何用抽象基类统一封装 callbackFlow 的正确姿势 Flow 与 su


「装闭」-AI驱动的开源装修闭坑系统
fthux2026/6/8

愿每个业主在装修路上心中有数,于是,「装闭」来了。 装修行业的水有点儿深 很多人装修完回头看,都发现自己花了不少冤枉钱。设计师画的效果图美轮美奂——复杂吊顶、满墙背景墙、开放格书架……装好以后才发现,这些东西费钱不说,日常打理还特别费劲。吊顶积灰、开放格藏污纳垢、花哨灯带一年到头开不了几次。 更别说合同和报价单里的猫腻。增项漏项、模糊工艺描述、虚报材料数量——这些套路装修公司玩得轻车熟路,但普通业主根本无从分辨。随便一个增项,几千块甚至上万块就多出来了。 于是就有了「装闭」(RenoPit)这


译 · Jake Wharton 访谈:Android 圈最熟悉的那个名字
bqliang2026/6/1

Jake Wharton 是我的偶像,也是很多 Android 开发者绕不开的名字。Retrofit、OkHttp、Dagger、Ktx... 这些项目或多或少都影响过我们写 Android 的方式。 前几天在网上看到他的这篇访谈,读完觉得很受用。里面既有他早年做 Android、做开源的经历,也有他对职业选择、会议、倦怠、家庭和工作方式的很多真实想法。这里把它翻译成中文,分享给同样喜欢 Android、Kotlin 和开源的朋友们。 ⚡️ 欢迎来到 Effective Interviews


从 textarea 到 AI 输入框:用 Tiptap 实现 / 命令、@ 引用和结构化请求
倾颜2026/5/11

本文对应项目版本:v0.0.12 在一个 AI 应用刚开始做聊天功能时,textarea 往往已经够用了。 用户输入一段自然语言,前端把它发给后端,后端拿到消息数组,模型开始生成回答。这个链路简单、直接,也足够支撑最早期的问答场景。 但当项目里慢慢出现 Skill(任务能力层)、Tool(可执行工具)、Resource(可读取上下文)、Prompt(可注入模型的提示模板)、MCP 能力(通过 MCP 接入的外部能力)之后,我开始遇到一个更具体的问题:用户输入不再只是一段自然语言。 它开始同时表


解决 4 大 AI 编码痛点:Matt Pocock 的 Skill 工作流深度拆解
小碗细面 VIP.5 如鱼得水2026/5/1

解决 4 大 AI 编码痛点:Matt Pocock 的 Skill 工作流深度拆解 当所有人都在用 AI 写更多代码的时候,TypeScript 之神 Matt Pocock 把自己的 .claude 目录直接推到 GitHub 上,告诉我们:先别急着 vibe coding,把工程基本功捡回来。 一、写在前面:一个让人拍大腿的开源项目 2026 年 3 月,TypeScript 社区的"老熟人"Matt Pocock(你大概率在他的 Total TypeScript 课程下面留过言)干了


Android Studio 项目模板完全指南
90后晨仔2026/4/22

本文将详细介绍 Android Studio 中创建项目时的各种模板选项,帮助你快速选择最适合的项目起点。一个小白的自学成长之路 一、设备类型分类 首先,左侧列表显示了不同的设备平台: Phone and Tablet:手机和平板应用(最常用) Wear OS:智能手表应用 Android TV:电视应用 Automotive:车载应用 二、Phone and Tablet 模板详解 1. No Activity 含义:创建一个没有任何活动(Activity)的空项目


【Ollama本地大模型】性能优化思考
盛世隐者2026/4/13

文章目录 1. 硬件配置与模型选择2. 模型参数配置🧠 参数详解:为何这样配置你的10核+8GB显存 3. 本地API调用3.1 模型驻留⚙️ 工作原理🛠️ 配置方式💡 实用技巧💡 最佳实践与注意事项 3.2 流式输出🔌 原理:它是如何工作的?⚖️ 场景与效果对比⚙️ 默认行为与语言SDK差异🛠️ 实际应用示例1. 流式 (`stream: true`)2. 非流式 (`stream: false`) ✨ 高级特性:工具调用与思考过程💡 最佳实践 3.3


JVM学习问题记录(2) jps命令无法识别
Engineer邓祥浩2026/4/5

现象: 命令行输入jps命令,提示"jps不是内部或外部命令,也不是可运行的程序" 背景: 学习JVM,测试jdk自带性能分析工具,需要用到jps工具 思路: 先怀疑自己 可能的原因 JDK安装有问题,无jps.exe环境变量设置问题,找不到jps.exe 动手: 去JAVA_HOME配置的查看,发现jps.exe在,用绝对路径执行是正常的查看环境变量,JAVA_HOME和path配置也是正确的,echo结果也是对的 这里就感觉很奇怪,而且试了下javac命令是正常的,那也不是路径配置问题,这里

首页编辑器站点地图

本站内容在 CC BY-SA 4.0 协议下发布

Copyright © 2026 聚合阅读