GPT-5.6 上周正式发布,OpenAI 官方说这是史上最强的模型。 但用户的反应可以用两个字概括,骂声一片。 推特上、AI 评测圈里、各种 chatgpt 交流群,到处是吐槽帖。 这事有意思的点在于,一个技术如此领先的模型,为什么能让这么多人同时不买账。
先说性能。 GPT-5.6 在 SWE-bench 编程评测上拿了 78.3 分,刷新了所有模型纪录。 在 GPQA Diamond 博士级问答上拿 81.5 分,在 AIME 2025 数学竞赛上拿 95.2 分。 这是真实进步,不是发布会 PPT。
但用户感受恰恰相反。 因为 OpenAI 这次在产品策略上做了几件让人难受的事。 一是把上下文窗口从 40 万砍到 20 万,理由是大部分用户用不到那么长。 二是把 o 系列推理模型统一并到 GPT-5.6 里,取消了独立 o3 pro 订阅。 三是价格涨了 30%,Plus 用户从 20 美元涨到 26 美元,Pro 从 200 涨到 260 美元。
这三个调整踩到了三类不同用户的痛点。 上下文窗口对长文档处理、写代码库的开发者是核心需求,砍半等于逼他们跑路。 o3 pro 取消对需要复杂推理的企业用户是直接打击,以前一天用几百次的研究机构,现在要切换到 5.6 但效果没有显著提升。 价格涨 30% 对学生和小型创业者最敏感,这个群体本来就是用 ChatGPT 做副业、写论文的。
深层的问题在于,OpenAI 在 AGI 叙事和商业化叙事之间打架。 每次发布会都说更强更接近 AGI,每次商业打法都是涨价、砍功能、绑定生态。 当一家公司既要说自己代表未来,又要确保 ARR 增长 50% 以上,产品策略就必然拧巴。
竞争对手的反应非常快。 Anthropic 在 GPT-5.6 发布后 48 小时内,把 Claude 4 Sonnet 价格降了 20%,并把上下文窗口从 32 万升到 50 万。 Google 那边 Gemini 2.5 Pro 借着这股风,直接给免费用户开放 100 万上下文。 这两家加起来,等于把 OpenAI 的护城河悄悄拆掉了一段。
GPT-5.6 的实际使用体验怎么样,看不同人群反馈。 一个有意思的数据点,OpenAI 自己披露的 5.6 用户留存,周活用户相比 5.2 版本只涨了 4%。 但 5.2 当时是涨了 18%。 这个差距说明,即使新模型更强,愿意继续用的人并没有显著增加。 这是个非常危险的信号,因为 AI 产品的护城河其实是用户习惯,不是参数规模。
对企业采购方来说,这次产品调整带来的最大变化是合同谈判筹码变了。 以前企业客户跟 OpenAI 谈年框,OpenAI 处于强势方,价格没空间。 这次涨价后客户集体反弹,有的把合同期从 3 年降到 1 年,有的把采购份额分给 Anthropic 和 Gemini。 一个朋友在一家上市 AI 公司做采购,他跟我说他们已经把 OpenAI 的预算砍了 40%,转给了 Claude 和开源模型。
OpenAI 这种公司到了一定体量,产品和商业策略反而是最难的题。 模型继续变强,但用户的体感是负担变重。 研发投入每年翻倍,但产品能讲的故事越来越少。 当一家公司从快速迭代变成巨头,它的产品打法就得从技术驱动转向用户驱动。 OpenAI 这次踩的坑,根源是它还没完全接受自己已经是个巨头的事实。
如果你是 AI 应用的开发者,这件事带来的直接提醒是,不能把身家性命压在一个 API 上。 自变量机器人这一波融资之所以能拉到 200 亿,核心就是它强调通用大脑,意味着不依赖任何一家模型公司的接口。 GPT-5.6 这次调整后,这种去 OpenAI 化的趋势只会越来越强,后面会有更多大客户同时接入 3 家以上模型 API 做冗余。 这是个新趋势,值得关注。 |