
OpenAI迎来"发布周":GPT-6 Sol疑似开启灰度测试、速度较Astra快约6倍,GPT-5.5将于10月14日全线退役
OpenAI产品负责人Tibo Sottiaux称"本周发布的产品和功能数量会达到DevDay 2025级别",CEO奥特曼随后预告本周有大版本发布、DevDay期间还有更多。多个信号指向GPT-6 Sol:有用户发现请求GPT-5.6 Sol时后台返回GPT-6 Sol(附"模型不一致"提示),测试者称其在强化学习投入极深、速度提升约6倍——同类SVG生成任务Astra需19分钟、Sol仅3分钟。ChatGPT官方宣布GPT-5.5将于10月14日起从ChatGPT、ChatGPT Work和Codex全线退役,建议迁移至GPT-5.6 Sol或GPT-6 Astra。此前一周OpenAI已密集推出Images 2.5、Agents API、GPT-Live-1、Data agent与金融行业版,Anthropic同期在Claude Code灰度测试Opus 5.2。DevDay定档9月29日。
【新闻原文】
9 月 15 日至 16 日,OpenAI 高层接连释放大规模发布信号。OpenAI 产品负责人 Tibo Sottiaux 在 X 上发文称:"本周发布的产品和功能数量,会达到你原本可能期待在 DevDay 2025 上看到的那个级别。"随后 OpenAI CEO Sam Altman 罕见地直接提前预告:"这周会有一个大版本发布,DevDay 期间还会有更多重磅发布。"末尾还附上了一排轮船表情,网友解读为"六艘船"暗示 GPT-6 Sol。
一个日常更新 Codex 动态的非官方账号说得更直接:GPT-6 Sol 很可能在本周四(9 月 17 日)发布,本周是个大周。不过这一消息尚未得到 OpenAI 官方确认。但灰度测试的信号已经出现——多名用户反映,自己请求的是 GPT-5.6 Sol,调用记录里返回的模型名称却变成了 GPT-6 Sol,旁边还挂着"模型不一致"的提示。中文社区也有同款报告,一位 V2EX 用户称通过反代账号调用时,使用记录里出现了请求 5.6 Sol、响应显示 6 Sol 的情况,评论区随后跟出一串"我也是"。
社区甚至玩出了一套自测方法:关闭联网,要求模型仅凭自身知识回答"最新的 Opus 模型是什么",如果答出 Opus 4.7,说明其预训练与后训练知识截止期被大幅刷新,极大概率已被悄悄接入测试池。
测试者们对 GPT-6 Sol 的描述集中在速度上。开发者 Chetaslua 表示,部分 5.6 Sol 的请求已经被路由到 6 Sol,"Sol 6 在强化学习方面投入非常深,效果很好,而且非常快",并称 OpenAI 在效率方面处于领先位置、与 Anthropic 的差距正在扩大。测试者 Lyra 记录了生成过程:Max 档位、一次提示、约 7.2 万 Token,耗时 9 分钟;而此前用 Astra 跑同类任务,同样 Max 档位、约 7.5 万 Token,耗时 26 分钟。另一组汽车绘图记录更直观——让模型用 SVG 代码画一辆宝马 M4 Competition,Sol 版本消耗约 2.8 万 Token、耗时 3 分钟,Astra 版本约 2.5 万 Token、耗时 19 分钟,速度提升约 6 倍。测试者 Lentils 展示了一片名为"The Realm of Aurellune"的体素世界,城堡、村庄、农田、河流构成完整场景,界面还配了缩略地图和控制项,Max 档位一次生成、耗时 15 分钟、总计约 6 万 Token。
从定位看,GPT-6 Sol 被放在 GPT-6 Astra 之下,类似 Anthropic 体系中 Opus 与 Fable 的关系:Astra 主攻极限能力突破,Sol 主攻"够聪明且足够快"的日常工程场景——代码补全、调试、文档生成、Agent 工作流。有早期测试者评价:"输出质量明显不如 Astra,但速度极快,而且似乎也是一个怪兽级模型。"
旧模型退役同步推进。ChatGPT 官方账号宣布,从 10 月 14 日开始,GPT-5.5 将停止在 ChatGPT、ChatGPT Work 和 Codex 中提供,所有套餐的用户都需要迁移到更新模型,官方建议切换到 GPT-5.6 Sol 或 GPT-6 Astra。这被外界视为为下一代模型腾位置。
密集的产品发布也在为这轮"发布周"铺垫。9 月 8 日,OpenAI 推出 ChatGPT Images 2.5,不仅更新了图像模型,还同时加入 Sketch、模板、图像评论编辑等一系列产品功能,API 端同步推出 GPT-Image-2.5 Flare 和 Sunburst 两款模型;9 月 10 日,OpenAI 在一天内连续推出 Agents API、GPT-Live-1、Data agent,以及面向金融行业的 ChatGPT for Financial Services,几项产品分别覆盖智能体基础设施、实时语音、企业数据分析和垂直行业应用。竞争方也在动:Anthropic 同期在 Claude Code 上灰度测试 Opus 5.2,有测试者称其"比 Opus 5 进步较大、速度也快,可以和 Astra 一拼"。
【企服观察】
这轮"发布周"里,对企业 IT 负责人最需要关注的不是 GPT-6 Sol 到底快了多少倍,而是那条看似不起眼的公告:GPT-5.5 将于 10 月 14 日从 ChatGPT、ChatGPT Work 和 Codex 全面下线。这意味着任何把 GPT-5.5 写进生产环境的企业,从今天算起只有不到四周的迁移窗口。模型换代正在从"技术事件"变成"项目风险",而多数企业的 AI 应用还没有建立与之匹配的版本管理机制。
先看迁移这件事的真实工作量。把 API 的模型名从 gpt-5.5 换成 gpt-5.6-sol,代码层面可能只要改一行;但真正耗时的是三件事:一是重新校准提示词,新模型对指令的敏感度、输出格式稳定性、长上下文处理方式都会变化,过去调优过的 prompt 大概率需要重跑;二是重跑评测基线,企业内部的准确率、召回率、格式合规率这些指标必须在新模型上重新测一遍,否则无法判断上线是否安全;三是复核成本模型,不同模型的输入输出计费单价、缓存策略、Token 效率都不同,财务口径要同步更新。以一个中等规模的企业 AI 应用为例,这三件事加起来通常需要 2 至 4 周——刚好用满 OpenAI 给的窗口,没有任何缓冲。
再看速度提升 6 倍这件事为什么重要。很多人把它理解为"体验更好",但对 Agent 类应用来说,这是经济性问题。一个需要多步工具调用、反复读取上下文、生成较长输出的智能体任务,在 Astra 上要跑 19 分钟、消耗 2.5 万 Token,在 Sol 上只需 3 分钟、消耗 2.8 万 Token。Token 消耗差不多,但墙钟时间砍掉三分之二。对按人天计费的服务型业务(如代运营、数据治理、代码审计),这意味着同样的人力可以承接三倍的业务量;对需要实时交互的场景(如客服辅助、现场工勘),这意味着从"不可用"变成"可用"。速度是 Agent 从演示走向生产的关键变量,比单纯的智能水平提升更有商业价值。
第三,OpenAI 这次真正值得企业关注的动作其实是 Agents API 和 Data agent,而不是新模型。GPT-6 Sol 只是把跑得更快这件事解决了,但企业要落地智能体,缺的是持久会话、上下文压缩、多智能体协同、沙箱执行这些基础设施能力。从产品线布局看,OpenAI 的战略重心已经从"模型更聪明"转向"模型能否真正完成复杂任务",这恰好是企业采购决策中最重要的那条标准。企业在做技术选型时,应该把"是否提供托管智能体运行时"和"沙箱与权限隔离能力"作为比模型跑分更靠前的评估项。
第四,Anthropic 同期灰度测试 Opus 5.2,两家在同一个周末被喊"刹车"、又在同一周开始灰测新模型,这个节奏对采购方是有利的。头部厂商竞争加剧意味着未来 6 到 12 个月模型单价会继续下行、能力迭代会更快。理性的做法是保持双供应商验证、把模型层做成可替换的抽象层,而不是在此时锁定长期独家合作。
最后给出三条落地建议:其一,建立模型版本台账,把每个生产环境使用的模型名、上线日期、评测基线、责任人登记清楚,并把厂商的模型下线公告纳入监控——这次 GPT-5.5 下线公告发出到实际下线只有不到一个月,留给企业的反应时间非常短;其二,为提示词和评测集建立版本化仓库,让"换模型"变成一次可回归测试的标准操作,而不是一次冒险;其三,对灰度期模型保持谨慎,社区已出现"请求 5.6 返回 6"的模型不一致情况,生产环境不要盲目切换到未正式发布的模型,即使它看起来更快。







评论
请评价真实、客观、有价值的内容请回复有价值的信息,无意义的评论将很快被删除,账号将被禁止发言。