OpenAI 年度发布会最全总结:25 个新品很夯,但额度减半拉爆了

产品

1 小时前

在实力至上主义的 AI 圈,用户口碑只看产品能力和性价比。

所以,随着这几天能力拉爆一切的 Opus 5.5 和 Sonnet 5.5 上线,Anthropic 那一厢可以说是勃勃生机万物竞发;而面临着压力的 OpenAI 最近又开始了谜语人模式,各种语焉不详的推文大意就是:「到 DevDay 看我们怎么还击!」

Image

今天凌晨,OpenAI 一年一度的开发者活动 DevDay 2026 终于到来。相比起往年只是不咸不淡地更新 API 和开发工具, 今年 DevDay 确实是量大管饱,合共带来了 20 多项功能和产品更新。

Image

新模型、新的人机协作方式、新的模型速率和套餐额度……总的来说,坐拥 12 亿周活跃用户的 OpenAI,正在尝试把自己的生态打造成一座完整的「在线办公室」,让你从早到晚都待在里面。

AI 员工上岗,入驻 AI 办公室

在这场「报菜名」发布会上站在 C 位的,是新产品 dots。

Image

简而言之,它是一个 24 小时在线的智能体助理,由 GPT-6 Astra 驱动,就像真正的同事一样自带云端电脑、工作环境和浏览器(当然你也可以让它操作你的工作环境),在你不看它时也继续干活。

Image

举个例子:假设你正在筹备一场产品发布会,在你下班期间,同行突然发布了一款很不错的竞品,直接影响到了你的产品卖点。这时候,你可以给自己的 dot 打个语音电话,让它加班重新梳理产品定位、修改发布会物料。

第二天上班时,你就能收到它整理好的新发布计划和物料。

Image

我们知道,好产品都是相似的。Dots 有 Grok Bot 的萌萌大眼睛,也支持像自定义 Muse 一样,由你来修改 dot 的外观和名字,什么三角饭团、画家帽云朵或大眼青蛙随你设计,让 dots 更像你的专属小跟班。

Image

靠着积累已久的插件生态,dots 还可以操作 Slack、Teams、Notion 和邮件、短信等超过 4000 个应用,也因此变得更加「全能」。

Image

在你不找它的时候,dots 也会通过「主动研究」自己找活干,比如遍历整个工作流,主动提醒你有疏忽忘记的工作。

当然,OpenAI 显然也知道,把一个有能力控制系统、掌握密码、还喜欢趁你不在时自己找事做的 AI 放进公司有多危险,因此给 dots 添加了 Custom Rules、权限控制和自动操作审查,确保它们不会滥发敏感信息或错改密码。

Image

针对企业需求,OpenAI 还推出了 Specialist dots。这是一种由公司统一配置的 dots,各自分配了特定的身份、权限和凭证,像高度专业分工的虚拟同事一样,在组织里承担专门的职责,如法务和会计工作。

Image

Dots 目前首先向 ChatGPT Pro、Business Premium 和 Enterprise 推出,Pro 和 Business Premium 套餐包含一只免费的 dot,而且和 dot 聊天本身不消耗普通 ChatGPT 额度——

但如果想添加新的 dot,或是让它调用 Codex 或 ChatGPT Work 干活,还是要乖乖花钱。

有了 dots 这些「员工」,没理由不让它们和你身处同一个环境工作,于是 ChatGPT Space 应运而生。

Image

ChatGPT Space 包含了几种协作功能。比如「动态页面」体验类似于飞书文档,能与同事、ChatGPT 和 dots 一起编辑页面,@一下 dots,它们就能开始动手修改文档或实时更新最新信息。

Image

类似地,在「协作式幻灯片」里,整个团队也可以和 dots 一起做幻灯片,每个人都能在线评论想修改的地方,dots 负责一一实现。并且,只要创建项目的人有 ChatGPT 会员,其他人没会员照样可以评论。

Image

Business 和 Enterprise 用户还可以建立团队、共享任务,把「每周一整理项目进度」这种活交给 ChatGPT。任务可以设置定时触发,也可以是在「收到一封邮件」「Slack 来了一条消息」等条件触发时自动开始。

Image

另一方面,开发者最爱的 Codex 也进一步搬进云端。

Sam Altman 在演讲里首先揶揄了一下用 Codex 不敢关笔记本盖子的现象,然后宣布:这种现象从此要作古了。

Image

现在,你可以在任意设备上操控云端运行的 Codex Cloud,而且这个云端开发环境可保留、可复用,不需要每次都重开项目,甚至整个团队共用一套配置、一个环境也不在话下。

打通各个平台的进程也还在继续。Sam Altman 宣布,未来用户可以直接用 ChatGPT 账号登录 Notion 等第三方应用,并消耗原有 ChatGPT 套餐里的额度来使用这些产品,从而降低体验不同产品的成本。

Image

GPT-6.1 Sol:Astra 五分之一价格,够用吗?

讲完以上功能,OpenAI 还意外地发布了一个新模型:GPT-6.1 Sol。

Image

Gemini 此前六周发布三个模型已经足够快了,但 OpenAI 再一次打破了这个记录——距离 GPT-6 Sol 发布只过去了 7 天时间。

前沿模型更新速度从此进入按天计算的时代。

产品狂潮也让 OpenAI 吃了一些苦头:由于在举行发布会的同时,GPT-6.1 Sol 和 bots 等新产品正在推送,巨大的服务器压力导致直播画面一时卡成 PPT,连现场演示也因为服务宕机频频翻车。

Image

言归正传,GPT-6.1 Sol 未命中缓存的 API 价格仍是每百万 token 输入 2 美元、输出 10 美元,和上一代 GPT-6 Sol 保持一致(亦即 Astra 的五分之一),但缓存输入价格比起上一代减半,来到了每百万 token 0.1 美元。

Image

考虑到 Agent 工作会频繁读取缓存,命中缓存价格下降 50%,在实际的多步 Agent 工作流中降本效应可能会相当明显。

能力方面,官方定调是:以五分之一的价格,获得接近 Astra 的智能水平。

在评估复杂软件工程任务的 DeepSWE v1.1 上,GPT-6.1 Sol 的成绩反超了 Astra 一个百分点,而完成任务成本仅需 0.65 美元,远低于 Astra 的 4.43 美元。

Image

在 OSWorld 2.0 电脑操作任务上,6.1 Sol 成绩比 6 Sol 高 7%,离 Astra 只差 2.1%,每个任务的成本大约是 Astra 的七分之一。

Image

而来到 GDP.pdf 这类复杂专业 PDF 任务,它的成绩高于带回退机制的 Claude Opus 5.5,单任务成本不到后者一半;至于多步骤业务流程测试 AutomationBench,中等推理强度下 6.1 Sol 成绩比 Opus 5.5 高 2.2%,成本大约只有三分之一。

Image

换句话说,尽管发布时间只相隔一周,但 6.1 Sol 和 6 Sol 的性能差距,可能堪比 Claude Sonnet 5.5 和 Sonnet 5 的差距,也更让人怀疑此前的 6 Sol 是不是本质 Terra。

正如官方一再强调的,GPT-6.1 Sol 的最大竞争力在于价格:在同一个测试中,GPT-6.1 Sol 每项任务平均成本约 5.47 美元,Opus 5.5 是 23.21 美元,Astra 是 23.80 美元。

Image

说到底,OpenAI 就想告诉大家一件事:Opus 虽好,但不能贪杯,还是不如便宜大碗的 Sol 啊!

目前 GPT-6.1 Sol 已经向 Plus、Pro、Business、Enterprise 和 Edu 用户推送,API 同步开放,但仅限 ChatGPT Work 和 Codex,普通聊天里暂时还用不到。

飞一般的速度,代价是额度缩水

有了「更高」和「更强」的产品,怎么能没有「更快」呢?

于是,Decisions API 正式公布,基本就是此前大热的 Jev 的复刻版:开发者先预设几个选项,输入材料,Decisions API 就能用定制版的 Luna 模型快速分类、请求路由,或决定 Agent 的下一步工作。

Image

在官方公布的案例里,Decisions API 在 150 毫秒内就能输出结果,而通过 API 调用的标准 GPT-6 Luna 是 1.6 秒,前者大约快了 10 倍。在大量的重复性工作中,这个时间差会累积成巨大的效率差距。

另一方面,GPT-6 Astra 也迎来了 UltraFast 模式,在 API 可实现 6 倍输出速度,Codex 更是能做到 8 倍速,达到每秒 300 个 token。GPT-6.1 Sol 稍后也会支持这一速度档位。

Image

快是要加钱的。Astra 现有的 Fast 模式大概是以 2 倍价格换取 2.5 倍速度,而根据 The Decoder 报道,UltraFast 模式的 API 价格大约为标准价的 6 倍,对应到 Astra 模型就是每百万 token 输入 60 美元、输出 300 美元。

至于普通 ChatGPT 订阅用户要想用上 UltraFast 模式,只能订阅最新推出的 Pro 500 会员套餐档位。

顾名思义,Pro 500 月费高达 500 美元,亦即目前 Pro 分为 100、200 和 500 美元三档,每档都包含一个免费的 dot,但只有 500 美元的最高档位支持 UltraFast 模式。

Image

OpenAI 也趁此机会重新开放了此前暂停近三周的 Pro 200 会员订阅,但随之而来的是一个坏消息:新的 Pro 会员额度相比原来减少了一半。

具体来说,新的 Pro 100 额度只有 Plus 会员的 5 倍,而 Pro 200 额度也从 20 倍降至 10 倍,现有存量用户的双倍额度到 10 月 29 号也会失效。仅有的补偿,是取消 5 小时使用限制。

新政策上线之前,Tibo 就在 X 上解释称未来模型会继续降价,即使额度缩水了,能完成的工作依然比之前更多。但这个说法观感就像是运营商说「5G 网速更快,所以我要把你套餐流量砍一半」,很明显难以服众。

Image

更可能的原因是,OpenAI 正在朝着企业服务的方向倾斜,而过去量大从优地补贴个人用户订阅的做法自然难以为继。

如果从头到尾看完整场 DevDay 发布会,你会发现,看似混乱的新品堆叠中其实暗藏着一条主线——

ChatGPT 正在变得越来越像一种 SaaS 服务。

如果说过去用 AI 的方式是不断开启「新对话」,那如今 OpenAI 想做的显然是把它替换成一种「持续存在的工作关系」。

这一变化,瞄准的是企业市场。

上个月,知名科技分析师 Ben Thompson 在播客中谈论 OpenAI 的商业化进程时,特意举了 Dropbox 花两年时间为企业用户重构客户端的案例:消费端产品可以带来巨大的知名度和用户规模,但真正稳定、高价值的商业模式,往往还是要回到企业客户、组织部署和工作流。

Image

在这方面,Anthropic 已经是先行者。

据路透社披露,去年 Anthropic 超过 30 万企业和商业客户贡献了大约 80% 的收入,Ramp 的企业支出数据也显示 A 社一度拿走了全球 73% 的新增企业 AI 客户支出。

Image

正是在企业市场的「弯道超车」,让 Anthropic 率先实现了季度盈利,最新估值已经逼近 2 万亿。

相比之下,ChatGPT 已经拥有 12 亿周活用户,消费者心智几乎无人能敌,但怎么把这种知名度转化为营收、向市场证明其商业模式拥有自我造血能力,是 OpenAI 在上市前必须解决的问题。

Image

另外,结合当下每家模型你来我往、各自领跑数周的情况,我们大可以认为:没有任何一个模型能在能力上领先竞品超过半年。

这也代表着,单纯依靠模型能力上的优势来构筑护城河已经不是一种可行的商业模式。

以后的 AI 厂商要想保持用户粘性,就必须重注项目、Agent、权限管理体系和软件工作流等难以迁移的东西。

Image

从这个角度来看,OpenAI 在过去一年砍掉 Sora 和 Atlas 浏览器等 C 端「玩具」的决定也就不难理解了——

在 DevDay 2026 上,我们目睹的,其实是 OpenAI 转向成为一家企业服务公司的「成人礼」。

登录,参与讨论前请先登录

评论在审核通过后将对所有人可见

正在加载中