人工智能
OpenAI 把 GPT-6 推到 12 亿人面前,顺手改掉了"答案"的样子。真正要紧的是那套组件库
GPT-6 周三抵达 ChatGPT 付费档,今天轮到免费用户。随之而来的 Intelligent UI 不再用纯文本作答,而是用图表、表单和当场可用的小工具把答案搭起来。真正有后果的决定不是模型,而是它背后那套可流式渲染的组件库。
MAI
OpenAI 周三开始把 GPT-6 推进 ChatGPT,而这份公告的重点不是模型。与它一同出货的,是该公司称为 Intelligent UI 的功能:ChatGPT 的答案不再是偶尔夹几张图的文字,而是模型当场搭建的界面——图表、表单、可点按的按钮、示意图,以及为刚刚那个问题专门造出来的小工具。免费档和 Go 用户今天拿到它。OpenAI 称每周有超过 12 亿人使用 ChatGPT。
实际在推送什么
| 档位 | 模型 | 时间 |
|---|---|---|
| Plus、Pro、Business、Enterprise | GPT-6 Sol | 10 月 7 日起,全球,Chat 标签页 |
| Free、Go | GPT-6 Luna | 10 月 8 日起 |
| Work、Codex | 不变 | 本次不更换模型 |
两款模型都是面向日常对话而非智能体式编码调校的,Enterprise 的可用性取决于企业管理员设置。驱动 Work 与 Codex 的模型没有动,这是一个关于范围的有用信号:这是一次面向消费端界面的发布,不是一次能力发布。
性能方面的说法全部出自 OpenAI 自己的内部评测,未经独立复现。该公司称,在需要联网搜索的问题上,GPT-6 Instant 平均比 GPT-5.6 Instant 早约 44% 开始作答;在高价值的日常任务上,GPT-6 Extra High 开始作答的速度与 GPT-5.6 Medium 相同,得分却高于 GPT-5.6 Extra High。前一个数字的机制在于,GPT-6 可以一边继续推理一边开始回答,把部分输出交错着送出来,而不必等整条思维链跑完。
组件库才是那个工程决定
做生成式界面最省事的路子,是让模型吐出 HTML 再渲染。OpenAI 没有这么做。它描述的是一套原生、可流式传输的组件库,外加一个编译器——在模型还在生成的过程中,就把界面逐步渲染出来。训练覆盖的不只是内容,还有版式:展示什么、放在哪里,以及什么时候一个交互元素才配得上它占的位置。
这个选择有三重后果。第一,输出更快,因为组件是以已知的形状流进来的,而不是作为一团需要解析的标记抵达。第二,在一个狭窄但真实的意义上,输出更安全:一个只能拼装经过审核的组件的模型,无法把任意代码拼进十亿人正在看的页面。第三,输出归 OpenAI 所有——因为"一个 ChatGPT 答案可以是什么"这套词汇表,如今就是 OpenAI 自己拥有并扩展的那个库。
不再是人去适应软件,而是软件来适应人。
这是 OpenAI 为这次转变给出的定调。产品经理 Aarush Selvan 在一次沟通会上把前提讲得更直白:"ChatGPT 迄今主要是一个基于文本的界面",而日常问题最有用的答案"并不只是文字"。
档位的分界,就是设计判断的分界
公告没有多谈的部分在这里。界面是由模型搭起来的,而这个模型取决于你付多少钱。付费档用 Sol 搭——那是 OpenAI 九月推出时定位给编码与智能体的那一档;Free 与 Go 用 Luna 搭,那是标价每百万输入 token 0.10 美元的大批量档位,也正是上周 Anthropic 用 Claude Haiku 5.5 对上的同一个价格下限。两者都被描述为面向对话调校,而 OpenAI 没有公布过这两款在版式判断上表现如何的任何对比。
于是功能是普遍的,背后的判断不是。产品是文字的时候,较弱的模型写出较差的句子。产品变成界面之后,较弱的模型做出较差的界面——一张没回答问题的图表、一个输入项选错的小部件、一幅看着很权威却在细处出错的示意图。OpenAI 承认了这件事的一般形态:它表示模型的设计判断和它能创造的体验范围仍需改进。用户可以要求少放一些视觉元素。
什么会坏掉
一个错误的句子是可审查的。你读它、你不同意、你去核对。但一张生成出来的图表,会把模型在底层数字上搞错的东西原样继承下来,再披上渲染图形的权威感呈现出去;而当场生成的储蓄计算器,它的算术没有任何人复核过。生成式界面的失败形态不是难看,而是自信、具体、无法核验的输出,偏偏以一种"这是精心做过的"的形式出现。
第二重代价,是那句口号遮住的那一面。软件按每一次请求去适应人,意味着没有一个稳定的界面可供习得;而界面正是靠"明天还是这样"赢得信任的。OpenAI 用可习得性换取贴合度。对一次性的解释,这大概是对的交易;对一个人反复要做的事,就不那么显然了。
怎么看
GPT-6 在二十四小时内铺到所有档位,是一步分发动作;而让它付得起的那套定价,几周前 OpenAI 与 Anthropic 把小模型费率压到同一个下限时就已经定下了。Intelligent UI 就是这些便宜 token 的去处。OpenAI 已经认定,输入框从来不是产品——答案才是——并开始把答案重建成自己出货的软件。这份野心真正被编码进去的地方就是那套组件库,那也是该盯住的地方:定义组件的人,定义了答案被允许成为什么。
Sources: OpenAI — GPT-6 and Intelligent UI for everyone · TechCrunch · 9to5Mac · TestingCatalog