先看证据
对话不再只有一种答法
OpenAI 于 2026 年 10 月 7 日宣布在 ChatGPT 中推出 GPT-6 和 Intelligent UI。GPT-6 是模型,Intelligent UI 则是模型组织回答的能力:它可以把文字、图形、按钮、表单、图表和交互体验组合起来,面向日常问答、复杂概念学习和临时任务处理。OpenAI 称 ChatGPT 每周有超过 12 亿用户,但没有在公告中提供这一数字的统计口径或独立核验材料。
值得理解的变化,不是聊天答案终于可以配图,而是模型开始决定“什么形式更适合解决这个问题”。简单问题可以仍用文字,比较任务可能适合并排展示,解释原理则可能需要交互图解。回答的界面形式由此成为模型需要做出的判断,而不只是产品团队预先固定的外壳。
一辆自行车说明了界面选择
发布页用“拆解一辆七速自行车”展示这种能力。回答先概括车架、车把、车轮和手刹等组成部分,再把自行车拆成五个相连系统;读者可以选择某个系统,查看它的作用。比如,传动系统把踩踏转化为运动,七个挡位让骑行者调整踩踏力度,手刹则通过刹车片控制减速。
这个例子并不只是把一段说明拆成几个标题。它把内容结构和浏览方式连在一起:读者可以沿着系统逐步探索,而不是一次读完一整段解释。它也说明交互的价值取决于问题本身。如果目标是快速了解一个简单事实,增加控件反而可能让答案更绕;如果需要看清多个部件之间的关系,分层呈现才可能有帮助。
灵活度来自组件,而非任意造软件
OpenAI 对实现方式的描述,给这种“模型选界面”划出了边界:GPT-6 使用一套原生、可流式输出的组件库,并由编译器在模型生成界面时处理内容。模型可以决定如何组合组件、安排布局和组织信息,但它不是从零开始生成任何想象得到的软件。组件库提供熟悉的设计基础,也限定了可用的交互形式。
编译器的作用,是让界面随着生成过程逐步出现,而不是等整份回答完成后再一次显示。这让交互体验与回答生成共享同一条过程:模型输出内容,系统将其转成界面并呈现。OpenAI 还称,训练中加入了对内容、布局、视觉和交互决策的学习,并评估界面的清晰度、实用性与完整性。不过,公告没有披露这些评估的具体方法或结果。
速度承诺需要拆成两层看
Intelligent UI 的渐进呈现是一层速度变化,GPT-6 的回答生成方式是另一层。OpenAI 称,模型可以边思考边逐步作答,而不是等所有思考完成后才开始输出。对于用户来说,前者让界面较早出现,后者让有用内容较早到达;两者都可能改善等待体验,但不能把它们混成一个笼统的“更快”。
公告还称,在需要网页搜索的问题上,GPT-6 Instant 平均比 GPT-5.6 Instant 早 44% 开始回答。这是 OpenAI 公布的内部比较,材料没有提供测试集、样本量或完整方法。另一项内部日常代理任务评测称,GPT-6 Extra High 的起答时间与 GPT-5.6 Medium 相同,但总体得分高于 GPT-5.6 Extra High。没有具体分数和评测集名称,这些数字能说明发布方的比较方向,不能单独证明所有任务都更快或更好。
产品团队要评估的是界面质量
对产品和平台团队来说,这条路线适合处理那些在对话里反复出现、又需要临时工具的任务:例如储蓄计算器、账单分摊、行程地图,或帮助理解概念的交互图解。过去,团队可能要为这类任务单独设计页面;现在,模型可以在对话中组合现有组件来回应需求。是否值得采用,取决于这些任务是否足够常见、组件是否覆盖关键交互,以及生成结果是否能让用户看懂并完成操作。
但“全球推出”不等于所有用户同时可用。OpenAI 称功能自 10 月 7 日起逐步向 Plus、Pro、Business 和 Enterprise 用户推出,10 月 8 日起扩大到 Free 和 Go,Enterprise 是否可用还取决于工作区管理员设置。帮助中心还对支持的模式和应用版本作了限制,并且对 Free、Go 用户使用的模型版本与发布公告存在不一致描述。实际接入前,应以账户界面和最新帮助信息确认可用性;在产品评估中,则应把清晰度、完整性和任务完成情况与响应速度一起看,而不要把更丰富的界面直接当成更可靠的答案。