展开目录 ▾
#OpenAI#ChatGPT#GPT-6#交互设计#AI 产品

ChatGPT 长出「界面」:GPT-6 让回答变成可点的图表、计算器和迷你应用

OpenAI 10 月 7 日起随 GPT-6 全量推送 Intelligent UI:ChatGPT 的回答从纯文本变成「文字 + 可交互视觉」——图表面板、可点按钮、任务专属计算器,甚至能在对话里直接生成一个迷你应用。同批上线 GPT-6 Sol(付费档)与更省算力的 Luna(免费与 Go 档)。

预计阅读 5 分钟

一句话总结

10 月 7 日开始,OpenAI 把 ChatGPT 从「聊天框」改造成了「能长出界面的聊天框」:新功能叫 Intelligent UI,随 GPT-6 一起推送给全部用户。它让回答不再只是文字,而是夹带图表面板、可点按钮、表单和任务专属计算器——你甚至可以要求它在对话里当场生成一个小工具,然后直接上手用。

数据来源:The Verge《ChatGPT’s ‘Intelligent UI’ update fills its responses with pictures, charts, and buttons》(2026-10-07,记者 Emma Roth)、TechCrunch《ChatGPT is getting a lot more visual, with the launch of a new interface》(2026-10-07,记者 Lucas Ropek),两家均基于与 OpenAI 的媒体电话会及官方博客。


OpenAI 官方演示:ChatGPT 的三块手机界面,分别是穿搭方案、交互式财务计算器与周日烤肉菜单,全部由模型在对话中生成

先说清楚这次变了什么

过去两年,ChatGPT 的界面基本没动过:一个输入框,一段回答,排版靠 Markdown。Intelligent UI 改的是回答本身的形态。

按官方说法,新版的回应会把文字与视觉混排——不是贴一张配图,而是放进可操作的组件:可点的按钮、可编辑的图表、可调节参数的滑块、为某个具体任务定制的计算器。TechCrunch 的描述是:不再是「扁平的、卡通式的图片」,而是「用户能直接上手操作的元素」。

OpenAI 产品经理 Aarush Selvan 在媒体电话会上的原话是:“ChatGPT has predominantly been a text-based interface”——公司想帮用户「把事情办成」,因为「从规划一份食谱或一趟旅行,到试图学点东西,最有用的答案都不只是文字」。

官方给这个功能定的目标是四个字:让复杂话题更好学。

官方到底训练了什么

这是这条新闻里最值得琢磨的一句:OpenAI 说他们专门训练了 GPT-6 判断「什么时候该用交互式视觉代替文字」,以及如何在回答里给这些视觉元素排版。

这句话的重量在于——「生成一张图」和「知道什么时候该生成图、并把它摆在对的位置」,是两件事。前者是能力,后者是判断与克制。当模型开始被训练「何时不该用图」,说明这个能力已经从演示阶段进入了产品阶段。

而且它是可调的:如果你不喜欢满屏的图,可以像调节 ChatGPT 其他「个性」一样,把视觉密度调低。

官方演示的交互式示意图:问「7 速自行车的设计」,ChatGPT 直接给出可点的自行车结构图,下方 Frame / Wheels / Drivetrain / Brakes / Cockpit 按钮可切换高亮部位

GPT-6 Sol 与 Luna:一次推两级模型

Intelligent UI 不是单独发的,它绑定在 GPT-6 上。

OpenAI 上个月刚发布第一批 GPT-6 模型,这次把其中的 Sol 和 Luna 两个版本带进了 ChatGPT:

版本定位谁能用
GPT-6 Sol中档能力版本Plus / Pro / Business / Enterprise
GPT-6 Luna更省算力的「效率版」免费档与 Go 档

推送节奏上,付费档(Plus / Pro / Business / Enterprise)先在 10 月 7 日拿到,Go 与免费档在次日(10 月 8 日)跟上——也就是说,截至今天,全部用户都已经在灰度范围里。

除了 Intelligent UI,OpenAI 还提到 GPT-6 带来的另外三点变化:联网搜索表现更好、能在检索过程中先给出部分答案(不用等全部查完),以及 “showed stronger resistance to attempts to bypass its safety training”——对绕过安全训练的尝试有更强的抵抗力。最后这条是厂商自述的安全结论,值得记下,但不宜当成独立验证过的第三方结论。

三次形态变化,回答终于不只「可读」了

把这次更新放进 ChatGPT 的形态演进史里看,会更清楚它在解决什么问题:

ChatGPT 回答形态的四次变化:从纯文本对话,到多模态,到 Agent 化,再到 Intelligent UI;下半部分对比同一个问题的三种回答形态

关键差别在互动性:

  • 纯文本时代:问「退休能存多少钱」,得到一段估算文字,数字是死的。
  • 多模态时代:能得到一张画好的收益曲线图,看着直观,但改不了参数。
  • Intelligent UI 时代:得到的是一个可交互的计算器——切换「投资 / 房贷 / 分账单」,拖动参数,结果即时重算。

官方演示里的那个计算器直接显示”Projected investment value 300,851 美元”、“+170,851 in estimated growth”,并带一条可调的成长曲线。它不是一个 PDF,是一个能在对话里跑的小应用。

真实产品界面:ChatGPT 用一张带标注的交互式球场示意图讲解足球「越位规则」,攻守双方位置可切换

官方列举的其他演示还包括:教人打麻将(把每张牌分类、可滚动浏览)、多日徒步路线地图、自行车机械原理图、以及可以对话中直接生成的小工具——退休储蓄计算器、复古小游戏、AA 分账单。

怎么理解这件事的意义

第一,AI 产品的竞争焦点从「答得对不对」转向「答得好不好用」。 当基础模型能力差距被拉平,「同样的答案,谁的呈现方式让你更容易理解、更愿意动手」就成了新的战场。把回答变成可操作对象,本质是在降低「从理解到行动」的摩擦力。

第二,它把一部分「应用」吸进了聊天框。 一个能按需生成小计算器、小工具、小游戏的助手,天然在替代那些一次性工具类 App。这对工具生态的影响是长期的:当生成成本趋近于零,「专门做一个小工具」这件事的商业价值会被重新评估。

第三,也是最容易被忽视的一点:这是对「学习场景」的正面进攻。 「让学生看懂机翼为什么产生升力」这种需求,传统上靠教材、视频、动画课件。现在一句话就能生成一张可交互讲解图——这解释了两家媒体都盯着教育场景报道的原因。

访问说明

Intelligent UI 与 GPT-6 Sol/Luna 是账号级的灰度推送,不需要手动开启。截至 10 月 8 日,付费档、免费档与 Go 档都已在推送范围内,具体到你自己的账号以实际界面为准。

需要提醒的是:ChatGPT 在国内访问需要代理工具,OpenAI 不对中国大陆地区开放注册与访问。如果只是想体验「回答里长出可交互图表」这类能力,国内目前也有若干具备多模态输出能力的助手可作为替代,但交互式组件的完整度与 ChatGPT 还有差距。

图片出处:封面与示意图由 UU AI Hub 自制;正文配图取自 OpenAI 官方演示素材(经 The Verge、TechCrunch 报道发布)。

Related

相关文章

延伸阅读

查看全部 →
Google

谷歌发布 Gemini agent:给目标不给指令,一个 Agent 干完知识工作与编码

10 月 9 日 Gemini at Work 2026 大会上,Google Cloud 发布 Gemini agent:一个通用工作 Agent,「给目标,不给指令」。它能连 Gmail/Workspace/Slack 与任意 MCP server,为任务临时组建子 Agent,还能以 coworker 身份拥有自己的 @agents 邮箱。官方称近 90% 财富 100 强已在用 Gemini Enterprise,模型层今天已可选 Anthropic Claude。

Mistral

Mistral Large 4「Le Chonk」:1 万亿参数、3800 张自训 GPU,欧洲把开源权重押成主权牌

Mistral 10 月 6 日发布 Mistral Large 4 公开预览:1 万亿参数、520 亿激活的原生多模态 MoE,在 3800 张 NVIDIA Grace Blackwell 上于自有欧洲数据中心从零训练,权重月底放出。网络安全基准上「复现并修补真实漏洞」拿到 82%,官方称为全场最高——Claude Opus 5.5 与 GPT-6 Astra 因拒绝执行而接近 0 分。

OpenAI

OpenAI 一次放出 722 篇数学手稿:372 个结果族、约 4000 道题里筛出来的

10 月 7 日 OpenAI 在 GitHub 公开 openai/math:722 篇由内部未发布模型产出的数学手稿、372 个结果族,官方称平均每个结果花 3 小时 ChatGPT Pro 算力,整个评测约 4000 道题。约 162 篇带 Lean 形式化,其余多数未经机器校验、全部未经同行评议;README 点名 CM 阿贝尔簇的 Hodge 猜想与 ζ 函数无零点区域两处为例外。