AI INSIGHT

全网首个可交互诺贝尔文学奖书单来了,这是GPT-6最好玩的新功能

AI新闻 36氪 2026-10-09 11:15
AI 摘要

爱范儿现在,Intelligent UI 把这束光放进了对话框。 莫言在 2012 年获得诺贝尔文学奖时,我花了整整一个晚上,才把《丰乳肥臀》《蛙》和《红高粱》的阅读顺序理清楚。 今年,中国作家残雪和日本作家村上春树继续陪跑,加拿大诗人、作家安妮·卡森摘得 2026 年诺贝尔文学奖。 我本来已经准备好再花一个晚上查资料、排顺序、做书单,结果只给 ChatGPT 丢了一句话「请你帮我用

爱范儿
现在,Intelligent UI 把这束光放进了对话框。

莫言在 2012 年获得诺贝尔文学奖时,我花了整整一个晚上,才把《丰乳肥臀》《蛙》和《红高粱》的阅读顺序理清楚。

今年,中国作家残雪和日本作家村上春树继续陪跑,加拿大诗人、作家安妮·卡森摘得 2026 年诺贝尔文学奖。

我本来已经准备好再花一个晚上查资料、排顺序、做书单,结果只给 ChatGPT 丢了一句话「请你帮我用卡片手账的方式整理安妮·卡森作品的阅读清单」不到三分钟我就得到了一个能够自动调整、选择的阅读卡片。

你可以一张张翻,看每本书适不适合入门、应该排在第几本、读它之前需要知道什么。读完之后,点一下「完成阅读」,卡片就会被勾选,阅读进度也会跟着更新。

谁敢想,实现这些功能的,来自于 10 月 7 日,OpenAI 发布《GPT‑6 and Intelligent UI for everyone》,向全量 ChatGPT 用户推送的 GPT-6 与Intelligent UI。

所有的场景都能可视化

这并不是 Intelligent UI 唯一有意思的案例。

OpenAI 对 Intelligent UI 的定义是「智能界面」,即 ChatGPT 可以根据用户的提问,在回答的时候把文字、图片、按钮、表单、图表以及可以互动的工具进行动态组合。

也就是说以前的人工智能只能输出文字,而现在的 GPT-6 可以按照你提出的问题,在现场组装出包含排版、按钮、表单、图表以及各种交互控件的独立界面。

你所提出的问题仍然没有改变,但是得到的结果已经不是简单的答案了。

根据 OpenAI 官方的例子来看的话,这样的应用程序主要包含知识学习、娱乐以及日常生活等场景,比如说在制定一个周日烤肉的大纲的时候,菜谱、购物清单以及时间表都可以一起出现;而在规划自驾游路线时,沿途的休息站可以直接标在地图上,并且标出一些需要绕行的地方。

除了对这些场景的完整复刻,我们还延伸出了一些有趣的新玩法。

比如,我们对初中化学课本里很重要的一个知识点进行了试验,只需要下达口令,「请告诉我酒精灯怎么用」。

模型会先查找资料,在等待了大约 52 秒之后就产生了交互式的方案。酒精灯的使用被拆成六个关键步骤,每一步都配有对应提示。用户可以按照顺序学习,也可以直接跳到自己不熟悉的部分:为什么不能用嘴吹灭,灯帽为什么要盖两次,酒精快用完了应该怎么办。

Intelligent UI 还可以用来做点个人小游戏。

比如说你想玩一款复古的小游戏,就可以直接对 GPT 说,「我喜欢玩贪吃蛇,给我做一个贪吃蛇的小游戏吧」。

得到的是可以直接用来玩游戏的画面,并非是游戏规则说明书。游戏有完整的规则、计分方法以及实时反馈。每吃掉一个能量块就加 10 分,分数随着贪吃蛇的动作而改变,屏幕也会随之更新。

谁看了不叫一声4399又回来了!

如果觉得普通的贪吃蛇很无趣的话就可以继续修改了,也可以定制化创建一些自己的规则,比如发出指令,「把贪吃蛇改成一只可爱的小熊,并且把得分规则改为每吃掉一个能量块就加 20 分」。

模型不只是一段代码被替换掉那么简单,还需要对角色形象、游戏规则、计分方式以及界面展示等方面进行修改,在输入新的需求之后,游戏界面也会随之改变,但是时间要比第一次生成的时候要长一些。

在实际的生活场景里,Intelligent UI 的价值就体现得比较清楚了。

如果你养小动物,并且纠结如何打扮他们的时候,就可以把照片上传上去然后问,「哪一套更符合我宠物的特点?」

GPT 会把这两件衣服并排放置,并且标注出它们的颜色、尺寸、材质以及适用场合等信息,用户可以根据不同的使用场景和偏好去选择。

这并不是将图表、按钮以及文字堆积在一起,而是在于让答案具有了继续工作下去的能力。

触发答案的「黑盒」

第一次见到 OpenAI 演示麻将交互的时候,我们认为自己找到了未来的聊天界面的样子。棋盘上会出现按钮,牌面上可以进行操作,页面也会根据答案而改变。

模型不只输出文字,还会把可以玩的东西放到你的面前。

但我们实际体验下来,发现使用过程中,UI界面出现得非常随机。

我们用同样的方法 按照演示那样 来模仿麻将桌难题,生成的结果没有麻将桌、没有按钮、也没有任何可以点击的地方,而是一段十分完整的、非常礼貌且普通的文本。

OpenAI 产品经理 AarushSelvan 对于这种随机性的解释是,「我们有一支设计团队花费了很多时间来研究,在什么情况下加入图表和按钮是有用的,在什么情况下又会让人感觉很混乱」。

但在实际测试中,最真实的感受是,你不知道你的问题会被以什么样的方式回答,是一段文字,还是一个交互产品。就像《阿甘正传》中的那句「Life was like a box of chocolates, you never know what you're gonna get」。

如果没有特别提示的话,ChatGPT 会按照任务来决定是否以互动的方式进行交流。比较类的问题可以采用并排的方式排列,复杂的概念可以用交互式的图表来表示,简单的题目优先选择文字回答。

这是因为Intelligent UI 不是模型临时「画了一张网页」,而是一套原生组件库加上配套的界面编译器。模型能够调用文字、图表、按钮、表单以及交互区域等元素,并且编译器会一边接收输出结果,一边把这些结果逐步地展现出来。

但这也正是它与一段用户体验感良好的交互的差距,动态图表、交互组件更像是一个一次性体验。

它们缺少稳定可靠的代码沙盒、独立的资产入口,这使得 Intelligent UI 在轻量级的任务上表现得非常流畅,而对于需要高精准度和专业性场景面前显得有些小儿科。

Intelligent UI 目前还不支持 Pro effort,而 Pro effort 用的是 GPT-6 Astra,这意味着新式的交互界面和最强大的推理模式不能一起出现,真正复杂的、要经过长时间思考的任务可能会回到传统的文字形式。什么时候可以真正地把它们结合起来,依然是 OpenAI 需要解决的问题。

在对话窗口里「玩起来」

回忆一下,当我们第一次在大模型对话窗口交互的场景,那时候,一段能够理解连续上下文语义的回答就足够让我们兴奋。

而今天,Intelligent UI 开始让普通的问答结果走向了交付能点、能拖、能玩的小界面,让我们在对话窗口里「玩起来」。

它的底层逻辑在于多模态的融合改变了我们和大模型的交互方式。

自然语言适合表达复杂目标,但不一定适合完成精细操作。图形界面适合观察状态、比较选项和调整参数,两种交互方式互相补充。

这就好比 2007 年第一代 IPhone 用点按、滑动和双指缩放重新定义了手机操作,把手机从依赖物理按键的间接操作带向直接触碰屏幕的交互体验。

更简单、更高效、更直接。

Intelligent UI 把交互从只回答问题变成用户参与问题解决。答案不再是对话的终点,而成为一个可以被触摸、修改和继续使用的对象。

跳出对话场景,这种变化已经出现在手机智能体中。豆包手机助手技术预览版把对话连接到了系统操作层,荣耀在 MagicOS 9.0 发布材料中演示,用户说「帮我点一杯热拿铁」,YOYO 会调用常用外卖应用,找到常去的咖啡店,完成点单并在结算前向用户确认。

这种交互的价值在于用户从阅读答案的人变成参与任务的人。

OpenAI 的说法更加直接,「过去的几十年里,人们一直在学习怎样用为某个具体任务而设计好的固定的程序,未来软件要能够去适应人的各种各样的工作」。

至于这种变化是否真的是未来软件形成的开端,安妮·卡森在《红的自传》中写道「How does distance look? …… It depends on light」,译为「距离看起来是什么样?它取决于光」。

现在,Intelligent UI 把这束光放进了对话框。

本文来自微信公众号“APPSO”,作者:发现明日产品的APPSO,36氪经授权发布。

来源:36氪
阅读原文