SheepNav
新上线今天0 投票

ChatGPT 迎来「智能界面」:从纯文本走向可交互视觉时代

OpenAI 正在为 ChatGPT 带来一次从「文字对话」到「视觉交互」的形态升级。

核心变化

OpenAI 推出了一项名为 Intelligent UI(智能界面) 的新功能,将大量可视化元素直接嵌入 ChatGPT 的对话之中。与以往单纯输出文字或静态卡通配图不同,这些视觉内容具备交互性——例如可点击的按钮、为特定任务定制的计算器、可交互的图表、可编辑的图形等。

据 OpenAI 介绍,该功能将随一款新的 GPT-6 模型一同上线,周三率先面向 Pro、Plus、Business 和 Enterprise 用户全球推送,周四扩展至 免费版和低价 Go 套餐用户。

为什么这么做

OpenAI 产品经理 Aarush Selvan 在面向记者的电话会上表示,ChatGPT 长期以来以文本界面为主,但公司真正想做的是帮用户「把事办成」——无论是规划菜谱、安排旅行,还是学习新知识,最有帮助的答案往往不只是文字。

他举了一个例子:一名大学生想了解飞机机翼的工作原理,向 ChatGPT 提问「机翼如何产生升力」后,聊天机器人迅速生成了多张示意图,直观展示飞机如何保持在空中。

OpenAI 给出的其他示例还包括:菜谱可视化、自行车机械原理图、多日徒步路线地图、个人储蓄计算器等。

可定制,也可「调低」

与 ChatGPT 的其他个性化设置类似,如果用户不希望回复中出现过多视觉元素,可以自行调低视觉内容的比重。这意味着 Intelligent UI 并非强制覆盖,而是作为一种可调节的表达方式存在。

深度解读

这次更新释放出一个明确信号:大模型产品的竞争正在从「文本生成质量」转向「交互形态」。纯文本对话虽然灵活,但在解释抽象概念、辅助决策和降低理解门槛方面存在天花板。

将可交互图表、定制化工具直接嵌入对话,本质上是把 ChatGPT 从「问答机器人」推向「任务工作台」。这既能提升学习复杂主题的效率,也可能让产品对更广泛的非技术用户更友好——尽管 OpenAI 并未直接这样表述。

值得注意的是,视觉交互对模型的多模态理解与实时生成能力提出了更高要求,GPT-6 的同步上线或许正是为此提供底层支撑。目前尚不清楚这些交互组件在移动端与桌面端的体验是否一致,具体效果仍有待用户实测。

延伸阅读

  1. ChatGPT 上线「智能界面」:回复里直接塞满图表、按钮和交互组件
  2. Claude Haiku 5.5 登陆 AWS:速度最快、成本降低 75% 的 Claude 模型
  3. 三款AI大模型实测开车:只有Claude成功把丰田卡罗拉开到In-N-Out
查看原文