上周OpenAI推了ChatGPT的智能UI更新,和GPT-6同步上线,所有用户都能用上。你问“七速自行车的设计细节”,它不会只堆文字,会同时给你一张结构图,带可点击的按钮——点哪个,对应部件就高亮。
这次更新到底加了啥?
不是凭空加图。这是给ChatGPT的响应层加了交互能力,同一次回复里,能把文本和可视化内容捏在一起出。能生成的不止图,还有图表、表单、可点击按钮这些。之前ChatGPT偶尔能出图,那是调用DALL-E的单独功能,和文本响应是分开的;这次是一体的,不会让你在两个页面间切来切去。
核心不是加图,是“懂什么时候加”
OpenAI的训练重点,是教GPT-6判断“什么时候该用交互内容,什么时候纯文字就够”,还有怎么把这些内容排版得自然,不破坏阅读逻辑。比如问自行车设计,用带按钮的结构图,比纯文字说“有七个齿轮、两个踏板位置”清楚太多;但如果只是问“那辆自行车卖多少钱”,纯文字报个数字就够,不用堆多余的交互内容。这才是这次更新的关键——不是技术上能画图,是知道什么时候用、怎么用,而不是乱加内容凑数。
对我们和同行来说,这意味着什么?
对普通用户来说,不用再切换到Excel或画图工具做辅助。比如问“月度预算分配建议”,ChatGPT直接出交互式饼图,点按钮就能看不同项目的占比变化;对OpenAI来说,从纯文本对话工具,变成了能做轻量级可视化辅助的实用工具,拓展了使用场景;对同行来说,其他做AI助手的公司,可能得跟进这种“响应层的交互内容整合”,不然用户可能更愿意用能直接出图表的ChatGPT,不用自己再花时间整理。
我觉得这次更新不算“颠覆性”,但补了之前的一个明显短板——之前ChatGPT的回答太“干”,用户得自己把文本转换成可视化内容,现在把这步省了。不过有个问题:要是交互内容太多,会不会反而打乱对话的流畅性?比如本来只想聊自行车的齿轮设计,结果一堆按钮让用户点不同部件,反而偏离了原本要聊的核心内容?
素材来源:The Verge AI · AI情报、大模型、具身智能、消费级AI
查看报道原文
本文由 WeValue 情报引擎基于公开报道整理改写

发表第一条评论吧