Basis最近的一次测试,把一份50标签的税务工作簿交给两款AI处理,结果是GPT-6 Astra的速度,刚好是GPT-5.6 Sol的两倍。
「速度翻倍,不止是数字游戏」
这个“两倍速”的数字,对做财务或税务的人来说挺实在。一份50页的税务工作簿,通常包含多表关联、数据核对、规则匹配这些环节,AI处理慢的话,财务人员得等上半小时甚至更久,中间没法干别的——总不能一直盯着进度条。速度翻倍,意味着等待时间直接砍半,省下来的时间能用来核对更细节的内容,不用在赶时间的前提下凑结果。Basis没说具体处理时长,但这个比例足够说明:不是小幅度优化,是实打实的效率翻倍。
「真正的硬门槛,是“懂没说出口的需求”」
比速度更关键的,是GPT-6 Astra的另一项表现:对用户意图的理解更强。Basis因此对实际使用更有信心,这不是没道理的。税务场景里,用户的需求往往半隐含——比如提一句“整理这部分营收数据”,实际是要对应本年小微企业税收减免条款,还要把数据匹配到税务系统的特定格式里。旧模型GPT-5.6 Sol可能只完成了“整理”这个表面动作,GPT-6 Astra能察觉到背后的合规要求、格式标准这些没说出来的意图。这种差异,直接决定了工具能不能从测试落到实际工作里——毕竟没人敢把只做了表面功夫的税务数据拿去申报。
「给同行的两个信号」
这次测试的结果,对AI工具厂商和用工具的企业,都有启发。对厂商来说,之前很多时候比的是“模型每秒处理多少token”,但这次的测试说明,“能不能精准捕捉用户的隐含意图”,才是让客户愿意掏钱的核心——速度快但用不对场景,等于白搭。对企业来说,选AI工具不能只看参数里的“处理速度”,得结合自己的业务场景挑:做税务的,就得找贴合合规要求、懂业务暗线的模型,不然快反而会出低级错误。
你觉得,接下来企业选AI工具,会先盯着速度,还是先看场景适配?
素材来源:OpenAI News · AI情报、大模型、AI应用落地、消费级AI
查看报道原文
本文由 WeValue 情报引擎基于公开报道整理改写

发表第一条评论吧