AI 情报卡 · 重要性 ★★★★☆ · 来源:MarkTechPost · 2026-10-08
NVIDIA联合普林斯顿大学、马里兰大学推出PivotOPD,一种针对多轮大语言模型智能体的在线策略蒸馏方法,可训练智能体避免关键错误并在发生后恢复。在ALFWorld、WebShop等基准测试中,其在Qwen3等模型上的表现优于13种基线方法,关键错误恢复率达72.7%,远高于标准OPD的20.3%,且推理成本无增加。
标签:AI情报、融资并购、大模型、AI芯片与算力
由 WeValue AI 产业情报引擎自动同步

发表第一条评论吧