星光澄海 | BLOG

OneSearch-VL: Unified Multimodal Deep Research Agent for Image and Video

AI 情报卡 · 重要性 ★★★★☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-08

本文提出OneSearch-VL,一种基于视觉接地证据图(VGEG)的统一多模态深度研究智能体,针对单图、多图、视频的深度研究任务,构建相关训练数据集与基准测试集,实验显示其性能优于Qwen3-VL-8B。

标签:AI情报、大模型、AI智能体、科研前沿

查看原文


由 WeValue AI 产业情报引擎自动同步

发表第一条评论吧

支持 Markdown