星光澄海 | BLOG

From Reward Signal to Visual Utility: A Controlled Audit of Medical VLM Post-Training

AI 情报卡 · 重要性 ★★★☆☆ · 来源:arXiv (LLM/多模态新论文) · 2026-09-25

本文针对医疗视觉语言模型(VLM)的后训练,以Qwen2.5-VL-3B为对象在PMC-VQA数据集上开展受控研究,对比SFT、LoRA、GRPO等多种训练策略,分析准确率变化与视觉效用事件的关联,揭示了模型优化与实际视觉行为间的差距。

标签:AI情报、大模型、AI应用落地、科研前沿

查看原文


由 WeValue AI 产业情报引擎自动同步

发表第一条评论吧

支持 Markdown