AI 情报卡 · 重要性 ★★★☆☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-07
本研究针对100条推文,评估TextBlob等定制情感分析工具、Qwen3-32B等大语言模型(LLMs)与6名人类评分者的情感分析一致性。结果显示人类间一致性仅一般,Twitter-roBERTa-base与人类对齐最强,LLMs在正负分类表现更优,强调领域微调与人类评估的重要性。
标签:AI情报、大模型、科研前沿
由 WeValue AI 产业情报引擎自动同步
AI 情报卡 · 重要性 ★★★☆☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-07
本研究针对100条推文,评估TextBlob等定制情感分析工具、Qwen3-32B等大语言模型(LLMs)与6名人类评分者的情感分析一致性。结果显示人类间一致性仅一般,Twitter-roBERTa-base与人类对齐最强,LLMs在正负分类表现更优,强调领域微调与人类评估的重要性。
标签:AI情报、大模型、科研前沿
由 WeValue AI 产业情报引擎自动同步
发表第一条评论吧