星光澄海 | BLOG
有点子了,就去执行……
RobotWorld: Benchmarking Multimodal Agents for Robot Use Across Diverse Tasks and Embodiments
AI 情报卡 · 重要性 ★★★★☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-07本文介绍RobotWorld,一个用于机器人多模态智能体的仿真测试基准,涵盖84类跨...
2026-10-07 2 0 人工智能/应用
Self-correction Optimization for Interleaved Multimodal Generation
AI 情报卡 · 重要性 ★★★☆☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-07多模态大语言模型在交错图文内容生成上存在挑战,现有方法计算成本高且视觉主体、时间一致...
2026-10-07 1 0 人工智能/应用
RoboQuest: Generalist Physical Agents that Search, Inspect and Test
AI 情报卡 · 重要性 ★★★☆☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-07本文提出RoboQuest基准,针对具身智能体在陌生环境中需主动获取任务相关信息的问...
2026-10-07 1 0 人工智能/应用
Document-Level Text Simplification in Estonian Using Large Language Models
AI 情报卡 · 重要性 ★★★★☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-07这篇arXiv的cs.CL领域论文针对低资源语言爱沙尼亚的文档级文本简化展开研究,评...
2026-10-07 1 0 人工智能/应用
TaoD2C-Bench: Benchmarking MLLMs for Industrial UI Code Generation Beyond Visual Fidelity
AI 情报卡 · 重要性 ★★★★☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-07针对多模态大语言模型(MLLMs)在工业设计转代码(D2C)中需结合视觉与其他模态信...
2026-10-07 1 0 人工智能/应用
MultiFly: A Real-World Multimodal Aerial Dataset with Annotation-Efficient Label Transfer and Cross-Modal Semantic Consistency
AI 情报卡 · 重要性 ★★★★☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-07论文介绍MultiFly,一种真实低空无人机多模态数据集,涵盖RGB、热成像、LiD...
2026-10-07 1 0 人工智能/应用
Open-MMUnlearning: Unifying Methods and Evaluation for MLLM Unlearning
AI 情报卡 · 重要性 ★★★★☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-07针对多模态大语言模型(MLLM)部署中的隐私与安全问题,现有模型遗忘方法存在碎片化等...
2026-10-07 1 0 人工智能/应用
LLM-Assisted Generation of Transparent, Open-Source Multiphysics Models of Electrochemical Devices
AI 情报卡 · 重要性 ★★★★☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-07本文提出利用前沿大语言模型智能体辅助构建电化学器件的透明开源多物理模型,以CO₂还原...
2026-10-07 1 0 人工智能/应用
Nobody Truly Agrees on Sentiment: Humans, Bespoke Tools, and LLMs Struggle with Social Media Texts
AI 情报卡 · 重要性 ★★★☆☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-07本研究针对100条推文,评估TextBlob等定制情感分析工具、Qwen3-32B等...
2026-10-07 1 0 人工智能/应用
SemanticFold: Latent Sequence Compression SeparatesLanguage Modeling, Decodability, and Reasoning
AI 情报卡 · 重要性 ★★★☆☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-07本文研究大语言模型提示前缀的潜在序列压缩是否保留推理能力,提出SemanticFol...
2026-10-07 1 0 人工智能/应用