有点子了,就去执行……
LLM的小世界连接:对应推理性能的结构密码?
用六款LLM做剪枝实验,小世界结构完好的模型,推理性能掉得更少——arXiv cs.AI分类的这篇研究,把LLM的内部结构和推理能力直接挂上了钩。为什么不看“表现”,要看“内部结构”?之前评估L...
Looking Inside LLMs: Small-World Connectivity as a Signature of Reasoning Performance
AI 情报卡 · 重要性 ★★★★☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-08该arXiv研究聚焦大语言模型(LLM)推理的内部结构特征,发现小世界连接性(小世界...
TestPrism:别用单一参考评代码测试质量
同样是评估大模型代码生成的测试质量,按行业常规的单参考方案算,14款基线模型的通过率有59.67%;但换成TestPrism这套新框架的核心指标,通过率直接掉到28%。这个反差,戳破了代码测试评...
TestPrism: Rethinking Test Evaluation Beyond a Single Reference
AI 情报卡 · 重要性 ★★★★☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-08针对大语言模型编码智能体测试依赖单一参考方案的缺陷,研究人员推出TestPrism工...
ARGUS:修复AI解读基因组变异幻觉的框架
全基因组关联研究里,超过90%和疾病相关的变异都藏在基因组非编码区。可现有AI解读这些变异时,十有八九会瞎编数据——这是基因组医学领域没人敢说的痛点。AI解读非编码变异,为啥总“瞎编”?大语言模...
Unlocking the Regulatory Genome by ARGUS: An Evidence-Constrained Agentic Framework for Interpreting Single Nucleotide Variants
AI 情报卡 · 重要性 ★★★☆☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-08针对全基因组关联研究中90%以上疾病相关非编码区变异功能解释的难题,研究团队提出AR...
DVD解码方案:解决多模态大模型感知的效率痛点
在RefCOCO、KITTI、nuScenes等多模态感知基准测试里,一个叫DVD的新解码方案,让多模态大模型(MLLM)在2D和3D感知任务上,既提升了性能,又砍了token开销、降了推理延迟...
DVD: Dynamic Vector Decoding for Efficient MLLM-based Perception
AI 情报卡 · 重要性 ★★★★☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-08针对现有基于多模态大语言模型(MLLM)的感知方法存在token开销大、范围精度受限...
EgoVoice:从第一视角流里主动说话的AR助手
AR助手主动搭话这件事,目前做得特别差。哪怕是零样本的基础模型,也很难踩中你真正需要提示的点——要么早了帮不上忙,要么晚了根本没用。直到arXiv那篇归类在cs.CL、cs.CV、cs.SD的论...
EgoVoice: Proactive Spoken Assistance from Egocentric Multimodal Streams
AI 情报卡 · 重要性 ★★★★☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-08针对现有主动语音助手未解决从第一人称多模态流中决策何时说话及说什么的问题,研究者提出...
