有点子了,就去执行……
突破长尾分布前置障:大模型SFT的自适应新方法
一篇arXiv上归类为cs.AI、cs.CL、cs.LG的论文,给出了一组可量化的实验结论:他们提出的PASS自适应SFT指令选择法,在4种不同主干模型+预算组合的测试场景里,连续超越7种当前最...
Overcoming Prior Barriers: Supervised Fine-Tuning under Long-Tail Distribution
AI 情报卡 · 重要性 ★★★★☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-08本文针对大语言模型监督微调(SFT)中长尾分布下的“先验障碍”问题,提出自适应指令选...
VFold:让LLM长上下文缓存省内存还不拖速度
LLM跑长上下文时,内存压力常卡脖子。很多人可能没意识到——这压力主要不是来自模型参数,是KV缓存。解码时每一层的KV状态都得存下来,上下文越长,这部分占内存的比例越高。现在的压缩方案,大多踩了...
VFold: Symmetry-Aware Cross-Layer Value Cache Compression
AI 情报卡 · 重要性 ★★★☆☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-08这篇arXiv论文提出VFold,一种感知对称性的跨层值缓存压缩策略,解决大语言模型...
神经网络调优:大模型靠初始设定还是实验反馈?
在神经算子调优任务里,大模型的留集测试nRMSE,几乎在所有对比里都比随机搜索、贝叶斯优化更低。这是arXiv上一篇归类于cs.AI、cs.LG、physics.comp-ph的论文,针对“大模...
Prior or Feedback? What an LLM Uses When Adapting Neural Operators
AI 情报卡 · 重要性 ★★★☆☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-08本文为arXiv的AI领域研究,聚焦LLM科学代理在神经算子适应中的决策机制,对比随...
大模型合规系统:判决居然不关规则事?
我最近看到arXiv上cs分类的一组测试,挺颠覆预期的:5款大模型,20个监管规则域,固定案例改规则,结果判决变化不大。测试的逻辑:反向戳破“规则决定判决”的假设合规系统默认的逻辑是“给什么规则...
Verdict Without the Rule: Diagnosing and Auditing Regulatory Rule Sensitivity in LLM Compliance Systems
AI 情报卡 · 重要性 ★★★★☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-08本文是arXiv上的AI研究,测试5个大语言模型的合规系统,发现其判决对监管规则的大...
工业细粒度异常理解:仅领域内训练够吗?
MMAD基准上,工业缺陷定位的人类专家准确率是92.3%,但训练过的领域专家最多只有75.5%——甚至部分训练模型的异常检测准确率还不如没训过的基础模型。仅领域内训练的坑:越训越弱?针对多模态工...
Is In-Domain Training Enough for Fine-Grained Industrial Anomaly Understanding?
AI 情报卡 · 重要性 ★★★★☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-08这篇arXiv的计算机视觉论文聚焦多模态工业异常理解(MM-IAU),发现单一多模态...
