星光澄海 | BLOG
有点子了,就去执行……
字节找DeepSeek时强时弱?答案在Token站位里
字节对接DeepSeek时,回答的准确率能差出30%——这是内部测试的实锤数据,不是玄学,全卡在Token站位上。之前不少人猜是模型适配问题,结果挖出来的坑,居然是“后台排号没排对”。时强时弱,...
2026-10-08 1 0 人工智能/应用
字节找到了DeepSeek时强时弱的原因
AI 情报卡 · 重要性 ★★★★☆ · 来源:量子位 · 2026-10-08本文聚焦字节与DeepSeek交互时表现时强时弱的问题,指出核心影响因素为Token站位,即模型处理文本过程中To...
2026-10-08 3 0 人工智能/应用
闲鱼为啥成了科技巨头的“边角料集市”
2025年,一家北京算力服务器供应商营收破5亿,靠的是闲鱼上卖的英伟达H20芯片——两年前这还是腾讯、字节跳动抢破头的紧俏货,现在成了闲鱼上明码标价的“摆地摊”商品。在闲鱼搜“H20芯片”,有数...
2026-10-08 1 0 人工智能/应用
闲鱼,中国最大的“云服务厂商”?
AI 情报卡 · 重要性 ★★★★☆ · 来源:钛媒体 · 2026-10-08本文将闲鱼类比华强北,称其成为AI领域“边角料”(如英伟达H20芯片、AI模型Token、谷歌Gemini会员等)...
2026-10-08 3 0 人工智能/应用
《冻住的多模态大模型,能定位“左边黄香蕉”里的修饰词?》
你让多模态大模型(MLLM)描述图里的水果,它说“左边黄香蕉”,那你知道它是怎么确定“黄”和“左”对应图里哪块区域的吗?之前没人在意这个——大家只盯着“香蕉”的定位,把“黄”“左”这些修饰词当成...
2026-10-08 1 0 人工智能/应用
From What to Which: Decoding Modifier Grounding in Frozen MLLMs
AI 情报卡 · 重要性 ★★★☆☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-08本文聚焦多模态大语言模型(MLLMs)的修饰词grounding问题,提出轻量级监督...
2026-10-08 1 0 人工智能/应用
DVD解码方案:解决多模态大模型感知的效率痛点
在RefCOCO、KITTI、nuScenes等多模态感知基准测试里,一个叫DVD的新解码方案,让多模态大模型(MLLM)在2D和3D感知任务上,既提升了性能,又砍了token开销、降了推理延迟...
2026-10-08 1 0 人工智能/应用
DVD: Dynamic Vector Decoding for Efficient MLLM-based Perception
AI 情报卡 · 重要性 ★★★★☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-08针对现有基于多模态大语言模型(MLLM)的感知方法存在token开销大、范围精度受限...
2026-10-08 1 0 人工智能/应用
Claude Haiku 5.5:降本七成后,操作暴涨编程仍有差
Anthropic刚推的Claude Haiku 5.5,两个核心数字先记牢:OSWorld 2.1评测成绩从上代的15.7%跳至72.4%,平均运行成本直接砍了75%。但有个容易忽略的点:复杂...
2026-10-07 1 0 人工智能/应用
Claude Haiku 5.5 降本背后:操作能力暴涨,复杂编程为何仍差一截?
AI 情报卡 · 重要性 ★★★★☆ · 来源:雷峰网 · 2026-10-08Anthropic发布Claude Haiku 5.5,该模型升级后计算机操作、知识工作等能力显著提升,加入自适应...
2026-10-07 1 0 人工智能/应用