有点子了,就去执行……
量子代码自动迁移:13个基准的实测与启示
把13个量子编程基准从Qiskit换到CUDA-Q,三个大模型各有优劣:有的能省96%的算力消耗,有的得反复催才不踩坑——这是arXiv上一篇quant-ph分类的案例研究,讲的是量子代码自动迁...
Autonomous Code Migration for Quantum Programming Languages: A Case Study with QED-C Benchmarks
AI 情报卡 · 重要性 ★★★★☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-08本文针对量子编程语言的自主代码迁移挑战,以QED-C基准测试集从Qiskit迁移到C...
Agentic BBO新基准出炉:LLM优化能力大比拼
为什么要做这个统一基准?之前研究Agentic BBO的各家,选的任务领域不一样,系统配置也不统一,导致结果没法横向比,连哪个设计选择真正起作用都分不清——说白了就是各说各的好,没个准谱。黑盒优...
A Closer Look at Agentic BBO: Benchmarking LLM Agents for Black-Box Optimization
AI 情报卡 · 重要性 ★★★★☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-08针对黑盒优化(BBO)现有代理研究因任务域和系统配置差异难以比较的问题,研究者推出跨...
Claude Haiku 5.5:降本七成后,操作暴涨编程仍有差
Anthropic刚推的Claude Haiku 5.5,两个核心数字先记牢:OSWorld 2.1评测成绩从上代的15.7%跳至72.4%,平均运行成本直接砍了75%。但有个容易忽略的点:复杂...
Claude Haiku 5.5 降本背后:操作能力暴涨,复杂编程为何仍差一截?
AI 情报卡 · 重要性 ★★★★☆ · 来源:雷峰网 · 2026-10-08Anthropic发布Claude Haiku 5.5,该模型升级后计算机操作、知识工作等能力显著提升,加入自适应...
Google新AI笔记工具:会议转录全靠离线跑
Google刚推了个实验性AI笔记工具——Google AI Edge Foresight,能完全离线转录会议和音频文件,目前只在macOS上用,免费。它能解决什么具体问题?和Granola、W...
Google’s AI note-taking app transcribes your meetings completely offline
AI 情报卡 · 重要性 ★★★★☆ · 来源:The Verge AI · 2026-10-08Google发布了名为Google AI Edge Foresight的实验性离线笔记应用,可完...
谷歌上线一站式Gemini工作代理,打通全场景办公应用
周四谷歌在Gemini at Work活动上,宣布上线一款通用Gemini AI代理。这不是那种只能在单应用里帮你改文档的小工具,是能在后台跨应用、跨设备干活的。一个界面,搞定跨场景任务它会整合...
Google is launching a one-stop Gemini agent for your work tasks
AI 情报卡 · 重要性 ★★★★☆ · 来源:The Verge AI · 2026-10-08Google在Gemini at Work活动中宣布推出一款通用Gemini AI智能助手,可在...
