星光澄海 | BLOG
有点子了,就去执行……
cathrynlavery/diagram-design
AI 情报卡 · 重要性 ★★☆☆☆ · 来源:GitHub Trending · 2026-10-08该项目为Claude Code、Codex、GitHub Copilot等AI工具提供编辑...
2026-10-08 1 0 人工智能/应用
thedotmack/claude-mem
AI 情报卡 · 重要性 ★★★☆☆ · 来源:GitHub Trending · 2026-10-08thedotmack推出claude-mem项目,为AI代理提供跨会话的持久上下文功能,通...
2026-10-08 1 0 人工智能/应用
Google把Gemini改成商用AI智能体,还配了专属邮箱
Google给Gemini做了个核心改动——不再是只陪聊的AI,而是面向企业的AI智能体。这次改的核心是什么?它的核心功能是能自己规划任务、执行任务,还能把细分的子任务分给更小的智能体去做。它不...
2026-10-08 1 0 人工智能/应用
Google brings agentic AI to Gemini, starting with businesses
AI 情报卡 · 重要性 ★★★★☆ · 来源:TechCrunch AI · 2026-10-08Google将Gemini升级为具备规划、执行任务能力的AI智能体,可跨企业应用与系统工作,能...
2026-10-08 1 0 人工智能/应用
Anthropic更新Claude使用政策:明确禁止滥用与选举干预
Anthropic刚更新了Claude的使用政策,其中最明确的一条是:极端情况下反复滥用模型的行为被禁止,但日常对模型的不满、批评仍被允许。新规到底卡了谁?之前不少AI模型的使用规则,常把“滥用...
2026-10-08 1 0 人工智能/应用
Anthropic changes usage policy to ban model abuse and election interference
AI 情报卡 · 重要性 ★★★★☆ · 来源:TechCrunch AI · 2026-10-08Anthropic更新使用政策,明确禁止用户在极端情况下反复滥用Claude,普通不满与批评仍...
2026-10-08 1 0 人工智能/应用
OmniCapBench:解决多模态模型评测痛点的新框架
你知道现在评测多模态大模型(MLLM)有多挠头吗?要么评分全但找不到具体问题在哪,要么能定位但覆盖不全,用大模型当裁判又容易乱打分。直到OmniCapBench出来——它靠786个精标视频,把评...
2026-10-08 1 0 人工智能/应用
OmniCapBench: A Deep-Structured Evaluation Framework for Fine-Grained Audio-Visual Captioning
AI 情报卡 · 重要性 ★★★★☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-08针对多模态大模型(MLLMs)音频-视频描述评估存在的覆盖与定位失衡、LLM法官不稳...
2026-10-08 2 0 人工智能/应用
SpatialHarness补了GPT-6 Astra精细操作的空间短板
给GPT-6 Astra的插针测试,之前成功率才26.7%,用SpatialHarness一上,直接飙到66.7%——汉诺塔更是从0变100%。这不是游戏,是arXiv cs.RO分类里一篇机器...
2026-10-08 1 0 人工智能/应用
SpatialHarness: Test-Time Spatial Scaffolding for Fine Robotic Manipulation
AI 情报卡 · 重要性 ★★★★☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-08这篇arXiv论文针对前沿多模态基础模型(如GPT-6 Astra)在机器人精细操作...
2026-10-08 1 0 人工智能/应用