有点子了,就去执行……
三名被解雇的OpenAI安全研究者否认指控 警告寒蝉效应
三名被解雇的OpenAI安全研究者:明确否认,担忧寒蝉效应三个此前在OpenAI从事安全研究的人员,近期被公司解雇后,发布了一封公开信。信里的内容非常直接:第一,他们明确否认公司给出的“不当处理...
Fired OpenAI safety researchers dispute misconduct claims, warn of chilling effect
AI 情报卡 · 重要性 ★★★★☆ · 来源:TechCrunch AI · 2026-10-08三名被解雇的OpenAI安全研究员对不当处理敏感信息的指控提出异议,在公开信中警告,他们的解雇...
OpenAI年度收入或低于预期,缺口约200亿美元
OpenAI此前被报道年度化收入约700亿美元,最新消息显示,这个数字比之前的预期少了整整200亿美元。这个量级的调整没有给出具体原因,但足够让行业警觉。【差在哪?】之前的700亿,是市场基于C...
OpenAI’s revenue is reportedly $20 billion less than previously projected
AI 情报卡 · 重要性 ★★★★☆ · 来源:TechCrunch AI · 2026-10-08据报道,OpenAI的年化收入比此前预计的少了200亿美元。此前有消息称这家AI实验室的年化收...
OpenAI的数学证明为何没达到行业标准
最近OpenAI推的一批数学证明工具,刚露面就被他们自己咨询过的数学研究小组盯上了——这些工具生成的大量证明,全偏离了当初顾问们定的行业指南。不是翻车,是没守约定的规则OpenAI为了做数学证明...
OpenAI’s math solutions aren’t meeting the field’s standards yet
AI 情报卡 · 重要性 ★★★★☆ · 来源:TechCrunch AI · 2026-10-08OpenAI推出的数学相关解决方案目前未达到该领域标准,其大量证明内容偏离了该前沿实验室咨询的...
OmniCapBench:解决多模态模型评测痛点的新框架
你知道现在评测多模态大模型(MLLM)有多挠头吗?要么评分全但找不到具体问题在哪,要么能定位但覆盖不全,用大模型当裁判又容易乱打分。直到OmniCapBench出来——它靠786个精标视频,把评...
OmniCapBench: A Deep-Structured Evaluation Framework for Fine-Grained Audio-Visual Captioning
AI 情报卡 · 重要性 ★★★★☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-08针对多模态大模型(MLLMs)音频-视频描述评估存在的覆盖与定位失衡、LLM法官不稳...
扩散模型的控制级不确定性:SCOPE解决采样成本痛点
机器人做实时路径规划时,用扩散模型生成轨迹,之前算不确定性要靠蒙特卡洛采样,这一步慢到跟不上毫秒级的控制需求。原来的问题:扩散模型的不确定性太“贵”扩散模型能表示复杂多变的多模态轨迹分布,但要从...
Control-Ready Uncertainty for Trajectory Diffusion
AI 情报卡 · 重要性 ★★★★☆ · 来源:arXiv (LLM/多模态新论文) · 2026-10-08针对扩散模型轨迹分布不确定性估计依赖高成本蒙特卡洛采样、难以应用于实时控制的问题,研...
