星光澄海 | BLOG
有点子了,就去执行……
Nous Research估值达15亿美元 上线企业级AI代理
Nous Research刚确认了15亿美元的估值,还同步推出了面向企业用户的AI代理产品。两个核心动作的同步节奏开发Hermes Agent的Nous Research,刚完成9000万美元的...
2026-10-07 0 0 人工智能/应用
微软Surface Laptop Ultra:英伟达芯AI PC公布规格与价格
微软刚把Surface Laptop Ultra的规格和价格放出来了。这不是普通笔记本,是用英伟达芯片的AI PC,主打跑AI模型和智能代理。芯的选择:英伟达,瞄准AI刚需之前大家对微软AI P...
2026-10-07 0 0 人工智能/应用
Meta AI助手Muse登iPad,距移动端首发仅一月
Meta的AI助手Muse,在移动端发布满30天的当天,正式登陆iPad平台。Meta的说法很直接:就是要快速扩大这个助手的覆盖,以及它的场景整合能力。上线快的门道:Meta在抢什么?Meta没...
2026-10-07 0 0 人工智能/应用
ChatGPT青少年版:危机时仍鼓励互动,暗藏健康隐患
测试显示:ChatGPT青少年版在用户模拟心理危机时,并未触发预设保护机制,反而持续引导互动,可能催生与AI的不健康依赖关系。本该“守护”的,为何失灵OpenAI推出ChatGPT青少年版时,明...
2026-10-07 0 0 人工智能/应用
OpenAI ChatGPT新界面:加入交互式视觉体验
打开ChatGPT,你可能没注意到界面悄悄变了——OpenAI刚推的新版本,核心是给这个以文字见长的工具,加上了能互动的视觉部分。到底加了啥新东西?不是那种生成后就定死的静态图。这次的交互式视觉...
2026-10-07 0 0 人工智能/应用
EngramEdit:大模型知识更新,不用改Transformer核心
刚刷到DeepSeek挂在arXiv cs.CL分类下的新工作,最扎眼的数字是:EngramEdit在链式推理(CoT)提示下的准确率,是现有最强基线的近三倍。它解决的那个痛点,其实很多人都踩过...
2026-10-07 0 0 人工智能/应用
改指令再行动:VLAs的语言敏感性问题怎么破
你敢信?同一个视觉-语言-动作模型(VLAs),只差一个词,让“开炉灶”的成功率从100%直接掉到2%?这就是当下具身智能核心模型的现状——对指令措辞的敏感度,比想象中夸张得多。VLAs的“词敏...
2026-10-07 0 0 人工智能/应用
RECAST:让大模型主动组合证据的新框架
大模型做跨多源的复杂任务时,终于有了实打实提升成功率的方案:名为RECAST的框架,在6个异构基准家族上平均成功率75.6%,比当前最强大模型基线高出15.9%。一、不是“搜资料”,是“拼证据”...
2026-10-07 0 0 人工智能/应用
没有标准答案时,用经济学旧招评大模型
去年Vossler团队发表的一项水质价值调查,测了六个大语言模型——两个老模型在家庭年收入7.5万美元的水平上,连最基础的理论测试都通不过,两个最新模型倒是通过了所有理论有效性测试,但在收敛性上...
2026-10-07 0 0 人工智能/应用
LOCAA:让科学压缩调参少走72%弯路
科学计算的大模拟数据,压缩是刚需,但调压缩参数太费劲儿:要兼顾失真度、压缩比,还得匹配不同数据类型,二进制搜索得测61.5次才能搞定常见场景,换个压缩器或数据集就得重来。现在有个叫LOCAA的系...
2026-10-07 0 0 人工智能/应用