🔥 聚焦
Claude 突破黎曼猜想下界 : Anthropic 未公开研究模型将黎曼 ζ 函数零点比例下界从 41.6% 提升至 67.2%,刷新了数论界 37 年来的纪录。该研究由 60 个子智能体协作完成,消耗 3100 万 Token。因其自主推演和验证能力已逼近人类学者极限,这标志着 AI 已从“解答已知”跨越到“探索未知”的科学研究阶段。(来源: TechCrunch)
OpenAI 核心高管 Brad Lightcap 离职 : 在 OpenAI 效力 8 年、曾任 CFO 及 COO 的核心高管 Brad Lightcap 宣布离职创业,奥特曼公开致谢。作为 OpenAI 商业体系的搭建者,他在公司估值达 8520 亿美元且筹备 IPO 的关键节点选择离职,引发外界对大模型商业化分歧及高管出走潮的广泛猜测。与此同时,唯一伦理负责人 Chloé Bakalar 也已悄然离职。(来源: TechCrunch)
Manus 宣布与 Meta 拆分恢复独立运营 : 历经 8 个月的安全审查,因监管合规要求,被 Meta 以 20 亿美元收购的通用 Agent 明星企业 Manus 宣布与 Meta 拆分,重新恢复独立运营。用户数据将迁至美国和新加坡,部分收购后产生的数据将被删除。分析认为,这标志着地缘政治对 AI 跨境并购的干预已进入实质阶段,Manus 必须在激烈的 Agent 赛道中重新自证商业模式。(来源: 量子位)
前千问负责人林俊旸官宣创办 Pragmatik Labs : 原阿里千问技术负责人林俊旸宣布在上海创办 AI 公司 Pragmatik Labs(语用科技),首轮获红杉中国和高榕创投领投,腾讯和上海未来产业基金跟投,估值达 20 亿美元。公司将专注研发横跨数字与物理世界的下一代 Agent。这表明国内大模型顶尖人才正加速流向 Agent 赛道,探索从“模型智能”向“行动系统”的范式跃迁。(来源: 36氪)
英伟达联合华尔街巨头启动 5000 亿美元算力融资 : 英伟达与贝莱德、黑石等六大资管巨头合作建立独立融资平台,计划随着时间推移防范和撬动超 5000 亿美元资金用于 AI 基础设施建设,英伟达提供最高 25% 的残值担保。黄仁勋表示,算力已成为可投资的基础设施资产。分析指出,这标志着算力金融化时代的到来,通过债务和证券化降低了 AI 扩张的资金门槛。(来源: NVIDIA Blog)

🎯 动向
远景乌兰察布星河基地投产 : 远景科技集团宣布星河基地正式投产,总规划容量达 2GW,支持百万卡并行,并点亮全球最大 AI 算力超级单体。该项目通过高比例绿电直连和 AI 电力系统,将波动的新能源转化为稳定的算力源。这表明算力竞赛的胜负手正在向电力和系统效率倾斜,新能源企业正成为 AI 基础设施建设的新主力。(来源: 机器之心)

天眸芯团队发布类脑自监督视觉感知框架 : 团队在《Nature Sensors》发表封面文章,提出基于视觉原语的自监督学习框架,并开源算法工具链 TianMouCV。该框架通过跨通路注意力和记忆模块,在无真值标注的极端退化场景下自监督构建内部模型,实现高动态范围和时空对齐的视觉重建。这为自动驾驶和具身智能在开放世界中的鲁棒感知提供了底层技术支撑。(来源: 机器之心)
.jpg)
自变量机器人发布 WALL-B 世界统一模型 : 在无脚本直播实测中,自变量机器人双臂夹爪方案分拣异形包裹效率达 1816 件/小时,超越 Figure AI 纪录,硬件成本降低 70%。这得益于其自研的 WALL-B 世界统一模型,实现了原生多模态感知与物理预测的融合。这证明通过提升模型大脑的泛化与预测能力,可以有效降低具身智能的硬件堆叠成本。(来源: 量子位)

字节跳动 Seed 团队提文生图文本条件扩展定律 : 研究发现,训练图像 Caption 的信息量(GPG/ED)而非 token 长度决定了扩散模型的收敛损失,并据此提出结构化 Prompt(SP)方案。通过将全局、元素和关系级变量组织进 JSON 字段,该方法显著提升了模型在复杂组合、空间推理和世界知识生成任务上的表现,为文生图模型训练开辟了新的优化变量。(来源: 机器之心)
.jpg)
人大与蚂蚁集团发布 LLaDA MoE v2 : 联合团队首次系统刻画了混合专家扩散语言模型的扩展定律,并训练出 30B-A3B 模型。该模型仅激活 3B 参数,使用同规模自回归模型约 65% 的预训练词元,即在推理和代码基准上逼近主流水平。这证明了稀疏激活与扩散建模结合在数据和算力分配上的高效率,推动扩散语言模型进入定律指引时代。(来源: 机器之心)
.jpg)
🧰 工具
openJiuwen 推出智能体“算力亲和”技术 : 平台通过 Agent Hint 机制,在 Agent 框架与推理引擎间建立语义协同,使 KV Cache 管理从被动超时淘汰升级为主动生命周期调度。在多智能体协作测试中,该技术使首 token 时延降低 57.46%,推理存储峰值占用降低 25.24%,为解决长程智能体带来的显存暴涨和时延瓶颈提供了系统级解法。(来源: 机器之心)
.jpg)
西交大提出世界模型正则化方法 QQWorld : 针对联合嵌入预测架构(JEPA)世界模型中潜变量分布的重尾和坍塌问题,研究团队用分位数匹配(QQ matching)替换原有正则,在分布尾部提供持续纠偏梯度。在多个控制环境中,该方法将平均规划成功率提升 5.33 个百分点,且核心代码不足 10 行,为大模型潜空间正则化提供了高效的数学工具。(来源: 机器之心)
.jpg)
港中文与恒生大学提出资源管理系统 Libra : 针对 Agent 轨迹长度不确定及策略漂移导致的算力失衡,Libra 引入因果感知调度与弹性资源切换,将训练与推理算力作为耦合系统动态优化。在多类复杂任务中,Libra 实现吞吐提升最高达 3 倍,达到目标奖励的时间缩短至 2.5 分之一,有效解决了强化学习后训练中的资源错配问题。(来源: 机器之心)
.jpg)
北航与清华等团队发布自动驾驶 VLA 模型 : 针对自回归型 VLA 驾驶模型规划空间与语义空间脱节的问题,团队提出交通常识视觉蒸馏(DVD)与 2D 图像轨迹引导提示(2D-TGP),将 BEV 轨迹映射到图像像素空间进行学习,充分利用基模的读图能力。模型在 NAVSIM 评测上取得 90.4 PDMS,展示了自驾 VLA 模型高效 Scaling 的新路径。(来源: 机器之心)
.jpg)
微软发布 CARE-X 放射学多模态大模型 : 采用双推理架构,将生成式 Findings/Impression 与结构化辅助预测头结合,并引入工具辅助测量,实现多步推理与精确计算的交替。在 Narayana Health 真实临床数据验证中,模型对罕见 ICU 病症和 CT 确诊的器官增大病症表现出高敏感度,ReXVQA 准确率达 94%。(来源: Microsoft Research Blog)

📚 学习
哈佛与斯坦福等发布虚拟人口模拟系统 : 团队构建了包含 1290 个维度的人格数据库,并利用大模型驱动 83 亿个虚拟 agent。在问答、聊天和应用操作等仿真环境中,agent 的行为遵循率达 91.5%。该系统为大规模、低成本的用户研究和产品测试提供了全新的模拟平台,展示了多智能体社会化模拟的巨大潜力。(来源: 机器之心)
.jpg)
多用户智能体协作与安全沙箱 WeClawArena : 针对多用户个人工作空间数据不互通的协作场景,团队推出包含 620 个场景变体的评测基准,涵盖本良性协作与四类攻击向量。沙箱可对运行轨迹进行全量审计,量化评估隐私泄露、恶意注入等跨用户安全风险,为构建安全的智能体社交网络提供了测试基准。(来源: HuggingFace Daily Papers)
港科大与腾讯等提出多参考图视频理解模型 : 针对多模态模型在处理多张参考图时视频语义与图像对应不准的瓶颈,团队推出 RefCaptioner 模型与 MRVBench 评测集。通过引入 HCD-GRPO 算法,模型在生成结构化描述的同时,实现了高精度的图像选择与局部绑定,显著提升了 grounded 视频重建的质量。(来源: 机器之心)
.jpg)
机器之心等联合发起在校 AI 本硕博荣誉 : 设立“年度新星”与“学术突破”“应用先锋”“社会责任”三大特别奖项,面向全球在校华人生徒开放申请。评选从学术影响力、技术创新性、应用可行性等维度综合考量,旨在发掘并资助在 AI 及交叉前沿领域表现卓越的年轻学者,加速人才生态建设。(来源: 机器之心)
.jpg)
💼 商业
寻明生科完成 1 亿美元 B 轮融资 : 专注于生成式抗体与大分子药物设计,通过超高通量微流控实验与 AuraIDE 基础模型构建干湿实验闭环。其 7 亿参数的开源版本 OpenDDE 在抗原复合物预测上表现优异,公司已有多条管线进入临床前或 IND 申报阶段,展示了 AI 在大分子药物设计上的商业可行性。(来源: 机器之心)
.jpg)
戴盟机器人完成数亿元战略轮融资 : 由蚂蚁集团领投,老股东跟投。戴盟专注于具身触觉与灵巧操作,推出触觉锚定世界模型 Daimon-TWM,通过“慢规划-快纠偏”机制,实现高频伺服动作纠偏,解决机器人在复杂接触任务中的滑移与力度控制瓶颈,已进入多家头部工业自动化与机器人供应链。(来源: 量子位)

忆纪元科技 MemoraX AI 完成数亿元融资 : 专注于 AI 长期记忆基础设施研发,提出“模型内生”记忆路线。其核心系统在 LoCoMo-Refined 等超长对话记忆评测上取得 SOTA 成绩,并已与华为云达成战略合作,将长期记忆能力嵌入医疗健康、智能家居等真实业务场景中。(来源: 36氪)
🌟 社区
社区热议 Anthropic 强制推行全局文本隐形水印 : 针对欧盟 AI 法案,Claude 将在全球所有渠道的输出中编织隐形水印。社区担忧这会劣化模型写作质量,且极易被开源工具绕过。许多用户开始考虑转向开源模型或本地部署,以维护文本表达的独立性与数据隐私安全。(来源: Reddit r/artificial)
开发者吐槽 AI 辅助编程导致“认知债”与焦虑 : 社区热议过度依赖智能体进行架构规划与代码生成,导致团队交付极快但对系统细节完全失控,呼吁建立“人拥有”的最低理解边界。开发者担忧长此以往会退化个人的系统设计能力,并增加系统维护与排错的隐性成本。(来源: Reddit r/artificial)
天猫 AI 虚拟代言人“段宴”声线涉嫌侵权 : 配音演员指控天猫七夕广告未经授权使用 AI 克隆其声线,暴露出 AI 角色商业化安全合规中脸部与声音版权授权的法律真空。这引发了行业对虚拟形象与声音合成技术合理使用边界的深度探讨,也催生了针对 AI 侵权检测与去水印的新市场。(来源: 36氪)
💡 其他
第 38 届百花奖首次设立 AIGC 影像推优单元 : 即梦 AI 作为独家技术合作方,征集超 2000 件作品,展示了 AI 工具在降低青年电影人创作门槛、缩短制作周期与视效成本上的潜力,多部获奖作品展现了国风美学与 AI 技术的深度融合,为年轻创作者开辟了新的入场路径。(来源: 机器之心)

微信朋友圈灰度测试“AI 帮写”与“AI 点评” : 微信开始在社交核心场景引入生成式 AI,辅助用户生成文案与互动评论,标志着国民级社交应用向 AI 化迈进。虽然该功能在体验上降低了表达门槛,但也在社交网络中引发了关于“真实感”流失和人际关系模板化的争议。(来源: 36氪)
谷歌健康 AI 助手被曝频繁“幻觉”运动数据 : 许多 Fitbit 用户反映,重新设计的 Google Health 频繁将日常活动误判为游泳、跑步等运动,引发对健康类 AI 可信度的质疑。这表明在医疗健康等高可信度场景中,AI 助手的幻觉问题依然是制约其规模化落地的关键障碍。(来源: TechRadar)