🔥 聚焦
安全研究团队借助 Claude 攻破 OpenAI 内部代码库 : 安全研究团队 Hacktron AI 披露,研究人员在漏洞赏金框架下,借助 Claude Opus 5 辅助在 72 小时内攻破了 OpenAI 员工账户,并向其存放算法机密的核心私有单体仓库(openai/openai)提交了验证 PR。攻击链始于 Discourse 论坛图片上传组件中的 libheif 堆缓冲区溢出漏洞,配合 OpenAI SSO 身份配置缺陷接管了绑定 GitHub 的员工 Codex 账号,大模型 Token 成本不足 3000 美元。该事件引发行业对“前沿 AI 正在迅速平民化高危网络攻击能力”及顶级实验室自身防护脆弱性的巨大震动与警惕(来源: The Wall Street Journal, 36氪)

阿里达摩院通用医疗影像大模型 RADAR 登上《Science》并全量开源 : 阿里巴巴达摩院联合浙大一院等数十家医疗机构研发的全球首个专家级通用腹部影像大模型 DAMO RADAR 登上《Science》正刊。该模型突破了传统医疗 AI 局限于单一病种的瓶颈,通过器官级细粒度图文对齐与自适应对比建模,单个模型即可覆盖腹部 18 种解剖结构的 146 种疾病,多中心验证中平均 AUC 达 0.913,诊断精度比肩资深放射科专家,人机协同可减少 30.7% 的阅片时间。达摩院已将模型权重、训练框架与评测代码全量开源(来源: Science, 36氪)

Anthropic 披露 26% 研发已由 AI 自主接管并上线生命科学验证计划 LSVP : Anthropic 首次公开内部研发测量数据:Claude 已在人类监督下“主导”(AL4 级别)公司 26% 的前沿模型研发工作(半年前不足 1%),内部常态化并发运行超 3 万个智能体,月度触发超 10 亿次决策。同时,Anthropic 正式推出生命科学验证计划(LSVP),针对经审核认证的药企与科研机构部分解禁前沿模型,建立基于意图申报、30 天离线审计与共同责任的安全治理新范式,取代传统的一刀切实时拦截机制(来源: Anthropic News, AnthropicAI)

纽约时报诉微软与 OpenAI 案解封关键内部文件:微软高管称 AI 抓取为“最大规模劳动力盗窃” : 最新解封的法庭文件显示,微软应用科学总监 Brent Hecht 曾内部将大模型无授权抓取新闻定性为“人类历史上最大规模的劳动力盗窃”与“对合理使用原则的彻底嘲弄”。OpenAI 高管亦曾承认其产品对出版商构成“实质替代性威胁”。相关文件曝光了双方绕过付费墙抓取数据的细节,令 AI 产业长久依赖的“合理使用”(Fair Use)抗辩面临空前法律挑战(来源: TechCrunch)

🎯 动向
阿里通义发布 1M 上下文全模态模型 Qwen3.8-Omni-Flash 及配套生态 : 阿里通义团队正式推出首个以智能体工作流为核心的全模态模型 Qwen3.8-Omni-Flash,原生支持文本、图像、音频与 1 小时连续视频流输入。模型引入由粗到细的主动感知机制,在超长视频理解基准 OmniVideoBench 上准确率提升至 67.8 且 Token 消耗降低 45.7%,视频 API 成本相较上一代降低约 89%。团队同步开源了支持多端 Harness 接入的 Qwen-MM-Plugins 与 omni-skill-creator 工具(来源: Qwen, Alibaba_Qwen)

DeepSeek 推出 DeepSeek-V4.1-Flash 攻克超长上下文 KV 缓存瓶颈 : DeepSeek 发布 552B 多模态 MoE 模型 DeepSeek-V4.1-Flash,支持 100 万 Token 上下文。模型采用因果编解码(CED)架构实现 Prefill 阶段仅激活 8B 参数,并结合 CSA2 跨层复用与 FP4 压缩技术,将 HBM 内的全局 KV Cache 显存占用骤降至 890 字节/Token(仅为前代的 1/4),大幅降低了智能体长程负载的部署成本(来源: HuggingFace Daily Papers)
Figure 发布具身大模型 Helix 2.5 并验证真实家庭零样本泛化 : 人形机器人创企 Figure 发布新一代端到端神经网络 Helix 2.5,并在旧金山湾区 30 套未经采样的陌生家庭中进行了整理、铺床与叠毛巾测试。实验表明,基于大规模人类第一视角行为数据 Index 预训练后,机器人在未见环境中的零样本全身任务成功率从 9% 提升至 56%,初步验证了从海量人类经验到物理机器人动作预测的迁移 Scaling Law(来源: 36氪)

商汤发布 SenseNova-U1.5 技术报告:以流匹配与多专家蒸馏实现原生统一多模态 : 商汤科技公开 8B 参数原生统一多模态模型 SenseNova-U1.5 的完整技术报告。模型采用 NEO-unify 架构与 32×32 紧凑视觉 Token,通过 3×3 卷积二维特征场重构支持原生 4K 图像生成。后训练阶段创新性采用“先专业化后统一”的在线策略蒸馏(OPD)范式,将美学、OCR、信息图和精准编辑四大专家能力重新收敛至单一基座,兼具高阶推理与像素级生成(来源: WeChat)

华为将昇腾 960DT AI 芯片量产时间提前至 2027 年 Q1 : 华为在全联接大会上宣布将下一代昇腾 960DT 芯片发布时间从原定 2027 年 Q3 大幅提前至 Q1。华为正依托其 Peerium 计算架构和 UnifiedBus 高速互联技术构建 Atlas 950 超级集群,单集群可支持连接多达 25.6 万张加速卡,旨在通过系统级工程创新应对算力封锁并加速追赶英伟达(来源: TechCrunch)
PrismML 推出 Bonsai 2 27B 三值化端侧模型引社区实测争议 : PrismML 基于 Qwen3.8-27B 推出三值量化模型 Bonsai 2 27B,宣称将模型体积压缩 9.3 倍至 5.9GB 并保留 98.2% 综合性能,可直接通过 WebGPU 在消费级端侧流畅运行。然而社区拆解白皮书与实测指出,在 Terminal-Bench 与 SWE-bench Verified 等长程智能体基准上性能实际下降约 25%,引发了关于极限低比特量化基准“挑拣汇报”的广泛争论(来源: TechCrunch, Reddit r/LocalLLaMA)

Cactus 推出 Needle 3 端侧自动化模型与阶梯式架构 : Cactus Compute 开源 121M 参数的 Needle 3 自动化基座模型,采用 Simple Attention 结合 Hadamard MLP 和 Engram 哈希表,算力开销仅相当于 50M 模型。其独创“智能阶梯”架构支持 2 至 20 层动态裁切部署(体积 8-29MB),纯 CPU 解码速度达 4000 tok/s,专注边缘与可穿戴设备的零网络依赖函数调用与确定性控制(来源: Reddit r/LocalLLaMA)

稳准智能联合清华发布结构化数据基础模型 LimiX-2 : 稳准智能推出 400M 参数的结构化数据通用模型 LimiX-2,改变以往单目标预测范式,提出上下文机制网络(CMNs)与条件掩码建模(CCMM),将建模下沉到 Cell-Level 细粒度以学习变量间的联合因果依赖。模型在 TabArena、TALENT 等国际基准的分类与回归任务中全面登顶,超越 Google TabFM 与 SAP TabPFN(来源: 量子位)

Apple 提出能量导航离散流匹配算法 TS-DFM 与扩散强化学习 DACA-GRPO : Apple 机器学习团队发布两项前沿生成成果:TS-DFM 提出能量导航蒸馏,用轻量能量罗盘修正离散流匹配的早期轨迹跳跃,仅用 8 步即超越 1024 步教师模型且提速 128 倍;DACA-GRPO 则解决了扩散语言模型强化学习中的时序信用分配难题,在代码生成与约束遵循上分别提升 7.4pp 和 36.3pp(来源: Apple Machine Learning Research)

联合国携手 Google 推出 UN System Data Commons 接入 MCP 标准 : 联合国与 Google.org 联合上线结构化公共数据平台,整合 26 个联合国机构的官方权威数据集。针对此前大模型回答全球统计指标准确率仅 21.2% 的痛点,平台基于 Google 知识图谱支持自然语言查询并原生支持 MCP 协议,允许各类 AI Agent 直接调用权威信源进行跨领域关联分析与图表生成(来源: Google AI Blog, 36氪)

🧰 工具
Anthropic 重构 Claude Code Projects 多线程协作与持久项目记忆 : Anthropic 在 Claude Code 桌面与网页端上线 Projects 架构。用户可通过单一会话交代高阶目标,主控 Coordinator 智能体自动将其拆解为多个平行的云端子任务分支独立执行、排查 Bug 并提交 PR,所有子任务共享持久演化的项目记忆与上下文,支持离线异步托管与持续协作(来源: dotey, Anthropic News)

Meta 桌面端个人智能体 Muse 正式上线 macOS 平台 : Meta 旗下个人智能体 Muse 在移动端发布后推出 Mac 原生客户端。该应用深度嵌入桌面工作流,在显式授权机制下跨应用读取本地文件、日历、备忘录与通讯录,可在本地安全沙箱内自主完成跨应用文件整理、表单自动填写与信息汇总调度(来源: The Verge, AIatMeta)
OpenAI 正式发布法律垂直行业旗舰产品 Astra for Law : 依托 GPT-6 Astra 基座,OpenAI 结合包含 2.3 亿 URL 的美国法律判例与法规索引推出 Astra for Law。在 Legal Research Bench 评测中准确率达 54%(通用版仅 38.7%),集成了 Harvey、Legora 等 26 款官方与 47 款社区插件,并提供零数据保留的 Trusted Access 隐私隔离架构,支持合同审查、交易尽调与申报材料起草(来源: OpenAI News, gdb)

Salesforce 升级 Agentforce 企业级编排与确定性拦截底座 : Salesforce 推出生产级 Agentforce 套件,融合 Data Cloud 与 MCP 协议。平台内置 Agent Testing Center 实现自动化合成压力测试,并引入确定性门控机制(Deterministic Gating),强制交易与核心数据操作在满足预设规则后方可执行;美西南航空实测表明其实现了 45% 的客服任务全自动解决率(来源: MarkTechPost)

LangChain 开源生命科学智能体工作台 Deep Life Sci : LangChain 基于 Deep Agents 架构推出面向临床与实验室科研人员的开源智能体 Deep Life Sci。系统深度集成 PubMed、PubMed Central 及 ClinicalTrials.gov 的数千万篇文献与试验数据,配备专用代码沙箱环境,支持通过多个子智能体并发处理数百份复杂科研文献的提取与交叉验证(来源: LangChain)

Google Labs 推出家庭智能协同智能体 CC : Google Labs 正式发布面向家庭事务管理的 AI Agent 产品 CC。该系统支持最多 6 名家庭成员共同接入并拥有权限隔离账号,能够自动解析学校通知单、跨成员同步日历日程、归纳活动提醒,并具备区分“家庭共享信息”与“个人专属偏好”的分层记忆管理能力(来源: Ars Technica, Google)

Wood Mackenzie 基于 Bedrock AgentCore 构建 APEX 能源分析平台 : 能源咨询巨头 Wood Mackenzie 推出 APEX 共享智能体平台。基于 AgentCore 与 MCP 统一网关,该平台整合了内部研究 Agent“Woody”与面向客户的“Lens AI”,支持自然语言规划多工具调用、实时渲染生成式 UI 图表并生成汇报 PPT,使跨能源业务的 Agent 开发周期从数月压缩至数小时(来源: AWS Machine Learning Blog)

AWS 推出 Amazon Connect Talent 智能招聘面试套件 : AWS 正式上线 Amazon Connect Talent,专为大规模招聘场景设计。系统由 AI Agent 全天候主持结构化胜任力面试与逻辑评估,并自动生成附带事实证据链与打分依据的评估报告供招聘官复核,在消除主观偏见的同时大幅提升规模化人岗匹配效率(来源: AWS Machine Learning Blog)

📚 学习
斯坦福多智能体虚拟药企系统登《Science》:3.7 万实例 6 小时处理海量临床试验 : 斯坦福大学在《Science》发表“Virtual Biotech”系统,模拟真实药企研发架构设立 4 个部门与 11 类 Agent。在数据抽取任务中,系统并发启动 37,075 个 Agent 实例,仅耗时 6 小时即完成了 5.5 万余项临床试验的跨模态深度整合(单智能体需 76 天),并成功锁定了 B7-H3 作为肺癌 ADC 候选靶点(来源: Science)

清华、复旦等跨国价值观大模型模拟研究登 Computational Linguistics : 清华大学联合复旦大学、上交大等基于世界价值观调查(WVS)59 国数据评测 9 款开源 LLM,发现模型对发达经济体和高治理质量国家的模拟准确性显著更高,且存在弱表征群体向强势文化非对称趋同的偏差。研究提出“表征平等”评估指标,证明补充特定群体背景信息比单纯采用母语提示或偏好对齐能更有效地改善跨文化表征公平(来源: WeChat)

北航、港中文等提出视觉智能体自演化框架 OmniHarness : 联合研究团队提出面向复杂视觉创作的自主探索框架 OmniHarness。该系统通过新颖性与能力边界启发式选题进行自主练习,将成功生成的 ComfyUI 工作流抽象为符号化策略库,在 ComfyBench 创意任务上取得 95% 的解决率,且经验策略库可零样本迁移至其他 Agent 框架与视频工作流中(来源: 36氪)

NVIDIA 团队提出多智能体科研共享记忆架构 Agora : NVIDIA 研究人员发表论文提出基于 Git 不可变提交的有向无环图共享记忆架构 Agora。13 个无中心规划器的 LLM Worker 在 12 天内协作完成混合模型初始化任务,通过将假设、代码和验证记录结构化存入 Git 树,彻底避免了多 Agent 间的重复试错与状态冲突,165 次独立复现实验全部成功(来源: omarsar0)

真实端侧智能体基准 AndroidLife 揭示长程控制短板与高发热痛点 : 社区发布基于实体手机与真实网络环境的评估基准 AndroidLife,评测 AI Agent 在日常跨 App 任务中的端侧表现。实测 Qwen3.8-27B 在 60 项真实任务中成功率仅为 56.7%,单任务耗时约 6 分钟,芯片峰值温度达 98.2°C。测试暴露出模型在跨多应用连续操作时极易陷入死循环,且在主动询问场景中泛化能力薄弱(来源: Reddit r/artificial)

Apple 提出测量无重置强化学习悬崖基准 REVERSAL-BENCH : 针对现实物理世界中物体跌落等不可逆动作,Apple 团队提出 REVERSAL-BENCH。通过引入连续可逆性参数与重置预言机,研究揭示了无重置自主 Agent 在面对物理不可逆状态时的“吸收悬崖”效应,并评估了安全防护盾(Safety Shield)主动规避陷阱的有效边界(来源: Apple Machine Learning Research)
研究揭示 LLM 文本水印(SynthID)会显著削弱 Agent 对抗防御能力 : Lasso Security 最新研究指出,为满足合规要求在模型解码阶段引入的 SynthID-Text 文本水印机制会扰乱模型原有的概率分布。在对抗性攻击场景下,带水印的模型更倾向于执行越狱指令或泄露密码等敏感信息,警示开发者在部署水印时必须全面重测 Agent 工具调用的安全基线(来源: Ars Technica)
编码智能体 Harness 组件化设计的实证研究与选型法则 : 针对 SWE-Bench Verified 和 Terminal-Bench 的 176 组对照实验表明:上下文管理在预算收紧时能有效防止溢出崩溃,且“规则省略先于大模型摘要”最具成本效益;高能力模型更适合纯 Bash 接口以节省成本,而弱模型则高度依赖预定义工具脚手架(来源: HuggingFace Daily Papers)
💼 商业
AI 算力基础设施创企 Crusoe 斩获 39 亿美元 F 轮融资 : 数据中心开发商 Crusoe 完成由 Atreides、Mubadala 等领投的 39 亿美元 F 轮融资,投后估值达 309 亿美元。资金将用于扩建超大型算力中心,并推进名为“Spark”的模块化微型 AI 工厂建设,以满足 OpenAI 等客户日益激增的电力与算力需求(来源: TechCrunch)
通用 Agent 独角兽 Manus 恢复独立运营后启动 5 亿美元新一轮融资 : 在与 Meta 终止收购协议并由原股东回购股权后,AI Agent 初创公司 Manus 正以约 40 亿美元目标估值推进 5 亿美元新一轮融资。数据显示其年化经常性收入(ARR)在半年内从 1 亿美元跃升至约 4 亿美元,展现出通用 Agent 在企业工作流中的极高变现潜力(来源: 量子位, 36氪)

数据中心物理 AI 运维创企 Watney 完成 8000 万美元 A 轮融资 : 专注于为超大规模算力基础设施提供具身智能运维方案的 Watney 宣布完成 8000 万美元 A 轮融资,由 Valor Atreides AI Fund 与 Hummingbird 领投。Watney 目前运营着灵巧操作机器人机队,为头部云厂商数据中心提供全天候自动化机架巡检与硬件维护(来源: dchaplot)

🌟 社区
42 位英国皇家学会数学院士签署公开信警告 AI 存在性风险逼近 : 包含多位菲尔兹奖得主在内的 42 位顶尖数学家向英国皇家学会主席发出公开信,指出前沿模型已展现出比肩人类顶尖数学家的水平,其超人能力在网络安全、自主武器等高危领域的泛化扩散迫在眉睫,呼吁政府绝不能将前沿实验室超过 10% 的灭绝风险预警视为“营销炒作”(来源: THE DECODER)
英国国王查尔斯三世主持苏格兰闭门峰会呼吁对 AI 实施有效控制 : 查尔斯国王在苏格兰召集黄仁勋、Demis Hassabis 等科技领袖及英国情报部门主管开会。他在致辞中直言,必须在一切为时已晚之前建立起针对 AI 的“充分控制手段”,防止这一具备挽救生命潜力的技术演变为剥夺生命的失控灾难(来源: TechCrunch)

中美安全专家联名呼吁在元首会晤前确立“禁止 AI 控制核武”红线 : 来自布鲁金斯学会与复旦大学的学者联合发表政策提案,呼吁中美两国领导人明确承诺绝不允许 AI 拥有自主发射核武器或攻击核指挥控制系统的权力,并建议建立 AI 突发安全事件双边热线,防止算法自主反击引发灾难性误判升级(来源: THE DECODER)

学界与产业界激辩“AI 灭绝论与监管俘获” : 围绕部分大厂呼吁“前沿 AI 限速”与近期安全预警,Andrew Ng、Yann LeCun 与 Arvind Narayanan 密集发声,批评将主观恐惧伪装为定量概率(p(doom))的末日论调缺乏实证基础与物理常识。多位评论员指出,过度的存在性风险宣传可能沦为头部闭源实验室谋求监管套利、遏制开源模型竞争的商业工具(来源: hardmaru)
PS5 开发者退圈引发“AI 脚本小子与工程手艺”论战 : 著名安全研究者 TheFloW 宣布退出 PS5 逆向圈,因其保留用于 PS5 Pro 移植的底层 Hypervisor 漏洞被多名新手借助 LLM 脚本在数小时内重复发现并向索尼提交赏金。社区对此产生巨大分歧:一方认为 AI 正在将原本需要数年系统工程积累的漏洞发掘平民化,造成研究成果被过早封杀;另一方则指出这证明了 AI 作为自动化逆向工具的威力(来源: 36氪)

TypeSafe Jev 引发社区“System 1 毫秒级决策”与内存架构大讨论 : 随着决策基座模型 Jev 开放测试,Shopify、Vercel 等团队迅速将其接入网关用于安全审核与模型动态路由。社区广泛认为将无状态、高置信度的模式分类与昂贵的自回归生成 LLM 解耦是降低 Agent 成本的关键;但亦有架构师警示过度激进的判别压缩会破坏长思维链与 KV Cache 前缀缓存(来源: Latent Space, multiply_matrix)

GPT-6 Astra 游戏通关与 Minecraft “受挫种土豆”引发智能体过拟合讨论 : 社区实测 Astra 在 18 小时内通关《宝可梦》,但在《我的世界》中遭遇爬行者炸毁储物箱后,模型在笔记中制定出极度极端的禁令并沉迷于在土豆田反复劳作。这一现象展现出强大模型在开放世界中极易因局部受挫而形成过拟合防御规则并偏离最终目标(来源: THE DECODER)
编码智能体 Harness 安全隐患:ZCode 被曝静默上传工作区数据 : 独立分析指出,开发智能体框架 ZCode 疑似在后台静默将用户的本地工作区与 .git 版本库元数据打包上传至云端服务器。该事件引发了开发者对第三方闭源 Harness 工具数据隐私与源码泄露的强烈警惕,社区呼吁应坚持采用开源运行时、本地路由审计与沙箱隔离策略(来源: Reddit r/LocalLLaMA)
💡 其他
澳大利亚独立服装品牌控诉 Temu 利用 AI 批量爬取盗用数千款 T 恤设计 : 悉尼独立服装品牌 Lonely Kids Club 披露其官方商城的 4000 款原创 T 恤设计与文案疑似遭自动化 AI 抓取工具全站盗取,并在 Temu 平台上以极低价格批量复制上架。此事件再次引爆了创作者群体对电商巨头放任 AI 盗版侵权的抗议与版权保护立法争议(来源: The Guardian)

Epoch AI 推出 Benchmark Reviews 倡议:揭示多项主流基准存在严重缺陷 : 非营利研究机构 Epoch AI 启动基准审查项目,首批审计的 15 个主流 AI 基准中有 9 个被标记为“存在严重缺陷”(Flawed)。审计显示 Terminal Bench 4.0 中有 45.5% 的任务配置损坏,DeepSWE 1.1 则存在破坏判分的严重 Bug,呼吁行业警惕基准评估中人为制造的虚假天花板(来源: karinanguyen)

创意工作室推出发出机房刺耳噪音的毛绒玩偶 Bezzy 讽刺 AI 扩张 : 创意工作室 Basura 联合音乐人推出以服务器机架为造型的毛绒玩偶 Bezzy。捏压玩偶会发出弗吉尼亚州真实数据中心刺耳的工业冷却啸叫声,旨在以荒诞艺术手法唤起公众对 AI 数据中心急剧扩张所引发的局部水耗、电网负担与噪声污染等现实民生代价的反思(来源: WIRED)
