🔥 聚焦
Moderna与默沙东个性化mRNA癌症疫苗III期临床试验取得历史性成功,AI算法精准锁定新抗原 : 全球mRNA巨头Moderna与默沙东联合宣布,双方合作研发的首款个性化mRNA癌症疗法intismeran autogene(mRNA-4157)联合KEYTRUDA(K药),在针对高危黑色素瘤的全球III期临床试验(INTerpath-001)中取得历史性突破,无复发生存期(RFS)与无远处转移生存期(DMFS)两大关键终点全部达标。该疗法在设计端由深度整合的AI算法从肿瘤基因测序数据中评估多达34个最具免疫原性的专属新抗原,并在45天内完成患者专属mRNA定制。临床数据显示其将复发或死亡风险大幅降低49%,标志着“AI靶点筛选+个性化mRNA”肿瘤免疫治疗正式跨入III期临床验证与商业化落地阶段。(来源:MIT Technology Review)

通用具身智能创业公司Generalist发布GEN-1.5模型,实现机器人单次示范零微调在轨学习 : 通用具身智能创企Generalist正式发布物理世界基础模型GEN-1.5。通过在海量真实物理交互数据上开展超过8个月的大规模预训练,GEN-1.5展现出强悍的物理上下文学习(In-Context Learning)与物理提示(Physical Prompting)能力。用户只需向机器人提供一段3至12秒的人类示范视频作为物理Prompt,机器人无需任何微调即可直接泛化并执行开瓶盖、抽纸巾、工具操纵等新任务。测试显示零微调单次示范成功率达59%,经5分钟数据微调后可提升至83%,被行业评估为具身机器人领域的“GPT-3时刻”。(来源:Generalist AI)

英伟达Vera Rubin架构首批算力机架正式交付OpenAI,支撑下一代前沿模型预训练 : OpenAI与英伟达联合宣布,双方算力合作迎来重要里程碑:首批Nvidia Vera Rubin架构算力机架已正式送抵OpenAI并完成组装,成功接入其底层训练栈。该批机架将直接用于拓展OpenAI下一代前沿AI大模型的预训练算力池,标志着英伟达全新一代加速计算平台正式投入全球最顶尖大模型的生产环境。(来源:Nvidia News)

Slack推出Slack Code开启“多人群聊编程”,集成Anthropic、Devin及GitHub等智能体 : Salesforce旗下Slack正式发布Slack Code,将AI编程智能体从传统的单人终端和IDE引入到企业协同群聊中。团队成员可在Slack频道内直接@智能体,自动生成专属Code Channel,实现人类开发者、产品经理与Devin、Claude Code、GitHub Copilot、ChatGPT等AI Agent在同一频道内的实时协作与代码审阅。智能体可继承Slack现有的安全策略与权限体系,在执行高危操作时必须由人类专家二次审核,标志着AI编程工具向多人群聊协同平台的范式转变。(来源:Salesforce / Slack)

🎯 动向
开源大模型Ornith-1.5发布,主打端到端自我进化路线 : 开源大模型团队Ornith正式发布Ornith-1.5系列模型,包含9B Dense、35B MoE以及397B MoE三种架构,采用MIT开源协议。模型通过自主提出新任务、自动构建脚手架和自我对弈生成解法开展强化学习,在SWE-bench Verified(86分)和Terminal-Bench 2.1(86.1分)等基准上达到开源同体量顶级水平,已原生集成至vLLM与Ollama生态。(来源:Ornith AI)

DeepSeek Harness发布v0.1.0-rc.8预发布版本,全面增强多模态与子代理编排 : DeepSeek将其开源Agent框架DeepSeek Harness升级至rc.8版本。新版为DeepSeek模型适配器增加了原生图片请求支持,/goal与/plan指令支持图文混合输入;同时将Claude Code与Codex进一步集成入子代理体系,支持作为Profile Bundle按需安装及多实例并发运行,并大幅优化了Windows PTY终端与web_search并发体验。(来源:DeepSeek Release)
.jpg)
Liquid AI推出LFM2.5-DSpark蒸馏草稿模型,推理速度提升高达3.2倍 : Liquid AI针对旗下的LFM2.5-1.2B、2.6B及8B-A1B模型推出了仅约300M参数的DSpark投机采样草稿模型。该模型结合并行骨干网络、马尔可夫接续头与置信度剪枝,在保持与目标模型贪婪解码输出100%一致的前提下,将H100及MacBook本地端侧推理速度提升2.1倍至3.18倍,显著降低Tool-calling延迟,并已同步支持llama.cpp与SGLang。(来源:Liquid AI Blog)

Meta推出Meta AI Mac独立桌面版,主打系统级语音听写与跨应用屏幕感知 : Meta发布基于Muse Spark模型的Mac版Meta AI桌面应用,支持通过全局Fn快捷键实现跨应用的实时高精度语音听写,并允许用户共享当前屏幕窗口供AI实时感知与辅导。该应用还可连接Google Workspace及Instagram/Facebook商家后台进行营销效果诊断与文档自动生成。(来源:TechCrunch)

OpenAI为ChatGPT桌面端推出Apple Messages插件并预告“私密安全处理”机制 : ChatGPT桌面端和Codex新增Apple Messages插件,允许用户在本地授权下通过自然语言检索、总结历史短信并草拟回复。同时OpenAI预告了“私密安全处理(Private Safety Processing)”技术,旨在保持零数据留存(ZDR)的前提下,通过加密安全信号跨会话识别高危滥用行为。(来源:OpenAI News)

🧰 工具
Superwhisper开源S1-mini端侧文本规范化模型,462MB实现语音转写极速纠错 : Superwhisper开源了专门用于语音识别后处理的文本规范化模型S1-mini。该模型基于Qwen3-0.6B微调,体积仅462MB(Q4_K_M GGUF),可完全在Mac/PC本地CPU上运行,能自动去除口语语气词、修正口误、补充标点并规范数字、邮箱与日期格式,token准确率达94.8%。(来源:Superwhisper / Hugging Face)

Chroma发布“Foundation”记忆引擎,为Agent构建自进化长期记忆 : Chroma正式发布了专门面向智能体长周期会话的自我进化记忆解决方案Foundation。该引擎能够从智能体历史运行Trace中自动提取结构化经验、策略偏好与上下文关联,并在后续会话中动态唤醒与更新,有效解决Agent跨Session记忆遗忘与模式僵化问题。(来源:Chroma)

腾讯开源AI Red Teaming平台AI-Infra-Guard (A.I.G) : 腾讯朱雀实验室开源全栈AI红队安全评估平台A.I.G,集成Agent Scan、Skills Scan、MCP Server Scan及AI基础设施漏洞扫描(涵盖2000+ CVE规则与130+组件),并内置Agent技能安全基准SkillTrustBench,帮助企业检测智能体越权、指令劫持与供应链漏洞。(来源:Tencent / GitHub)

📚 学习
陶哲轩发表ICM 2026长文:AI时代数学研究的五阶段“问题-解决管道”与认知危机 : 菲尔兹奖得主陶哲轩发表最新论文,指出AI大规模参与数学研究将引发自哥德尔时期以来最大的价值危机。他提出将数学解题拆解为“生成-验证-阐释-共同体接受-理论规范化”5个阶段,强调仅靠AI给出正确证明并不等于完成数学工作,人类数学家必须承担起证明阐释与理论规范化的不可替代职责。(来源:THE DECODER)

智谱AI唐杰分享后训练Scaling Law:参数量不再是衡量智能的唯一尺子 : 智谱联合创始人唐杰详细阐述了GLM-5.3背后的后训练 scaling 思考。GLM-5.3在未更换743B底座(激活40B)的前提下,纯靠长周期环境强化学习使编码能力提升50%。他提出模型能力由底座大小、数据量、前向计算量及后训练共同决定,在现阶段,提升有效深度与推理链长度的后训练拥有巨大潜能。(来源:dotey / 智谱AI)

谷歌与DeepMind提出Recirculation机制:无须重训即可让Transformer实现深层激活回流 : 论文提出在不修改预训练模型梯度的前提下,在推理阶段引入深层表示向浅层回流的递归循环机制(Recirculation)。通过一个小巧的MLP动态预测回流系数,Gemma3在9个语言建模数据集上的困惑度降低23.0%,表现反超全量微调,GSM8K准确率提升约21%。(来源:DeepMind / 机器之心)

清华与微软等团队提出SPADE:基于可执行环境自对弈的长周期Agent自进化框架 : 论文提出SPADE框架,由同一个LLM分别扮演环境设计器(Environment Designer)与推理智能体(Reasoning Agent)。环境设计器自主编写带Gym接口的可执行代理环境与逐渐升级的任务,通过提示后悔度信号驱动强化学习,实现在无需人工干预情况下的开放式自主训练提升。(来源:HuggingFace Daily Papers)

💼 商业
Nvidia与Poolside达成60亿美元技术授权协议并追加10亿投资 : 专注于代码大模的AI创企Poolside与英伟达达成60亿美元非独家技术授权协议,英伟达同时对其投资10亿美元,使Poolside投前估值达到120亿美元。协议还包含109名Poolside员工获得英伟达工作要约,创下半导体与AI领域又一巨额交易。(来源:Techmeme / Newcomer)

Simile完成3亿美元融资并以20亿美元估值崛起,主打全人群合成仿真 : 源自斯坦福Smallville(25个AI Agent小镇实验)研究团队创立的Simile公司,在成立不足6个月内完成超3亿美元融资,估值飙升至20亿美元。该公司利用海量真实人群访谈数据构建合成人群,用于在真实投放前预测产品、定价与政策的市场反应。(来源:The Turing Post)

Ramp推出AI模型路由服务“Router”,与OpenRouter及Stripe展开正面竞争 : 企业支出管理巨头Ramp正式推出自主AI模型路由服务Router.com,提供OpenAI、Anthropic、DeepSeek、Moonshot、xAI等多家模型的统一API接入,并支持基于成本、延迟及自定义评测指标的动态路由策略,直接介入企业的AI Token支出管理。(来源:TechCrunch / Ramp)

🌟 社区
开发者热议AT&T等大企“去前沿依赖”:40%企业AI流量转向开源模型降本56% : 社区热议AT&T等大型企业将40%的员工AI流量路由至开源模型(计划升至60-70%),在质量仅下降2%的情况下使编码成本骤降56%(日均处理450亿Token)。这证实了顶级实验室最担忧的趋势:企业正将非核心任务大规模转向高性价比开源模型。(来源:TheZachMueller)

Grok Bot掀起“15秒手搓应用”热潮,被誉为AI时代的又一“Claude Code时刻” : 硅谷投资人与开发者纷纷晒出Grok Bot体验,称其“零配置云端VM+多智能体协同”的体验让生产力提升百倍。用户只需几句自然语言即可在15秒内生成一个带独立域名的完整可用应用,引发关于“一人公司”与智能体原生工作流的广泛讨论。(来源:grok)

OpenAI与Anthropic先后推出无保留数据/私密处理策略,回应企业级隐私安全焦虑 : 面对企业对前沿模型隐私及合规的担忧,OpenAI发布Private Safety Processing,Anthropic亦宣布将于今秋为Mythos级高级模型推出零数据留存(ZDR)及客户自控数据策略,显示出前沿实验室在争夺企业客户时对隐私保护的全面内卷。(来源:Bloomberg / OpenAI)

美国多州政客因“数据中心电网与水资源争端”引发选民反弹,AI基础设施面临地方政治阻力 : 美国共和党参议院委员会发出内部警示,称数据中心建设带来的水电资源争端和电费上涨已在俄亥俄、德克萨斯等地引发强烈公众反弹,德州已暂停多达1800个数据中心项目,AI基础设施落地正成为大选季最具政治敏感性的地方议题。(来源:EERandomness / MIT Technology Review)

💡 其他
Anthropic上线免费Claude Academy学习平台 : 随着IPO临近,Anthropic正式推出了面向公众的免费学习平台Claude Academy(academy.claude.com),涵盖从AI基础概念到高级Prompt工程与Claude Code使用的全套课程,并提供完成认证证书。(来源: Claude)

Cloudflare修复Workers平台中可被利用的远程Spectre侧信道漏洞 : Cloudflare安全团队披露并修补了一个位于Cloudflare Workers边缘计算平台上的远程Spectre侧信道漏洞,该漏洞曾可能允许攻击者跨租户读取内存数据,目前未发现线上实际利用记录。(来源: Cloudflare)
Gemma开源大模型家族全球下载量突破10亿次大关 : 谷歌DeepMind团队宣布其开源模型Gemma系列全球累积下载量已突破10亿次,社区衍生出超过10万个Gemma微调变体,涵盖从卫星边缘计算到离线移动端设备的广泛应用。(来源: Google DeepMind / Ollama)
