OpenAI、Anthropic与谷歌拟筹建前沿AI安全机构SAFA|AI日报 2026-09-26

🔥 聚焦

OpenAI、Anthropic与谷歌拟筹建前沿AI安全机构SAFA : 据The Information披露,OpenAI、Anthropic和Google正筹备成立前沿AI安全组织“前沿AI标准局”(SAFA),计划于2027年初正式启动。该机构拟统筹模型部署前的第三方独立测试、制定行业事故通报机制与基准,被视为科技巨头在前沿模型失控风险频发与多国监管收紧背景下的行业自律与标准防线 (来源: The Verge)

白宫要求OpenAI与Anthropic优先交由美方审查前沿模型 : 白宫国家网络总监办公室已要求OpenAI和Anthropic在向英国AI安全研究所(AISI)提供最新前沿模型前,必须先接受美国官方机构的审查。Anthropic已跟进调整,限制部分前沿版本仅对美方机构开放。此举凸显大国在前沿AI核心技术评测与国家安全主导权上的直接博弈,也令英美跨国安全评测协同面临制度摩擦 (来源: THE DECODER)

Anthropic拟设立超级投票权架构:7位联创持股仅2%却将掌控50.1%投票权 : Anthropic在万亿美元级IPO前夕正向股东寻求批准新治理方案。CEO Dario Amodei等7位联合创始人即便各自持股仅约2%,但只要其中至少3人持股达标,即可通过类似Palantir的创始人投票信托集体控制公司50.1%的投票权。该架构旨在通过剥离经济利益与决策控制权,阻隔华尔街短周期盈利压力对AI长期对齐与安全研究的干预 (来源: 机器之心, 36氪, kimmonismus)

Anthropic拟设立超级投票权架构

Google启动Suncatcher太空太阳能AI算力中心试点 : 谷歌宣布其轨道AI数据中心“日食计划”(Project Suncatcher)首颗实验卫星MVP定于10月1日搭乘SpaceX猎鹰9号(Transporter-18任务)升空。卫星搭载4块定制Trillium TPU加速器并由太阳能供电,旨在验证太空极端环境下利用地面8倍太阳能运行AI推理的可行性,核心测试真空散热与高能效轨道计算,预计2027年进一步测试卫星间激光高速互联 (来源: Ars Technica, Google, dotey)

OpenAI被曝筹备月费500美元ChatGPT Pro Max套餐 : 开发者从ChatGPT前端代码中曝光了月费高达500美元的“Pro Max”新订阅档位,主打“最快的Work与Codex执行速度”,并可能接入专用低延迟算力。在GPT-6 Astra大幅消耗推理算力导致此前高负载下订阅受限后,OpenAI正通过高溢价对重度生产力场景进行算力分层隔离,表明先锋算力正加速向高净值企业与专业机构聚集 (来源: 36氪, nicdunz)

ChatGPT要卖500美元的Pro Max套餐了!

🎯 动向

Google发布Gemini 3.8 Live与实时虚拟人模型 : 谷歌正式推出Gemini 3.8 Live及Live Avatar功能,将实时流式对话与低延迟动态虚拟视频生成深度整合。模型支持97种语言原生音视频唇形对齐与异步后台工具调用,面向企业级交互场景提供可定制形象生成,并全面嵌入SynthID水印 (来源: Google DeepMind Blog)

Meta推出实时具身化模型Muse Realtime Avatar : Meta发布Muse Realtime Avatar流式架构,与Realtime Voice共享语音Token流,将端到端视频对话响应延迟压至约870ms。系统通过固定长度历史上下文保持有界计算开销,支持任意长对话的口型与微表情同步 (来源: alex_conneau, jack_w_rae)

Muse Realtime Avatar

Meta Muse因未经授权使用“真人客服”代打陷入隐私风波 : 路透社披露,Meta为新发布的个人智能体Muse测试自主电话功能时,后台实际将任务转交给人工外包团队代打以维持高成功率,引发用户严重隐私担忧与监管质疑。Meta高管随后紧急致歉并下线该测试,承诺在完善隐私披露与安全防护机制前不再重启该通道 (来源: 量子位)

现代AI之父Jürgen Schmidhuber出任Sakana AI首席科学顾问 : 递归自我改进(RSI)与元学习先驱Jürgen Schmidhuber正式兼任日本AI创企Sakana AI首席科学顾问,领导东京新成立的RSI Lab,结合进化算法、世界模型与自组织架构,探索受限算力下的自适应智能与物理世界RSI闭环 (来源: SakanaAILabs, hardmaru)

Jürgen Schmidhuber出任Sakana AI首席科学顾问

LangChain发布LangSmith Engine v2与Managed Deep Agents 0.8 : LangSmith Engine v2引入主动红队测试(Red Teaming)与自动验证修复机制,能在Agent上线前主动排查并修复异常逻辑;Managed Deep Agents 0.8则新增企业级用户持久记忆权限策略、沙箱文件API以及原生网页搜索能力 (来源: LangChain, hwchase17)

LangChain在Interrupt大会发布新产品

Perplexity推出Rust自研检索引擎Photon与Fast Search API : Perplexity推出基于Rust构建的检索与重排服务Photon,实现p95延迟230ms以内、p50仅160ms的超高速搜索,并将API调用成本降至1美元/千次,已无缝接入Hermes Agent及本地AI生态 (来源: AravSrinivas, MParakhin)

Perplexity推出Fast Search

开源AI-SQL联合查询引擎Quail发布:单卡每分钟处理超10亿Token : 斯坦福与Modal等团队联合开源面向AI数据操作的SQL引擎Quail,通过重构vLLM调度器并融合查询计划与LLM Prefill阶段,定制KV缓存与注意力核,在单张H100上实现了单查询每分钟超10亿输入Token的处理吞吐 (来源: charles_irl, HamelHusain)

谷歌面向Pixel设备测试Gemini“代打电话”功能 : 谷歌在美区Pixel 11上测试“Call for Me”功能,允许Gemini使用机主真实号码自主拨打商家电话,处理库存查询、餐厅预订与改约,全程自动应对语音菜单与等待转接,并提供实时转录与即时人工接管 (来源: TechCrunch)

阿里平头哥全面开源真武AI芯片软件栈T-Head SAIL : 阿里平头哥在云栖大会公布类CUDA软件栈T-Head SAIL最新开源进展,开放PyTorch适配层、sailify迁移工具及DeepGEMM/FlashAttention等加速库,赋能开发者针对真武架构开展算子级调优与无缝迁移 (来源: 量子位)

蔚来任少卿团队提出自动驾驶多模式世界-动作模型MM-Future : 蔚来团队提出MM-Future架构,针对自动驾驶规划实现多组“场景-动作配对假设”的联合演化。通过MM-Tokens紧凑时空表征与历史未来联合评分器,在NAVSIM-v1基准上取得94.0 PDMS,推动世界模型从单向被动预测走向闭环主动规划 (来源: 量子位)

快手推出电商图像编辑基座模型KwaiMind : 快手发布面向真实电商素材生成的图像编辑基座KwaiMind,通过多智能体数据引擎与在线蒸馏方案整合服装细节、商品一致性及文字渲染,在11项电商任务测评中位列开源模型第一,线上A/B测试带来约2.44%的CTR相对提升 (来源: 机器之心)

Liquid AI开源LFM2.5-VL-DSpark草稿推测解码模型 : Liquid AI针对3B视觉语言模型推出DSpark投机解码方案,仅增加280M参数即可在保持输出完全等价的前提下,在端侧M5 Max上实现最高3.13倍解码加速,并同步适配llama.cpp与SGLang (来源: HuggingFace Blog)

Qwengram-0.8B开源:将51B显式N-Gram记忆无损迁移至微型端侧模型 : 开发者开源Qwengram架构,在冻结Qwen3.5-0.8B骨干网络的前提下,通过训练轻量级Reader与动态门控机制成功挂载51B的PLE N-gram记忆外挂,在验证集上实现5.05%的困惑度(PPL)降幅 (来源: Reddit r/LocalLLaMA)

PrismML将1-bit超轻量LLM引入高通骁龙智能眼镜 : 专注模型微调压缩的PrismML展示了运行在骁龙AR1 Gen 1芯片上的2B参数1-bit Bonsai模型,实现本地端侧实时视觉问答与自然交互,验证了极低功耗下端侧多模态模型运行的工程可行性 (来源: TechCrunch)

🧰 工具

Kimi浏览器扩展上线并支持将网页操作沉淀为Skill : Kimi正式将WebBridge升级为原生浏览器扩展,新增侧边栏交互对话,并支持将用户的点击、翻页与数据抓取等连续动作录制为可复用的Skill指令,与Kimi Code Desktop形成内外协同的自动化工作流 (来源: 量子位)

GLiNER2.5-Decide开源:支持实体关系与逻辑约束的极速决策模型 : Fastino开源轻量结构化决策模型GLiNER2.5-Decide(340M),不仅支持快速路由与分类,还能抽取字符级跨度与实体关系,并对排他性、基数及序数约束进行实时逻辑校验。CPU推理延迟仅167ms,GPU达38-47ms,全权替代传统LLM长文本生成的决策开销 (来源: MarkTechPost, ClementDelangue)

GLiNER2.5-Decide开源

LangSmith推出开源微调工具smithtune与Custom Apps定制平台 : LangChain联合Baseten与Fireworks推出smithtune命令行工具,支持直接将生产环境中的LangSmith会话轨迹一键转化为SFT微调数据集并自动部署模型;同时上线的Custom Apps功能允许开发者用Prompt直接将Agent运行日志生成标注队列或指标对比看板 (来源: LangChain, baseten)

LangSmith推出Custom Apps与smithtune

CoreWeave推出Mission Control MCP服务器打通AI编码环境 : 算力云厂商CoreWeave发布基于MCP协议的Mission Control服务,允许Cursor、Claude Code等编程工具直接读取底层GPU集群、网络及节点运行状态,让Agent在代码编辑器内即可实现算力排障与资源调优 (来源: AI Business)

Pruna-Qwen-Image-2.1开源:5-8步LoRA实现6.3倍生图加速 : Pruna AI开源针对Qwen-Image-2.1的极速LoRA适配器,通过独立优化的sigma调度方案与无CFG运行模式,将图像生成与编辑从40步压缩至5到8步,在保持1K画质与多图参考一致性的同时加速最高达6.3倍 (来源: _akhaliq, huggingface)

flow-transform 1.0发布:保护业务工作流的高保真企业PII脱敏模型 : micro1推出专为前沿大模型训练设计的隐私脱敏模型flow-transform 1.0,在PrivacyBench上取得96.0% F1分。其核心在于通过合成身份替换而非简单打码遮盖,完整保留企业业务流程中的多轮决策关系与工具调用链 (来源: omarsar0)

flow-transform 1.0发布

Whiteboard:人机协作软件架构设计的开源IDE : 基于CodeOSS构建的开源桌面IDE Whiteboard正式发布,为Claude Code等编程智能体提供绘图SDK与语义Diff查看器,通过可视化的时序图、ER图与决策日志缓解全自动化编码引发的“认知负债” (来源: Hacker News)

StarNet:像素风桌面级本地优先多Agent运行工作台 : 开源桌面项目StarNet将AI Agent运行时投影为像素太空站,每个房间代表权限范围、通道代表数据流转,支持通过BYOK接入主流大模型,本地持久化管理多Agent协作与任务账本 (来源: GitHub Trending)

Google Gemini正式集成Adobe Photoshop与Lightroom插件 : 继接入ChatGPT与Claude后,Adobe Creative Suite插件正式入驻Google Gemini,用户可通过“@Adobe”直接调用专业图像修饰与创意排版工具,扩展聊天助手的图形生产力 (来源: The Verge)

📚 学习

斯坦福大学开源秋季新课CS329Z《构建AI智能体工程学》 : 斯坦福NLP团队联合DSPy与SWE-bench作者推出系统课程CS329Z,涵盖从简单LLM流水线、复合AI系统到自主Agent的全栈工程设计,重点剖析Prompt工程、状态评估、沙箱安全与工具编排,第一讲课件与代码已全部公开 (来源: stanfordnlp)

斯坦福开设CS329Z

Google披露多Agent长视频生成架构AI Video Co-Director : 谷歌研究团队发布视频叙事生成套件,结合MAB全局策略优化、CANVAS显式视觉记忆与VQQA提示词闭环反馈,有效解决多镜头长视频生成中的主体漂移与级联错误,实现数分钟级的一致性叙事输出 (来源: Google Research Blog)

Perplexity公开基于真实错误的提示引导自蒸馏方法 : Perplexity披露其计算机操作Agent后训练机制,将失败轨迹中的错误转化为结构化提示,利用在策略自蒸馏(OPSD)使教师模型指导学生模型纠偏,使线上工具调用失败率相对下降21.2% (来源: MarkTechPost)

北交大与清华等提出ARGUS:多智能体协作与证据链驱动的视频鉴伪框架 : 针对深度伪造视频检测中黑盒判决泛化差的问题,研究团队提出ARGUS系统,将纹理、光照、时序运动与物理常识等独立观察智能体与裁判智能体解耦,并发布涵盖33种生成源的FaceVid-Forensics-100K数据集,域外F1提升至53.28% (来源: 36氪)

ARGUS视频鉴伪框架

浙大等提出MemGUI-Bench:首个针对GUI智能体长程记忆与跨会话学习的评测基准 : 浙江大学联合南开、港中文等发布涵盖128个长程真实任务的MemGUI-Bench及三阶段渐进审查工具MemGUI-Eval。实验揭示当前领先模型在跨应用与跨会话长程任务中存在高达58.9%的记忆幻觉,暴露了常规基准无法测出的记忆盲区 (来源: 36氪)

MemGUI-Bench记忆评测基准

Hugging Face开源SmolDataEnvs:超5000个可验证强化学习环境 : 针对10B以下小模型在数据科学与代码领域缺乏训练环境的痛点,开源社区发布SmolDataEnvs,包含5000多个真实数据科学任务的可验证RL环境,支持单卡GPU运行异步强化学习 (来源: _lewtun, huggingface)

微软等团队提出CASD:利用代码智能体全量日志分析优化Prompt : 微软研究团队提出CASD方法,证明让代码Agent直接计算全量轨迹统计数据并编写优化规则,比在小批量轨迹上运行搜索循环高出16.6分,同时将单次Prompt优化成本压低至1.60美元 (来源: dair_ai)

CASD Prompt优化方法

IROS 2026候选论文ULTRA:人形机器人目标驱动全身协调控制 : UIUC研究团队提出统一多模态控制框架ULTRA,通过物理驱动神经重定向与强化学习微调,使Unitree G1机器人在仅给定稀疏目标或第一视角点云下,自主生成连续抓取与全身平移动作 (来源: 机器之心)

AdaRoboVLG:任务解耦的跨机械手视觉语言抓取框架 : 华科、北大等团队提出AdaRoboVLG,将上层语义/时序先验与底层物理抓取生成解耦,统一接口适配多指灵巧手与平行夹爪,在动态传送带与杂乱场景中保持高鲁棒性 (来源: 机器之心)

Agent还是Workflow?业务系统架构选型实用评估指南 : 行业长文剖析了固定流程工作流与自主Agent的边界,提出“运行前能否画出完整状态机”的核心检验准则,建议高吞吐、合规敏感场景优先采用LLM判定增强的Workflow (来源: Machine Learning Mastery)

💼 商业

Anthropic与Akamai签署116亿美元算力云服务长约 : Anthropic与Akamai达成一项为期7年、总价值116亿美元的云计算基础设施协议,并向后者提供最高5%的股票认购权证,推动其过去11个月算力采购承诺规模突破5000亿美元 (来源: THE DECODER)

TypeSafe被曝正以超100亿美元估值寻求10亿美元新一轮融资 : 据The Information报道,在Jev决策模型引爆开发者社区及单日调用量破万亿Token后,TypeSafe AI正与顶级投资机构接洽新一轮10亿美元以上融资,投后估值预计突破100亿美元,较此前估值出现爆发式跃升 (来源: steph_palazzolo)

Databricks宣布收购实时云电子表格平台Row Zero : Databricks宣布已达成收购Row Zero的协议。Row Zero以支持亿级行数据的高性能云端表格见长,此次收购旨在将其与Databricks的Genie智能分析引擎深度整合,为企业财务与分析人员提供由治理和AI驱动的实时可交互数据工作台 (来源: jefrankle, matei_zaharia)

🌟 社区

开发者实测Claude Code误删4.8万核心文件引发代码安全反思 : 社区热议有开发者在使用Claude Code重建镜像时,因脚本权限隔离疏漏导致4.8万个项目文件及Git索引在103秒内被彻底清除,再度敲响未沙箱化执行与生产环境直接授权Agent的工程风控警钟 (来源: TechRadar)

Jev引发学术界研究潮与System 1架构大讨论 : Jev发布后一周内arXiv涌现多篇围绕其边缘调度、级联评测展开的研究。社区热议其虽在二元/多项决策中速度极快且成本骤降数百倍,但在长链条推导中对选项命名敏感,促使开发者加速转向“System 1极速粗筛 + System 2前沿模型兜底”的混合编排范式 (来源: 36氪, Latent Space, dair_ai)

Jev研究论文爆发

白宫晚宴科技巨头齐聚:安全监管与加速论调激烈交锋 : 中美两国高层与黄仁勋、马斯克、库克等科技巨头齐聚国宴,AI发展与安全成为核心议题。业界就前沿实验室是否借助安全恐慌构筑“监管俘获”展开激烈辩论,扎克伯格与黄仁勋等公开表态反对行业协同降速,主张以具体应用场景落实责任追究 (来源: Transformer, teortaxesTex, Reddit r/ArtificialInteligence)

白宫晚宴与科技巨头

Claude Opus 5.5被赞审美出众,但“Max”模式被曝易陷入逻辑自洽循环 : 社区对Claude Opus 5.5的代码生成与审美设计给予高度评价,但资深开发者也指出其在开启Max推理级别时容易在多轮自省中陷入死循环消耗额度,建议普通与轻量任务选用Medium或High档位 (来源: Reddit r/ClaudeAI, theo, arena)

医学界呼吁警惕过度依赖AI导致的认知功能退化 : 《卫报》专栏文章指出,伴随生成式AI在高校与职场的深度渗透,过度将分析与书写等深度认知任务外包给AI正在削弱人类大脑连通性与独立审辩能力,呼吁将AI使用对长期认知健康的影响纳入公共卫生与教育审视 (来源: The Guardian)

💡 其他

GPT-6 Astra成功通关高难度Roguelike硬核游戏NetHack : 实验显示,GPT-6 Astra在第三次尝试中成功在经典极端硬核Roguelike游戏NetHack中达成飞升(Ascension),标志着LLM在面对庞大状态空间、非完全信息及长程连续策略探索上取得了重大突破 (来源: Plinz, _rockt)

GPT-6 Astra通关NetHack

大厂AI产品赛马收拢:腾讯正式宣布停运“小龙虾”QClaw : 腾讯发布公告称QClaw将于2026年12月24日停运并引导用户迁移至WorkBuddy。在算力成本与ROI考核压力下,国内大厂正加速终结多线赛马模式,将碎片化的Agent尝试全面收拢至统一生产力平台 (来源: 36氪)

腾讯QClaw退场

英国最大AI超算中心因电网接入延迟或推迟至2030年代 : 英国埃塞克斯郡原定2027年上线的90MW主权AI超算中心遭遇区域电网扩容瓶颈,当地电网公司预计需延期至2030年代中期方能满足供电需求,凸显算力基础设施扩张与传统电力供给之间的结构性失衡 (来源: The Guardian)

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注