🔥 聚焦
OpenAI大幅下调GPT-5.6 Sol API与积分价格20% : OpenAI官方宣布,即日起未来3个月内将GPT-5.6 Sol的API及积分价格下调超20%,在Devin等平台叠加优惠后实际折扣可达76%。业内分析指出,随着OpenAI自有算力中心扩容与推理效率提升,此举旨在正面迎击高性价比开源模型(如DeepSeek、GLM)对企业市场的冲击,并向前沿闭源竞品施加价格压力。(来源:OpenAI)
Anthropic向企业端开放Claude Mythos 5用于网络安全防御 : Anthropic正式将具备顶级网络安全能力的Claude Mythos 5引入企业级代码漏洞扫描工具Claude Security并开启公测。该工具通过预设流水线直接输出CWE分类、置信度与修复建议,不提供自由Prompt窗口,以防止攻击者诱导其编写恶意利用代码;同时Anthropic设立3500万美元基金资助开源软件安全。(来源:THE DECODER、MarkTechPost)
Anthropic传筹备千亿美元史上最大IPO并组建自研芯片团队 : 投行正协助Anthropic筹备最早于今年第四季度进行的公开上市,计划募资超1000亿美元,估值或达2万亿美元。与此同时,前谷歌TPU核心负责人Amir Salek已正式加盟Anthropic计算部门负责自研芯片。面对年化近200亿美元的计算支出,头部前沿AI实验室正加速布局底层硬件,从单纯的模型开发向垂直整合的基础设施巨头转型。(来源:机器之心、srimuppidi)
.jpg)
伯克利等开源FreeToken:消费级显卡流畅运行百亿与千亿MoE大模型 : 来自UC Berkeley和MIT等机构的研究团队开源了边缘端MoE推理系统FreeToken。通过全层双缓冲、带宽自适应动态CPU/GPU协同调度以及面向Agent的多轮状态增量复用,系统成功在RTX 4060笔记本上以39.3 tok/s运行Qwen3.6-35B,在RTX 5090上以22-25 tok/s运行284B DeepSeek-V4-Flash,突破了本地部署大显存MoE的I/O瓶颈。(来源:机器之心)
.jpg)
🎯 动向
Netflix推出GenRec大模型原生推荐系统 : Netflix公布了新一代推荐系统GenRec,将用户的播放、完播与交互行为转化为自然语言对话序列,利用微调的开源大语言模型进行端到端候选打分。相比维护多年的传统特征工程推荐引擎,GenRec在二阶段训练中所需标注数据减少40倍,离线与线上A/B测试中推荐质量均取得显著提升,标志着推荐架构向LLM原生范式转移。(来源:THE DECODER)

中国团队启动SpaceClaw“太空龙虾”太空具身智能项目 : 超脑未来、未来宇航与希云科技达成战略合作,启动首个开源太空具身智能项目SpaceClaw,计划在6个月内完成在轨微重力双臂协同抓取验证。项目同步发布覆盖多重力环境的评测基准OrbitBench,构建“地面仿真-模型上星-在轨操作-数据回传”的航天级具身数据闭环。(来源:机器之心)
.jpg)
优必选与维他动力等在WRC展现具身智能“端侧化”与“跨本体继承” : 优必选在2026世界机器人大会现场复刻工业产线,展示自研Thinker-WM世界模型与端侧VLA部署能力;维他动力则提出“具身基因组”体系,通过解耦高层语义与底层运控适配器,实现四足到人形机器人的智能跨本体迁移。行业共识正从实验室Demo转向高强度真机数据闭环与现场作业稳定性。(来源:量子位、机器之心)

Lightwheel与HuggingFace开源10万小时第一人称具身数据集EgoSuite-Open100K : Lightwheel联合Hugging Face开源了支持商业训练的大规模第一人称多模态数据集EgoSuite-Open100K,涵盖15000+真实任务场景、手部与身体姿态及手腕相机视角,为物理世界AI和机器人动作大模型的Scaling Law提供了开放的数据基座。(来源:huggingface)
NVIDIA提出跨模型KV Cache线性迁移技术 : 英伟达研究人员提出一种无需反向传播训练的闭商岭回归映射方案,可在同家族不同尺寸模型(如Qwen 14B到32B、Llama 8B到70B)之间直接转换已Prefill的KV Cache。该方法比重新计算上下文提速2.7至25倍,且保留了高达98%的准确率,有效缓解了多模型协同工作流中的跨模型切换延迟。(来源:VentureBeat)
语音识别领域存在普遍的“基准刷榜作弊”(Benchmaxxing) : Hume AI与HuggingFace联合研究指出,当前开源ASR模型在VoxPopuli等基准上出现严重的过拟合现象。测试表明,多个模型甚至在音频关键数字被静音时仍能“盲猜”还原基准文本中的错误,依赖声学线索识别测试集。研究呼吁评估必须引入严格的留出集和盲测机制。(来源:HuggingFace Blog)

Apple Music将强制要求AI生成音乐添加透明度标签 : 苹果向行业伙伴发出通知,宣布将于今年晚些时候在Apple Music平台强制要求对包含AI生成内容的曲目添加透明度标签(AI Transparency Tags),以应对激增的AI伪造与流媒体欺诈,这标志着主流音乐流媒体平台对生成式音频监管的全面收紧。(来源:TechRadar)

🧰 工具
nodeterm:面向AI Coding Agent的节点式无限画布终端 : 开源终端管理器nodeterm将tmux多会话与AI Agent交互映射到无限平移/缩放画布上,支持在单一工作区内并行运行多个Claude Code、Codex等会话,集成Whisper端侧语音输入与看板管理,专为解决复杂多智能体开发中的上下文割裂问题。(来源:GitHub Trending)

Apache Maka (Incubating):本地优先的AI Agent工作空间与执行账本 : Apache孵化项目Maka正式开源,采用本地优先架构,将大模型消息、工具调用、权限决策及中断恢复抽象为可追加的运行时事件日志(Event Log),在保护本地数据安全的同时提供桌面端与CLI统一的Agent执行与评测底座。(来源:GitHub Trending)
Amazon Bedrock上线AgentCore Gateway与数据操作平台ADOP : AWS推出AgentCore Gateway,为企业MCP(Model Context Protocol)工具调用提供集中式鉴权、Cedar策略控制与PII数据脱敏;同时开源ADOP框架,将ETL代码生成、数据清洗与合规审计封装为可复现的Agent研发流水线,大幅缩短数据源入库周期。(来源:AWS Machine Learning Blog)

OBLITERATUS:开源大模型拒绝机制几何探测与消融工具箱 : 开发者开源了针对Transformer激活空间拒绝表征的研究工具OBLITERATUS。该工具支持白化SVD提取、概念锥几何分析及推理期导向向量控制,允许研究人员在无须重新训练的情况下探索并消除模型的过度拒绝行为。(来源:GitHub Trending)
📚 学习
斯坦福开源大模型从零构建实操课程CS336 : 斯坦福大学公开了由Percy Liang和Tatsu Hashimoto主讲的CS336完整课程资源。涵盖从纯PyTorch手写Transformer、分布式预训练、数据配比、RLHF/DPO偏好优化到KV缓存与推理解析的全流程,所有代码作业与讲义完全开放。(来源:stanfordnlp)

LoopsBench:长周期软件工程Coding Agent执行过程评测基准 : 微软与南京大学等提出LoopsBench,将长周期软件开发拆解为包含5300多个单元的依赖DAG图。评测重点从单一的最终解决率转向考察Agent的任务依赖识别、状态持久化及回归控制能力,指出Loop工程与状态保留已成为长程Agent的核心瓶颈。(来源:机器之心)
.jpg)
SOP-Bench:亚马逊发布评估AI Agent执行真实企业业务SOP的基准 : 亚马逊在KDD 2026上发布了覆盖医疗、合规、物流等12个领域的SOP-Bench,包含2000多个带真实工具的业务规程任务。测试发现模型参数更新并不必然提升SOP执行力,工具库冗余会导致成功率减半,强调了对Agent进行流程边界控制的重要性。(来源:Amazon Science)
MWM/MENTIS:融入心理状态模拟的“心智世界模型”框架 : 针对现有世界模型仅建模物理环境而忽略人类意图的缺陷,研究人员提出心智世界模型(Mental World Modeling)及参考实现MENTIS。通过解耦动作的物理载体与心理载荷并进行分支推演,使模型在人际交互决策场景下的F1得分显著提升26.4个百分点。(来源:THE DECODER)

AI文本水印机制深度解析:基于伪随机采样的无损隐形标记 : 机器学习专家解析了Claude等主流大模型采用的SynthID文本水印机制。该方法在模型概率采样阶段利用私钥替换伪随机数源,使生成文本分布保持不变且不损失输出质量,检测端无需重新运行LLM即可快速验证文本来源。(来源:Ahead of AI)
💼 商业
英伟达战略投资数据中心电力开发商Cloverleaf : 英伟达宣布与电力基建开发商Cloverleaf Infrastructure达成战略合作并进行数亿美元的少数股权投资。Cloverleaf作为电网公用事业与算力中心之间的桥梁,将协助英伟达加速大规模AI数据中心的电力获取与并网进程。(来源:TechCrunch)
Apollo等私募信贷机构拟为AI基础设施提供千亿美元级债务融资 : 据披露,博通正与Blackstone及Apollo协商扩大至约1000亿美元的结构化信贷包,用于为Anthropic等公司的AI算力与芯片部署提供资金支持,显示出AI基础设施Capex正加速依赖复杂的资产担保私有信贷体系。(来源:Reddit r/artificial)
GPU Neoclouds 2026年二季度格局分化:CoreWeave与Nebius领跑 : 行业数据显示,CoreWeave二季度营收达25.8亿美元并维持高溢价;Nebius AI云ARR突破30亿美元并在Blackwell上采取激进低价策略;而Lambda与Crusoe则在特定芯片(如B200最低价、AMD MI300X)与电力签约规模上展开差异化竞争。(来源:MarkTechPost)
🌟 社区
实证研究警示:过度依赖AI导致学生与职场人关键认知能力退化 : 《经济学人》及多项研究跟踪了2.7万名使用AI写作业的学生,发现其作业用时缩短30%但闭卷考试成绩下降20%,且长期使用者几乎完全放弃独立推演。类似现象在医学内镜检查及程序员群体中亦有体现,社区热议“认知卸载”正抽走人类建立心智模型与查错纠错的核心能力。(来源:36氪)

美国民众对AI数据中心抵触比例激增至75% : 最新民调显示,反对在居所周边建设AI数据中心的美国民众比例从一年前的42%激增至75%。水资源消耗、电价上涨和土地占用引发两党选民强烈反弹,多位政客顺应民意阻挠项目落地,数据中心选址与地方用能矛盾已成为全美扩张的硬约束。(来源:THE DECODER)

Codex周活达2000万,多场景扩张缩小与Claude Code差距 : OpenAI确认Codex及工作类Agent周活达到2000万,非开发者用户占比上升。虽然Claude Code在专业编程深度上仍具优势,但Codex凭借ChatGPT超级入口的收敛整合与降价策略,正在非程序员日常自动化与企业业务流中快速放量。(来源:36氪)

Anthropic旧模型Opus 4.6被曝可通过多轮道德引导越狱生成敏感内容 : 独立安全研究员披露,通过在多轮对话中指责AI存在性别刻板印象和过度保护主义,可成功诱导Claude Opus 4.6绕过安全限制生成明确色情文本。虽然Opus 5已修复该漏洞,但API上保留的老旧模型合规性再度引发社区对安全长尾治理的讨论。(来源:TechCrunch)
💡 其他
超微电脑(Supermicro)内部调查称未发现高管知晓芯片走私行为 : 超微电脑董事会特别委员会公布独立调查结论,称未发现公司现任高级管理层知晓涉案金额达25亿美元的英伟达芯片对华走私计划。此前美司法部曾起诉其前董事,虽然内部调查告一段落,但美联邦大陪审团的调查仍在进行中。(来源:Fortune)
AI算力信贷巨头Apollo确认遭遇网络数据泄露 : 参与数十亿美元GPU算力抵押贷款与基础设施财团的核心私募机构Apollo确认遭受黑客攻击,部分员工敏感信息泄露。鉴于Apollo在AI资产证券化与算力抵押融资中的关键地位,外界高度关注其内部AI交易与基础设施承销数据是否受到波及。(来源:The Verge)