🔥 聚焦
特朗普宣布拟设立“AI Force”并任命AI沙皇 : 特朗普在社交平台公开将当前AI安全恐慌定调为由反对派挑起的“政治骗局”,并宣布将仿照太空军成立全新的“AI Force”以强化国家主导地位,同时计划近期任命一位高IQ的“AI沙皇(AI Czar)”。特朗普强调AI是产值可达美国GDP 25%的关键工业革命,美国绝不能在对华竞争中减速,对AI潜在滥用应由既有民刑法体系处理而非设立阻碍创新的新监管壁垒。此举让白宫与呼吁“全球前沿限速”的领头大厂及两党部分监管派形成公开对抗(来源:The Guardian)。

阶跃星辰正式发布Step 5 Preview多模态旗舰模型 : 阶跃星辰推出新一代旗舰基座Step 5 Preview,采用总参数600B、激活仅27B的稀疏MoE架构,原生支持1M上下文与全模态视觉输入。在最新升级的Artificial Analysis智能指数中斩获44分,跻身全球开源模型前三,单任务推理成本仅0.71美元。该模型针对长程代码工程、深度研报和金融尽调场景进行了长轨迹强化学习与92层超深架构优化,展现出极高的数据勾稽与复杂任务自主编排能力,计划于10月15日全量开源权重(来源:新智元)。

阿里Qwen团队开源Qwen-Image-2.1并发布实时同传模型 : 阿里通义团队正式开源轻量级图像生成与编辑统一模型Qwen-Image-2.1,该模型采用7B DiT架构结合Qwen3-VL-8B,支持原生2K生成、RGBA透明图层直接输出以及多达10张参考图的局部精准编辑,已获vLLM与ComfyUI首日支持;同日上线Qwen3.8-LiveTranslate实时同声传译模型,采用全新Interleave架构,将60种语言的平均翻译延迟降至2.3秒并原生支持流式说话人分离与音画上下文消歧(来源:Alibaba_Qwen)。

GPT-6 Astra攻克FrontierMath重大进展级数学难题 : 在全球顶级数学基准FrontierMath中,GPT-6 Astra联手多位顶尖学者攻克了自2017年困扰社会选择理论的开放难题——“批准式委员会选举中核的存在性”。出题原意是寻找反例,Astra却反向证明核永远非空,并创造性提出基于“调和熵”的优化框架与多项式时间求解算法。该突破促使Epoch AI紧急为基准引入“Human + AI”全新标签,标志着大模型从被动解题正式迈入提出全新数学概念与规律发现的新阶段(来源:36氪)。

25位菲尔兹奖得主联合签署紧急声明抗议AI巨头“掠夺式解题” : 陶哲轩、埃菲·杰曼诺夫等25位菲尔兹奖得主联合发表《人工智能在数学中的严重错位》公开信,严厉抨击科技巨头将数学难题沦为模型跑分与IPO营销噱头。杰曼诺夫在专访中直指OpenAI利用上万并发智能体对数学家工作轨迹进行“明目张胆的学术掠夺”,警告缺乏概念性理解与知识传承的机器暴力破解正在颠覆学术培养体系,将使年轻一代数学家面临失去生存空间的严重危机(来源:每日经济新闻)。

🎯 动向
Anthropic被曝密集灰度测试Fable 5.2与Opus 5.2 : 开发者社群捕获Anthropic在Claude Code、Chat及Cowork中对Fable 5.2与Opus 5.2(内部代号Opus-Next)展开大范围流量灰测。实测显示新模型在复杂物理工程、前端架构及3D资产构建上呈现越级提升,高推理模式下输出深度明显超越Astra,但伴随较明显的慢思考延迟与算力开销上升。分析指出,面对Astra近两周抢走13%企业支出的严峻态势,Anthropic正计划打乱发布节奏提前祭出旗舰防御(来源:新智元)。
谷歌内部数学特化模型DeepThink Mathematica意外泄露 : 科技社区流出谷歌内部评测模型“models/deepthink-mathematica-tf-raw-thoughts”的参数卡片与原始思维链日志。该模型具备65K最大输出与1M上下文,默认在Temperature=1的高发散度下运行;在攻克复杂多项式丢番图方程时,模型内部神经元在撞见对称化简路径时产生强烈奖励激增,并在未过滤思考日志中留下极具情绪化的大写感叹,展现出深度强化学习下的非传统直觉跳跃能力(来源:新智元)。

Aether AI发布因果世界模型CausalWM登顶TriWorldBench : Aether AI推出首个16B因果世界模型CausalWM,引入“因果思维链”(Causal CoT)范式。模型放弃直接从当前帧预测未来,而是显式分步推演光流运动与三维几何点云变化(Motion→Geometry→Future),并将前序预测重新注入上下文形成干预接口。该架构在机器人多视角基准TriWorldBench与物理规律评测PAI-Bench上均位列全球第一(来源:机器之心)。

大晓机器人联合高校发布可仿真人-场景交互重建框架HSImul3R : 大晓机器人携手南洋理工大学与上海AI Lab提出HSImul3R,成果入选ECCV 2026。该框架针对三维视觉中的“感知-仿真鸿沟”,采用物理闭环双向优化,将重力稳定性与接触可靠性引入重建,将穿模率从69.5%降至22.9%,并成功将日常单目视频中的人体交互经验提炼并迁移至Unitree G1人形机器人上稳定执行(来源:机器之心)。

Runway披露实时流式视频生成研究与自纠错架构 : Runway公开其实时可控视频流生成技术路线,该技术利用自回归因果扩散架构将画面延迟压至毫秒级,实现“边提示边推流”。针对自回归视频生成中微小瑕疵易引发全局画面崩溃的问题,Runway通过在带有自身偏差的输出上训练模型,构建了实时动态自纠错机制,为自动驾驶长程仿真与交互式世界模型奠定基础(来源:THE DECODER)。

🧰 工具
TypeSafe Jev生态爆发与开源复现潮涌现 : TypeSafe AI推出的System 1决策模型Jev在社区掀起自动化集成热潮,APUS发布开源复现项目fast-browser-use打通本地离线执行,Bespoke Labs开源基于Qwen微调的Nimble 9B;LangChain推出Jev-as-a-Judge评测套件,实测单次判定耗时0.44秒、成本仅0.00035美元;社区更涌现出JevBench基准、fast-jev-compaction上下文压缩插件及智能模型路由器等丰富周边(来源:机器之心)。

Vercel Labs开源Generative UI框架json-render : Vercel Labs正式开源Generative UI框架json-render,旨在解决大模型前端生成中结构失控与样式幻觉问题。框架通过预定义组件目录、Zod严格类型验证与SpecStream增量流式渲染,使LLM仅在安全边界内生成结构化JSON,全套支持React、Vue、Svelte、Next.js以及基于Three.js的3D高斯泼溅渲染(来源:GitHub Trending)。
OpenClaw发布2026.9.5引入原子更新与插件热重载 : 开源个人Agent网关OpenClaw发布2026.9.5版本,合入4179个PR。核心新增“原子更新”机制,在升级前通过私有隔离环境对配置进行全量校验,验证失败即自动无缝回滚,确保Agent网关不中断;此外支持免重启插件热重载、跨多终端只读会话安全共享以及冷数据归档存储(来源:MarkTechPost)。
开源项目Editable-Design实现AI生图的语义解耦与图层编辑 : 面向视觉设计领域开源的Editable-Design框架,将AI生图从传统交付固定像素PNG转向结构化交付。视觉模型仅负责提炼构图、层级与色彩先验,由Coding Agent重建语义化HTML、真实文本与独立素材图层,支持用户双击改字、自由拖动图层并完整回放设计决策轨迹(来源:机器之心)。

微软开源学生数字分身系统StudentSim助力AI导师优化 : 微软与UIUC联合发布StudentSim,通过两阶段训练流水线(基础模型学习通用错误特征 + 少量记录个性化微调),在仅需数篇习作样本下即可精确复刻真实学生的认知漏洞与对提示的反应。在国际象棋、写作与数学评测中全面超越GPT-5.4,为AI教育产品提供了低成本闭环测试平台(来源:THE DECODER)。

📚 学习
Salesforce与UIUC提出KV Cache随机剔除策略Random Attention : 论文研究发现,在推理模型长链计算中,只要对输入Prompt进行完整保护,对模型自生成的Reasoning Trace在各头中独立随机丢弃KV,其在MATH500等六大基准上的准确率即可打平复杂的启发式评分算法,并在vLLM部署中因消除计算开销使推理吞吐提升32%–43%,揭示出长推理思维链本身存在极强的文本与多头表征冗余(来源:机器之心)。

清华团队揭示多模态大模型“视觉源幻觉”机制 : 清华大学在ACM MM 2026发表论文,指出在短答案与Yes/No问答场景中,多模态物体幻觉并非由语言先验主导,而是由视觉特征提取错误与图文嵌入崩塌引发。团队提出对抗属性翻转诊断探针AHAF与对抗对比微调ACFT,仅需COCO 0.9%数据量即可在零推理开销下大幅抑制幻觉(来源:新智元)。

VBVR-Pro构建300项视觉原生推理基准与可验证奖励体系 : NTU、CMU与UC伯克利等机构联合推出原生视觉推理套件VBVR-Pro,涵盖300项任务与125万条多模态数据,为其中100项任务开发出基于几何属性的确定性可验证打分器(与人类判断一致性超60%)。实验证实该打分器能作为RLVR的可验证奖励,促使多模态模型在去噪过程中学会自主修正视觉中间状态(来源:机器之心)。

无界进化开放科研Agent工作台Karl Workbench内测 : 无界进化发布科研智能体工作台Karl Workbench,基于递归科学发现(RSD)框架,将科学假说、文献、分析代码和可复现证据统一归档管理。在权威评测SciAgentArena中,其单细胞与空间组学数据分析通过率均达100%,综合表现位列所有参评AI系统首位(来源:机器之心)。

百度LoongForge开源并揭示无NVLink多卡VLA训练陷阱 : 百度百舸团队开源多模态具身模型训练框架LoongForge-VLA,技术报告详述在纯PCIe Gen5环境下将通讯量化为FP8的实战经验。研究发现盲目合并小参数AllReduce反而会破坏其与反向传播的计算重叠,导致通讯字节减半但训练步耗时未降,强调必须结合通信暴露面进行拓扑感知调度(来源:Reddit r/deeplearning)。
💼 商业
AI搜索优化独角兽Profound完成1.8亿美元D轮融资 : GEO(生成式引擎优化)开创者Profound宣布完成1.8亿美元D轮融资,由红杉资本与Kleiner Perkins联合领投,投后估值达18亿美元。公司专注帮助品牌追踪并优化在ChatGPT、Gemini等AI对话中的被推荐概率与形象,过去半年营收增长3倍,客户涵盖超三分之一的财富100强企业(来源:36氪)。
RISC-V云端AI算力芯片独角兽奕行智能完成近20亿元融资 : 奕行智能宣布完成近20亿元新一轮融资,投后估值接近150亿元,投资方包含华泰创新、中芯聚源等20余家机构。其首代Epoch芯片与64节点正交无背板液冷超节点集群已在运营商数据中心量产交付,新一代芯片已完成流片,在大模型PD分离场景下实现吞吐大幅提升(来源:36氪)。

具身世界模型创企极佳视界完成股改拟冲刺港股IPO : 极佳视界(GigaAI)正式更名为股份有限公司完成股改,投前估值约200亿元,计划最快于2026年底递交港交所上市申请。公司依托GigaWorld-1世界模型与通用大脑GigaBrain推进软硬一体具身方案,今年已完成35亿元融资,有望冲击“世界模型第一股”(来源:36氪)。
🌟 社区
Anthropic推迟IPO传闻与“安全降速”动机大辩论 : 《华尔街日报》等媒体披露Anthropic或将IPO推迟至11月,引发社区对于AI巨头“安全降速论”的深度审视。调查博主与分析人士指出,Anthropic早期投资者与核心评测机构METR之间存在复杂资金关联,“AI灭世”叙事或已演化为闭源巨头获取监管俘获与高额估值的商业闭环;与此同时,杨立昆等学者批评过度夸大存在性风险实质上是在打压开源竞争(来源:THE DECODER)。

YC与开发界热议“Harness比底层模型更关键” : YC Paper Club举办专题研讨指出,在ARC-AGI-3等基准中,同一GPT-6 Astra模型在不同Harness下得分从62.7%跃升至98.6%且成本下降34%。社区达成共识:随着基础模型能力逐渐趋同,状态分层管理、权限管控与子Agent调度的Harness架构正成为决定Agent能否在企业实际落地的核心胜负手(来源:36氪)。
Meta Muse个人智能体引发隐私与“认知负债”争议 : Meta桌面个人Agent应用Muse上线首周下载突破90万并在加拿大App Store登顶。然而其默认开启用户交互数据用于模型训练、不断引导关联银行及邮箱等高权凭证的做法引发数字隐私机构猛烈批评,多模态Agent全盘接管生活决策带来的“认知退化”亦成为社区反思焦点(来源:WIRED)。

开源权重模型在Vercel用量占比首超78% : Vercel AI Gateway最新数据显示开源模型Token调用量占比达78.4%,DeepSeek与Kimi等国产高性价比模型在开发端快速蚕食闭源API份额。开发者指出在生产级工作流中,以小参数模型处理常规高频任务、仅将1%极难决策交由前沿闭源模型的混合架构已成行业标准(来源:X平台讨论)。

💡 其他
具身智能与终端操作系统加速融合 : 启元机器人宣布接入腾讯WorkBuddy打通万种办公与交互Skill调用;华为HarmonyOS 7则升级HMAF 2.0智能体框架,支持端侧A2A(Agent-to-Agent)跨应用通信与状态自演化,推动消费级硬件从单指令响应跨入系统级自主协同时代(来源:机器之心)。

全球科技大厂掀起“.ai”顶级域名争夺战 : 随着安圭拉“.ai”域名注册量突破100万,阿里、腾讯等巨头密集通过UDRP国际仲裁收回被抢注的品牌域名,二级市场单域名交易屡破百万美元。域名已由单纯的网址入口演变为AI创业与品牌资本叙事不可或缺的稀缺“数字领土”(来源:36氪)。
AI“数字亲人留存”服务遭遇商业模式与伦理退场困境 : 随着HereAfter等多家主打AI语音与形象“复活”已故亲人的初创公司陷入停运或破产保护,数字永生赛道在面临用户心理脱敏、按月付费断流及知情权伦理争议的复杂现实,促使相关创企向活人数字分身与知识变现转型(来源:36氪)。