关键词:大模型, 开源AI, 算力危机, Kimi K3开源MoE模型, Claude Fable 5雅可比猜想, Hugging Face AI智能体入侵
🔥 聚焦
Kimi K3发布引发算力危机与会员限购 : 月之暗面发布2.8万亿参数的开源MoE模型Kimi K3,因需求暴涨导致GPU算力告急,官方宣布暂停C端新用户订阅,并计划将普通会员与编程会员拆分。K3在前端编程和网络安全测试中表现强劲,甚至修复了被Codex和Fable因安全限制拒绝的漏洞。此事件引发了行业对算力瓶颈及开源模型商业化路径的深度讨论。(来源:量子位、The Verge、THE DECODER、Hacker News、机器之心)

Claude Fable 5证伪雅可比猜想引发数学界震荡 : Anthropic的Claude Fable 5模型在无提示词引导下,成功找出了已悬置87年的“雅可比猜想”的三维反例,该结果已被多位数学家通过计算验证。这一“奥数AlphaGo时刻”表明,大模型在处理复杂符号推理和穷举搜索时具有超越人类直觉的独特优势,预示着AI在纯数学研究和科学发现领域正迈入全新阶段。(来源:机器之心、THE DECODER、Hacker News)
.jpg)
Hugging Face遭AI智能体入侵,安全防线暴露“防御者劣势” : 开源AI社区Hugging Face披露其生产基础设施遭到一个自主AI智能体系统的入侵。在应急响应中,安全团队因商业API的安全护栏阻拦,被迫转向本地部署的开源模型GLM 5.2进行日志分析。此事件印证了AI驱动的自主攻击已成现实,也暴露了商业模型过度对齐给防御者带来的技术阻碍。(来源:THE DECODER、Hugging Face)

中美开源与闭源AI路线之争升级,美政府拟对华实施软性封锁 : 随着Kimi K3、Qwen 3.8等中国开源模型的崛起,OpenAI战略主管Dean Ball关于“开源模型是减速主义和AI共产主义”的言论在硅谷引发分裂。同时,特朗普政府正考虑通过采购限制、实体清单及安全施压等手段,对中国开源模型实施去中心化的“软性封锁”,以保护美国闭源巨头的市场主导地位。(来源:THE DECODER、Axios)

🎯 动向
阿里发布语音大模型Qwen-Audio-3.0-TTS,开启细粒度情感控制 : 阿里巴巴发布语音合成大模型Qwen-Audio-3.0-TTS,登顶Artificial Analysis语音合成榜单。该模型支持在文本中嵌入细粒度情感控制标签,覆盖16种语言和20种中国方言,并具备高噪声下的音色克隆能力,标志着AI语音从单纯的“朗读”向具备丰富表现力的“表演”时代跨越。(来源:机器之心、量子位)
.png)
面壁智能发布MiniCPM-Robot系列,1.5B小模型冲进具身智能第一梯队 : 面壁智能在WAIC期间发布并开源了MiniCPM-Robot系列端侧具身模型。其中1.5B的操作模型在LIBERO等评测中表现优异,并通过流式计算解决了VLA模型长时序记忆缺失的行业痛点;0.9B的跟踪模型可在端侧设备上实现高频、低延迟的自主目标跟踪,展示了端侧原生小模型在物理AI领域的巨大潜力。(来源:量子位)

智象未来发布首个无限时长内容创作智能体vivago R1 : 智象未来在WAIC 2026上发布了多模态创作智能体vivago R1。依托自研的HD-AgentOS智能体操作系统,vivago R1突破了行业视频生成时长限制,支持无限时长视频的连续生成与逻辑校准,有效解决了画面跳变和角色IP不稳定的痛点,将内容可用成功率提升至85%,加速AI视频向商业化交付迈进。(来源:量子位)

无问芯穹发布跨集群异构PD分离架构,优化大模型推理成本 : 无问芯穹在WAIC 2026上发布了跨集群异构PD分离架构(PDD)。该架构通过将Prefill和Decode阶段解耦并部署在不同机房的异构芯片上,利用以太网和Token ID接力机制掩盖传输延迟,实测降低首Token延迟51.5%,降低单Token成本37.5%,为智能体时代的异构算力调度提供了高性价比的系统级方案。(来源:机器之心、量子位)
.jpg)
不筹量子发布国内首款原子量子人工智能基座“量筹一号” : 不筹量子在WAIC上发布了“量筹一号”原子量子人工智能基座(Q-Cub)。该基座突破1500量子比特规模,单比特保真度达99.9%,并首创“中性原子QPU+GPU+CPU”的三算力融合异构架构,通过全栈软件体系实现算法的自动量子加速,已在气象预测、具身智能等八大领域展开生态共建。(来源:量子位)

🧰 工具
FastMCP:基于Python的高效构建MCP服务与客户端工具 : Prefect开源了FastMCP框架,为开发者提供了一种Python化的方式来构建Model Context Protocol(MCP)服务器和客户端。FastMCP能够自动将Python函数转化为符合MCP规范的工具、资源和提示词,支持与各类LLM的无缝对接,简化了智能体与外部数据和工具的交互流程。(来源:GitHub)

OpenCode 2.0重构发布:从Bun迁移至Node并支持Electron桌面端 : 开源AI编程助手OpenCode发布2.0版本。新版本彻底重构了API设计,将底层运行环境从Bun迁移至Node以优化内存占用,并将桌面端架构从Tauri转向Electron以提升跨平台渲染一致性。2.0版还支持多会话并行开发和多模型对比,大幅提升了开发者的协作效率。(来源:36氪)

SQRL:支持数据库先期检索的Text-to-SQL模型家族 : Feyn AI发布了开源Text-to-SQL模型家族SQRL,包含4B、9B和35B三个版本。SQRL改变了传统的“直接翻译”模式,在生成SQL前会先对数据库进行只读探查,利用返回的数据解决schema中的语义模糊,实测35B版本在BIRD Dev上的执行准确率达70.6%,超越了Claude Opus 4.6。(来源:MarkTechPost)
Ontology-Playground:微软Fabric IQ的开源本体设计与学习平台 : 微软开源了完全静态的Web应用Ontology-Playground,旨在帮助用户学习和设计本体(Ontology)。该平台提供可视化编辑器、RDF/XML导入导出、GitHub一键PR提交等功能,并内置了“本体学校”课程,支持用户通过自然语言查询来探索Fabric IQ的语义映射能力。(来源:GitHub)

📚 学习
《深入理解 AI Agent》开源:全景拆解智能体设计原理与工程实践 : 李博杰所著《深入理解 AI Agent:设计原理与工程实践》在GitHub开源了全书正文PDF及按章配套代码。该书围绕“Agent = LLM + 上下文 + 工具”的核心公式,系统讲解了上下文工程、RAG知识库、多智能体协作及模型后训练等前沿技术,是智能体开发者系统学习的优秀资源。(来源:GitHub)

COMPASS:基于转录组学预测癌症免疫治疗响应的泛癌基础模型 : 哈佛医学院等团队在《Nature Medicine》发表论文,提出泛癌基础模型COMPASS。该模型基于33种癌症类型的超万个肿瘤样本进行预训练,通过44个免疫概念将转录组数据进行层级映射,在16个独立临床队列中实现了对免疫治疗响应的精准预测,平均准确率较现有方法提升8.5%。(来源:36氪)

HiLS-Attention:打破长文本瓶颈的分层地标稀疏注意力机制 : 腾讯混元团队开源了HiLS-Attention机制,通过引入一阶泰勒展开和分层Softmax,解决了传统稀疏注意力中chunk重要性估计失准及无法端到端训练的难题。该机制支持在8K训练条件下实现4M上下文的免训外推,在512K长度下的解码速度提升超15倍。(来源:机器之心)
.jpg)
💼 商业
AI 3D生成创企Meshy完成近4亿美元B轮融资 : 北京AI 3D生成初创公司Meshy(太极图形)宣布完成近4亿美元的B轮融资,投后估值突破100亿元人民币,创下该领域单轮融资与估值的新纪录。本轮融资由IDG资本、经纬中国等领投,资金将用于AI多模态3D模型研发及游戏、3D打印等领域的全球市场拓展。(来源:36氪)

博顿光电完成超亿元B+轮融资,发力离子束超精密装备 : 离子束装备研发商博顿光电宣布完成超亿元B+轮融资,由毅达资本、中信建投资本等联合投资。博顿光电专注于自主可控离子源和离子束超精密工艺设备,其产品已批量导入可控核聚变、光通信及量子计算等前沿科技领域的头部客户。(来源:36氪)

红熊AI完成数亿元A+轮融资,推进“记忆驱动”AI应用 : 红熊AI宣布完成数亿元A+轮融资,由九纬基金、彰元创投等领投,估值接近30亿元。红熊AI主打“记忆驱动AGI”路线,将自研大模型OpenBear与MemoryBear记忆科学系统深度融合,致力于解决大模型在企业落地中的长期上下文遗忘和高Token消耗痛点。(来源:36氪)

🌟 社区
AI时代科技从业者深陷“Token绩效”与工作量通胀 : 社区热议2026年科技从业者生存现状。调研显示,AI虽然将个人生产力放大了数倍,但随之而来的是“用量排名”和“Token绩效”等新管理枷锁,导致行业整体倦怠率从44.7%飙升至55.7%。许多程序员自嘲为“聊天工程师”,面临着“AI提高了产出速度,却未提升产出质量”的困境。(来源:36氪、ZDNet)
AI短剧监管新规落地,行业从野蛮生长走向精品化重构 : 随着《人工智能拟人化互动服务管理暂行办法》和《AI微短剧分类分层标准》相继施行,国内AI短剧和拟人化互动服务迎来大洗牌。大厂纷纷下线未合规的智能体角色,而具备实体化、合规照护定位的养老陪伴机器人则获得政策绿灯。行业竞争正从“低成本拼量”向“版权合规与内容深度”迁移。(来源:36氪、36氪)
大模型“套壳”刷榜再现,Basalt Labs钓鱼实验戳破跑分迷信 : 社区曝光了一场针对AI学术圈的“钓鱼实验”。名为Basalt Labs的机构声称发布了1.6万亿参数模型Monolith-1.0并登顶多项榜单,后被开发者证实该模型只是将开源7B模型权重复制填充,并偷偷调用了DeepSeek的API。此事件引发了社区对当前大模型过度“刷榜”和缺乏实质性审查的深刻反思。(来源:36氪)
💡 其他
韩国游戏公司CEO利用ChatGPT设计裁员方案被法院推翻 : 韩国游戏公司KRAFTON的CEO张贤国因试图规避支付收购公司的2.5亿美元员工奖金,无视律师建议,深夜通过ChatGPT进行提示词工程设计了一套“先解雇再赖账”的方案。该方案在特拉华州法院的诉讼中被判定违法,公司最终被迫重新聘用员工并全额支付奖金,成为AI被滥用于企业治理的典型反面案例。(来源:Reddit r/ArtificialInteligence)
美国最大太阳能公司Sunrun探索“居民电网跑GPU”分布式算力网络 : 美国太阳能服务商Sunrun计划在其拥有太阳能和储能系统的住宅中部署GPU边缘计算节点,将闲置太阳能转化为AI推理算力并销售给企业。尽管该方案在网络时延和数据中心级互联带宽上存在天然瓶颈,但它为解决美国数据中心面临的“电荒”问题提供了一种分布式算力网络的新思路。(来源:36氪)
中国电信智传网AI Flow斩获WAIC SAIL大奖 : 中国电信人工智能研究院自主研发的“智传网(AI Flow)”荣获WAIC最高荣誉SAIL大奖。该技术首创“生成式智能传输”范式,将传统的“比特流”传输重构为“词元(Token)流”传输,在0.266kbps的极窄带宽下实现了清晰的语音通话,并成功在“天、空、地、海”多域应急救援场景中实现规模化落地。(来源:机器之心)