AI日报 – 2026-01-02(晚)
DeepSeek发布mHC架构改进Transformer残差路径 : DeepSeek发布了关于“流形约束超连接”(mHC)的研究,旨在解决Transformer架构中残差连接的局限性。mHC将单条残差“高速公路”扩展为n条并行车道,允许每一层学习如何在不同车道间共享和打乱信号。通过引入流形正则化,该架构在提升训练稳定性的同时,显著增强了模型捕获复杂特征的能力。专家认为,这标志着2026年AI研究
AI日报 – 2026-01-02(早)
DeepSeek发布mHC论文:重构残差连接以实现大规模训练稳定 : DeepSeek团队发布了关于流形约束超连接(mHC)的研究,旨在解决传统残差连接在极深网络中出现的表示崩溃和训练不稳定问题。通过将连接空间投影到双随机矩阵流形上,mHC成功恢复了身份映射属性,并在3B至27B规模的MoE模型上验证了其卓越的扩展性。这一突破不仅提升了数学和逻辑任务的性能,更展示了DeepSeek在底层算子融合、
AI日报 – 2026-01-01(晚)
韩国启动 1.4 亿美元“主权 AI”计划以构建本土生态 : 韩国科学部联合 SKT、LG、Naver 等 5 家巨头,投入约 1.4 亿美元训练不受外部控制的本土大模型。目前已发布多款开源模型,包括 SKT 的 A(.)X-K1(519B)和 LG 的 K-EXAONE(236B)。该计划强调“从零训练”和“商业开放”,旨在通过提供算力与数据支持,防止欧洲式数字主权流失,使韩国成为全球 AI 版
AI日报 – 2026-01-01(早)
DeepSeek R1 突袭与强化学习范式转移 : DeepSeek-R1 的开源标志着中国 AI 力量对硅谷的直接冲击。该模型以极低的训练成本实现了比肩 OpenAI o1 的推理性能,核心在于强化学习(RL)的大规模应用。这一事件动摇了“算力决定论”,证明了通过算法优化和 RL 环境建设,可以在有限资源下实现智能涌现。目前,全球主流实验室正迅速转向 RL 路径,试图通过模拟环境和奖励模型突破预
AI日报 – 2025-12-31(晚)
Meta以数十亿美元收购AI智能体初创公司Manus:Meta于2025年末完成对其成立以来第三大收购案,以超20亿美元天价将AI Agent赛道黑马Manus收入囊中。此次交易由扎克伯格亲自操盘,仅用十余天敲定。Manus凭借“通用智能体”定位,在不到一年内实现1亿美元ARR,其核心优势在于强大的任务规划与执行框架。此举标志着AI产业重心从“对话模型”向“行动智能体”的范式转移,Meta试图通过
AI日报 – 2025-12-31(早)
Meta斥资数十亿美元收购智能体初创公司Manus AI:Meta宣布收购成立仅九个月的通用AI智能体公司Manus。Manus以“全球首个通用智能体”出圈,在不具备自有模型的情况下,凭借卓越的工程化能力和对用户需求的理解,实现了8个月ARR突破1亿美元的惊人增长。此次收购被视为Meta在AI应用层的一次“买时间”策略,旨在补齐其在自主执行复杂任务能力的短板。Manus将保持独立运营,创始人肖弘将
AI日报 – 2025-12-30(晚)
Meta 数十亿美元收购 Manus,开启 Agent 执行力时代 : Meta 宣布完成对通用 AI 智能体初创公司 Manus(蝴蝶效应)的收购,交易金额据传高达数十亿美元。此次收购标志着 Meta 战略重心的偏移:从单纯的 Llama 模型研发转向具备“执行力”的 Agent 生态。Manus 在上线仅 9 个月内实现了 1.25 亿美元的 ARR,并处理了超过 147 万亿个 token。
AI日报 – 2025-12-30(早)
“Vibe Coding”引发开发范式革命 : 随着Claude Code和OpenAI Codex的深度应用,开发者社区掀起了“Vibe Coding(氛围编程)”的热潮。Andrej Karpathy展示了AI自主运行实验、调试并优化代码的全流程,而DHH等资深开发者也对AI在处理Rails等大型复杂代码库时的表现感到震撼。这种模式强调开发者从“编写者”转变为“指挥官”,通过自然语言驱动AI完
AI日报 – 2025-12-29(晚)
Meta发布SSR框架,AI编程进入“左右互搏”时代 : 来自Meta、UIUC和CMU的研究团队发布了Self-play SWE-RL (SSR) 框架,标志着AI程序员开始脱离人类数据天花板。该框架让AI分饰“破坏者”注入Bug和“修复者”解决Bug,在代码沙盒中进行对抗进化。实验显示,SSR在从未见过自然语言Issue的情况下,在SWE-bench验证集上性能提升了10.4%。这一突破意味着