AI日报 – 2025-07-17(晚)
IMO 2025 竞赛结果公布,AI模型表现不佳: 在澳大利亚举行的 IMO 2025 国际数学奥林匹克竞赛中,多个AI模型参与其中,但成绩并不理想。Claude Sonnet 4、Gemini 2.5 Pro 和 ByteDance Seed 1.6 都只解决了 2/6 的问题,其中 Seed 1.6 和 Gemini 2.5 Pro 对其中一个问题给出了完整解答。值得关注的是,Seed 1.6
AI日报 – 2025-07-17(早)
AI教父联名OpenAI、DeepMind、Anthropic:警惕CoT: OpenAI、Google DeepMind、Anthropic 等公司以及包括 Yoshua Bengio 在内的多位 AI 研究员联合发表立场文件,呼吁加强对 CoT(思维链)监控技术的研究。CoT monitoring 允许监控 AI 模型的推理过程,从而及早发现不良意图。然而,CoT 可监控性并非一成不变,可能受
AI日报 – 2025-07-16(晚)
Andrew Ng携手贝恩成立AI咨询公司AI Aspire: 吴恩达宣布成立AI咨询公司AI Aspire,与贝恩公司合作,帮助企业制定AI战略并实现转型。新闻稿指出,企业高管意识到AI转型需要自上而下的领导,但AI对特定业务的影响极其复杂。AI Aspire将与贝恩合作,帮助企业应对AI战略、产品创新、生产力提升、技术投资、风险管理、人力资源、团队转型以及新市场等方面的挑战。
AI日报 – 2025-07-16(早)
Batch AI 新闻与见解:美国国会通过特朗普的“大而美的法案” : 美国国会通过了特朗普总统的“大而美的法案”。令人失望的是,它没有包括一项关于暂停美国州级人工智能监管的提议。这可能导致各州之间出现监管碎片化,并可能阻碍人工智能在美国的发展。(DeepLearning.AI Blog, DeepLearning.AI Blog)
AI日报 – 2025-07-15(晚)
Kimi K2 的发布与社区优化: Moonshot AI 发布了 Kimi K2,一个具有 1T 参数的开源 MoE 模型。该模型在发布后 72 小时内就被社区快速优化,可在单个 M4 Max 128GB VRAM(带卸载)或单个 M3 Ultra (512GB) 上运行。这突显了开源社区的强大力量和快速响应能力,推动了大型语言模型的快速发展和应用。
AI日报 – 2025-07-15(早)
Kimi K2 发布并开源: Moonshot AI 发布了 Kimi K2,一个1T参数的MoE架构大语言模型,激活参数32B,上下文窗口128K。该模型在代码生成、Agent任务和数学推理方面表现出色,并在多个基准测试中取得了开源模型的SOTA成绩。Kimi K2 的发布即开源,并提供了Web端、App和API服务。此举被视为 Kimi 对 DeepSeek R1 冲击波的回应,也体现了其对开
AI日报 – 2025-07-14(晚)
Meta/剑桥/MIT提出全原子扩散Transformer框架 : Meta FAIR、剑桥大学与麻省理工学院的联合科研团队提出全原子扩散 Transformer ADiT,打破了周期性与非周期性系统的建模壁垒,通过全原子统一潜在表示与 Transformer 潜在扩散两大创新,实现了用单一模型生成分子与晶体的突破。ADiT 的核心优势在于打破了周期性与非周期性系统之间的建模壁垒,实现了用单一模型
AI日报 – 2025-07-13(晚)
Kimi K2 发布,OpenAI 推迟开源模型 : Kimi K2 是一个开源的智能体模型,拥有1万亿参数,其中320亿参数处于激活状态。该模型在软件工程基准测试中表现出色,尤其在编码和智能体任务方面。Kimi K2 的发布对开源社区产生了重大影响,OpenAI 甚至因此推迟了其开源模型的发布。这标志着开源LLM在性能上的提升,对AI发展格局带来潜在的改变。
AI日报 – 2025-07-13(早)
全球网络安全警报系统正在崩溃: 美国支持的国家漏洞数据库 (NVD) 和通用漏洞披露 (CVE) 项目都面临资金问题,导致安全漏洞分析出现缺口,增加了网络攻击风险。这凸显了全球网络安全基础设施的弱点,即关键服务依赖于美国机构的利益和政府资金,这些资金随时可能被削减或改变方向。多个国家和组织正在努力建立更分散、更可靠的漏洞管理系统,以应对日益增长的网络安全挑战。