AI日报 – 2025-10-02(早)
OpenAI Sora 2发布及其影响 : OpenAI正式发布Sora 2,将其定位为“AI版抖音”iOS社交应用,支持音视频同步生成,并在物理定律遵循和可控性方面显著提升。新功能包括“客串”(cameos),允许用户将自己或朋友形象植入AI生成视频。社交媒体热议其惊人的真实感和创造力,但也有对“slop”内容泛滥、真假难辨、GPU需求激增以及区域可用性(如英国无Sora)的担忧。OpenAI
AI日报 – 2025-10-01(早)
NVIDIA向OpenAI投资1000亿美元建设10GW AI数据中心 : NVIDIA宣布向OpenAI投资1000亿美元,用于建设一个10吉瓦(相当于10座核电站)的AI数据中心,该中心将基于NVIDIA的VERA RUBIN平台。此举预示着AI计算基础设施的巨大飞跃,可能重塑AI经济格局,并引发对小型竞争者和能源环境可持续性的深远影响。
AI日报 – 2025-09-30(晚)
Anthropic Claude Sonnet 4.5发布,编程与智能体能力大幅提升 : Anthropic正式发布Claude Sonnet 4.5,被誉为全球最强编程模型,并在智能体构建、计算机使用、推理和数学能力上取得显著突破。该模型能自主连续工作30小时以上,在SWE-bench Verified测试中登顶,并在OSWorld计算机任务基准中刷新纪录。新功能包括Claude Code的“检
AI日报 – 2025-09-29(晚)
GPT-5攻克「量子NP难题」 : 量子计算专家Scott Aaronson首次发表论文,揭示GPT-5在量子复杂性理论研究中的突破性辅助作用。GPT-5在30分钟内助攻解决了“量子版NP难题”中的关键推导环节,而这通常需要人类1-2周时间。这一成果标志着AI已开始触及人类智慧的核心科学发现工作,预示着AI在科学研究领域潜力的巨大飞跃。
AI日报 – 2025-09-29(早)
DeepMind提出CoF:视频模型有自己的思维链 : DeepMind发布Veo 3论文,首次提出“帧链(CoF)”概念,类比语言模型中的CoT。Veo 3展示了通用视觉理解能力,能零样本解决多种视觉任务,包括感知、建模、操控和跨时空推理,被誉为“视觉推理领域的GPT-3时刻”。团队预测未来通用视频模型将取代专才模型,并认为其成本问题将随技术发展而解决。
AI日报 – 2025-09-28(晚)
NVIDIA重塑AI产业:从卖芯片到“卖AI产能” : 英伟达CEO黄仁勋在最新访谈中指出,通用计算时代已终结,AI需求正经历双重指数级增长,推理需求预计将增长10亿倍。英伟达正从芯片供应商转型为“AI基础设施伙伴”,通过与OpenAI等公司合作建设10GW级别的“AI工厂”,提供从芯片到软件、系统、网络的“极致协同设计”,以实现最高的单位能耗性能。他强调,这种全栈优化能力是核心竞争壁垒,使英伟达
AI日报 – 2025-09-28(早)
AI助力儿童虐待图像检测 : 随着生成式AI导致儿童性虐待图像数量激增1325%,美国国土安全部网络犯罪中心正试验使用AI软件(来自Hive AI)来区分AI生成内容与真实受害者图像。此举旨在将调查资源集中于真实受害者案件,最大化项目影响力并保护弱势群体,标志着AI在打击网络犯罪中的关键应用。该工具通过识别图像中的特定像素组合来判断是否为AI生成,无需针对特定内容进行训练。
AI日报 – 2025-09-27(晚)
Richard Sutton对LLM的质疑 : 强化学习之父Richard Sutton对大型语言模型(LLMs)的“苦涩教训”提出质疑,认为当前LLM架构并非通向通用人工智能(AGI)的最终路径。他主张需要新的架构以实现持续的、在职学习,使AI代理能够像人类和动物一样进行学习,这可能导致现有LLM方法过时。这一观点在AI社区引发了广泛讨论,促使人们重新思考AI学习范式。