AI日报 – 2025-06-05(早)
AI在数学领域的进展与挑战: DARPA启动expMath项目,旨在利用AI加速数学研究,将大型复杂问题分解为更易解决的小问题。尽管AI在奥数等竞赛中已展现出超越人类的潜力(如AlphaProof、AlphaEvolve),但研究级数学问题(如千禧年大奖难题)的解决仍遥不可及。新基准FrontierMath旨在更准确评估AI在未知难题上的能力。AI目前在处理极长证明路径(如黎曼猜想的百万行证明)方
AI日报 – 2025-06-04(晚)
OpenAI Codex向Plus用户开放并获重大更新,包括互联网访问与语音输入: OpenAI宣布Codex将向ChatGPT Plus用户逐步开放。此次更新的重点包括允许AI智能体在执行任务时访问互联网(默认关闭,用户可控域名和HTTP方法),以便安装依赖、升级软件包和运行外部资源测试。同时,Codex现在支持直接更新已有的Pull Request,并能通过语音输入任务。其他改进包括支持二进制
AI日报 – 2025-06-04(早)
“互联网女皇”发布AI趋势报告,揭示AI应用空前加速与成本结构变革: “互联网女皇”玛丽·米克尔发布长达340页的《AI趋势报告》,强调AI正以前所未有的速度被采用。报告指出,ChatGPT用户增长迅猛,17个月内月活用户达8亿,年收入近40亿美元,远超历史任何技术。科技巨头对AI基础设施的资本投入激增,2024年已达2120亿美元。同时,AI模型训练成本8年内暴涨2400倍,单个模型训练成本或达
AI日报 – 2025-06-03(晚)
Karpathy亲授ChatGPT模型使用指南与记忆系统揭秘: OpenAI创始成员Andrej Karpathy分享了不同ChatGPT版本的使用策略:o3适用于重要/困难任务,因其推理能力远超4o;4o适合日常简单问题;GPT-4.1则推荐用于编程辅助。他还指出,Deep Research功能(基于o3)适合深度主题研究。同时,工程师Eric Hayes揭秘了ChatGPT的记忆系统,包括用户
AI日报 – 2025-06-03(早)
DeepMind AlphaEvolve 刷新数学纪录,人机协作推动科学进步: DeepMind 的 AlphaEvolve 在一周内两次打破尘封18年的数学纪录,引发广泛关注。陶哲轩评论认为,这展现了不同方法如何互补以推动数学进步,而非简单的“赢家”和“输家”。这一事件凸显了 AI 与人类协作在科技和科学领域创造新范式的潜力,AI 并非简单取代人类,而是共同开创进步的新途径
AI日报 – 2025-06-02(早)
斯坦福大学意外发现AI可生成超越人类专家的CUDA内核: 斯坦福大学研究团队在尝试生成合成数据训练内核生成模型时,意外发现AI(o3、Gemini 2.5 Pro)生成的CUDA内核在性能上超越了人类专家优化的版本。这些AI生成的内核在矩阵乘法、二维卷积、Softmax和LayerNorm等常见深度学习操作上,性能分别达到PyTorch原生实现的101.3%至484.4%。该方法通过先让AI生成自
AI日报 – 2025-06-01(晚)
xAI公开Grok系统提示并加强审查机制: xAI公司近日宣布,由于其Grok响应机器人在X平台上被未经授权修改提示词并发表了违反公司政策和价值观的政治言论,公司决定将Grok系统提示在GitHub上公开。此举旨在增强Grok作为追求真相的AI的透明度和可靠性。xAI同时表示将加强内部代码审查流程,增设24/7监控团队,以防止类似事件再次发生,并更快响应未被自动系统捕获的问题。
AI日报 – 2025-06-01(早)
斯坦福大学意外发现AI可生成超越人类专家的CUDA内核: 斯坦福大学研究团队在尝试为内核生成模型创建合成数据时,意外发现AI(OpenAI o3和Gemini 2.5 Pro)能够生成比人类专家手动优化性能更优的CUDA内核。这些AI生成的内核在矩阵乘法、二维卷积、Softmax和层归一化等常见深度学习操作上,性能远超原生PyTorch,部分操作性能提升近4倍。该方法通过让AI先以自然语言生成优化
AI日报 – 2025-05-31(晚)
英伟达在中美市场间“踩钢丝”的困境与策略: The Information的深度报道揭示了英伟达在中美两大市场间的艰难处境。黄仁勋亲自游说美国政界,试图缓解出口禁令带来的压力。中国市场占英伟达营收的14%,H20芯片禁售已造成数十亿美元损失。尽管黄仁勋公开批评拜登政府限制并讨好特朗普,但政策突变仍时有发生。英伟达一方面强调尊重中国市场,另一方面又需应对美国政府对其“不老实”的指责。目前,英伟达正为