AI日报 – 2025-07-22(早)
OpenAI 的 ChatGPT Agent 获得国际数学奥林匹克金牌: OpenAI 的模型在国际数学奥林匹克竞赛中取得了金牌级别的成绩,引发了人们对 AI 解决复杂数学问题能力的关注。虽然测试格式与人类选手略有不同,但这一成就仍然是 AI 数学推理能力的重大进步,预示着 AI 在科学研究领域的巨大潜力。
AI日报 – 2025-07-21(晚)
OpenAI的IMO金牌争议 : OpenAI宣布其AI模型在国际数学奥林匹克竞赛(IMO)中取得金牌水平的成绩,引发广泛争议。焦点在于OpenAI未遵守IMO要求的公布时间,在闭幕式前宣布结果,被指责抢夺学生风头,缺乏尊重。此外,OpenAI的测试并非由IMO官方组织,评分也并非由官方评委进行,其“金牌”的含金量受到质疑。此事件引发了对AI竞赛规则、评估标准以及AI与人类竞赛公平性的讨论。
AI日报 – 2025-07-21(早)
OpenAI的推理LLM在国际数学奥林匹克竞赛中获得金牌: OpenAI的实验性推理LLM在国际数学奥林匹克竞赛(IMO)中取得了金牌级别的成绩,这标志着人工智能在解决复杂数学问题上的重大突破。该模型并非专门的数学系统,而是通用的推理系统,是OpenAI迈向通用人工智能的重要一步。虽然GPT-5即将发布,但OpenAI表示,拥有IMO金牌水平能力的模型还需要数月才能推出。
AI日报 – 2025-07-20(晚)
OpenAI 的实验性推理 LLM 在国际数学奥林匹克竞赛中获得金牌水平 : OpenAI 的最新实验性推理大型语言模型在 2025 年国际数学奥林匹克竞赛 (IMO) 中取得了金牌水平的成绩。该模型在与人类相同的时限内完成比赛,未使用任何工具,并以自然语言书写证明,这标志着 AI 在数学推理领域的重大突破。虽然该模型是实验性的,OpenAI 表示不会立即发布具有同等能力的模型,但这一成就预示着未
AI日报 – 2025-07-20(早)
OpenAI的实验性推理LLM在国际数学奥林匹克竞赛中获得金牌 : OpenAI 的最新实验性推理LLM在2025年国际数学奥林匹克竞赛(IMO)中取得了金牌级别的成绩,解决了6道题中的5道。该模型在与人类相同的规则下运行,包括每次4.5小时的限制,并且没有使用任何工具,以自然语言输出证明过程。这标志着AI在数学推理领域的重大突破,预示着AI在科学发现中的潜力。
AI日报 – 2025-07-19(晚)
ARC 发布交互式推理基准 ARC-AGI-3 预览版: ARC 发布了 ARC-AGI-3 的预览版,包含三个游戏,旨在挑战交互式推理能力。与前两版不同,ARC-AGI-3 更侧重于评估智能体在动态环境中的推理能力,而非静态推理。目前,前沿 AI 在该基准测试中得分 0%,而人类得分 100%。ARC 还发布了 API 供 AI 研究人员测试他们的智能体,并举办了奖金为 1 万美元的智能体竞赛。
AI日报 – 2025-07-19(早)
印度计划建立自己的大型咨询公司: 印度正在计划建立自己的“七大”咨询公司,以与全球巨头竞争。此举旨在减少在专业机构监管和政府招标中的自我限制,并提升印度在国内外咨询市场的地位。此举反映了印度希望在全球经济中扮演更重要角色的雄心,并可能对全球咨询业格局产生影响。
AI日报 – 2025-07-18(晚)
OpenAI 发布 ChatGPT Agent : OpenAI 发布了全新的 ChatGPT Agent,它融合了 Operator、Deep Research 和 ChatGPT 的优势,能够在虚拟机中自主选择和使用工具,完成复杂任务,如购物、预订、生成报告等。这标志着 AI 智能体能力的重大升级,也引发了对 AI 安全和未来工作模式的讨论。
AI日报 – 2025-07-18(早)
OpenAI 推出全新AI编程工具 Codex : OpenAI 发布 Codex,一款深度集成 ChatGPT 的 AI 编程工具。Codex 不仅能理解自然语言指令,还能生成高质量代码、修复 bug、甚至根据用户需求进行代码重构。该工具的发布标志着 AI 编程进入新阶段,有望大幅提升程序员的生产力,并降低编程门槛,让更多人参与到软件开发中来。