分类: AI日报

AI日报

AI日报 – 2025-04-22(上)

OpenAI 发布 o3 和 o4-mini 模型,集成工具与视觉推理能力 : OpenAI 正式发布其迄今最智能、最强大的推理模型 o3 和 o4-mini。核心亮点在于首次实现 Agent 主动调用并组合 ChatGPT 内部所有工具(网页搜索、Python 数据分析、深度视觉理解、图像生成等),并能在推理链中整合图像进行思考。o3 在编码、数学、科学、视觉感知等领域全面领先,刷新多项基准测试
AI日报

AI日报 – 2025-04-21(上)

“AI四小龙”面临挑战与转型 : 商汤、旷视、云从、依图等曾被誉为“AI四小龙”的公司,近年来普遍面临商业化困境和持续亏损。例如,商汤2024年亏损43亿元,累计亏损超546亿元;云从2024年亏损近6-7亿元,累计亏损超44亿元。为应对挑战,各公司纷纷进行战略调整,包括裁员、降薪、业务重组。面对以大语言模型为主导的新AI浪潮,拥有视觉技术基因的“四小龙”正积极转向多模态大模型和AGI领域。商汤发
AI日报

AI日报 – 2025-04-20(下)

全球首场人形机器人半程马拉松在北京举办: 2025年4月19日,北京亦庄举办了全球首个人形机器人半程马拉松,与人类选手同场竞技(赛道隔离)。赛事旨在检验机器人在长距离奔跑、复杂路况适应、能耗管理、稳定性及耐用性等方面的综合能力。优必选与北京人形机器人创新中心联合研发的“天工”获得冠军,完赛时间2小时40分,远超人类记录,但展示了当前技术水平。赛事也凸显了亦庄在机器人产业政策、资金和产业链生态方面的
AI日报

AI日报 – 2025-04-20(上)

AGI 训练数据引争议:是否需要“原始”人类经验?: Reddit上一篇帖子引发激烈讨论,认为当前依赖“净化”数据的AI训练方法无法实现真正的AGI。作者主张应收集并利用更“原始”、未经过滤的具身人类经验数据,包括私密、负面甚至令人不适的场景,以赋予AI真正的人类理解和直觉。该观点挑战了现有数据收集伦理和技术路径,呼吁发起“原始感知组项目”(Raw Sensorium Project)记录真实生活
AI日报

AI日报 – 2025-04-19(下)

全球首场人形机器人半程马拉松举行: 在北京亦庄举办的全球首场人形机器人半程马拉松赛事中,天工 1.2max 以 2 小时 40 分 24 秒的成绩成为首个冲线的机器人。该赛事旨在验证机器人在不同场景下的实用性,汇集了国内多种驱动方式和算法流派的人形机器人。比赛不仅考验机器人的行走能力、续航(需中途充电或更换电池,有罚时)、散热和稳定性,还测试了人机协作。尽管途中出现如宇树机器人“怯场”、天工机器人
AI日报

AI日报 – 2025-04-19(上)

AI发展范式转变:从刷榜到创造价值: OpenAI研究员姚顺雨的博客引发讨论,提出AI发展已进入下半场。上半场聚焦算法创新和基准测试刷分(如AlphaGo、GPT-4),通过结合大规模预训练(提供先验知识)和强化学习(RL),并引入“推理即行动”的概念,实现了泛化突破。然而,他认为持续刷榜的边际效益递减,下半场应转向定义有实际应用价值的问题,开发更贴近现实世界的评估方法,像产品经理一样思考,真正用
AI日报

AI日报 – 2025-04-18(下)

谷歌发布Gemini 2.5 Flash混合推理模型,主打性价比与可控思考: 谷歌推出Gemini 2.5 Flash预览版,定位为高性价比的混合推理模型。其独特之处在于引入“思考预算” (thinking_budget) 功能,允许开发者(0-24k token)或模型自身根据任务复杂度调整推理深度。关闭思考时成本极低($0.6/百万token输出),性能优于2.0 Flash;开启思考($3.
AI日报

AI日报 – 2025-04-18(下)

谷歌发布混合推理模型Gemini 2.5 Flash : 谷歌推出其首款混合推理模型Gemini 2.5 Flash,旨在平衡性能、成本和延迟。该模型引入“思考预算”功能(0-24k tokens),允许开发者调整推理深度。关闭思考模式时,成本大幅降低($0.6/百万token),性能仍优于2.0 Flash;开启思考模式($3.5/百万token)可处理更复杂任务。基准测试显示,其在数学、多模态