作者: Rebabel Editorial

Rebabel Editorial 是 Rebabel 的编辑团队,每日聚合并梳理全球人工智能领域的重要资讯,以 12 种语言发布。The Rebabel Editorial team curates and summarizes the most important AI news worldwide, published daily in 12 languages.
AI日报

AI日报 – 2025-04-19(下)

全球首场人形机器人半程马拉松举行: 在北京亦庄举办的全球首场人形机器人半程马拉松赛事中,天工 1.2max 以 2 小时 40 分 24 秒的成绩成为首个冲线的机器人。该赛事旨在验证机器人在不同场景下的实用性,汇集了国内多种驱动方式和算法流派的人形机器人。比赛不仅考验机器人的行走能力、续航(需中途充电或更换电池,有罚时)、散热和稳定性,还测试了人机协作。尽管途中出现如宇树机器人“怯场”、天工机器人
AI日报

AI日报 – 2025-04-19(上)

AI发展范式转变:从刷榜到创造价值: OpenAI研究员姚顺雨的博客引发讨论,提出AI发展已进入下半场。上半场聚焦算法创新和基准测试刷分(如AlphaGo、GPT-4),通过结合大规模预训练(提供先验知识)和强化学习(RL),并引入“推理即行动”的概念,实现了泛化突破。然而,他认为持续刷榜的边际效益递减,下半场应转向定义有实际应用价值的问题,开发更贴近现实世界的评估方法,像产品经理一样思考,真正用
AI日报

AI日报 – 2025-04-18(下)

谷歌发布Gemini 2.5 Flash混合推理模型,主打性价比与可控思考: 谷歌推出Gemini 2.5 Flash预览版,定位为高性价比的混合推理模型。其独特之处在于引入“思考预算” (thinking_budget) 功能,允许开发者(0-24k token)或模型自身根据任务复杂度调整推理深度。关闭思考时成本极低($0.6/百万token输出),性能优于2.0 Flash;开启思考($3.
AI日报

AI日报 – 2025-04-18(下)

谷歌发布混合推理模型Gemini 2.5 Flash : 谷歌推出其首款混合推理模型Gemini 2.5 Flash,旨在平衡性能、成本和延迟。该模型引入“思考预算”功能(0-24k tokens),允许开发者调整推理深度。关闭思考模式时,成本大幅降低($0.6/百万token),性能仍优于2.0 Flash;开启思考模式($3.5/百万token)可处理更复杂任务。基准测试显示,其在数学、多模态
AI日报

AI日报 – 2025-04-17(下)

OpenAI发布o3与o4-mini模型,强化视觉推理与工具调用: OpenAI推出o3和o4-mini两款新推理模型,显著提升了AI的推理能力,特别是在视觉领域。这是OpenAI首次发布能将图像融入思维链进行推理的模型,能够解读图表、照片甚至手绘草图,并结合Python、网络搜索、图像生成等工具进行多步骤复杂任务处理。o3定位为最强推理模型,在多项基准测试中刷新记录,尤其擅长视觉分析;o4-mi
AI日报

AI日报 – 2025-04-17(上)

OpenAI震撼发布o3与o4-mini,开启“看图思考”新时代: OpenAI正式发布其最新“推理”旗舰模型o3与精简版o4‑mini。这两款模型首次实现了“用图像思考”,能够在推理链中嵌入和处理图像(如放大、旋转),结合文本进行分析。它们还能首次自主组合使用ChatGPT内的所有工具(网页搜索、Python代码执行、文件解析、图像生成)来解决复杂问题。o3在Codeforces、SWE-ben
AI日报

AI日报 – 2025-04-16(上)

快手发布可灵 2.0 视频生成大模型 : 快手发布可灵 2.0 视频生成大模型及可图 2.0 图像生成大模型,宣称在用户评测中超越 Veo 2 和 Sora。可灵 2.0 在语义响应(动作、运镜、时序)、动态质量(运动速度与幅度)和美学(电影感)方面显著提升。技术创新包括全新 DiT 架构和 VAE 提升融合与动态表现、强化复杂运动与专业术语理解、应用人类偏好对齐优化常识与审美。发布会还推出了基于
AI日报

AI日报 – 2025-04-15(下)

OpenAI发布GPT-4.1系列模型,API性能提升并弃用GPT-4.5: OpenAI于4月15日通过API发布了GPT-4.1、GPT-4.1 mini和GPT-4.1 nano三款新模型,旨在全面超越GPT-4o系列。新模型拥有最高100万Token的上下文窗口,知识库更新至2024年6月。GPT-4.1在编码能力(SWE-bench Verified得分54.6%,较GPT-4o提升21