AI日报 – 2025-06-12(早)
Meta据悉斥资近150亿美元入股Scale AI并任命其CEO领导新“超级智能”团队: Meta计划以约149亿美元收购AI数据标注与基础设施公司Scale AI 49%的股权,并任命其年仅28岁的华裔CEO Alexandr Wang领导新成立的“超级智能小组”。此举旨在强化Meta在AI领域的竞争力,特别是在高质量训练数据和AGI研发方面。Scale AI以其高达99.7%的数据标注精度著称
AI日报 – 2025-06-11(晚)
OpenAI 发布 o3-pro,号称史上最强模型,并大幅降低 o3 定价: OpenAI 正式推出其迄今最强大的推理模型 o3-pro,并已向 ChatGPT Pro 及 Team 用户开放,API 也同步上线。o3-pro 在科学、教育、编程、商业和写作辅助等领域表现优于前代,支持网页搜索、文件分析、视觉输入和 Python 编程等多种工具。其定价为输入每百万 tokens 20美元,输出80
AI日报 – 2025-06-11(早)
DeepSeek与OpenAI的创新路径揭示“认知型创新”: DeepSeek通过“有限Scaling Law”、MLA与MoE架构创新及软硬协同优化,实现了低成本高性能,其R1推理模型的开源推动了AI认知能力的突破,打破了中国创新者在基础研究领域的“思想钢印”,证明了中国企业在AI基础研究和模型创新方面的全球领先实力。OpenAI则凭借Transformer架构和Scaling Law(尺度定律
AI日报 – 2025-06-10(晚)
苹果WWDC25 AI进展:务实整合与开放,Siri仍需等待: 苹果在WWDC25上展示了其AI战略的调整,从去年“画大饼”转向更务实的系统底层和基础功能完善。重点包括将AI“有意义地”整合到操作系统和第一方应用,并将设备端模型“Foundation”框架向开发者开放。新功能如全系统翻译(支持电话、FaceTime、Message等,并提供API)、Xcode引入Vibe Coding(支持Cha
AI日报 – 2025-06-10(早)
苹果发布论文称当前大语言模型仅有“思考的假象”而非真正推理能力,引发业界热议: 苹果研究人员(包括谷歌大脑创始人之一Samy Bengio)发表论文,通过汉诺塔、跳棋交换等四个可控难度任务测试,指出DeepSeek、o3-mini、Claude 3.7等顶尖模型在面对高复杂度问题时均会“崩溃”,表现出“推理努力反向缩放”(问题越难反而减少思考)。论文认为这些模型更多依赖模式匹配和记忆,而非真正的、
AI日报 – 2025-06-09(晚)
苹果发布AI推理能力研究报告引发热议,质疑其并非真正“思考”: 苹果公司最新研究论文《思维的幻觉》通过汉诺塔等谜题测试指出,包括o3-mini、DeepSeek-R1、Claude 3.7在内的大型语言模型(LLM)在处理复杂问题时,其“推理”更像是模式匹配而非真正思考,当任务复杂度超过某个阈值,模型表现会彻底崩溃,准确率降至零。研究还发现,即使提供解题算法,模型性能也无显著提升,并观察到“推理努
AI日报 – 2025-06-09(早)
苹果研究揭示“思维幻觉”:当前“推理”模型并非真正思考,更依赖模式匹配: 苹果公司最新研究论文《思维的幻觉:通过问题复杂性视角理解推理模型的优势与局限性》指出,当前号称具备“推理”能力的大型语言模型(如Claude、DeepSeek-R1、GPT-4o-mini等),其表现更像是高效的模式匹配器而非真正意义上的逻辑推理。研究发现,这些模型在处理训练分布之外或复杂度较高的问题时,性能会显著下降,甚至
AI日报 – 2025-06-08(晚)
智源大会发布“悟界”系列大模型,聚焦物理AGI与多模态融合: 2025年智源大会上,智源研究院发布了全新的“悟界”系列大模型,标志着其研究方向从“悟道”的语言模型探索转向更广阔的物理世界与多模态融合。该系列包括原生多模态世界模型Emu3、全球首个脑科学多模态通用基础模型“见微Brainμ”、具身大脑RoboBrain 2.0以及全原子微观生命模型OpenComplex2。这一系列模型的发布,体现了
AI日报 – 2025-06-08(早)
Reddit与Anthropic法律纠纷升级,指控其违规使用数据训练Claude AI: Reddit正式起诉Anthropic,指控其未经授权抓取平台内容用于训练其大型语言模型Claude,严重违反了Reddit禁止商业利用内容的用户协议。诉讼文件指出,Anthropic不仅承认使用了Reddit数据,还在被质询后谎称已停止抓取,但实际上其爬虫仍在持续访问Reddit服务器。此外,Anthrop