AI日报 – 2025-06-29(晚)
Meta重金挖角,四名OpenAI顶尖华人研究员集体跳槽: Meta从OpenAI成功挖走四名核心华人研究员:毕树超(多模态后训练负责人)、余家辉(感知技术研究负责人)、任泓宇(o1/o3-mini创造者)和赵晟佳(o1/GPT-4o贡献者)。这四位均在中国顶尖大学完成本科教育,并在OpenAI近期关键项目(如o1、GPT-4o)中扮演核心角色。此举被视为扎克伯格为重振Meta AI、追赶业界领先
AI日报 – 2025-06-29(早)
Meta掀起AI人才争夺战,重金挖角并意图召回旧部: 为应对Llama 4模型的失利,扎克伯格正亲自领导一场大规模的AI人才招募行动。Meta不仅以数千万美元的薪酬方案从OpenAI、Google等对手处挖角,还斥资超10亿美元收购AI领域的VC,并与Scale AI达成协议引入其CEO及高管。量子位独家消息称,Meta正频繁接触包括前AI高级副总裁Bill Jia在内的离职高管,希望他们回归。这
AI日报 – 2025-06-28(晚)
Karpathy 提出“LLM认知核心”概念,端侧AI竞赛加剧: Andrej Karpathy 预言,AI竞赛的下一个焦点将是“LLM认知核心”——一种牺牲百科知识以换取极致能力的数十亿参数小型模型。它将作为个人计算的内核,永远在线并默认在每台设备上运行。其特点包括原生多模态、能力可调节、强大的工具使用、设备端微调和与云端大模型的协同。这一构想与Google发布的Gemma 3n模型不谋而合,后
AI日报 – 2025-06-28(早)
谷歌发布Gemma 3n多模态模型: 谷歌正式发布Gemma 3n,一款专为端侧设备设计的开源多模态模型。该模型基于创新的MatFormer(套娃式Transformer)架构,提供E2B(20亿有效参数)和E4B(40亿有效参数)两种尺寸,最低仅需2GB内存即可运行。Gemma 3n原生支持图像、音频、视频和文本输入,E4B版本在LMArena评测中得分突破1300,成为首个10B参数以下达到此
AI日报 – 2025-06-27(晚)
谷歌发布Gemma 3n,开启端侧多模态新纪元: 谷歌正式发布Gemma 3n系列模型,专为端侧设备设计,原生支持文本、图像、音频和视频输入。该系列包括E2B和E4B两个型号,虽然实际参数量为5B和8B,但得益于创新的MatFormer“套娃”架构和逐层嵌入(PLE)技术,其显存占用仅相当于2B和4B模型,最低2GB RAM即可运行。Gemma 3n在LMArena竞技场得分超过1300,是首个低
AI日报 – 2025-06-27(早)
Meta重金挖角OpenAI,AI人才争夺战白热化: Meta从OpenAI成功挖走三名顶尖计算机视觉研究员:Lucas Beyer、Alexander Kolesnikov和Xiaohua Zhai。这三位是ViT、SigLIP等重要视觉模型的背后功臣,此前共同创立了OpenAI的苏黎世办公室。此举被视为Meta CEO扎克伯格为打造超级智能(AGI)而亲自下场招揽人才的又一力证。面对Meta的
AI日报 – 2025-06-26(晚)
AI训练数据版权迎里程碑判决:美法院裁定AI使用合法购买书籍训练构成“合理使用”:美国联邦法院在一项针对Anthropic的诉讼中裁定,AI公司使用合法购买的已出版书籍训练大语言模型属于“合理使用”范畴,无需作者事先同意。法院认为AI训练是对原作的“转化性使用”,未直接取代原作市场,且有利于技术创新和公共利益。然而,法院同时裁定使用盗版书籍进行训练不构成合理使用,Anthropic仍可能因此承担责
AI日报 – 2025-06-26(早)
Anthropic 模型训练细节曝光,法院对“合理使用”作出部分裁决: 五位作家起诉 Anthropic,指控其在训练 Claude 模型时未经授权使用了数百万本书籍。法庭文件揭示,Anthropic 早期曾下载盗版资源(如 Books3、LibGen)用于构建“内部研究图书馆”以评估、采样和过滤数据,但从2024年起转向大规模购买实体书并扫描。法院裁定,扫描合法购买的纸质书用于模型内部训练构成“
AI日报 – 2025-06-25(晚)
OpenAI 被指控窃取技术与商标,首款AI硬件出师不利: iyO公司起诉OpenAI及其收购的硬件公司io(由前苹果设计师Jony Ive创立),指控其在AI硬件开发中存在商标侵权和技术窃取。iyO称OpenAI在洽谈合作及技术测试过程中,获取了其定制耳机的生物传感与降噪算法等核心技术,并用于io的AI设备研发。OpenAI否认侵权,称其首款硬件非入耳设备,且与iyO产品定位不同。法庭文件显示,