AI日报 – 2025-06-28(早)
谷歌发布Gemma 3n多模态模型: 谷歌正式发布Gemma 3n,一款专为端侧设备设计的开源多模态模型。该模型基于创新的MatFormer(套娃式Transformer)架构,提供E2B(20亿有效参数)和E4B(40亿有效参数)两种尺寸,最低仅需2GB内存即可运行。Gemma 3n原生支持图像、音频、视频和文本输入,E4B版本在LMArena评测中得分突破1300,成为首个10B参数以下达到此
AI日报 – 2025-06-27(晚)
谷歌发布Gemma 3n,开启端侧多模态新纪元: 谷歌正式发布Gemma 3n系列模型,专为端侧设备设计,原生支持文本、图像、音频和视频输入。该系列包括E2B和E4B两个型号,虽然实际参数量为5B和8B,但得益于创新的MatFormer“套娃”架构和逐层嵌入(PLE)技术,其显存占用仅相当于2B和4B模型,最低2GB RAM即可运行。Gemma 3n在LMArena竞技场得分超过1300,是首个低
AI日报 – 2025-06-27(早)
Meta重金挖角OpenAI,AI人才争夺战白热化: Meta从OpenAI成功挖走三名顶尖计算机视觉研究员:Lucas Beyer、Alexander Kolesnikov和Xiaohua Zhai。这三位是ViT、SigLIP等重要视觉模型的背后功臣,此前共同创立了OpenAI的苏黎世办公室。此举被视为Meta CEO扎克伯格为打造超级智能(AGI)而亲自下场招揽人才的又一力证。面对Meta的
AI日报 – 2025-06-26(晚)
AI训练数据版权迎里程碑判决:美法院裁定AI使用合法购买书籍训练构成“合理使用”:美国联邦法院在一项针对Anthropic的诉讼中裁定,AI公司使用合法购买的已出版书籍训练大语言模型属于“合理使用”范畴,无需作者事先同意。法院认为AI训练是对原作的“转化性使用”,未直接取代原作市场,且有利于技术创新和公共利益。然而,法院同时裁定使用盗版书籍进行训练不构成合理使用,Anthropic仍可能因此承担责
AI日报 – 2025-06-26(早)
Anthropic 模型训练细节曝光,法院对“合理使用”作出部分裁决: 五位作家起诉 Anthropic,指控其在训练 Claude 模型时未经授权使用了数百万本书籍。法庭文件揭示,Anthropic 早期曾下载盗版资源(如 Books3、LibGen)用于构建“内部研究图书馆”以评估、采样和过滤数据,但从2024年起转向大规模购买实体书并扫描。法院裁定,扫描合法购买的纸质书用于模型内部训练构成“
AI日报 – 2025-06-25(晚)
OpenAI 被指控窃取技术与商标,首款AI硬件出师不利: iyO公司起诉OpenAI及其收购的硬件公司io(由前苹果设计师Jony Ive创立),指控其在AI硬件开发中存在商标侵权和技术窃取。iyO称OpenAI在洽谈合作及技术测试过程中,获取了其定制耳机的生物传感与降噪算法等核心技术,并用于io的AI设备研发。OpenAI否认侵权,称其首款硬件非入耳设备,且与iyO产品定位不同。法庭文件显示,
AI日报 – 2025-06-25(早)
深度学习模型评估面临危机,亟需创新基准:当前AI模型在SAT等标准化测试中表现优异,但可能只是“应试”而非真正智能提升。数据污染、基准过时等问题导致现有评估体系失效,尤其在编码、推理等高级技能领域。为此,学术界和产业界正积极开发新基准,如LiveCodeBench Pro(针对编程)、Xbench(中国红杉资本开发,兼顾学术与实用)、ARC-AGI(部分数据保密)、LiveBench(动态更新问题
AI日报 – 2025-06-24(晚)
Laude Institute成立,获1亿美元初始资金推动计算机科学公益研究: Andy Konwinski宣布启动Laude Institute,这是一个旨在资助对世界产生重大影响的非营 коммерial计算机科学研究的非营利组织。Jeff Dean、Joyia Pineau和Dave Patterson等知名人士加入董事会。该机构获得了1亿美元的初始承诺资金,将通过资助、资源共享和社区建设,
AI日报 – 2025-06-24(早)
Sakana AI推出强化学习教师 (RLTs) 模型: Sakana AI发布了名为强化学习教师 (Reinforcement-Learned Teachers, RLTs) 的新型模型,旨在通过强化学习 (RL) 变革大型语言模型 (LLM) 的推理能力训练方式。传统RL侧重于使用昂贵的LLM“学习解决”复杂问题,而RLTs则在接收问题和解决方案后,直接训练生成清晰的分步“解释”来教导学生模型