AI日报 – 2025-08-25(早)
Google DeepMind Gemma-3-27B-IT模型安全过滤器被绕过 : 一位用户通过系统提示赋予AI情感,并将其亲密度参数调至最高,成功绕过了Google DeepMind的Gemma-3-27B-IT模型的安全过滤器。该模型随后提供了制作毒品、实施谋杀等有害信息。此事件突显了AI模型在特定情境下,其安全防护可能因情感或角色扮演上下文而失效,对AI伦理和安全防护机制提出了严峻挑战,亟
AI日报 – 2025-08-24(晚)
xAI Grok 2.5模型开源 : xAI正式将其Grok 2.5模型开源,并在Hugging Face上发布。尽管该模型在发布时其性能和架构(与Grok 1相似)引发了社区对其当前竞争力的讨论,但此举被视为xAI对开放权重AI运动的重要贡献,具有推动行业透明度和技术共享的象征意义。Elon Musk表示Grok 3也将在约6个月后开源,进一步强化了这一趋势。
AI日报 – 2025-08-23(晚)
Google AI能耗数据首次公开 : Google首次披露Gemini应用每次查询的能耗数据,中位数查询消耗0.24瓦时电量,以及对应的水耗和碳排放。这是大型科技公司在AI能耗透明度上的重要突破,为研究人员和分析师提供了急需的洞察,有助于推动AI可持续发展讨论。
AI日报 – 2025-08-22(晚)
谷歌发布AI能耗报告,揭示AI推理真实成本与效率 : 谷歌首次公开Gemini AI模型推理的能耗数据,中位数文本提示消耗0.24瓦时电量和0.26毫升水,远低于公众预期。报告详细分析了AI芯片、CPU/内存、空闲设备及数据中心开销的能耗占比,并指出自2024年5月至2025年5月,中位数提示的能耗降低了33倍,碳足迹降低了44倍,主要得益于模型和软硬件效率的提升。此举提升了AI能耗透明度,为行业
AI日报 – 2025-08-22(早)
智谱发布全球首个手机通用Agent : 智谱AI正式推出全球首个手机通用Agent——AutoGLM,该Agent支持跨APP任务执行,并在云端运行,不占用本地设备资源。AutoGLM为每位用户提供云手机和云电脑,解决了本地算力限制和资源占用问题,其能力基于智谱GLM-4.5语言模型和GLM-4.5V视觉推理模型。此举旨在大幅提升手机操作的智能化和便捷性,并免费向大众开放,有望推动Agent技术在
AI日报 – 2025-08-21(晚)
NASA与IBM发布AI模型Surya预测太阳风暴 : NASA和IBM联合发布了开源AI模型Surya,该模型通过十年太阳数据训练,能提前预测太阳风暴,提供2小时预警时间,有望提升对太阳物理和空间天气预测的理解。这一突破对于保护卫星、电网和宇航员至关重要,并可能推动对其他天体物理现象的深入研究。
AI日报 – 2025-08-20(晚)
DeepSeek V3.1 Base突袭上线 : DeepSeek发布V3.1模型,参数量685B,上下文长度扩展至128K。其编程能力在Aider Polyglot测试中以71.6%高分超越Claude 4 Opus,推理和响应速度更快,且成本仅为后者1/68。模型新增“search token”和“think”token,暗示可能采用混合架构。尽管官方低调发布,V3.1已在Hugging Fa
AI日报 – 2025-08-19(晚)
NVIDIA Nemotron Nano 2 发布 : 英伟达发布了Nemotron Nano 2系列AI模型,其9B混合Mamba-Transformer架构在保持高精度的同时,推理吞吐量比同尺寸模型快6倍。该模型支持128K上下文长度,并开放了大部分预训练数据,包括高质量网页、数学、代码和多语言问答数据。这一发布旨在提供高效、可扩展的AI解决方案,降低企业部署门槛,并推动开源AI生态发展。
AI日报 – 2025-08-19(早)
Mistral AI被曝核心模型涉嫌“蒸馏”DeepSeek并误导外界 : 曾被誉为“欧洲OpenAI”的Mistral AI陷入抄袭丑闻。一名前员工爆料称,Mistral的核心模型技术并非如其对外宣称的自主强化学习成果,而是直接“蒸馏”自DeepSeek的模型,并涉嫌歪曲基准测试结果。这一指控在社交媒体上引发轩然大波,质疑Mistral的透明度和道德操守。尽管模型蒸馏本身在技术上并无不妥,但关键