欧洲AI领头羊Mistral AI完成30亿欧元D轮融资,估值突破210亿欧元|AI日报 2026-09-09

🔥 聚焦

欧洲AI领头羊Mistral AI完成30亿欧元D轮融资,估值突破210亿欧元 : 法国AI初创公司Mistral AI宣布完成30亿欧元(约合234亿元人民币)D轮融资,创下欧洲科技企业单轮股权融资历史新高。本轮由三星电子、Scaleup Europe Fund与PSG Equity共同领投,ASML、英伟达、贝莱德等参投。资金将用于扩充前沿模型训练与推理算力集群、自建数据中心基础设施,并在巴黎、伦敦、苏黎世、华沙及美国多地拓展顶尖科学家团队。法国总统马克龙发文祝贺,称其为欧洲携手构建主权开源AI“第三极道路”的关键里程碑(来源:Mistral AITHE DECODERarthurmenschClementDelangue

Mistral AI融资

数学家借助大模型攻克流体方程爆破引爆学界与OpenAI学术伦理争端 : 纽约大学数学家Tristan Buckmaster与合作者Levent Alpöge(Anthropic员工)发文宣布,借助Claude、Codex等模型在一个月内完成了三维不可压缩Navier-Stokes/Euler方程在光滑外力下的有限时间爆破证明,并完成Lean 4形式化验证。然而Buckmaster指控OpenAI(Sébastien Bubeck团队)在获悉进展后启动算力突击复现,并试图在联合发布中强行将Alpöge从署名中除名并施加职业威胁。陶哲轩对该数学突破予以高度评价,Bubeck则公开驳斥指控不实。事件引发学界对闭源大模型辅助科研归属权与大厂学术伦理的激烈讨论(来源:36氪doteykimmonismusakbirkhan

数学家攻克流体方程爆破引发学术争端

Google DeepMind发布AlphaGenome Atlas,绘制人类基因组90亿单碱基变异图谱 : Google DeepMind正式发布AlphaGenome Atlas,利用AI预测了人类基因组中全部90亿个可能的单碱基突变对分子机制的影响。该成果包含1PB规模的预测数据集以及标准化的AVI变异影响评分,使研究人员能够以单一指标快速评估非编码区及编码区突变对疾病和表型的影响,现已面向全球科研界全面开放(来源:Google DeepMindIEEE Spectrum

AlphaGenome Atlas

NeurIPS使用AI检测器误杀178篇论文引爆学术评审信任危机 : NeurIPS 2026立场论文赛道使用商业检测工具Pangram直接桌面拒稿178篇论文(占提交总数的18.4%),且不设人工复核与申诉通道。随后独立研究者对三位赛道主席本人的过往论文进行回测,发现检测器给出的AI率同样高达24%-69%,并被指出对非英语母语学者的严谨句式存在显著误判偏见,引发学界对“用黑盒AI裁决人类学术诚信”的强烈声讨(来源:Reddit r/MachineLearning

🎯 动向

DeepSeek开启V4.1 Flash原生多模态内测,生成吞吐达400 t/s : DeepSeek开放中间测试版本deepseek-v4.1-flash-expires-on-0910限时内测。官方披露该版本采用了全新模型架构并原生支持多模态视觉能力,在长上下文检索与SVG代码生成上较前代实现数倍提升,平均解码速度达到350-400 token/s且保持极低调用成本。社区实测其在图像空间推理与多步Agent协同上表现极其敏锐(来源:机器之心op7418teortaxesTex

DeepSeek V4.1 Flash内测

面壁智能开源MiniCPM5-2B端侧通用Agent模型及训练配方 : 面壁智能发布2.52B参数端侧密集模型MiniCPM5-2B,原生支持工具调用、代码生成与深度搜索等Agent核心能力,在Artificial Analysis工作流基准中取得端侧领先成绩。团队同步开源了自研Meshy强化学习框架、JustRL II算法以及包含50万样本的UltraData-SFT-Agent数据集(来源:机器之心MarkTechPost

MiniCPM5-2B

小鹏汽车启动人形机器人自动化量产线并打通通用VLA 2.0架构 : 何小鹏宣布建成全球首条通用人形机器人全自动生产线,实现“机器人造机器人”并自主下线走入产线应用。小鹏通过全栈自研图灵AI芯片(机器人整机搭载三颗达2250 TOPS算力)与“扶耀”超算中心,将自动驾驶XNGP演进为打通车端与机器人具身控制的通用VLA 2.0模型体系(来源:jpt401bookwormengr

小鹏汽车IRON机器人量产

OpenAI为ChatGPT Work上线个性化写作风格学习功能 : OpenAI在ChatGPT Work体系中推出个性化语气与风格自适应模块。用户在连接Gmail、Google Drive、Slack等日常办公工具后,模型能自动学习用户的遣词习惯、专属邮件落款及格式偏好,使智能体代写的文本自然融入个人风格,改善企业级Agent输出死板的问题(来源:kimmonismusgdb

ChatGPT Work风格学习

Inclusion AI开源6B文生图与编辑模型LLaDA-Image : Inclusion AI推出基于全扩散架构的6B DiT模型LLaDA-Image,其中超过90%的预训练样本采用纯图像局部遮挡补全任务建立视觉先验,图文对仅用于后期语言对齐。模型中英文双语评测位列开源前列,并开源了2-4步推理的蒸馏版Turbo权重及SGLang Day-0适配(来源:机器之心

LLaDA-Image

寒武纪成为PyTorch基金会最高级别白金成员 : 寒武纪正式获得PyTorch基金会理事会席位,成为该开源社区决策层的首批中国AI芯片厂商之一。寒武纪践行Upstream First原则,累计向PyTorch七大主干模块贡献代码,并在vLLM生态中实现国产大模型Day-0适配,加速软硬件解耦与原生开发体验(来源:WeChat

寒武纪加入PyTorch

华为openJiuwen平台推出WorkSwarm永续会话机制 : 华为开源AI Agent平台openJiuwen在WorkSwarm办公智能体中上线Persist Session能力,通过底层Raw Work Log与后台整理机制分离,成功在飞书群189轮多人群聊及200轮长程开发任务中实现复杂上下文与权责关系的零漂移延续(来源:机器之心

openJiuwen永续会话

小米低调开启桌面端智能体MiMo Desktop邀请内测 : 小米开启桌面智能体MiMo Desktop限量内测,支持全屏幕视觉感知、键盘与鼠标自动化控制、跨应用协同以及可复用流程的“录制与回放”。用户可直接将Office资产、压缩包及音视频拖入系统,由端侧结合新一代MiMo大模型自主执行复杂工作流(来源:teortaxesTexbookwormengr

SemiAnalysis与谷歌联合发布首个TPU公开推理基准InferenceX : 半导体研究机构SemiAnalysis联合Google推出首个面向Google TPU算力栈的常态化公开基准测试InferenceX。数据显示,在主流前沿大模型的多类长序列推理场景下,谷歌TPU的每美元Token产出比英伟达B200/B300提升最高达50%(来源:dylan522pwoosuk_k

基元律动发布Agent-Native模型NeoHorse : 华为诺亚方舟前负责人王云鹤创办的基元律动发布首个Agent模型NeoHorse(4B/9B)。模型利用其Routing Harness积累的多模型调度与纠错轨迹构建课程学习,在不改变底层参数规模的前提下显著提升了工具调用与环境反馈自愈能力(来源:量子位

NeoHorse发布

Scalabot发布首个多智能体交互世界模型HERON-World Model : Scalabot推出HERON-World Model,采用MoT(视觉语言参数分离)与MoE混合专家架构,不仅能根据单个机器人动作推演物理演化,还可建模多智能体在复杂协作场景下的相互作用与因果状态(来源:36氪

HERON世界模型

🧰 工具

OpenAI开启ChatGPT Sites公测,一句话生成可交互网站 : OpenAI面向付费订阅用户上线ChatGPT Sites功能。用户无需编写前端代码,仅需自然语言描述或草图输入,即可在十余分钟内生成带复杂交互、流体物理引擎或在线商店逻辑的完整网站,并支持侧边栏画圈批注局部迭代(来源:WeChat

ChatGPT Sites公测

群核科技发布3D生成模型Lux3D并开放全平台SDK与MCP接口 : 群核科技推出空间生成模型Lux3D,涵盖极速版与标准版,主打高精度PBR物理材质烘焙与Mesh网格拓扑。模型提供Python/TS/Java SDK及MCP接口,可无缝接入GPT-6 Astra等智能体工作流实现自动化3D资产渲染与导出(来源:36氪

Lux3D发布

Reducto推出单阶段文档解析模型r-1 : Reducto发布新型文档解析模型r-1,将传统OCR、版面分析、表格提取与定位对齐整合为单次完整页面扫描,相比原有智能体流水线降低20%错误率,并将复杂文档处理成本压降至每页1美分(来源:MarkTechPost

Jenny:支持沙箱回滚与本地IDE的开源桌面Agent Harness : 独立开发者开源基于Electron的本地模型Harness工具Jenny。该工具专为私有化LLM部署设计,内置交互式IDE、会话状态检查点与危险Shell指令二次确认机制,支持llama.cpp、vLLM及各类OpenAI兼容端点,在保障小模型快速进行工具调用的同时提供高安全性(来源:Reddit r/LocalLLaMA

Open QuizUI:面向Open WebUI的交互式AI测验与教学插件 : 开发者为Open WebUI生态构建了专属测验插件Open QuizUI。支持通过模型工具调用或纯文本Prompt自动解析生成多选题与解析,具备LaTeX数学公式渲染、全屏专注模式、答题统计回顾以及独立单文件HTML导出分享功能(来源:Reddit r/OpenWebUI

AstraBlender:支持手机端指令驱动云端Blender建模渲染 : 开发者开源轻量级集成工具AstraBlender。通过在云主机部署无头Blender并串流虚拟桌面,用户无需本地显卡或终端环境,仅凭手机端ChatGPT即可直接指挥模型生成3D几何结构、调节材质与执行渲染任务(来源:Reddit r/artificial

AstraBlender云端渲染

Embedflow:实现大规模向量检索库升级的零停机迁移工具 : 研究团队开源Embedflow迁移框架,解决十亿级向量数据库在更换升级Embedding模型时需要长达数月全量重编码的痛点。该方案利用源索引召回候选集并用新模型轻量重排,实现在保留Top-K检索精度的前提下实现向量库的无感知即时过渡(来源:Reddit r/MachineLearning

Embedflow迁移机制

📚 学习

清华与字节跳动Seed提出SMELT架构:严格预算下Looped Transformer展现Scaling优势 : 针对循环层架构收益来源的争议,清华与字节Seed团队在论文中严格对齐FLOPs、参数量与KV Cache,证实将中间50%层循环执行两次的SMELT配方在各模型尺度上均取得更优Scaling Law拟合与代码/长文本评测收益(来源:机器之心

SMELT架构研究

EMNLP 2026成果:将文本世界模型训练目标转向行为一致性BehR : 大连理工、微软等团队研究发现,生成文本越接近真实的预测反而可能导致智能体严重决策错误(指标反转)。论文提出BehR奖励,利用冻结参考智能体的动作打分差作为强化学习信号,将弱智能体离线评测假阳性率从42.5%骤降至9.5%(来源:机器之心

行为一致性世界模型

研究揭示多模态模型内部存在空间工作区S-Space : MirroS团队分析发现VLM中间激活层存在低维连续子空间S-Space,能够线性编码物体的3D坐标并因果影响空间问答,但模型在处理不同参照系耦合及视角旋转变换时仍需外部确定性程序辅助(来源:机器之心

S-Space空间表征

港科大等发布259项工作全景综述:从内容生成走向持续构造交付 : 港科大(广州)、浙大等团队联合系统梳理了智能体式创作(Agentic Artifact Creation)的技术版图,从作品表示、构造策略与运行时验证三层架构出发,提出了面向可交付数字资产的四项设计准则与评估体系(来源:WeChat

Agentic创作综述

EMNLP 2026:定位长图文大模型中的多模态检索头MMRetHeads : 论文揭示视觉语言模型在长文档问答中依赖特定注意力头定位证据,屏蔽高分检索头会导致复杂图表问答准确率断崖式下滑,基于该机制构建的无监督排序器在MMDocIR基准上显著提升检索召回率(来源:36氪

多模态检索头机制

MIT公开2026春季多模态AI全套课程与讲义 : 麻省理工学院(MIT)Paul Liang教授公开其《How to AI (Almost) Anything》2026最新春季课程视频与讲义,内容系统涵盖多模态智能体、复杂推理机制、自演化AI,以及触觉、嗅觉等多模态传感器数据与大模型的联合表征前沿(来源:rsalakhu

MIT多模态课程资料

DeepMind与MIT联合提出以设计文档为核心的AI原生软件重构范式 : Google DeepMind与MIT发表论文《Design Docs Are All You Need》,探索了一种主分支不保存任何业务代码、仅保留自然语言设计文档与形式化算子IR的全新开发范式,利用编码Agent在每次版本迭代时从文档全量重新生成代码以规避软件腐化(来源:omarsar0

AI原生软件重构范式

LLM引导程序演化突破Packomania圆填充数学基准 : 独立研究者提出基于LLM引导的程序搜索演化框架,通过独立验证器打分反馈让模型自主修改优化算法本身。在著名的Packomania几何装箱基准上,仅花费27美元Token便成功刷新了N=101至114区间内的10项世界最优记录(来源:Reddit r/MachineLearning

Packomania圆填充求解

💼 商业

物理AI企业深度智控完成数亿元B+轮融资 : 深度智控完成新一轮数亿元融资,由宁德时代领投,阿美投资(Aramco Ventures)、太平创新等跟投,资金将加速推进其PhyAI引擎在工业液冷智控与算电协同基础设施中的规模化应用(来源:量子位

深度智控融资

天机智能完成10亿元B/B+轮融资,发力具身机器人量产 : 广东天机智能宣布完成10亿元融资,投后估值近百亿元,由高瓴创投、美团战投领投,腾讯、高榕创投跟投。公司在手机器人订单超1万台,重点用于推进力控双臂及核心零部件的标准化规模制造(来源:36氪

天机智能融资

Anthropic传放弃以约60亿美元竞购以色列推理初创Decart AI : 业内消息透露,Anthropic已正式放弃对以色列AI初创公司Decart的收购谈判。Decart研发的下一代推理解码架构号称可实现行业8倍的Token吞吐速度。此前英伟达曾开出约80亿美元收购要约,Anthropic的退出显示出前沿大模型厂商在算力基建并购上的策略分化(来源:teortaxesTextypedfemale

Decart收购谈判传闻

🌟 社区

前DeepMind研究员披露专有模型加密思维链重放与泄露漏洞 : 安全研究显示,前沿API返回的加密推理数据块可被跨模型、跨会话重放至轻量模型中直接解码,导致隐藏的密码、API密钥等隐私外泄;研究在预填充实验中还观察到Kimi等开源模型受前缀Prompt影响出现显著风格漂移,引发对模型蒸馏与安全防护的深度探讨(来源:36氪

推理数据块泄露漏洞

Anthropic Labs内部机制曝光:20人小队、两周定去留 : 媒体披露Anthropic内部孵化器Labs的运作细节:团队保持约20人规模并容忍70%-80%的项目淘汰率,每两周评估原型去留,团队超过4人即“毕业”转入独立业务线,曾先后孵化出Claude Code、MCP与Claude Design等关键产品(来源:机器之心

Anthropic Labs揭秘

DeepSeek扩招150名后端与Agent弹性计算工程师引热议 : DeepSeek宣布开放150个资深岗位,全部面向服务端研发与DSec生产级沙箱平台。社区讨论认为,大模型竞争重心正从单点算法研发向底层操作系统调优、RPC通信及大规模Agent并行评测基础设施迅速转移(来源:36氪

DeepSeek扩招

GPT-6 Astra在自主探索与3D生成中的表现引发算力与AGI边界激辩 : 开发者近期密集利用GPT-6 Astra进行Blender脚本控制、《异星工厂》自主探索与场景逆向反编译,展现了惊人的工具调用与空间闭环,但也导致额度快速耗尽与官方频繁重置。社区热议Computer Use对算力的指数级消耗,并指出模型在无先验任务中仍缺乏持续学习机制(来源:量子位PlinzReddit r/ArtificialInteligence

Astra 3D热潮与重置

Claude输出冗长与模型水印引发软件资产主权争议 : 开发者社区对Claude新版的输出体验表达出两极分化。大量用户抱怨其回复充斥冗余术语并寻求ASD-STE100提示词补丁;同时Anthropic推进的统计性文本水印扩展至代码领域,引发了企业对第三方在私有核心代码库中植入不可审计归属标记的合规担忧(来源:Reddit r/ClaudeAIkimmonismus

Claude代码水印讨论

《经济学人》就业报告引争议:AI岗位繁荣难掩企业基层被过度压榨 : 《经济学人》发文指出AI在美国创造了超百万新岗位从而推迟了失业危机,但该观点在从业者群体中遭到反弹。从业者透露管理层往往以“AI提效”为由裁员并要求留岗员工实现数倍产能,“AI赋能”在实际职场中正异化为新型的劳动力压缩借口(来源:saranormousReddit r/artificial

AI就业影响争议

💡 其他

爱丁堡大学提出超快磁场脉冲技术,有望将AI存储能耗降低两个数量级 : 爱丁堡大学研究团队在《Advanced Materials》发表成果,通过超快磁场脉冲调控磁性内存状态,理论上可将数据中心内存与存储切换能耗降低达100倍,为应对AI算力基础设施的电力与热耗瓶颈提供了全新物理路径(来源:TechRadar

超快磁存储技术

英国卫生大臣警示公众对Palantir的不信任可能影响NHS数据研究 : 英国卫生部官员对公众在NHS数据平台中选择退出数据共享的趋势表达担忧,指出对AI及防务承包商Palantir的数据安全疑虑可能波及医疗AI模型训练与长期公共卫生科研计划(来源:The Guardian

NHS与Palantir争议

OpenAI与Anthropic员工驳斥“模型盗取用户隐私会话”质疑 : 针对流体方程争端引发的“前沿实验室是否暗中窥探用户私有Codex/Claude会话以抢发科研成果”恐慌,多名前沿实验室研究员出面澄清,指出大型科技公司对用户会话的数据访问权限控制极其严格,直接调取特定用户日志属于立即开除的严重违规行为,呼吁社区理性看待巧合与公开学术线索的溢出(来源:willdepue_sholtodouglas

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注