🔥 フォーカス
欧州AIの旗手Mistral AIがシリーズDで30億ユーロを調達、評価額は210億ユーロを突破 : フランスのAIスタートアップMistral AIは、30億ユーロ(約234億人民元相当)のシリーズD資金調達を完了したと発表しました。これは欧州テクノロジー企業の単一ラウンドにおけるエクイティ調達額として過去最高となります。本ラウンドはSamsung Electronics、Scaleup Europe Fund、PSG Equityが共同リード投資家を務め、ASML、NVIDIA、BlackRockなどが参加しました。調達資金は、フロンティアモデルの学習・推論用コンピュートクラスタの拡張、自社データセンターインフラの構築、ならびにパリ、ロンドン、チューリッヒ、ワルシャワおよび米国各地におけるトップサイエンティストチームの拡充に充てられます。フランスのマクロン大統領は祝辞を投稿し、欧州が一体となって主権的なオープンウェイトAIの「第三の道」を構築する上での極めて重要なマイルストーンであると評価しました(出典:Mistral AI、THE DECODER、arthurmensch、ClementDelangue)

数学者がLLMを活用して流体方程式のブローアップを証明、学界とOpenAIの間で研究倫理を巡る論争が勃発 : ニューヨーク大学の数学者Tristan Buckmaster氏と共同研究者のLevent Alpöge氏(Anthropic社員)は、ClaudeやCodexなどのモデルを活用し、滑らかな外力下における3次元非圧縮Navier-Stokes/Euler方程式の有限時間ブローアップの証明およびLean 4による形式検証を1か月で完了したと発表しました。しかしBuckmaster氏は、進捗を把握したOpenAI(Sébastien Bubeck氏のチーム)が計算資源を集中投入して再現を試み、共同発表においてAlpöge氏を著者から強制的に除外しようとし、キャリア上の脅迫を行ったと告発しました。テレンス・タオ(Terence Tao)氏はこの数学的ブレークスルーを高く評価する一方、Bubeck氏は告発を事実無根と公に反論しています。この事態は、プロプライエタリなLLM支援による研究の帰属権とビッグテックの研究倫理を巡る激しい議論を学界に巻き起こしています(出典:36氪、dotey、kimmonismus、akbirkhan)

Google DeepMindがAlphaGenome Atlasを公開、ヒトゲノム90億の単一塩基変異アトラスを構築 : Google DeepMindは、ヒトゲノムにおける起こり得る全90億個の単一塩基変異が分子メカニズムに与える影響をAIで予測したAlphaGenome Atlasを正式に公開しました。この成果には1PB規模の予測データセットと標準化されたAVI変異影響スコアが含まれており、研究者は単一の指標で非コード領域およびコード領域の変異が疾患や表現型に及ぼす影響を迅速に評価できます。現在、世界の研究コミュニティに向けて全面的に公開されています(出典:Google DeepMind、IEEE Spectrum)

NeurIPSがAIチェッカーで178本の論文を誤判定デスクリジェクト、査読の信頼性危機に : NeurIPS 2026のPosition Paperトラックにおいて、商用検出ツールPangramを用いて投稿全体の18.4%に相当する178本の論文が人手による確認や不服申し立ての機会なく即座にデスクリジェクトされました。その後、独立した研究者が当トラックのチェア3名自身の過去論文を再テストしたところ、チェッカーによるAI判定率が24%〜69%と高率で算出されたほか、英語非母語話者による厳密な文章構造に対する顕著な誤判定バイアスが指摘され、「ブラックボックスAIによる人間の学術的誠実性の裁定」に対する強い非難が学界で巻き起こっています(出典:Reddit r/MachineLearning)
🎯 動向
DeepSeekがV4.1 Flashのネイティブマルチモーダル限定クローズドテストを開始、生成スループットは400 t/sに到達 : DeepSeekは中間テストバージョンdeepseek-v4.1-flash-expires-on-0910の期間限定テストを開始しました。公式発表によると、本バージョンは新しいモデルアーキテクチャを採用し、ネイティブマルチモーダルビジョン機能をサポートしています。長文コンテキスト検索やSVGコード生成において前世代比で数倍の向上を実現し、平均デコード速度は350〜400 token/sに達しながら極めて低いAPIコストを維持しています。コミュニティの検証では、画像空間推論やマルチステップAgentの協調において極めて高精度な挙動が確認されています(出典:機器之心、op7418、teortaxesTex)
.jpg)
ModelBest(面壁智能)がオンデバイス向け汎用AgentモデルMiniCPM5-2Bと学習レシピをオープンソース公開 : ModelBestは2.52Bパラメータのオンデバイス向け高密度モデルMiniCPM5-2Bを公開しました。ツール呼び出し、コード生成、ディープサーチなどのAgentコア機能をネイティブでサポートし、Artificial Analysisのワークフローベンチマークにおいてオンデバイス最高峰のスコアを記録しました。チームは自社開発の強化学習フレームワークMeshy、JustRL IIアルゴリズム、および50万件のサンプルを含むUltraData-SFT-Agentデータセットを同時にオープンソース化しました(出典:機器之心、MarkTechPost)
.jpg)
XPeng(小鵬汽車)が人型ロボットの全自動量産ラインを稼働、汎用VLA 2.0アーキテクチャを統合 : 何小鵬(He Xiaopeng)氏は、世界初となる汎用人型ロボットの全自動生産ラインを構築し、「ロボットがロボットを製造する」仕組みと自律的なラインオフ・実稼働を実現したと発表しました。自社開発のTuring AIチップ(ロボット1台につき3基搭載、計2250 TOPSの計算能力)と「Fuyao」スーパーコンピューティングセンターを通じ、自動運転XNGPを発展させて車両とロボットの身体性制御を統合する汎用VLA 2.0モデル体系を確立しました(出典:jpt401、bookwormengr)

OpenAIがChatGPT Work向けにパーソナライズされた執筆スタイルの学習機能をリリース : OpenAIはChatGPT Workシステム内に、トーンとスタイルを自動適応させるパーソナライズモジュールを導入しました。ユーザーがGmail、Google Drive、Slackなどの日常業務ツールと連携させると、モデルが語彙の癖、専用のメール署名、フォーマットの好みを自動学習し、Agentが代筆する文章に個人のスタイルを自然に反映させ、エンタープライズAgentのアウトプットが画一的になる課題を解消します(出典:kimmonismus、gdb)

Inclusion AIが6Bの画像生成・編集モデルLLaDA-Imageをオープンソース公開 : Inclusion AIは、フル拡散アーキテクチャに基づく6B DiTモデルLLaDA-Imageをリリースしました。事前学習サンプルの90%以上で純粋な画像の局所マスキング・補完タスクを用いて視覚的プライアを構築し、画像とテキストのペアは後期の言語アライメントのみに使用されています。モデルは中英バイリンガル評価でオープンソース上位に位置し、2〜4ステップの推論が可能な蒸留版TurboウェイトおよびSGLangのDay-0サポートも公開されています(出典:機器之心)
.jpg)
Cambricon(寒武紀)がPyTorch Foundationの最高位プラチナメンバーに就任 : CambriconはPyTorch Foundationの理事会シートを正式に獲得し、同オープンソースコミュニティの意思決定層に参画する初の中国AIチップメーカーの1社となりました。CambriconはUpstream Firstの原則を掲げ、PyTorchの主要7モジュールにコードを寄贈してきたほか、vLLMエコシステムにおいて国産LLMのDay-0適合を実現し、ハード・ソフトの分離とネイティブ開発体験の向上を加速させています(出典:WeChat)

HuaweiのopenJiuwenプラットフォームがWorkSwarmの永続セッション機構を公開 : HuaweiのオープンソースAI AgentプラットフォームopenJiuwenは、WorkSwarmワークプレイスAgentにおいてPersist Session機能をリリースしました。基盤となるRaw Work Logとバックグラウンド整理機構を分離することで、Feishu(Lark)グループでの189ターンのマルチユーザーチャットおよび200ターンの長期開発タスクにおいて、複雑なコンテキストと役割・責任関係をドリフトなく維持することに成功しました(出典:機器之心)
.jpg)
Xiaomiがデスクトップ向けAgent「MiMo Desktop」の招待制テストを静かに開始 : XiaomiはデスクトップAgent「MiMo Desktop」の限定テストを開始しました。画面全体の視覚認識、キーボード・マウスの自動制御、クロスアプリケーション連携、および再利用可能なプロセスの「記録と再生」をサポートしています。ユーザーはOfficeファイル、圧縮ファイル、音声・動画をシステムに直接ドラッグ&ドロップするだけで、オンデバイスと次世代MiMoモデルの連携により複雑なワークフローを自律実行させることが可能です(出典:teortaxesTex、bookwormengr)
SemiAnalysisとGoogleが初のTPU公開推論ベンチマークInferenceXを共同発表 : 半導体調査機関のSemiAnalysisはGoogleと共同で、Google TPUコンピュートスタックを対象とした初の定常的公開ベンチマークテストInferenceXを発表しました。データによると、主要なフロンティアモデルにおける多様な長シーケンス推論シナリオにおいて、Google TPUはNVIDIA B200/B300と比較して1ドルあたりのToken出力が最大50%向上しています(出典:dylan522p、woosuk_k)
Giyun Rhythms(基元律動)がAgent-NativeモデルNeoHorseを発表 : 元Huawei Noah’s Ark Lab責任者の王雲鶴氏が創業したGiyun Rhythmsは、初のAgentモデルNeoHorse(4B/9B)を発表しました。本モデルはRouting Harnessで蓄積されたマルチモデルスケジューリングとエラー修正軌跡を活用してカリキュラム学習を構築しており、基盤パラメータ規模を変更することなく、ツール呼び出し能力と環境フィードバックによる自己修復能力を大幅に向上させました(出典:量子位)

Scalabotが初のマルチエージェント相互作用世界モデルHERON-World Modelを発表 : ScalabotはHERON-World Modelを発表しました。MoT(ビジョン・言語パラメータの分離)とMoE(Mixture of Experts)を組み合わせたアーキテクチャを採用し、単一ロボットのアクションに基づく物理現象の推移を予測するだけでなく、複雑な協調シナリオにおけるマルチエージェントの相互作用と因果状態のモデリングも可能です(出典:36氪)

🧰 ツール
OpenAIがChatGPT Sitesのパブリックベータを開始、一文の指示でインタラクティブなWebサイトを生成 : OpenAIは有料プランのユーザーを対象にChatGPT Sites機能の提供を開始しました。ユーザーはフロントエンドのコードを書く必要がなく、自然言語による記述やスケッチの入力だけで、複雑なインタラクション、流体物理エンジン、オンラインショップのロジックを備えた完全なWebサイトを十数分で生成できます。サイドバーで範囲を選択して注釈を付けることによる部分修正にも対応しています(出典:WeChat)

Manycore Tech(群核科技)が3D生成モデルLux3Dを発表、全プラットフォームSDKとMCPインターフェースを公開 : Manycore Techは空間生成モデルLux3Dを発表しました。高速版と標準版が用意されており、高精度なPBR物理ベースマテリアルのベイクとMeshメッシュトポロジーを特徴としています。Python/TS/Java SDKおよびMCPインターフェースを提供し、GPT-6 AstraなどのAgentワークフローにシームレスに統合して3Dアセットの自動レンダリングとエクスポートが可能です(出典:36氪)

Reductoがシングルパス文書解析モデルr-1をリリース : Reductoは新しい文書解析モデルr-1を発表しました。従来のOCR、レイアウト解析、表抽出、位置合わせを1回の完全なページスキャンに統合し、従来のAgentパイプラインと比較してエラー率を20%削減し、複雑な文書の処理コストを1ページあたり1セントに抑えました(出典:MarkTechPost)
Jenny:サンドボックスロールバックとローカルIDEをサポートするオープンソースのデスクトップAgent Harness : 個人開発者がElectronベースのローカルモデルHarnessツールJennyをオープンソース化しました。プライベートなLLMデプロイ向けに設計されており、インタラクティブIDE、セッション状態のチェックポイント、危険なShellコマンドの再確認機能を内蔵しています。llama.cpp、vLLM、および各種OpenAI互換エンドポイントをサポートし、小型モデルによる高速なツール呼び出しを可能にしながら高い安全性を確保します(出典:Reddit r/LocalLLaMA)
Open QuizUI:Open WebUI向けのインタラクティブAIクイズ・教育用プラグイン : Open WebUIエコシステム専用のクイズプラグインOpen QuizUIが開発されました。モデルのツール呼び出しやテキストプロンプトからの選択式問題と解説の自動生成をサポートし、LaTeX数式レンダリング、全画面集中モード、解答統計の振り返り、単一HTMLファイルとしてのエクスポート・共有機能を備えています(出典:Reddit r/OpenWebUI)
AstraBlender:スマートフォンからの指示でクラウド上のBlenderモデリングとレンダリングを実行 : クラウドBlenderをスマートフォンから操作できる軽量統合ツールAstraBlenderがオープンソースで公開されました。クラウドホスト上にヘッドレスBlenderを配置して仮想デスクトップをストリーミングすることで、ユーザーはローカルのGPUやターミナル環境を必要とせず、スマホ版ChatGPTから直接モデルに指示を出して3Dジオメトリの生成、マテリアル調整、レンダリングを実行できます(出典:Reddit r/artificial)

Embedflow:大規模ベクトル検索データベースのダウンタイムなしアップグレードを実現する移行ツール : 10億規模のベクトルデータベースにおいてEmbeddingモデルを更新する際、数か月にわたる全量再エンコードが必要となる課題を解決するため、研究チームが移行フレームワークEmbedflowをオープンソース公開しました。ソースインデックスから候補セットをリコールし、新モデルで軽量に再ランキングすることで、Top-K検索精度を維持したまま、ユーザーに意識させることなく即時移行を実現します(出典:Reddit r/MachineLearning)

📚 学習
清華大学とByteDance SeedがSMELTアーキテクチャを提案:厳密なリソース制約下でLooped Transformerが優れたScaling優位性を実証 : ループ層アーキテクチャの性能向上の要因をめぐる議論に対し、清華大学とByteDance SeedチームはFLOPs、パラメータ数、KV Cacheを厳密に揃えた論文を発表しました。中間50%の層を2回ループ実行するSMELTレシピが、あらゆるモデル規模においてより優れたScaling Lawへの適合を示し、コードや長文テキスト評価で優位性を持つことを証明しました(出典:機器之心)
.jpg)
EMNLP 2026の研究成果:テキスト世界モデルの学習目標を行動整合性(BehR)へ転換 : 大連理工大学やMicrosoftなどのチームによる研究で、生成テキストがより現実に近い予測であっても、Agentが重大な意思決定エラーを引き起こす可能性があること(指標の逆転現象)が判明しました。論文ではBehRリワードを提案し、凍結された参照Agentのアクションスコアの差分を強化学習シグナルとして利用することで、弱Agentのオフライン評価における偽陽性率を42.5%から9.5%へと劇的に低下させました(出典:機器之心)
.jpg)
マルチモーダルモデル内部に空間作業領域「S-Space」が存在することが判明 : MirroSチームの分析により、VLMの中間活性化層に物体の3D座標を線形エンコードし空間QAに因果的影響を与える低次元連続部分空間「S-Space」が存在することが明らかになりました。ただし、異なる座標系の結合や視点回転変換を処理する際には、依然として外部の決定論的プログラムによる補助が必要です(出典:機器之心)
.jpg)
香港科技大学などが259件の研究をまとめたサーベイ論文を発表:コンテンツ生成から持続的な構築・デリバリーへ : 香港科技大学(広州)や浙江大学などのチームが、Agentによる成果物作成(Agentic Artifact Creation)の技術ランドスケープを包括的に整理しました。成果物の表現、構築戦略、ランタイム検証の3層アーキテクチャから出発し、デリバリー可能なデジタルアセットに向けた4つの設計原則と評価体系を提唱しています(出典:WeChat)

EMNLP 2026:長文マルチモーダルモデルにおけるマルチモーダル検索ヘッド(MMRetHeads)を特定 : 視覚言語モデルが長文ドキュメントQAにおいて特定のAttention Headに依存して根拠を特定していることを明らかにした論文が発表されました。高スコアの検索ヘッドをマスクすると複雑な図表QAの正解率が急落することが示され、このメカニズムに基づいて構築された教師なしリランカーはMMDocIRベンチマークで検索再現率を大幅に向上させました(出典:36氪)

MITが2026年春季マルチモーダルAIコースの講義動画と資料を全編公開 : マサチューセッツ工科大学(MIT)のPaul Liang教授は、2026年最新春学期コース《How to AI (Almost) Anything》の講義動画とスライドを公開しました。内容はマルチモーダルAgent、複雑推論メカニズム、自己進化AI、ならびに触覚・嗅覚などのマルチモーダルセンサーデータとLLMの統合表現フロンティアを体系的に網羅しています(出典:rsalakhu)

DeepMindとMITが設計文書を中心としたAIネイティブなソフトウェアリファクタリングパラダイムを共同提案 : Google DeepMindとMITは論文《Design Docs Are All You Need》を発表し、メインブランチに業務コードを一切保持せず、自然言語の設計文書と形式化された演算子IRのみを管理する新しい開発パラダイムを探求しました。コーディングAgentがバージョン更新ごとに文書からコードをゼロから再生成することで、ソフトウェアの経年劣化(腐敗)を防ぎます(出典:omarsar0)

LLM主導のプログラム進化がPackomania円パッキング問題の数学ベンチマークを更新 : 独立系研究者がLLM主導のプログラム探索・進化フレームワークを提案しました。独立した検証器のスコアフィードバックを通じて、モデル自らがアルゴリズム自体を修正・最適化します。著名なPackomania幾何パッキングベンチマークにおいて、わずか27ドルのToken費用でN=101から114の範囲における10件の世界最高記録を更新しました(出典:Reddit r/MachineLearning)

💼 ビジネス
フィジカルAI企業のDeepControl(深度智控)が数億人民元のシリーズB+ラウンド資金調達を完了 : DeepControlはCATL(寧徳時代)がリード投資家を務め、Aramco VenturesやTaiping Innovationなどが参加する数億人民元の新たな資金調達を完了しました。調達資金は、同社のPhyAIエンジンの産業用液冷スマート制御および電力・計算協調インフラにおける大規模応用の加速に充てられます(出典:量子位)

Tianji Intelligence(天機智能)が10億人民元のシリーズB/B+ラウンド資金調達を完了、具身ロボットの量産を本格化 : 広東天機智能は10億人民元の資金調達を完了し、評価額は約100億人民元に達しました。Hillhouse Investment(高瓴創投)とMeituan Strategic Investmentが共同リードを務め、TencentやGaorong Venturesが参加しました。同社は1万台以上のロボット受注残を抱えており、力制御デュアルアームおよびコア部品の標準化・大規模製造の推進に重点を置きます(出典:36氪)

Anthropicがイスラエルの推論スタートアップDecart AIの買収(約60億ドル規模)を断念か : 業界筋によると、AnthropicはイスラエルのAIスタートアップDecartの買収交渉を正式に打ち切った模様です。Decartが開発する次世代推論デコードアーキテクチャは、業界比8倍のTokenスループットを実現できるとされています。以前NVIDIAが約80億ドルの買収提案を行っており、Anthropicの撤退は計算基盤M&AにおけるフロンティアLLMベンダー間の戦略的分岐を示しています(出典:teortaxesTex、typedfemale)

🌟 コミュニティ
元DeepMind研究者がプロプライエタリモデルの暗号化CoT再生・漏洩脆弱性を公表 : セキュリティ研究により、最先端APIから返される暗号化推論データブロックがモデルやセッションをまたいで軽量モデルに再生され、直接デコードされることで隠されたパスワードやAPIキーなどのプライバシーが漏洩する可能性があることが示されました。また、事前入力実験ではKimiなどのオープンモデルがプレフィックスPromptの影響を受けて著しいスタイルドリフトを起こす現象も観察され、モデル蒸留と安全保護に関する深い議論を呼んでいます(出典:36氪)

Anthropic Labsの内部メカニズムが判明:20人の小規模チーム、2週間で存廃を決定 : メディアがAnthropicの社内インキュベーター「Labs」の運営実態を報じました。チーム規模を約20人に維持し、70%〜80%のプロジェクト淘汰率を許容しながら、2週間ごとにプロトタイプの存廃を評価します。チームが4人を超えると「卒業」して独立したビジネスラインに移行する仕組みで、これまでにClaude Code、MCP、Claude Designなどの重要プロダクトを生み出してきました(出典:機器之心)
.jpg)
DeepSeekがバックエンドおよびAgentエラスティックコンピュートエンジニア150名を大募集し話題に : DeepSeekはサーバーサイド開発およびDSec本番サンドボックスプラットフォーム向けに150名のシニアポジションを募集すると発表しました。コミュニティでは、LLMの競争の主戦場が単一アルゴリズムの研究開発から、基盤OSのチューニング、RPC通信、大規模Agent並列評価インフラへと急速にシフトしているとの見方が広がっています(出典:36氪)

自律探索と3D生成におけるGPT-6 Astraの挙動が計算リソースとAGIの境界をめぐる議論を喚起 : 開発者の間でGPT-6 Astraを用いたBlenderスクリプト制御、『Factorio』の自律プレイ、シーンのリバースエンジニアリングなどが活発に行われ、驚異的なツール呼び出しと空間的閉ループ制御が示されましたが、同時にクォータの急速な枯渇と公式による頻繁なリセットを招いています。コミュニティではComputer Useによる計算資源の指数関数的な消費が議論されているほか、事前知識のないタスクにおいてモデルがいまだ継続的学習メカニズムを欠いている点が指摘されています(出典:量子位、Plinz、Reddit r/ArtificialInteligence)

Claudeの冗長な出力とモデル透かしがソフトウェア資産の主権を巡る論争に発展 : 開発者コミュニティにおいて、Claude新バージョンの出力に対する評価が二極化しています。多くのユーザーが冗長な専門用語の多さに不満を漏らしASD-STE100プロンプトによる対策を求める一方、Anthropicが進める統計的テキスト透かし技術がコード領域にまで拡張されたことで、プライベートなコアコードベースに監査不能な帰属マークが埋め込まれることへのコンプライアンス上の懸念が企業の間で生じています(出典:Reddit r/ClaudeAI、kimmonismus)

『The Economist』の雇用レポートに異論:AI雇用の活況は現場の過酷な搾取を覆い隠しているとの指摘 : 『The Economist』は、米国でAIが100万人以上の新規雇用を生み出し失業危機の到来を遅らせていると報じましたが、現場の実務者からは反発の声が上がっています。実務者らによると、経営陣は「AIによる効率化」を名目に人員を削減し、残った社員に数倍の生産性を要求するケースが多く、実際の職場において「AI活用」が新たな労働力圧縮の口実に変質していると指摘されています(出典:saranormous、Reddit r/artificial)

💡 その他
エディンバラ大学が超高速磁場パルス技術を提案、AIストレージの消費電力を2桁削減できる可能性 : エディンバラ大学の研究チームは『Advanced Materials』に論文を発表し、超高速磁場パルスを用いて磁気メモリの状態を制御することで、データセンターのメモリおよびストレージ切り替え時の消費電力を理論上最大100分の1に削減できる技術を報告しました。これはAI計算インフラの電力・熱問題に対する新たな物理的アプローチとなります(出典:TechRadar)

英保健相が警鐘、Palantirへの不信感がNHSのデータ研究に悪影響を及ぼす懸念 : 英国保健省の高官は、NHSデータプラットフォームにおいてデータ共有のオプトアウトを選択する市民が増加している傾向に懸念を表明しました。AI・防衛コントラクターであるPalantirに対するデータセキュリティ上の不信感が、医療AIモデルの学習や長期的な公衆衛生研究プロジェクトに悪影響を及ぼす可能性があると指摘しています(出典:The Guardian)

OpenAIとAnthropicの社員が「モデルがユーザーのプライベートセッションを盗用している」との疑念を否定 : 流体方程式の論争をきっかけに広がった「フロンティアラボがユーザーの非公開Codex/Claudeセッションを密かに覗き見て研究成果を先回り発表しているのではないか」という懸念に対し、複数の研究所所属の研究者が釈明を行いました。ビッグテックにおけるユーザーセッションデータへのアクセス権限管理は極めて厳格であり、特定ユーザーのログを直接閲覧することは即時解雇に値する重大な違反行為であると指摘し、偶然の一致や公開学術情報のスピルオーバーを冷静に判断するよう呼びかけています(出典:willdepue、_sholtodouglas)