🔥 フォーカス
Hugging Face、130億ドル超の評価額での売却を模索と報道 : 全世界最大のオープンソースAIモデルおよびデータセットのホスティングプラットフォームであるHugging Faceが、投資銀行と連携して潜在的な買収者の意向を評価しており、評価額は2023年の45億ドルから大幅に急上昇し、130億ドル以上に達する可能性がある。コミュニティやアナリストは、モデル層の競争が激化する中、開発者の入り口やモデル配信ハブを掌握するインフラ資産の戦略的価値が急上昇していると指摘している。しかし、単一の巨大IT企業に買収された場合、プラットフォームの中立性とオープンソースエコシステムの独立性が厳しい試練に直面する恐れがある(出典:TechCrunch、36氪)
Alibaba、動画生成大規模モデルWan 3.0を正式リリースしパブリックベータテストを開始 : Alibabaの動画生成大規模モデルWan 3.0が正式にローンチされ、Alibaba Cloud Model Studio(百煉)、Qwen(千問)、および複数のエコシステムプラットフォームで同時に公開された。本モデルは1回でネイティブに最大30秒の連続した動画生成をサポートし、PDF、PPT、表、ウェブページなどのマルチモーダルな参照入力に初対応した。また、長時間のカメラワーク、光と影の物理法則、リアルな人物の質感において「AI特有の不自然さ」を大幅に低減しており、現在はショートドラマ、広告、EC制作などの商用ワークフローに全面的に統合されている(出典:量子位、The Verge)

IBM、ArmとZのデュアルアーキテクチャに対応した初のメインフレームチップとSpyre AIアクセラレータを発表 : IBMはHot Chipsカンファレンスにて、次世代メインフレームプロセッサアーキテクチャを発表した。各コアはナノ秒単位でIBMネイティブのZ命令セットとArm64アーキテクチャを動的に切り替えて実行可能であり、企業は基幹取引システムの隣でオーバーヘッドなしに広大な最新のArmおよびLinux AIエコシステムを実行できる。同時にIBMは、エンタープライズクラスの大規模モデル推論およびエージェントワークフローをサポートするため、高帯域幅メモリを搭載した次世代Spyre AIコプロセッサをプレビューした(出典:VentureBeat)
OpenAI、Instantチームを買収、Codexのクレジット異常に対し全量リセットを実施 : OpenAIは、マルチスレッド協調、オフラインキャッシュ、永続的な状態管理におけるAgentの重大な弱点を補強するため、YC出身の注目スタートアップであるInstant(AI版Firebaseと称される)のチームを完全買収したと発表した。同日、ユーザーから報告されたクレジットの急速な消費問題に対し、Codexの責任者は、長時間のセッションにおける画像圧縮、Computer History、および会話の自動命名機能に過剰消費のバグが存在したことを確認し、すべての有料プラン加入者に対して利用クレジットの完全なリセットを実施した(出典:36氪、WeChat)
ハーバード大とAnthropicの研究者、Claudeを活用して78年越しの数学の難問を解決:6次元球面に複素構造が存在することを証明 : ハーバード大学の研究者Levent Alpöge氏はClaudeと共同で、全108ページに及ぶ論文において、6次元球面($S^6$)上のコンパクト複素多様体構造を初めて明示的に構成し、トポロジーおよび微分幾何学の完全な検証を完了した。この難問は1948年の提起以来、約80年間にわたり数学界を悩ませてきたが、今回のブレークスルーは、複雑な数学的対象をゼロから構築し、分野横断的なツールを統合する大規模モデルの深い推論能力を示している(出典:36氪、X @teortaxesTex)
🎯 動向
Anthropicの内部テストコードネームが流出、フラッグシップFable 5の企業導入は伸び悩み : 開発者がAnthropic API内で「claude-marshmallow-eap」と「claude-melon-eap」という2つの新しい内部テストモデルのコードネームを発見し、Opus 5.1または次世代Sonnetブランチと推測されている。一方で、決済サービスプロバイダーRampのデータによると、フラッグシップのFable 5は高額な単価のため、企業顧客のAnthropicにおける総支出のわずか11.4%を占めるにとどまり、よりコストパフォーマンスに優れたOpus 5がリリース後、実際の呼び出し量と支出において急速に上位モデルを逆転した(出典:機器之心、Financial Times)
Xiaomi、自社開発AIチップ「玄戒O3」「玄戒O100」「玄戒D100」の3製品を発表 : Xiaomiは技術説明会にて3つのチップを集中的に発表した:TSMCの3nmプロセスを採用しフルモジュールのAIユニットを統合したフラッグシップスマートフォンSoC「玄戒O3」、3Dウェハレベルハイブリッドボンディング技術を採用しメモリ帯域幅1.22TB/sを誇るエッジAIアクセラレータチップ「玄戒O100」、そして中国初の3nmスマートドライビング向け高演算能力チップ「玄戒D100」である。さらに、これら3つのチップを統合し、100億パラメータ規模の大規模モデルをローカルでオフライン実行可能な「AI Cube」プロトタイプも披露された(出典:機器之心)
.jpg)
Tencent ARC Lab、動画DiT向け光線空間位置エンコーディングSCoPEをオープンソース化 : 従来の動画DiTがグリッド座標を採用することでカメラワーク時に幾何学的表現が混乱する問題に対し、Tencentは香港大学および香港科技大学と共同でSCoPEを提案した。この手法は、アテンションメカニズムにカメラのPlücker光線座標を直接注入することで、極めてわずかなパラメータ増加で単一画像入力からの自由視点ナビゲーション、精密なカメラ軌道制御、および閉ループ視点一貫性の復元を実現した(出典:機器之心)
.jpg)
Alibaba DAMO Academy、肝臓がん診断モデルDAMO LiONを発表、『Nature Medicine』誌に掲載 : DAMO Academyは盛京病院と共同で肝臓がん診断AIモデル「DAMO LiON」を開発した。マルチフェーズCT画像を反復融合して微細なピクセルレベルの差異を捉えることで、複雑な組織の干渉下でも約1cmの原発性および転移性の微小病変を正確に検出できる。1万人規模の患者を対象とした前向き臨床試験において15例の見落とし防止を支援し、医師の画像読影時間を27%削減した(出典:量子位)
Cerebras、次世代ラック型AIアクセラレーションシステムCS-4を発表 : CerebrasはHot Chipsにて、5nmのWSE-3ウェハスケールチップをベースとしたラック型システム「CS-4」を発表した。電源と冷却のアップグレードによりクロック周波数を向上させ、1つのラックに3つの完全なウェハを収容し、単一ユーザーの推論スループットは最大4400 tokens/sに達する。公式によると、特定の大型モデル推論タスクにおいて、従来のGPU構成と比較して最大30倍の性能を発揮するという(出典:THE DECODER)
Ant Groupとアモイ大学、医療ファクトチェックシステムMedGuardを共同提案 : 本研究は『npj Digital Medicine』に掲載され、オンライン診療における事実性のリスクに着目している。MedGuardは、複雑なマルチターンの医師・患者間の長い対話を独立して検証可能な原子的医学主張に分解し、不確実性駆動の外部ガイドライン証拠検証ループを導入することで、きめ細かな対話リスク識別におけるF1スコアを汎用大規模モデルのベースラインと比較して22.1%向上させた(出典:機器之心)
HiDream.ai、ネイティブ全モダリティインタラクティブ世界モデルHiDream-O1-Worldを発表 : HiDream.ai(智象未来)は独自開発のUiTアーキテクチャをベースにインタラクティブ世界モデルを発表した。テキスト、画像、リアルタイム操作コマンドの入力をサポートし、長期的な時空間の一貫性と物理法則の推論能力を備え、WBenchランキングのNaviサブランキングで首位を獲得した。AIインタラクティブゲーム、具身知能(Embodied AI)の仮想トレーニング、高精度3D空間生成に向けたインフラを提供する(出典:量子位)
🧰 ツール
claude-obsidian:Claude Codeベースのローカル自動化ナレッジベースシステム : Andrej Karpathy氏のLLM Wiki設計パラダイムを参考に、このオープンソースプロジェクトはClaude CodeをObsidianローカルナレッジベースに深く統合している。データ収集、アサーションの事実検証、自動クロスリファレンス、双方向リンク生成をカバーする15のAgent Skillsを含み、完全にローカル化され外部へのネットワーク漏洩がない前提で、自己反復可能なパーソナルナレッジグラフを構築する(出典:GitHub Trending)

Flare:コード依存トポロジーグラフを核とするAgenticデスクトップIDE : Coding Agentの協調作業向けに特別設計されたオープンソースデスクトップIDE(Electronベース)。システムメイン画面はコードベースの呼び出し関係グラフをリアルタイムでレンダリングし、ClaudeやCodexなどのAgentがコードを編集またはテストを実行する際、対応するファイルノードが影響範囲と変更の波及を動的にハイライト表示する。さらにGitから切り離されたリアルタイムの変更取り消しとタスクカンバン機能を提供する(出典:Reddit r/ArtificialInteligence)

MongoDB、Claude CodeおよびCursor向けの公式Agent Skillsをリリース : MongoDB公式がAgent専用ツールキットをリリースし、スキーマ設計、インデックス最適化提案、複雑なクエリ作成、コネクションプール管理のベストプラクティスを統合した。開発者はMCPまたはプラグインの形式で主要なコーディングAgentに組み込むことができ、Agentがデータベースコードを生成しアーキテクチャの再構築を行う際に、公式の本番仕様に厳密に準拠させることが可能になる(出典:TheTuringPost)

AnthropicがClaude Tagをアップグレード:Slackエージェントに能動的な会話閲覧と介入機能を付与 : AnthropicはエンタープライズコラボレーションアプリClaude Tagをアップデートし、単一メッセージのみを処理する孤立した分類器を廃止、Claudeがグループチャットのコンテキストと履歴メモリを通読できるようにした。システムは現在のチャンネルで直接返信するか、独立したトラブルシューティングスレッドを開始するか、あるいは静観するかを自律的に判断でき、複数人での協調トラブルシューティングなどのシナリオにおいて、指示なしでの能動的介入の有効性を30%向上させた(出典:VentureBeat)
📚 学習
清華大学とウォートンスクールの研究者、GPT-5.6を活用して勾配降下法の40年来の収束限界予想を証明 : 清華大学のJianhao Ma氏とペンシルベニア大学ウォートンスクールのYuxin Chen氏が協力し、GPT-5.6 Sol Proを利用して敵対的オラクル幾何構造を提案し、純粋なステップサイズスケジューリングによる勾配降下法アルゴリズムには越えられない収束下限 $\Omega(T^{-1.9319})$ が存在することを初めて証明した。これにより、ステップサイズシーケンスのみでNesterovモメンタムの理論的限界に到達できるかという長年の予想に完全に終止符を打った。この証明はその後、Codexを通じて完全にLean 4コードへと書き起こされ、欠陥のない形式検証をパスした(出典:36氪)

吉林大学やアモイ大学など、「グラフエンジニアリング(Graph Engineering)」システム知能パラダイムを共同提案 : 複雑で長期的なタスクにおいて単一Agentが直面する組織的能力の限界に対し、15の研究機関が動的に進化するグラフを中心としたAgentエンジニアリング体系を体系的に総括した。論文ではタスク目標の分解、異種Agentの協調分担、ランタイム状態管理をグラフ構造として統一的にモデル化し、大規模モデルシステムが「個別知能」から監査可能で自己進化可能な「システム知能」へと移行するための方法論的フレームワークを確立した(出典:HuggingFace Daily Papers、36氪)
清華大学の趙明国氏の研究チーム、『Science Robotics』に視覚駆動型二足歩行ロボットのサッカー制御フレームワークを発表 : チームは統一された知覚-運動エンドツーエンド強化学習フレームワークを提案し、エンコーダー・デコーダーを用いて過去の時系列観測を圧縮し、敵対的運動事前分布で補強することで、実機(Booster Roboticsプラットフォーム)上で機載カメラのみに依存した動的なボール探索、歩行パターンの適応的微調整、50Hzの連続キック反応を実現した。動くターゲットに対しても高い成功率を維持している(出典:機器之心)
.jpg)
DAIR.AI、コーディングAgentの開発行動とコンテキスト読み取りの選好に関する実証研究を発表 : 研究チームは3万3000件のAgent生成Pull Requestと557回の長時間タスク開発セッションを追跡し、指示ファイル(AGENTS.md/CLAUDE.md)や一時的なメモがAgentの総読取量の60.5%を占める一方で、従来のAPIドキュメントはわずか1.3%にとどまることを発見した。早い段階でAgentにドキュメントを頻繁に検索させると、即時のテスト検証頻度が著しく低下することも明らかになった(出典:dair_ai)
強化学習の全体像チュートリアル:方策勾配から最先端のLLMポストトレーニングまで : 機械学習研究者のCameron Wolfe氏がLLM強化学習に関する体系的な長文ガイドを公開した。マルコフ決定プロセスの導出から出発し、Vanilla Policy Gradient、PPO、GRPOおよびその最新の派生形(Dr. GRPO、DAPO)の技術的詳細を体系的に解説し、Critic不要アーキテクチャが大規模モデルのアライメントにおいて持つVRAMおよび計算面での利点を重点的に分析している(出典:cwolferesearch)
💼 ビジネス
Anthropicのエンタープライズサービス合弁会社Ode、Casper Studiosを買収 : AnthropicがBlackstoneやHellman & Friedmanなどのファンドと共同設立した企業向けAIサービス事業体Odeが初の買収完了を発表し、サンフランシスコのAIインテグレーターであるCasper Studiosチームを傘下に収めた。これにより、Claude CodeおよびカスタマイズされたAgentソリューションを大企業の複雑なITおよびコンプライアンスワークフローに組み込む動きを加速させる(出典:AI Business)

Unitree Robotics、上場初週に時価総額が40%以上急落 : 科創板の「人型ロボット第一号銘柄」であるUnitree Robotics(宇樹科技)は、初日に急騰して時価総額4400億元を突破したものの連続して反落・調整が続き、最新の時価総額は約2400億元台に低下した。市場分析では、当初の極めて低い浮動株比率がバリュエーションプレミアムを押し上げたが、現在の高水準なPERと売上の7割以上を大学の研究機関向け調達に依存している現状から、セカンダリー市場は量産納品品質と実際の産業界でのリピート率に基づいた合理的な再評価へとシフトしていると指摘されている(出典:36氪)
エッジAIインフラ系スタートアップの硅基詞元、数億元規模の複数ラウンド資金調達を完了 : 硅基詞元(Silicon Token)は真知創投が主導する複数ラウンドの資金調達を完了し、評価額が20億元に迫ったと発表した。同社はデスクトップ級のエッジAIワークステーションと異種スケジューリングシステムを主力とし、VRAMをストリーミングチャネルに変換する技術により、1枚の16GBコンシューマー向けGPUで120GBの重みが必要な高負荷動画生成モデルをフル稼働させることを可能にし、低コストなローカルコンテンツ制作に注力している(出典:36氪)
🌟 コミュニティ
OpenAI、ChatGPTでの脅迫対話を報告しユーザーが逮捕、AIプライバシーの境界を巡る議論が白熱 : 米フロリダ州の元アナリストがChatGPTの対話欄に元交際相手への詳細な殺人計画を入力したことで、システムのセキュリティリスク管理がトリガーされ、OpenAIがFBIに通報した結果、逮捕に至った。この事件はコミュニティで激しい議論を呼んでおり、支持派はタイムリーな介入が悪質犯罪を未然に防いだと評価する一方、多くの開発者や法学者は、令状のないプラットフォーム側による自発的な監視メカニズムがユーザーのプライバシーを侵害し、新たな「タラソフ警告義務」のジレンマをもたらすのではないかと懸念している(出典:36氪)
Vercel GatewayにおいてオープンソースモデルのTokenシェアが62%へと急伸、プロプライエタリモデルを逆転 : Vercel創業者Guillermo Rauch氏および投資機関が開示したデータによると、Vercel AI GatewayにおけるオープンウェイトモデルのToken消費シェアが直近2か月で28.4%から62%へと跳ね上がり、初めて市場の主流となった。コミュニティは、マルチAgent協調アーキテクチャにおいてサブエージェントのタスク実行がコストに極めて敏感であるため、膨大なTokenが高価なクローズドソースのフラッグシップから高コストパフォーマンスなオープンソースモデルへと流入していると指摘している(出典:X @GavinSBaker、36氪)
開発者の間でエッジ向け超低ビット量子化と450M専用ビジョンモデルの実用化が話題に : LocalLLaMAコミュニティにて、450Mの小型ビジョン言語モデル(LFM2.5-VL)を5万枚のブラウザスクリーンショット上で特化型教師あり微調整(SFT)を行った実験が共有され、ウェブページの状態構造化抽出において4Bの汎用モデルに迫る精度を示した。同時に、Llama 3.2向けの2.7-bit ARM CPU超低ビット量子化フレームワークも注目を集めており、エッジAIエージェントにおける「専用モデルの適材適所活用」というエンジニアリング上の可能性を実証している(出典:Reddit r/LocalLLaMA、HuggingFace Daily Papers)
💡 その他
2026年「科学探索賞」受賞者発表:黄高氏、劉譞哲氏らが情報電子分野に選出 : 2026年科学探索賞が正式に発表され、清華大学の黄高氏(基礎ニューラルネットワークアーキテクチャおよび拡散言語モデル)、北京大学の劉譞哲氏(分散大規模モデルおよびインテリジェントコンピューティングセンターシステムソフトウェア)、清華大学の銭学海氏ら若手科学者が情報電子分野に選出された。AIの先端アルゴリズム、高効率推論フレームワーク、計算資源のハード・ソフト協調設計における中国国内の強固な基盤を示している(出典:機器之心)
.jpg)
非営利団体の調査、主要AIチャットボットがセンシティブな相談において立場を明示していないと批判 : AlgorithmWatchがChatGPT、Gemini、Claude、Grokを対象に行った国際的な実態調査によると、未成年や予期せぬ妊娠などのセンシティブな相談に対応する際、各モデルは25%以上の確率で、イデオロギー的背景を明記しないまま特定の立場を持つ非公式相談機関を推薦していることが判明した。これにより、生成AIが情報のゲートキーパーとしての役割を果たす際の事実の透明性に関する法令遵守上の懸念が高まっている(出典:THE DECODER)

Pew Research Centerの調査、ChatGPT公開以降の新規ウェブページの3分の1以上にAI生成コンテンツが含まれると報告 : ピュー研究所(Pew Research Center)の最新データによると、2022年末の大規模モデル普及以降、オープンウェブ上の新規英文ウェブページの3分の1以上がAIによって生成または大幅に編集されたものであることが示された。コンテンツ生成の価値の大幅な下落に伴い、検索エンジン、データクレンジングツール、評価フレームワークに対して、より厳格な合成テキストのフィルタリングおよび出所追跡メカニズムの構築が迫られている(出典:The Verge)