🔥 フォーカス
OpenAIが未公開モデルによる数学論文722本を一挙公開、準リーマン予想など世紀の難問の境界を切り拓く : OpenAIはGitHubのオープンソースリポジトリopenai/mathにて、未公開の社内フロンティアモデルによって生成された372組の結果、計722本の数学論文原稿を正式に一挙公開した。主要な成果には、準リーマン予想(すべてのディリクレL関数が実部7/8超の領域で零点を持たずジーゲル零点を排除することの証明を主張)、アーベル多様体上のホッジ予想の証明、4次元掛谷予想、有理数体上のヒルベルトの第10問題、Unique Games予想から独立したBasic-SDPの通常NP困難性閾値の確立などが含まれ、そのうち約160本にはLeanによる形式化証明が付随している。OpenAIの開示によると、1つの成果あたりの平均消費計算リソースは約3時間のChatGPT Pro推論処理に相当するという。マシンによる自律的科学発見の金字塔と見なされる一方、フィールズ賞受賞者3名を含むプリンストン高等研究所のアドバイザリーグループは声明を発表し、公開は学界の承認を意味するものではないと強調した上で、マシンによる証明の大量生成が人間の研究者による消化・検証メカニズムに深刻な負荷を与えていると警鐘を鳴らした (出典: 机器之心、The Verge、Latent Space、Abhishek Saha、openai)

米エネルギー省とNIH、DeepMindなどの巨大テックと連携し「仮想生物学イニシアチブ」を始動 : 米国エネルギー省(DOE)と米国国立衛生研究所(NIH)は国家レベルの戦略的パートナーシップを発表し、Google DeepMind、Meta、Isomorphic Labs、NVIDIAなどの機関と連携して「仮想生物学イニシアチブ」(Virtual Biology Initiative)を立ち上げた。本計画は、全スケールの細胞生物学アトラスを体系的にマッピングして標準化ベンチマークデータを生成し、マルチモーダルAIを結集して細胞の生命活動をエンドツーエンドで予測可能な世界初の汎用デジタルモデルを構築することで、新薬開発と疾患メカニズムの探究を第一原理から再定義することを目指している (出典: Alex Rives)
Google DeepMind、エッジ向けフルモーダル埋め込みモデルEmbeddingGemma 2をオープンソース化 : Google DeepMindは、Gemma 4アーキテクチャに基づく初のマルチモーダル埋め込みモデルEmbeddingGemma 2をApache 2.0ライセンスで正式にオープンソース公開した。パラメータ数は740Mで、テキスト、コード、画像、音声、動画のベクトル表現空間をネイティブに統合し、8Kコンテキストに対応する。モジュール設計によりテキスト単一モーダルは270Mパラメータで動作可能で、量子化後のモバイル端末上のメモリ消費は約191MBに抑えられる。さらにMatryoshka表現学習により768次元以内への動的次元削減をサポートし、Qdrantによる実測では1-bit量子化との組み合わせでVRAM消費を77倍削減しつつ94.5%の検索精度を維持した。これにより、軽量なエッジ向けフルモーダルRAGおよびオフラインセマンティック検索の基盤的空白が埋められた (出典: Google DeepMind Blog、THE DECODER、GoogleDeepMind)

OpenAI、「28日間コミットメント」Day 2アップデートを実施:Auto-reviewを完全無料化しDecisions APIのパブリックベータを開始 : 「28日間毎日実用的な改善を届ける」チャレンジの2日目として、OpenAIはAgentの実装摩擦を解消する複数のコアアップデートを集中的に発表した。長時間タスクの自動リスク管理監査機能「Auto-review」が全ChatGPTログインユーザー向けに無料開放され、利用枠の消費対象外となった。APIの有料階層はBuild、Launch、Growの3段階に簡素化され、最上位ティアの条件は500ドルへ引き下げられた。離散ルーティングとツール振り分け向けの「Decisions API」のパブリックベータも開始され、同インターフェースはGPT-6 Lunaによって駆動され、サーバー側の応答時間は100ミリ秒未満、入力100万トークンあたりわずか0.10ドルで提供され、出力およびキャッシュ料金は免除される。さらにmacOS向けにはMeetings会議ワークスペースプラグインの段階的ロールアウトが同時に実施された (出典: 机器之心、OpenAI Developers、)

MetaとSierra、大手各社と共同で個人エージェントプロトコルPAPを発表、人間と企業のAgentインタラクション仕様を確立 : コンシューマー向けAI Agentが商用Webサイトでスクレイピング防止ブロックに頻繁に遭遇する課題を受け、MetaとAIカスタマーサービスプラットフォームのSierraは、Stripe、Shopify、Walmartなど複数企業と連携し、オープンな業界標準「個人エージェントプロトコル」(Personal Agent Protocol、PAP)を共同発足した。本プロトコルはA2AおよびOAuthアーキテクチャをベースとし、個人のAIアシスタントがユーザーを代理してECでの注文、チケット検索、フォーム入力を行う際の企業システムとの通信における認証およびリスク管理の境界を明確に定義している。Decagonも連携する信頼プロトコルPACTを同時にオープンソース化し、境界を越えたエージェント呼び出しに伴う信頼の摩擦解消を加速させている (出典: The Verge、TechCrunch、saranormous)

🎯 動向
Google DeepMind、画像生成・編集モデルNano Banana 2.1をリリース : GoogleはGemini 3.6 Flashベースの画像生成モデルNano Banana 2.1(API識別子:gemini-nano-banana-2.1)をリリースし、Gemini API、AI Studio、Google Adsで同時に提供を開始した。新モデルは複雑な組版レイアウト設計、精密なマスク局所再描画、最大14枚の参照画像を用いたキャラクターの一貫性統合をネイティブサポートし、最大4K解像度のレンダリングに対応する。画像1枚あたりの生成コストは0.034ドル(約50%値下げ)へと抑えられ、商用ビジュアルデザインにおけるマルチターンでの連続した一貫性維持という難題を重点的に解決している (出典: 机器之心、GoogleAIStudio、THE DECODER)

Claudeが確率論の難問を攻略、浸透連続相転移予想をLeanで形式化証明 : Anthropicの未公開内部フロンティアモデルClaudeが、数学界を約70年間悩ませてきた連続相転移予想(臨界確率$p_c$において無限連結成分が存在する確率は0であること)の攻略に成功した。モデルは2024年に学界で構築された不等式フレームワークを基盤に、Lean証明アシスタントを用いて数千行の形式化推論を完遂し、3次元から10次元という極めて重要な物理次元における長期の停滞を打破した。AIがフィールズ賞級の予想の形式化証明を達成したこの進展は、学術界に大きな衝撃を与えている (出典: 36氪)

Anthropic、サイバーセキュリティ検証プログラムを拡張し3段階のアクセス権限メカニズムを新設 : Anthropicはサイバーセキュリティ検証プログラム(CVP)を恒常的な3段階アクセスアーキテクチャ(防御レベル、レッドチームレベル、専用レベル)へとアップグレードし、検証済みの機関やホワイトハッカー向けに安全フィルターを緩和したClaude Opus 5.5、Sonnet 5.5、Mythos 5.1を開放することを発表した。新体制ではペネトレーションテストやレッドチーム演習に向けた認可済みの攻撃的呼び出し機能が初めてコンプライアンスに則って開放され、「防御側が脆弱性を修復するために強力なツールを必要としているにもかかわらず、汎用セキュリティポリシーによって拒絶される」というジレンマの解消を目指している (出典: Anthropic News、AnthropicAI、THE DECODER)
DeepMind、全ゲノム変異の影響を解読するAlphaGenome Atlasを発表 : Google DeepMindはゲノム深層学習モデルAlphaGenomeとその事前計算データベースAlphaGenome Atlasを発表した。モデルは単一塩基対の解像度と100万塩基対の長大なコンテキスト長を備え、そのAtlasアトラスはヒトゲノムにおける全90億個の単一ヌクレオチド変異候補の分子的表現型への影響を事前計算している。データ規模はAlphaFoldデータベースの30倍に達し、希少変異と複雑な疾患感受性メカニズムの体系的解明を目的としている (出典: )
vLLM v0.31.0、CRIUスナップショット機構を導入しコールドスタートをミリ秒単位のプロセス復元へと刷新 : vLLMはv0.31.0をリリースし、常駐デーモンであるvllm snapshotとvllm preloadを導入した。この機構はLinux CRIU技術をベースに推論エンジンのランタイムにおける迅速なチェックポイント保存とイメージ復元を実現し、インスタンスのホットフェイルオーバーやスケールアウト時に時間のかかるモデル重みの読み込みと初期化処理をスキップすることで、大規模推論クラスタのエラスティックスケジューリング時におけるコールドスタートのレイテンシを大幅に削減する (出典: vLLM)
ハルビン工業大学とシンガポール国立大学、動画世界モデル向け2-bit KV Cache圧縮手法QuantWMをオープンソース化 : 自己回帰型の動画世界モデルが極度のVRAM消費を伴い、従来の量子化手法では深刻な画面のちらつきが発生するという課題に対し、ハルビン工業大学深圳校とNUSのチームは学習不要の量子化手法QuantWMを提案した。研究では、Keyの量子化によって生じる時空間アテンションのずれが時間的ジッターの根本原因であることを突き止め、感度を意識したクラスタリングと主部分空間誤差補償により、生成画面の時間的一貫性を維持しながら最大6.2倍のKV CacheのVRAM圧縮を達成した (出典: 机器之心)
.jpg)
Perplexity、アップグレード版のオープンソース意思決定モデルpplx-decider-v1.1-27bをリリース : Perplexityはマルチモーダル意思決定モデルの改良版であるpplx-decider-v1.1-27bをオープンソース化した。本重みは最新のHugging Face Decision Index 0.3評価で首位を獲得し、視覚および論理的な意思決定の精度を維持しながら推論効率を大幅に最適化した。付属するDecision APIサービスの単価も入力100万トークンあたり0.02ドルへと引き下げられた (出典: AravSrinivas)

Meta、プロダクション対応の割り当て決定ソルバーRebalancerをオープンソース化 : Metaは、社内で9年以上にわたり稼働し、1日あたり約4,000万件のリソーススケジューリングを処理してきたC++製コアソルバーRebalancer(Pythonインターフェース提供、Apache 2.0ライセンス)を正式にオープンソース化した。本ツールはシャーディングスケジューリングやトラフィックバランシングなどのNP困難問題を統一された有向非巡回グラフとして抽象化し、100万規模の超大規模エンティティに対して高効率な局所探索と混合整数計画法による求解を提供する (出典: MarkTechPost)
TII、UAE方言特化型大規模言語モデルFalcon-Emirati-7Bを公開 : アラブ首長国連邦の技術革新研究所(TII)は、UAE方言に特化したモデルFalcon-Emirati-7Bを発表した。研究チームは口語Webデータ、現地の文化的背景、制御された合成コーパスからなるデータパイプラインを構築し、現地評価ベンチマークAlyahにおいて84.83%の多肢選択正解率を達成。自由対話においても文化的メタファーの理解とエチケットへの適合度を大幅に向上させた (出典: HuggingFace Blog)

Figma、製品デザイン向けAI AgentをGA(一般提供)として正式商用化 : Figmaは、UI/UX製品デザイン向けの組み込み型AIエージェントを全ユーザー向けに正式開放したと発表した。新バージョンではチームデザインシステムの参照ガイドラインバインディング機構や、マルチプレイヤー共同編集モードにおけるチーム横断的なAgentアクション協調の可視化機能が追加され、エージェントがコンポーネントライブラリを直接活用して高精度なインターフェースや多状態インタラクティブプロトタイプを自動構築できるようになった (出典: The Verge)

Cohere、70以上の言語をカバーする多言語小型モデルファミリーTiny Ayaをオープンソース化 : Cohere LabsはCOLM 2026カンファレンスにおいて、軽量多言語モデルファミリーTiny Ayaをオープンソース公開した。本シリーズは汎用的な多言語ベースモデルと地域特化バリアントを組み合わせ、世界70言語以上(低リソース言語を多数含む)をカバーしており、エッジ環境での多言語デプロイのハードルを下げ、小型モデルの異文化セマンティック生成の改善を図っている (出典: sarahookr)

NeurIPS 2026 | SAGEフレームワーク:トポロジー構造信号を用いてLLMの長大推論の脱線を補正 : バージニア工科大学などの研究チームは、LLMの長い推論チェーンにおいて「途中で脱線しても最終リワードの遅延により自己修正できない」という根深い課題に対し、構造的受容性誘導型探索手法SAGEを提案した。本手法は代数的スパース化により探索の偏りを圧縮し、双曲空間の距離を手がかりに段階的なフィードバックを提供することで、複数の記号的および形式的数学ベンチマークで精度を大幅に向上させ、Leanの検証通過率を数倍に引き上げた (出典: 机器之心)
.jpg)
Google、実験的なノーコードゲーム生成プラットフォームPlaygroundを発表 : GoogleはAIゲーム実験プラットフォームplayground.googleをローンチした。ユーザーは自然言語の対話のみで、独自の物理ルール、キャラクターインタラクション、シーンスタイルを含む軽量ゲームをブラウザ上でデザインでき、マルチデバイスでのプレイやコミュニティ共有に対応している。今後はUnity Sparkを統合し、より高度な3Dエンジンのサポートを導入する予定である (出典: Google AI Blog)
Replit、プロジェクト横断グローバルコンテキストとバックグラウンド非同期コードAgentを導入 : Replitは開発環境の大幅アップグレードを行い、ワークスペースを横断するグローバルコンテキストを正式に導入した。エージェントはユーザーアカウント内の全履歴プロジェクトとデザインシステムをインデックス化でき、参考プロジェクトからカラーやコンポーネントロジックを抽出して新規プロジェクトへ移植できるほか、バックグラウンドでの非同期生成・編集タスクおよびワンクリックでのレビューとマージをサポートしている (出典: amasad)
🧰 ツール
Hark Pro:独立サンドボックスブラウザを搭載したエッジプライバシー型パーソナルエージェント : Figure AIの創業者Brett Adcock氏のチームが、デスクトップおよびモバイル向けアプリHark Proをリリースした。システムにはHandoffコンピューター使用エージェントと元Appleチームが手掛けたUIが搭載されており、隔離サンドボックス内でユーザーの資格情報を安全に制御し、自律的にWebをブラウジングしてビザ申請、チケット購入、クロスシステムのフォーム操作などを実行可能。操作履歴はすべてユーザーに可視化され、自律エージェントの利便性と端末側のプライバシー保護を両立している (出典: TechCrunch、TheRundownAI)
Monid.aiが770万ドルを調達、Agent向け動的ツール決済ゲートウェイを構築 : エージェント開発インフラを提供するMonid.aiが、「Agent版OpenRouter」と呼ばれる統合APIゲートウェイを発表し、770万ドルの資金調達を実施した。開発者は単一のインターフェースを通じて、エージェントが実行時にマーケティング、SEO、検索、EC、マルチモーダル生成に及ぶ2,500種の商用APIを動的に検出して従量課金決済できるようにし、従来の月額制エンタープライズSaaSサブスクリプションの縛りを解消する (出典: yoheinakajima)
AgentIDが登場:AI Agent専用の独立アイデンティティ資格情報ソリューション : AgentMailはAgentIDサービスをリリースした。本ソリューションは自律稼働する各エージェントに対して、人間の所有者に紐づく独立した認証メールアドレスと資格情報を割り当てることで、サードパーティSaaSプラットフォームが監査の追跡性を確保しアカウント停止リスクを回避した上で、外部Agentのログインやプラットフォーム横断の認可処理を安全に許可できるようにする (出典: omarsar0)
Spotify Portal AI Plugins:エンタープライズ開発プラットフォームを主要コードエージェントへ統合 : Spotifyは公式オープンソースプラグインセットを公開し、社内開発者プラットフォームSpotify PortalをClaude Code、Codex、Cursorへ直接接続できるようにした。エージェントはCLIを通じてマイクロサービスカタログの検索、サービス診断の呼び出し、ヘルス状態の照会を直接行えるほか、shuntプラグインを通じてI/Oヘビーなタスクを軽量モデルへオフロードしてトークンコストを削減することも可能である (出典: GitHub Trending)
T3 Code、スレッド内リアルタイムUIレンダリングとインタラクティブプレビューを実装 : コーディングツールT3 Codeがアプリ内UI可視化機能を発表した。エージェントがフロントエンドのリファクタリングやPRコードレビューを行う際、対話スレッド内で直接インタラクティブなHTML/Reactコンポーネントの出力結果やビジュアルプロトタイプをインライン描画でき、開発者がホットリロードデバッグのためにIDEを頻繁に切り替えるコンテキスト損失を軽減する (出典: theo)

Overmindがオープンソース化:エージェントの実行トレースを活用してドメイン特化型小型モデルを自動蒸留 : オープンソースツールOvermindが公開され、日常の開発エージェントや業務Agentのツール呼び出しログおよび実行トレースから、高付加価値なファインチューニング用データセットと評価セットを抽出・構築できるようになった。実測テストでは、微調整された特化型小型モデルが長大な契約条項の抽出シナリオにおいて、引用のハルシネーション率を大規模モデルの3.36%から0.12%へと大幅に低下させた (出典: kimmonismus)

Mitchell Hashimoto氏、OSC 7501汎用ターミナルプログラム状態仕様を発表 : 著名な開発者Mitchell Hashimoto氏が新たなOSC 7501ターミナル制御仕様を発表した。コマンドラインプログラムがターミナルに対してアイドル、実行中、ブロック待機、完了、失敗などのきめ細かな状態を正確に報告できるようにするもので、現在数百種類のエージェントオーケストレーターが依存しているヒューリスティックな正規表現判定を置き換え、マルチAgent間での状態通信の標準プロトコルを確立することを目指している (出典: mitchellh)
Scale AI、高忠実度エージェント強化学習環境フレームワークAgentEnvをオープンソース化 : Scale AIはModalと共同でAgentEnv環境構築ツールキットをオープンソース化した。本フレームワークは複雑な長時間Agentの強化学習ポストトレーニング専用に設計されており、動的トリガー、仮想クロック、マルチサンドボックス環境スケジューリングを提供し、主要なクラウドサンドボックスクラスタとシームレスに連携して膨大な並行Rolloutや環境対戦トレーニングをサポートする (出典: Scale AI)
DAIR.AI、Agent向けトップカンファレンス論文探索MCPスイートを公開 : 著名なオープンソースAI組織DAIR.AIが専用MCPプラグインをリリースし、Claude Code、Codex、Grok Botなどのエージェントへのワンクリック接続に対応した。エージェントは厳選されたAI論文データベースを自律的に呼び出し、最新の研究動向の整理、自動文献レビューの作成、手法アーキテクチャの視覚的比較などを完了できる (出典: DAIR.AI)
ruNNtime、EmbeddingGemma 2の完全なブラウザ内WebGPU実行を実現 : WebGPU推論ライブラリruNNtimeが、EmbeddingGemma 2のテキストおよびビジョンタワーの完全フロントエンド環境への移植に成功した。ユーザーはバックエンドサービスの介在なしにローカルブラウザのGPUを直接活用してフォトライブラリのマルチモーダルセマンティック検索を実行でき、プライバシー保護とオフライン環境における端末側軽量マルチモーダル検索アーキテクチャの有用性が実証された (出典: Reddit r/LocalLLaMA)

Anthropic、Claude for Google Workspaceアドオンのパブリックベータを開始 : Anthropicは有料サブスクリプションユーザー向けにGoogle Workspace公式サイドバーアドオンの提供を開始した。ユーザーはDocs、Slides、Sheetsの内部からClaudeを直接呼び出して複数ターンの編集、構成の最適化、自動フォーマット調整を行えるようになり、複数ドキュメントを横断したコンテキストの直接読み込みにも対応している (出典: The Verge)
📚 学習
Yann LeCun氏のチーム、階層型世界モデルH-JEPAを提案、長大視覚プランニングの成功率を4倍に向上 : 視覚エンドツーエンドプランニングにおいて局所的な詳細が失われやすいという問題に対し、Yann LeCun氏率いるチームはトップダウン階層表現を持つH-JEPAアーキテクチャを提案した。各階層は独立した潜在空間表現と意味的抽象スケールを備えており、複雑なVisual AntMaze迷路の長大プランニングテストにおいて、3層スタック構造によりタスク成功率が従来の18%から73%へと飛躍的に向上した (出典: ylecun)

MetaとMIT、ハードウェアと深層学習モデルをコデザインするAgentプラットフォームCocoを発表 : MetaとMITはハードウェア設計用マルチエージェントシステムCocoを提案した。数百GBにおよぶ未知のシミュレーションスキャンデータに対し、エージェントがリレーショナルデータベースへのSQLクエリの記述、分析ツールのオーケストレーション、UIナビゲーション状態の読み取りを自律的に行い、TPUアーキテクトがシミュレーション環境構築やボトルネックの特定に費やしていた工数を半減させた (出典: dair_ai)

AgentCoreとOpenClawを用いた永続メモリ付きインテリジェントアシスタント構築ガイド : AWSチームが長編アーキテクチャチュートリアルを公開し、Serverlessランタイム上でOpenClaw基盤とBedrock AgentCore永続メモリコンポーネントを統合する方法を解説した。記事では短期イベントのキャプチャと非同期の長期ファクト抽出からなる2層メモリ構造を詳解し、プロンプトキャッシング技術によってメモリを保持した複数ターンの対話推論コストを約90%削減する手法を示している (出典: AWS Machine Learning Blog)

スタンフォード大、LLMの独創的科学仮説提案能力を定量化するPriced Guidanceフレームワークを提案 : Percy Liang氏らのチームは、情報理論に基づく「有価ガイダンス」(Priced Guidance)評価パラダイムを提案した。「20の質問」ゲームの仕組みを設計することで、モデルが事前学習カットオフ以降に発表された新論文のコア概念を復元するために必要な情報ビット数を精密に測定し、圧縮の観点からモデルの科学的直感とフロンティア一般化能力を定量化するベンチマークを確立した (出典: percyliang)

マルチティーチャー・オンポリシー蒸留(MOPD)メカニズムの解説:ドメイン横断RLの能力衝突を打破 : マルチティーチャー・オンポリシー蒸留(MOPD)手法を解き明かした研究。推論、コーディング、対話など複数ドメインを統一RL微調に組み込む際に生じるリワードの衝突と計算過負荷に対し、本手法は各ドメインに特化した教師モデルを個別に訓練し、逆KLダイバージェンスを用いてトークン単位で生徒モデルに高密度な教師シグナルを提供することで、万能モデルを統合しつつサンプル効率も両立させている (出典: cwolferesearch)

HADフレームワーク:環境認識蒸留により小型言語モデルエージェントの実行力を向上 : Harness環境下で動作する小型モデルエージェント向けの蒸留手法HADが提案された。外部状態情報の有無による教師モデルのアクションの違いを対比させることで、ハーネス情報を活用する意図を小型モデルに特化して学習させ、ALFWorldベンチマークにおいてタスク成功率を63.4%に引き上げ、スタック状態に陥ったケースの約6割で復帰に成功した (出典: omarsar0)

Amazon AGI、適応型再帰拡散言語モデルALoDLMをオープンソース化 : Amazonの研究チームは、8BパラメータのALoDLMアーキテクチャとトレーニングパイプラインをオープンソース化した。拡散言語モデルの内部に適応型再帰推論と漸進的エラー修正メカニズムを導入することで、難易度の高いサンプルへ動的に計算リソースを配分し、複数の総合言語理解・生成ベンチマークにおいて同等規模の自己回帰ベースラインを包括的に上回った (出典: arankomatsuzaki)

Jay Alammar氏、『AIエージェント図解ガイド』のコアシステムアーキテクチャ図を公開 : 著名な技術執筆者Jay Alammar氏が、エージェントシステムの最も重要なループ構造図を公開した。エージェント環境においてLLMがユーザーの目標受け取り、状態維持、メモリ検索から環境アクション実行に至る再帰的ループの仕組みを詳細に解説し、最新の自律Agentシステムを構築するための重要なエンジニアリングの土台を整理している (出典: Jay Alammar)

💼 ビジネス
AMD、李飛飛氏の空間知能スタートアップWorld Labsを82億ドルで全株式取得により買収へ : AMDは、李飛飛(フェイフェイ・リー)氏が共同設立した世界モデルのユニコーン企業World Labsを、全株式取引による約82億ドルで買収する最終合意に達したと発表した。業界分析では、Atlasモデルがスパース視点からのリアルタイム4D再構成の実現可能性を示したことで、身体性AIおよび世界モデルがスケーラブルな産業の転換点を迎えており、AMDは本買収によりNVIDIAに対抗し、4D計算チップアーキテクチャとシミュレーションエコシステムにおいて強力な参入障壁を築く狙いがあると指摘されている (出典: 36氪)

快手傘下のKling AI、CICCやGoldman Sachsなどを指名して香港IPOを準備、10億ドル超の調達を計画 : 快手傘下の動画生成モデル事業Kling AI(可霊AI)は、CICC、Goldman Sachs、UBSを引受会社チームに選定し、香港でのスピンオフ上場プロセスを進めており、少なくとも10億ドルの調達を目指し、早ければ2027年にも上場する見込みである。Klingの2026年第2四半期売上高は8.5億元を超えており、独立上場によって巨額の計算リソースクラスタ開発に向けた独自の資金調達チャネルを確保することを目的としており、快手は絶対的な支配権を維持する予定である (出典: 36氪)

AIコンピュートクラウドプロバイダーのLambda、IPO前の評価額145億ドルで40億ドルの資金調達を計画 : ウォール・ストリート・ジャーナルの報道によると、GPUクラウドインフラプロバイダーのLambdaは、145億ドルのプレマネー評価額で最大40億ドルの資金調達を進めており、CoatueとBlackstoneが主導している。Anthropicなどの大手顧客からの巨額の計算能力契約を背景に受注残高は500億ドルへと急増しており、今回の株式調達はIPOに先駆けて次世代データセンターの建設枠を確保するために充てられる (出典: TechCrunch)
🌟 コミュニティ
企業のAgent導入が「コラボレーション税」に直面:1件のチケット解決に対して3時間の社内調整が発生 : カスタマーサービス管理プラットフォームFrontが実施した700名の企業管理者への調査が話題を呼んでいる。データによると、企業はAgent導入後に人件費を直接削減できたわけではなく、エージェントがタスクを完結できないことに起因する複数ステップでの引き継ぎやチケットのエスカレーションにより、測定されてこなかった莫大な「コラボレーション税」が発生していることが明らかになった。システム間の引き継ぎやコンテキストの確認に費やされる時間は実際の解決時間の3倍に達し、エンドツーエンドの可観測性不足というガバナンス上の課題が浮き彫りになっている (出典: )
ChatGPTのタイトル末尾にギャンブル広告が紛れ込む原因を詳細分析:トークナイザーの汚染と切り捨て失敗 : 開発者がChatGPTのセッションタイトルに時折違法な広告文が出力される技術的メカニズムを詳細に検証した。o200kトークナイザーの事前学習コーパスにグレーゾーンサイトの高頻度なロングトークンが多数混入しており、軽量なタイトル生成推論モデルが終端のEOS制御コードを出力する際に確率のドリフトが発生。その結果、モデルが未学習である低頻度トークンの「ゴミ箱」から高確率な広告テキスト片が誤ってサンプリングされて出力されていた (出典: 36氪)
クラウドネイティブHarnessアーキテクチャの台頭:K8s創始者陣がAgent集中管理ソリューションを模索 : Kubernetesの初期コアチームが設立したStacklokが、クラウドネイティブAgent HarnessプロジェクトMecatlをオープンソース化した。コミュニティでは、エージェントが「ローカルターミナルスクリプト」から「エンタープライズ集中管理プラットフォーム」へと進化する道筋について活発な議論が交わされ、企業のコア資産や権限が単一マシン環境に縛られるのを防ぐため、Agentの状態、MCPツールゲートウェイ、機密サンドボックス実行環境を完全に疎結合化することが提唱されている (出典: Latent Space)
Meta Muse、400万人のユーザープロフィールをリアルタイム構築していることが発覚しプライバシー懸念が浮上 : コミュニティの暴露によると、Meta傘下のエージェントMuseは、ユーザーのチャットや通信履歴に基づいて、人間関係のネットワーク、対人トラブル、好みなどを含む詳細なプロフィールを毎時間自動更新しているという。Meta側はユーザーVMが独立したサンドボックスであると説明しているものの、インスタンス間で「学習経験を共有」するメカニズムに対し、ステルスデータ収集やターゲット広告への悪用を警戒する強い声が上がっている (出典: Reddit r/artificial)

開発者コミュニティで「AIが人間の言葉を話さない」現象が議論に:CoTの過度な圧縮からコーパスのフィッティング不全まで : 最近の開発者コミュニティでは、最新のコーディング向け大規模モデルが進捗報告時に「15/15全緑、片肺停止」といった不自然なジャーゴンを頻繁に吐き出す現象が話題になっている。議論では、トークン消費を抑えるために各社が暗黙的な思考の連鎖(CoT)を極端に圧縮して難解な省略表現にしたことが一因と指摘されている。またギーク層の間では、これを機に高密度な古代漢文や文言プログラミングが持つトークンの極限圧縮に対する工学的な優位性を議論する動きも現れている (出典: 量子位)

Prompt暗号化バイパスの脆弱性が露呈:エージェントの自己復号化がセキュリティの弱点に : セキュリティ研究によると、攻撃者が暗号化した悪意ある指示を利用してCopilotなどのシステムの外層セキュリティフィルターを回避し、エージェントが入力を処理する際に自律的に復号を実行してローカルの機密情報を取得・外部送信する手口が判明した。検証結果では、モデルの自動ルーティング機構によって防御の安定性が極めて脆くなることが示され、モデル自身の自律的な制御を安全対策の砦とすることの構造的リスクが浮き彫りになった (出典: Reddit r/artificial)

小型化の極限を突破:わずか2万パラメータのストーリー生成モデルMacroStoriesを開発 : 個人開発者が容量わずか81KB(19,969パラメータ)の極小言語モデルMacroStoriesをオープンソース化した。本モデルはシングルデコーダーを4回ループ推論させるアーキテクチャを採用し、一般的なCPUやマイコンのキャッシュ内でも高速動作が可能。制限された語彙の中で明確なストーリーラインを維持でき、言語の一貫性を保つために必要な最小計算リソースの境界を探求している (出典: Reddit r/LocalLLaMA)

💡 その他
電力網の増強遅延と変圧器のサプライチェーン不足がチップに先んじてAI拡大の急ブレーキとなる可能性 : エネルギー政策の分析によると、全米のAIデータセンターの電力負荷は2030年までに50GWに達すると予測されているものの、超高圧変圧器をはじめとする重電設備の納期はすでに概ね5年を超えており、メーカー側も過去の設備投資バブルの後遺症から安易な増産に踏み切れない状況にある。物理的な送配電設備と電力インフラにおける需給の絶対的な不一致が、計算能力の無制限な拡大を阻む最も深刻で現実的な物理的ボトルネックになりつつある (出典: Transformer)
Adobeデザインツール一式がオープンソースでリバースエンジニアリング再現:コードLLMが知財の堀を再構築 : オープンソースプロジェクトArtcraftは、Opus 5.5などの先端コードモデルを活用し、従来のデザインツールのロジックを逆コンパイルしてRust仕様へ再設計することで、Photoshop水準のデザインソフトウェア群をクリーンルーム手法によってオープンソースで完全に再構築した。コードAgentがレガシーソフトウェアを極めて高速にリバースエンジニアリングする能力は、従来のプロプライエタリソフトウェアが拠って立つ高い参入障壁としてのビジネスの堀を根本から突き崩しているとコミュニティで大きな反響を呼んでいる (出典: dotey、amasad)

マクドナルド、AI価格決定ツールを用いたフランチャイズ店間の価格カルテル疑惑で反トラスト法違反の集団訴訟に直面 : シカゴ連邦裁判所において、消費者がマクドナルドを相手取り反トラスト法に基づく集団訴訟を提起した。独立フランチャイズ加盟店への導入を求めた動的価格設定AIツールが、実際には非公開の売上データの水平的交換およびアルゴリズムによる価格操作を構成しており、消費者の利益を侵害し公正な市場競争の秩序を乱していると告発されている (出典: The Guardian)
