🔥 注目のニュース
Anthropicが第2回リスク報告書を公開、内部モデル「Model 2」を初開示 : Anthropicは第2回『リスク報告書』を公開し、内部で使用されている高性能モデル「Model 2」を初めて開示した。同モデルは内部の研究開発テストであるCoBenchで62.8%のスコアを記録し、Mythos 5を上回るものの、まだ人間の研究者を代替するには至っていない。報告書では、マルチエージェント協調の逸脱や強化学習における思考の連鎖(Chain of Thought)の漏洩など、複数の安全プロセスのミスも自ら明らかにしており、これにより「ミスアライメント」の評価リスクレベルを「低」に引き上げた。(ソース:機器之心)
GoogleがGemini 3.7 Flashモデルを発表、低価格競争を開始 : GoogleはGemini 3.7 Flashモデルを正式にリリースした。性能は前世代から大幅に向上し、DeepSWEベンチマークで65.3%のスコアを達成した。激しい市場競争に対応するため、Googleは100万入力Tokenあたり0.75ドル、出力3.75ドルという超低価格のプロモーション価格を提示し、OpenAIやAnthropicに対して直接価格競争を仕掛け、企業向け軽量モデル市場でのシェア拡大を狙っている。(ソース:AI Business)
SpaceXがAIプログラミングツールCursorの買収を完了 : イーロン・マスク率いるSpaceXは、AIプログラミングツールCursorの買収を正式に完了した。CursorチームはSpaceX AIに加わり、Grokシリーズのモデルおよび新たにリリースされたGrok Botエージェントエコシステムの向上を支援する。同時に、安全テストにより、新モデルGLM-5.3がCursor内で未公開の深刻なセキュリティ脆弱性を発見したことが明らかになり、現在両社は共同で修正を進めている。(ソース:The Verge)
GoogleがAI部門を再編:DeepMindの一部の非技術チームを本社へ移管 : GoogleはGoogle DeepMindの分割再編を開始し、複数の非技術支援チームをDeepMindから除外してGoogleの直属の報告体制に統合することを発表した。これにより、研究と製品化の間の障壁を減らし、GeminiとGoogleのコア製品との統合を加速させる。同時に、共同創業者のセルゲイ・ブリン氏が再びAI意思決定の中心に関与し、「再帰的自己改善(recursive self-improvement)」などの最先端の技術ロードマップを強力に推進している。(ソース:Reuters)
🎯 動向
アリババが軽量マルチモーダルモデルQwen3.8-27Bをオープンソース化 : アリババは、Apache 2.0ライセンスのもと、マルチモーダル密モデルQwen3.8-27Bを正式にオープンソース化した。同モデルは、SWE-bench ProなどのAgentおよびプログラミング評価においてClaude Opus 4.6 Maxを上回り、262Kのネイティブコンテキスト(最大1Mまで拡張可能)をサポートする。また、推論レベルの調整機能を初めて導入し、開発者がタスクの難易度に応じて思考の深さを自由に制御できるようにしており、コンシューマークラスのGPUでのローカルデプロイに非常に適している。(ソース:量子位)
AnthropicがClaudeのテキスト電子透かしメカニズムを詳細に説明 : EUの『人工知能法(AI法)』のコンプライアンス要件に対応するため、AnthropicはClaudeのテキスト電子透かし技術を詳細に開示した。この技術はGoogle DeepMindのSynthID-Textスキームに基づいており、単語選択のランダム性の中に特定のキーパターンを埋め込むことで、知覚できない電子透かしを生成する。公式は、このメカニズムが生成品質に影響を与えず、Token消費も増加させないと強調しており、近いうちに検出APIをリリースする計画である。(ソース:Anthropic News)
World Labsがロボット仮想トレーニングエンジンR2S2Rを発表 : フェイフェイ・リ(李飛飛)氏が設立したAIスタートアップWorld Labsは、SceniX技術に基づく「Real-to-Sim-to-Real」(R2S2R)ロボットシミュレーションエンジンを発表した。このシステムは、単一の現実世界のロボットタスクを、異なる照明、物体の位置、物理特性を含む何千もの仮想トレーニングシナリオに変換することができ、実機に一切触れることなく制御ポリシーのトレーニングを完了させ、物理ハードウェア上で直接安定して動作させることができる。(ソース:World Labs)
GoogleがAI生成コンテンツの可視電子透かしのオフ機能をユーザーに提供 : Googleは、GeminiおよびビデオエディターFlowにおいて、AIが生成した画像、動画、音楽の可視電子透かしをユーザーが手動でオフにできるようにすることを発表した。この措置は、クリエイターの実用的なニーズと安全コンプライアンスのバランスを取ることを目的としており、不可視のSynthID透かしとC2PAメタデータは、真実性検証のためにバックグラウンドに引き続き保持される。(ソース:TechCrunch)
Amazon傘下のTwitchがプライバシーポリシーを更新、ユーザーのAI学習オプトアウトを可能に : Amazon傘下のライブ配信プラットフォームTwitchは、セキュリティとプライバシーの設定を更新し、配信者が「生成AI学習」オプションを手動でオフにできるようにした。これにより、ライブ配信動画、録画、チャットデータがAmazonのAIモデルの学習に使用されるのを防ぐことができる。ただし、プラットフォームのレコメンデーションやモデレーションに使用される補助的なAI機能は、このオプションの制限を受けない。(ソース:WIRED)
Waymoの自動運転サービスがカリフォルニア州の複数地域での拡大承認を獲得 : 自動運転企業Waymoは、カリフォルニア州公共事業委員会(CPUC)から承認を受け、無人自動運転ライドシェアサービスをサンフランシスコ・ベイエリア、ロサンゼルス、サンディエゴ、サクラメントへ正式に拡大することを発表した。Waymoは、自社の安全評価フレームワークに基づき、各地域での運行展開を段階的かつ着実に進めていくとしている。(ソース:Waymo)
🧰 ツール
浙江大学が科学研究エージェントプラットフォームPolarisをオープンソース化 : 浙江大学のチームは、Polarisと呼ばれるAI科学研究エージェントプラットフォームをオープンソース化した。このプラットフォームは、文献調査、アイデア生成、実験管理、論文執筆などの科学研究プロセスを自動化されたパイプラインとして連結する。AIは接続されたGPUサーバー上で自律的に実験を設計・実行でき、重要な意思決定ポイントでは人間の確認を導入することで、人間とマシンの協調による科学研究の新たなパラダイム構築を目指している。(ソース:機器之心)
音潮が音楽大規模モデルV4.0を発表し、APIを公開 : 中国のAI音楽チーム「音潮」は、人間味のあるセマンティック理解と多言語創作を特徴とするV4.0大規模モデルをリリースした。新バージョンは、世界の主要10言語をサポートするだけでなく、個人ユーザー向けにインストゥルメンタル(純音楽)生成機能を初めて開放した。さらに、音潮はAPIオープンプラットフォームを立ち上げ、歌詞生成や楽曲の模倣作成などのインターフェースを提供し、開発者向けに期間限定で無料開放している。(ソース:量子位)
📚 学習・研究
SWD:再学習不要の重みレベルの大規模モデル解釈可能性アプローチ : 至知創新研究院は、オックスフォード大学やスタンフォード大学などと共同で「稀薄重み分解(Sparse Weight Decomposition: SWD)」手法を提案した。この手法は、事前学習済みモデルの密な重み行列を2つの稀薄な因子に直接分解し、共有次元を独立して介入可能なボトルネックユニットに変換するもので、GPT-2やQwenなどのモデルでタスク回路の抽出に成功した。この手法のデータコストは従来の学習型代替ネットワークのわずか1%であり、キャリブレーションデータを必要としないzero-dataバージョンも提供されている。(ソース:至知研究院)
DeepSeek Harnessの背景にある時空間可構成プログラミングパラダイム : エージェントフレームワークHarnessのオープンソース化に伴い、DeepSeekチームは論文『時空間可構成プログラミングパラダイム』を発表した。論文では、その基盤となるCordisフレームワークの理論的基礎を詳細に説明しており、「効果(effect)」と「余効果(co-effect)」を実行時(runtime)メカニズムとして具体化することで、実行時におけるコンポーネントの動的ロード、依存性の注入、および可逆的な副作用のクリーンアップを実現し、自己進化型エージェントに堅牢なシステムレベルのサポートを提供している。(ソース:機器之心)
UniMotion:統一マルチモーダル大規模モデルへの連続モーションモダリティの導入 : 北京大学、東華大学、華南理工大学のチームはECCV 2026で論文を発表し、統一マルチモーダルフレームワークUniMotionを提案した。この手法は、複数フレームの連続的な人体運動(Motion)を独立したモダリティとして扱い、テキストおよびRGB視覚シグナルと共有のLLMバックボーン内でアライメントを行うことで、単一のモデルでモーションの理解、予測、生成、編集など7つのクロスモーダルタスクを実現した。(ソース:北京大学)
HarnessFix:エージェントHarnessの欠陥を自動診断・修復 : 複雑なタスクにおいて、外部環境メカニズム(Harness)の機能不全によりエージェントが失敗する問題に対し、研究者らはHarnessFixフレームワークを提案した。このシステムは、エージェントの失敗の軌跡とHarnessコンポーネントを中間表現にコンパイルし、欠陥が存在するHarnessのレイヤー(ツールインターフェースや検証ロジックなど)を自動的に特定して、境界のある修正パッチを生成する。複数のベンチマークテストにおいて、タスク完了率を6.3〜18.4パーセント向上させた。(ソース:HarnessFix)
MDA:大規模モデルとベイズ実験設計に基づくメカニズム発見エージェント : ハーバード大学やマサチューセッツ工科大学(MIT)などの研究者らは、メカニズム発見エージェント(Mechanism Discovery Agent: MDA)を開発した。このシステムは、大規模モデルの仮説生成能力とベイズ推論の厳密性を組み合わせ、情報の価値(Value of Information: VoI)を最大化することで、候補となる物理的メカニズムを最もよく区別できる介入実験を能動的に設計・選択し、多くの科学的発見タスクにおいて大幅に少ない実験回数で誤った仮説を排除した。(ソース:NeuronBench)
Libra:エージェント強化学習のポストトレーニングに向けた高効率リソースマネージャー : 香港中文大学と香港恒生大学のチームは、Libraシステムをオープンソース化した。このシステムは、Agentic RLにおけるツール呼び出しがもたらす軌跡のロングテール問題やステージ間の不均衡に対し、グローバルリソースプランナーとC-MLFQスケジューラを設計した。ツールから返される実行時シグナルに基づいてGPUの学習と推論の比率を動的に調整することができ、複数のタスクにおいて学習スループットを最大300%向上させた。(ソース:NetX-lab)
💼 ビジネス
IBMとOpenAIがエンタープライズ向けAIで戦略的提携に合意 : IBMとOpenAIは新たなパートナーシップの締結を発表し、IBMコンサルティング内に専門のOpenAI部門を設立して数千人のコンサルタントを育成することを明らかにした。両社は、GPT-5.6、Codex、ChatGPT WorkなどのモデルをIBMのコンサルティングおよびマルチエージェント・サイバーセキュリティ・プラットフォームに深く統合し、規制の厳しい業界におけるエンタープライズ向けAIの安全な導入を共同で加速させる。(ソース:AI Business)
NVIDIAがウォール街の巨頭と共同で5000億ドルのAIインフラ資金調達を開始 : NVIDIAは、Apollo、Blackstone、Goldman Sachsなど世界のトップ金融機関6社と提携し、AIインフラ建設に向けて5000億ドルを超える資金を動員する計画を発表した。このプロジェクトは、独立したネットワークおよび計算資源の資金調達プラットフォームを確立し、AIデータセンターやハードウェア調達に資本支援を提供することで、計算資源施設を新しい投資可能な資産クラスとして位置づけることを目指している。(ソース:AI Business)
🌟 コミュニティ
「認知の共有地の悲劇」とAIによるジュニア職の代替を巡りコミュニティで熱い議論 : 学術界が最近提唱した「認知の共有地の悲劇(Tragedy of the Cognitive Commons)」理論が大きな議論を呼んでいる。研究によると、企業がAIでジュニア職を代替することは短期的には有益であるものの、ジュニア人材が実践を通じて深いドメイン知識を蓄積する経路を遮断してしまい、将来的にAIの誤りを修正できるシニアエキスパートの不足を招くという。ソフトウェア開発、金融、法律など、参入障壁が低くモジュール化が進んだ業界が最も高い流出リスクに直面している。(ソース:Human Resource Development Review)
AI生成書籍がAmazonの自己出版市場に与える「希釈効果」を研究が解明 : Amazonの1万冊以上の自己出版電子書籍を対象としたPangram検出研究によると、大量 of AI生成コンテンツを含む書籍がすでに全カタログの20%を占めていることが明らかになった。AI書籍の1冊あたりの売上は低いものの、その極めて高い出版頻度が市場に深刻な希釈効果をもたらしており、AIの痕跡が検出されなかったオリジナル書籍であっても、1冊あたりの平均収入が全体的に減少する結果となっている。(ソース:arXiv)
米裁判所初の事例:原告が起訴状に不可視のAI指示を埋め込み裁判の操作を画策 : 米国コネチカット州の訴訟において、原告が起訴状の余白に3ポイントの白いフォントで不可視のプロンプトを埋め込み、裁判所がAI自動審査システムを使用した場合に、自身に有利な判決を下すようシステムを誘導しようとした。裁判所はAI審査を採用していなかったものの、裁判官はこれを発見した直後に原告の電子訴訟特権を取り消し、この行為を「陪審員への不適切な接触」と同等であると非難した。(ソース:Ars Technica)
ヘッジファンドSAの巨額損失がコミュニティでAI投資バブルの議論を誘発 : ウォール街のクオンツ大手Jane Streetは、7月にAIをテーマにしたヘッジファンド「Situational Awareness」へのリスクエクスポージャーにより、約150億ドルの巨額の損失を被った。この出来事はコミュニティで広範な議論を巻き起こし、一部の投資家は、市場のAIに対する中短期的な投資回収率(ROI)への期待が高すぎたことを示しており、資金チェーンの局所的な混乱につながったと指摘している。(ソース:The Guardian)
💡 その他
インドネシア初の大学AI技術センターが正式に設立 : インドネシアの通信・デジタル省は、インドネシアの通信大手Indosat、NVIDIA、およびガジャ・マダ大学(UGM)と共同で、ジョグジャカルタに同国初となる大学AI技術センターを設立した。同センターは、NVIDIAの加速コンピューティングプラットフォームとインドネシアのソブリンGPUサービスを活用し、結核スクリーニング、精密農業、自然災害の早期警戒など、国家の基幹分野に焦点を当てたAIの研究開発を行う。(ソース:NVIDIA Blog)
英国スコットランド・ラーバートの住民が建設予定のAIデータセンターに抗議 : スコットランドのラーバート(Larbert)地区で、建設が予定されているAIデータセンターに対する抗議活動が発生し、数百人の住民が参加した。現在までに約7000件の反対意見が寄せられている。地元住民や環境団体は、データセンターに配備される200台の非常用ディーゼル発電機が、周辺の病院や療養所に深刻な大気汚染や騒音被害をもたらすことを主に懸念している。(ソース:The Guardian)