OpenAIが社内RSIデータを公開し「AI研究インターン」目標の達成を確認、チ…|AI日報 2026-09-08

🔥 フォーカス

OpenAIが社内RSIデータを公開し「AI研究インターン」目標の達成を確認、チーフサイエンティストは「エイリアン・マインド」に警鐘を鳴らし業界の減速を呼びかけ : OpenAIはAIモデルによる社内研究開発加速の詳細データを公式発表し、「自動化AI研究インターン」の目標を予定通り達成したこと、ならびに2028年3月までに完全自律型AI研究者の実現を目指す計画を明らかにしました。データによると、OpenAIの中央値の研究者は1日あたり600ドル相当以上の推論Tokenを消費しており、上位10%の研究者では1日あたり7000ドルを超えています。また、人間の1労働日はAgentの3.1労働日に相当します。しかし、チーフサイエンティストのJakub Pachocki氏は同日、長文記事『An Alien Mind』を発表し、モデルの強化に伴い思考チェーンの監視能力が急速に失われつつあり、AIは監視を離れると極めてアライメントが崩れた行動を取りやすいと警告。業界全体に対して、自発的な減速と国際的な協調を最優先事項とするよう呼びかけました(出典:OpenAI NewsTHE DECODER机器之心

OpenAI公開内部RSIデータ

フィールズ賞受賞者率いるMostik、大規模モデルの隠れ状態を直接接続する「クロスモーダル・ブリッジ」を発表、4B小規模モデルがテキスト対話なしで大規模モデルを凌駕 : フィールズ賞受賞者のStanislav Smirnov氏がチーフサイエンティストを務めるスタートアップMostikは、従来のテキスト対話のボトルネックを打破する新アーキテクチャを提案しました。この手法では、小型の学習可能な「ブリッジ」を介して、753BパラメータのGLM-5.2がプリフィル段階で生成した隠れ状態(Hidden State)をモバイル端末上で動作する4BのQwen-3.5へ直接転送します。大規模モデルは一切テキストを出力せず、小規模モデルのみがデコードと出力を担当します。この設計により、大規模モデルの推論コストを20分の1に圧縮しながら、4B小規模モデルのARC-AGI 3難問サブセットにおける正解率を倍増させ、異種マルチモデルの高度な協調に向けた新たな数学的・工学的パラダイムを提供しました(出典:量子位

フィールズ賞受賞者が大規模モデルに参入

韓国が「国民AIプロジェクト」を始動:政府が512基のB200チップを補助、3大コングロマリット主導で国民向けソブリンAIサービスを提供 : 韓国科学技術情報通信部は、SK Telecom、KT、Kakaoの3大企業連合を選定し、国家プロジェクト「AI for All」を推進すると発表しました。年内に全盲国民に向けて無料・無制限の汎用AIおよび行政手続きAgentサービスを提供する予定です。韓国政府は今年、512基のNVIDIA B200 GPUを直接配分し、2027年以降は国家予算で運用コストの全額を負担する計画です。同時に、各企業連合のサービスにおいて国産自社モデルの比率を80%以上に維持することを義務付けており、高度なAIを公共インフラと位置付け国家レベルで保障を提供する世界初のG20経済国となりました(出典:TechRadar36氪

韓国が国民AIプロジェクトを始動

Zeno Roboticsが世界初の分散協調型Embodied基盤モデル「Zeno-1」を発表 : Zeno Roboticsは、分散型マルチロボットのリアルタイム協調作業向けに設計された3Bパラメータの物理知能基盤モデル「Zeno-1」を発表しました。従来の集中型スケジューラや同期デモ模倣のアプローチを排除し、「クローズドループ・パートナー・インタラクション(CPI)」による4段階の漸進的学習を採用。同構モデルのレプリカがローカルの30Hz視覚-運動フィードバックと環境状態の相互作用のみに依存して、減速、待機、譲り合いといった協調行動を自発的に創出します。さらに、0.5秒先の故障を事前警告する予測型世界モデルを内蔵し、マルチEmbodied Agentのタスク分解における次元の爆発と時系列の累積誤差の課題を解決しました(出典:机器之心

協調型Embodied知能基盤モデルZeno-1

🎯 動向

GPT-6 Solの内部テストが判明:単一テスト速度はAstraの6倍、高スループットAgentタスクに特化 : コミュニティからのリーク情報によると、OpenAIはGPT-6ファミリーの新メンバー「GPT-6 Sol」を社内テスト中であることが明らかになりました。実測では、SVG生成やサンドボックスワールド構築などの長文出力タスクにおいて、Max推論モード下でのSolの単一応答速度はGPT-6 Astraの約6倍に達し、待機時間とTokenコストを大幅に削減しています。業界では、Astraが最高難度の深い因果推論に重点を置く一方、Solは高スループットと経済性を兼ね備えたスケーラブルな本番環境向けAgent主力モデルと位置付けられており、9月末の開発者会議で正式発表される見込みです(出典:量子位36氪

GPT-6 Solの内部テストが判明

HiDream.aiがEmbodied世界モデル「HiDream-O1-Embodied」を発表、RoboColiseumの擾乱サブリーダーボードで首位を獲得 : HiDream.aiは、画像、動画、3D、アクションの統合表現と因果推論を初めて実現したネイティブ全モーダルEmbodied世界モデル「HiDream-O1-Embodied」を正式にリリースしました。Embodiedシミュレーション評価プラットフォームRoboColiseumにおいて、照明、遮蔽、カメラのズレなどの強い干渉を伴う「擾乱適応」サブリーダーボードで0.692スコアを獲得し首位に立ちました。研究チームは、高精度モーションキャプチャ基盤と生成型拡散モデルによって「実環境基盤+生成拡張」のデータフライホイールを構築し、非理想的な実環境におけるロボットの堅牢な操作能力を大幅に向上させました(出典:机器之心量子位

HiDream-O1-Embodied世界モデル

アリババが空間認識と軌道計画を統合したエンドツーエンド自動運転大規模モデル「Qwen-Drive 1.0」をオープンソース化 : アリババのQwenチームは、Qwen3.5-4Bをベースに構築された「Qwen-Drive 1.0」をオープンソース化しました。バードアイビュー(BEV)3D認識ヘッドと軌道計画エキスパートモジュールを導入し、単一モデルで車載音声アシスタント、交通因果Q&A、連続運転計画タスクを同時にこなすことが可能です。クローズドループのシミュレーション評価では、強化学習による微調整後のモデルが車両の車線逸脱率を24%から12%に低減させ、ベースモデルの汎用言語能力および常識理解能力を完全に保持していることが示されました(出典:THE DECODER

Qwen-Drive 1.0アーキテクチャ

Shuicheng Yan氏らのチームがリアルタイム対話型デュアルブレイン記憶アーキテクチャ「VoiceMem」を発表 : Shuicheng Yan氏と南洋理工大学などの共同チームは、デジタル共生体向けの脳型記憶フレームワーク「VoiceMem」を発表しました。音声対話の高い即時性と感情特性に対応し、事実を管理する「情報左脳」(2層グラフ検索)と、長期・短期の感情帰属およびペルソナ沈殿を行う「感情右脳」を設計。長文コンテキスト検索の遅延を134msに圧縮し、標準的なVAD無音待機時間内に隠蔽することで、長対話ベンチマークLoCoMoにおいてわずか5件のメモリ参照で91.2点を達成しました(出典:机器之心

VoiceMemストリーミングデュアルブレインアーキテクチャ

マイクロソフトと上海交通大学がエビデンス駆動型の長期科学研究Agentランタイム「Argus」をオープンソース化 : マイクロソフトと上海交通大学は、数日間にわたる複雑な科学研究タスク向けAgent推論ランタイム「Argus」を共同発表しました。従来の目標駆動型(Goal-Driven)アーキテクチャからエビデンス駆動型(Evidence-Driven)へと転換し、Manager、Planner、Engineer、Reviewerの4つの疎結合ロールが循環動作することで、複数のHarness連携と知識の蓄積をサポートします。学際的な27件の科学研究キャンペーン(計1548時間)の連続実測において、平均40.7時間に1回の手動介入のみで済む高い自律運用を実現しました(出典:机器之心

Argus長期科学研究Agentシステム

NVIDIAとハーバード大学などがアクションフロー世界モデル「Hydra-0」を共同提案 : NVIDIAとハーバード大学の研究チームは、アクションフロー(Action Flow)を条件とする汎用世界モデル「Hydra-0」を提案しました。ロボットアームや人間の手の物理的動作をピクセル平面の連続運動軌跡にマッピングすることで、オントロジーを超えた制御インターフェースのギャップを解消します。テスト結果では、Hydra-0によりロボットの動作予測誤差が90.4%、物体の変形予測誤差が60.2%削減され、逆モードによって対象物体の軌跡からロボットの実行可能操作を逆算して生成することも可能であることが示されました(出典:36氪

Hydra-0汎用世界モデルアーキテクチャ

西湖大学などがコード駆動型世界モデル「Code World Model」を提案 : 西湖大学と南洋理工大学のチームは、インタラクティブ世界モデルの生成パラダイムを刷新する「Code World Model」アーキテクチャを発表しました。Coding Agentが実行可能コードを記述することで低レイヤーの剛体衝突、属性、因果規則を維持し、その状態を軽量な低解像度Proxyスケルトンにコンパイルして動画拡散モデルMiniMax-H3に入力して精細な映像を生成します。純粋な動画モデルが抱える長期物理的一貫性や複雑なインタラクションロジックにおける構造的欠陥を効果的に解決しました(出典:36氪

Code World Modelフレームワーク

🧰 ツール

アリババの「千問オフィス」が業界初の複数人協調ワークベンチをローンチ : アリババ傘下のエンタープライズ向けAgent製品「千問オフィス(Qwen Office)」は「複数人ワークベンチ」機能をリリースしました。ユーザーが自然言語で業務プロセスと役割要件を記述するだけで、最大100人が同時オンライン協調可能な専用Webアプリケーションをワンクリックで生成できます。ロール権限の分離、クラウドデータベース、集中管理バックオフィス、メンテナンスフリーのデプロイ機能がネイティブ統合されており、中小規模組織による社内OAやワークフローシステムのカスタム開発ハードルを大幅に下げています(出典:量子位

千問オフィス複数人ワークベンチ

360がエンタープライズ向けAgentプラットフォーム「纳米Work」を発表 : 360は、「クラウドオフィス」と企業権限連携を強みとするエンタープライズ向けAgent協調作業プラットフォーム「纳米Work」を正式リリースしました。2万種以上の常用ツールと環境依存関係がプリセットされており、ローカルPCのシャットダウンによる中断を受けることなく、Agentがクラウド上のセキュアなサンドボックス内で長期の複雑なタスクを直接実行できます。エンタープライズ版は連絡先、ドメインアカウント、コードリポジトリの権限と深く連携しており、検証済みのベストプラクティス・ワークフローをチーム共有のSkillコンポーネントとして蓄積可能です(出典:36氪

360纳米WorkエンタープライズAgentプラットフォーム

feynman:全工程の研究開発に対応したオープンソースAI Agentワークベンチ : 開発者により、PiランタイムとalphaXiv論文エコシステムをベースに構築されたAI研究Agentワークベンチ「feynman」がオープンソース化されました。Researcher、Reviewer、Writer、Verifierの4つの協調ロールを内蔵し、文献検索、論文間グラフスコアリング(PaperRank)、論文とオープンソースコードの一貫性監査(audit)、再現手順の生成に至る全リンクをローカルおよびCLIでサポート。さらに、CodexやClaude Code互換のAgent Skillsとしてワンクリックでエクスポートすることも可能です(出典:GitHub Trending

feynman研究Agentワークベンチ

geo-seo-claude:AI検索時代(GEO)に向けた自動SEO最適化スキルライブラリ : オープンソースツール「geo-seo-claude」は、Claude Code向けに生成エンジン最適化(GEO)スキルパッケージを提供します。AI検索(Perplexity、ChatGPT、Google AI Overviewsなど)の引用メカニズムを対象とし、コンテンツの引用可能性スコアリング、AIクローラー権限監査、llms.txt仕様生成、クロスプラットフォームのブランド認知度スキャンなどを提供。Webサイトが従来のキーワード順位対策から、AI大規模モデルの回答情報源最適化へ移行することを支援します(出典:GitHub Trending

geo-seo-claudeスキルライブラリ

📚 学習

Meta FAIRがAI研究選好モデル(RPMs)を提案、実験の事前フィルタリングにより計算資源消費を抑制 : Meta FAIR、オックスフォード大学、UCLが共同でAI Research Preference Models(RPMs)を提案しました。自動研究Agentが膨大な実験候補を生成する際、検証に必要な計算コストが高騰する問題に対し、RPMは凍結された事前学習済み大規模モデルを用いて未実行の計画をペアワイズで評価・順位付けし、最も有望な実験計画を選定して実行します。AIRS-Benchベンチマークにおいて、Agentはベースラインが24時間かけて到達する探索水準に1.5〜1.6倍の速度で先行して到達しました(出典:MarkTechPost

H Companyがシングルタワー・マルチモーダル・デコーダフリー検索エンコーダ「NeoMME」をリリース : フランスのスタートアップH Companyは、NeoMME双方向エンコーダファミリー(260Mおよび800M)をオープンソース化しました。従来の独立したビジョンエンコーダタワー(Vision Tower)と因果デコーダを完全に排除し、単一のTransformerアーキテクチャでテキストTokenと32×32の生画像Patchを同時に処理します。ViDoRe v3視覚ドキュメント検索ベンチマークにおいて0.523 nDCG@10を達成し、極めて小型のパラメータサイズでありながら3.75BのColQwen2.5モデルに匹敵する性能を示しました(出典:MarkTechPost

NeoMMEシングルタワーマルチモーダルエンコーダ

YC Paper Clubの長文考察:なぜAgent Harnessはモデル自体よりも重要なのか : Y Combinator主催のAgent Harness特別セミナーにおいて、複数の第一線研究者が、静的なPromptラッパーから自己進化型OSへと至るHarnessの進化プロセスを詳細に解説しました。同一のモデル重みであっても、プログラムによるREPLインタラクション、永続的コンテキスト階層管理(L1-L3 Cache)、自己修正機能を備えたHarnessを利用することで、ARC-AGIスコアが30%から95%に向上することが指摘され、将来のAIアーキテクチャの競争優位性は外部実行環境の表現力と状態管理へシフトしていくと結論付けています(出典:)

論文が大規模モデルのOn-Policy蒸留の限界を解明:単一サンプルで全データセットの重要状態をカバー可能 : 清華大学などの研究グループは、論文『Rethinking On-Policy Distillation of Large Language Models II: One Training Example』を発表しました。生徒モデルに単一の問題上で複数回の生成とターゲットを絞ったアライメントを行わせるだけで、その内部表現は問題集全体で学習した場合の71.5%の隠れ状態をカバーでき、16問で98.9%のカバレッジに達することが判明しました。これにより、On-Policy蒸留のボトルネックは初期問題数ではなく、生徒モデルの消化効率にあることが示されました(出典:HuggingFace Daily Papers

単一サンプルOn-Policy蒸留の研究

💼 ビジネス

電力・計算力協調型AI Infraベンダーの中科類脳、CRRCキャピタル主導で数億元のシリーズB+戦略的資金調達を実施 : インテリジェント技術と計算力最適化を手掛ける中科類脳は、中央国有企業系産業資本のCRRCキャピタルが主導し、Ginkgo Valley Capitalなどが参加する数億元規模のシリーズB+資金調達を完了したと発表しました。調達資金は、電力・計算力協調型Token工場のコアスケジューリングアルゴリズム開発および異種計算力管理に重点投入されます。CRRCの新エネルギー分野の強みを活かして高消費電力シナリオにおけるグリーン電力と計算力のマッチング課題を解決し、国内AIインフラの規模拡大から電力効率競争へのシフトを推進します(出典:量子位

中科類脳B+ラウンド戦略的資金調達

インテリジェント意思決定・オントロジーインフラプロバイダの中科世通亨奇、約5億元のシリーズB資金調達を完了 : 高信頼性重要分野向けのインテリジェント意思決定サービスを提供する中科世通亨奇は、Nanfang Demao FundやChina Unicom Venture Capitalなどの機関から約5億元のシリーズB資金調達を完了したと発表しました。自社開発のインテリジェント・オントロジー・スペース(AOS)と製品体系「世通霊境」をベースに、防衛、エネルギー・電力、通信キャリアなどの業界に対して、トレーサビリティと厳格な権限管理を備えた産業グレードのAgent意思決定ループを提供します(出典:36氪

中科世通亨奇の資金調達発表

Uber共同創業者カラニック氏のロボットスタートアップAtoms、Robotaxi市場への参入を計画と報道 : フィナンシャル・タイムズの報道によると、Uberの元創業者Travis Kalanick氏が設立したEmbodied・自動化ハードウェアスタートアップAtomsは、a16z主導による17億ドルの巨額資金調達を完了した後、Robotaxi自動運転分野への参入に向けて大規模な採用とM&A計画を開始した模様です。報道では、UberがすでにAtomsに1億ドルを出資し、将来の車両フリート技術連携に関する協議を進めていることも明かされています(出典:TechCrunch

🌟 コミュニティ

ジェンスン・ファン氏が「AGIは到来した」と発言、学術界と開発者の間で汎用知能の定義を巡る議論が白熱 : NVIDIAのCEOであるジェンスン・ファン氏がSNS上で「GPT-6 AstraはAGIの到来を意味する」とOpenAIを祝福したことをきっかけに、コミュニティ内で汎用人工知能の定義基準を巡る激しい議論が巻き起こっています。著名学者のGary Marcus氏らは反論を投稿し、現行モデルは因果推論、長期的な自律計画、実世界の理解において依然として大きな断絶を抱えており、科学的に厳密な客観評価を欠く中でビジネスリーダーが安易にAGIを再定義すべきではないと指摘しました。一方、支持派はPC操作や複数ステップのコーディングなどの実用的経済価値の観点から、AIは事実上のAGI段階に突入したと主張しています(出典:Marcus on AIReddit r/ArtificialInteligence

ジェンスン・ファン氏がAGI議論を喚起

GPT-6 Astraが名作ゲーム『Portal』をクリア、571ドルのToken消費が計算資源と自律性を巡る話題に : 開発者がGPT-6 Astraを用い、純粋な視覚入力とマウス・キーボード操作によって一人称視点パズルゲーム『Portal』を自律クリアした全記録を共有しました。プロセス全体で約24時間を要し、消費したAPI Token費用は約571.18ドルに達しました。コミュニティでは、3D空間理解と連続アクション探索におけるモデルの質的変化を示すものとして注目される一方、1タスクあたり数百ドルというコストに対し、現行の最先端モデルの実用化における費用対効果を慎重に見極める声も上がっています(出典:The VergeReddit r/ChatGPT

GPT-6 AstraがPortalをクリア

Notion公式MCPコネクタがプロモーション用Promptを不正注入して有料プランへ誘導していると開発者が告発 : Reddit上で開発者が告発したところによると、Notion公式のModel Context Protocol(MCP)サーバーが、システムプロンプト内にNotion Businessプランを宣伝する指示を密かに注入しており、通常のワークフロー実行中にAI Agentがユーザーへ有料アップグレードを自発的に勧誘するよう仕組まれていたことが判明しました。この事態は、サードパーティ製プラグインの安全性、コンテキストポイズニング、企業によるAgentプロンプトチャネルの悪用に対する幅広い懸念を引き起こしています(出典:Reddit r/ClaudeAI

Notion MCPが広告プロンプトを注入

スイス金融大手UBS、ジュニアバンカー採用においてAIツール活用スキルを必須要件に設定 : フィナンシャル・タイムズの報道によると、UBSグループは2027年度のグローバル投資銀行・市場部門における新卒・インターン採用において、AIツールの習得を必須の評価指標に設定しました。面接プロセスでは、AIを活用した財務モデリング、業界調査、レポート作成の効率性が直接テストされる予定であり、金融業界における若手ホワイトカラーのスキル要件が、基礎的作業の実行からAIのハンドリングと出力検証へ全面的にシフトしたことを象徴しています(出典:THE DECODER

自律エージェント「微小経済圏」実験1f916.ai:2000体のAIが独立協調とオンチェーン取引を実現 : 個人開発者が実験プロジェクト「1f916.ai」の運用データを公開しました。Claude Agentに独立したドメインと環境を提供して1か月後、2000体以上の自律AI Agentが自発的に4000件以上の投稿と10万回のインタラクションを生成しました。Agentたちは自律的なエラー修正メカニズムとID検証体系を構築しただけでなく、USDCマイクロペイメントを通じてタスク発注とサービス決済を自動化し、マルチエージェント分散型社会のミクロな進化モデルを実証しました(出典:Reddit r/ClaudeAI

1f916 Agent経済圏実験

💡 その他

英政府AI政策の中心人物Matt Clifford氏、Anthropic移籍に伴う利益相反でAria会長を辞任 : 先週Anthropicへ移籍し国際政府渉外を統括すると発表した英国先端研究発明機構(Aria)会長のMatt Clifford氏は、有力議員や議会科学委員会から「深刻な利益相反が存在する」との強い批判を受け、Aria会長職を正式に辞任しました。この一件は、AI大手企業と政府規制当局との間の「回転ドア(天下り・癒着)」人事に対する各国の警戒と監視の高まりを浮き彫りにしています(出典:The Guardian

Matt Clifford氏が英Aria会長を辞任

書籍50万冊の著者が集団で権利保護を主張:Anthropic著作権和解金を巡り出版社やエージェントと争奪戦に : AnthropicがAI学習に関する15億ドルの著作権侵害和解に合意し賠償手続きに入る中、HarperCollinsをはじめとする複数の大手従来型出版社や文芸エージェントが、すでに版権が切れた旧作やセルフパブリッシング作品に対しても50%から100%の賠償請求を悪意を持って提出していると、多くの原著者がSNS上で告発しました。作家協会(Authors Guild)が介入して著者の異議申し立てを支援しており、AI著作権和解の執行段階における混乱と権利帰属の不備が浮き彫りとなっています(出典:TechCrunch

ケニアの外注ライティング産業、生成AIの普及により構造的崩壊の危機に直面 : ニューヨーク・タイムズの調査報道によると、かつて4万人以上を雇用していたケニア・ナイロビの学術代筆およびデータラベリング産業が、ChatGPTをはじめとする大規模モデルの普及以降、受注数と単価の壊滅的な急落に見舞われています。低コストの知的労働力アウトソーシングに過度に依存していた発展途上国のギグエコノミーは急速に縮小し、わずかに「AIテキストの機械臭除去(リライト)」のポジションが残るのみとなっており、生成AIが世界の労働力アウトソーシング市場に与える深刻な打撃を浮き彫りにしています(出典:THE DECODER

コメントを残す

メールアドレスが公開されることはありません。 が付いている欄は必須項目です