OpenAI、Anthropic、GoogleがフロンティアAI安全機関「SAFA」の設立を計画|AI日報 2026-09-26

🔥 フォーカス

OpenAI、Anthropic、GoogleがフロンティアAI安全機関「SAFA」の設立を計画 : The Informationの報道によると、OpenAI、Anthropic、GoogleはフロンティアAI安全組織「Frontier AI Standards Authority(SAFA)」の設立を準備しており、2027年初頭の正式発足を予定している。同機関はモデル配備前の第三者独立テストの統括や、業界内のインシデント報告メカニズムおよびベンチマークの策定を担う予定であり、フロンティアモデルの制御不能リスクの頻発や各国での規制強化を背景とした、テック大手による業界の自主規制および標準防衛線とみなされている (出典: The Verge)

米ホワイトハウス、OpenAIとAnthropicに対しフロンティアモデルの米側先行審査を要請 : 米ホワイトハウス国家サイバー調整官オフィスは、OpenAIとAnthropicに対し、英国のAI安全研究所(AISI)へ最新フロンティアモデルを提供する前に、まず米政府機関による審査を受けるよう義務付けた。Anthropicはこれに対応し、一部のフロンティア版の提供を米政府機関のみに限定する調整を行った。この動きは、最先端AIのコア技術評価と国家安全保障の主導権を巡る大国間の直接的な駆け引きを浮き彫りにしており、米英間の国境を越えた安全評価の連携にも制度的な摩擦を生じさせている (出典: THE DECODER)

Anthropic、スーパー議決権構造の導入を計画:共同創業者7名の持株比率はわずか2%でも50.1%の議決権を掌握へ : Anthropicは兆ドル規模のIPOを目前に控え、株主に対して新たなガバナンス案の承認を求めている。CEOのDario Amodei氏ら7人の共同創業者は、それぞれの持株比率が約2%に過ぎない場合でも、そのうち少なくとも3人が一定の持株基準を満たしていれば、Palantirに似た創業者議決権トラストを通じて集団で同社の議決権の50.1%を支配できるようになる。この構造は、経済的利益と意思決定権を切り離すことで、ウォール街の短期的な収益圧力が長期的なAIアライメントおよび安全研究に干渉することを防ぐことを目的としている (出典: 機器之心, 36氪, kimmonismus)

Anthropicがスーパー議決権構造の導入を計画

Google、宇宙太陽光発電AIデータセンターの実証プロジェクト「Suncatcher」を始動 : Googleは、軌道上AIデータセンター「Project Suncatcher」の最初の実験衛星MVPを、10月1日にSpaceXのFalcon 9(Transporter-18ミッション)に搭載して打ち上げると発表した。衛星にはカスタム仕様のTrillium TPUアクセラレータが4基搭載され、太陽光で駆動する。地上の8倍に達する太陽光エネルギーを利用して極限の宇宙環境下でAI推論を実行する実現可能性を検証することが目的で、真空放熱と高エネルギー効率の軌道上コンピューティングのテストを中核とし、2027年には衛星間レーザー高速通信の試験も予定している (出典: Ars Technica, Google, dotey)

OpenAI、月額500ドルの「ChatGPT Pro Max」プランを準備中と判明 : 開発者がChatGPTのフロントエンドコード内から、月額500ドルに達する新たなサブスクリプションプラン「Pro Max」を発見した。「最速のWorkおよびCodex実行速度」を売りにし、専用の低遅延コンピュートリソースへのアクセスを提供する可能性がある。GPT-6 Astraによる膨大な推論コンピュート消費が引き起こした高負荷時のサブスクリプション制限を受け、OpenAIは高いプレミアム価格を設定してヘビーな生産性ユースケース向けにコンピュートの階層的分離を進めており、最先端の計算資源が高付加価値企業や専門機関へと急速に集約されていることを示している (出典: 36氪, nicdunz)

ChatGPTが500ドルのPro Maxプランを販売へ!

🎯 動向

Google、Gemini 3.8 Liveおよびリアルタイムアバターモデルを発表 : Googleは、リアルタイムストリーミング対話と低遅延の動的仮想ビデオ生成を高度に統合した「Gemini 3.8 Live」および「Live Avatar」機能を正式にリリースした。97言語のネイティブ音声・映像リップシンクと非同期バックグラウンドツール呼び出しをサポートし、エンタープライズ向けのインタラクティブシーンに対応したカスタマイズ可能なアバター生成機能を提供、さらにSynthID電子透かしを全面的に組み込んでいる (出典: Google DeepMind Blog)

Meta、リアルタイム身体化モデル「Muse Realtime Avatar」を発表 : MetaはMuse Realtime Avatarのストリーミングアーキテクチャを発表した。Realtime Voiceと音声Tokenストリームを共有し、エンドツーエンドのビデオ対話応答遅延を約870msまで短縮した。システムは固定長のコンテキスト履歴を維持することで計算コストを有界に保ち、任意の長さの対話におけるリップシンクと微細な表情の同期に対応する (出典: alex_conneau, jack_w_rae)

Muse Realtime Avatar

Meta Muse、無許可で「人間のオペレーター」を代理稼働させプライバシー問題に発展 : ロイター通信の報道によると、Metaが新たに発表したパーソナルエージェント「Muse」の自動通話機能のテストにおいて、高い成功率を維持するためにバックエンドでタスクを人間のアウトソーシングチームに転送して代行させていたことが判明し、ユーザーからの重大なプライバシー懸念と規制当局からの疑念を招いている。Metaの幹部は緊急で謝罪を行い、当該テストを停止。プライバシー開示と安全保護メカニズムを整備するまでこの機能を再開しないことを約束した (出典: 量子位)

現代AIの父Jürgen Schmidhuber氏、Sakana AIの首席科学アドバイザーに就任 : 再帰的自己改善(RSI)とメタ学習のパイオニアであるJürgen Schmidhuber氏が、日本のAIスタートアップSakana AIの首席科学アドバイザーを兼任することが正式に決定した。東京に新設されたRSI Labを率い、進化アルゴリズム、世界モデル、自己組織化アーキテクチャを組み合わせることで、制限された計算資源下での適応型知能および物理世界におけるRSIのフィードバックループを探求する (出典: SakanaAILabs, hardmaru)

Jürgen Schmidhuber氏がSakana AIの首席科学アドバイザーに就任

LangChain、LangSmith Engine v2およびManaged Deep Agents 0.8を発表 : LangSmith Engine v2はプロアクティブなレッドチーミング(Red Teaming)と自動検証・修復メカニズムを導入し、Agentのリリース前に異常なロジックをプロアクティブに特定・修正できるようにした。Managed Deep Agents 0.8では、エンタープライズ向けの永続的メモリ権限ポリシー、サンドボックスファイルAPI、およびネイティブなWeb検索機能が新たに追加された (出典: LangChain, hwchase17)

LangChainがInterruptカンファレンスで新製品を発表

Perplexity、Rustベースの自社開発検索エンジン「Photon」とFast Search APIを発表 : Perplexityは、Rustで構築された検索およびリランキングサービス「Photon」を発表した。p95遅延230ms以内、p50わずか160msという超高速検索を実現し、API呼び出しコストを1,000回あたり1ドルに低減。Hermes AgentやローカルAIエコシステムにもシームレスに統合されている (出典: AravSrinivas, MParakhin)

PerplexityがFast Searchを発表

オープンソースのAI-SQL統合クエリエンジン「Quail」が公開:単一GPUで毎分10億超のTokenを処理 : スタンフォード大学やModalなどのチームが、AIデータ操作向けのSQLエンジン「Quail」を共同でオープンソース化した。vLLMスケジューラを再構築し、クエリプランとLLMのPrefillフェーズを融合、KVキャッシュとアテンションカーネルをカスタマイズすることで、単一のH100上で1クエリあたり毎分10億入力Token以上の処理スループットを達成した (出典: charles_irl, HamelHusain)

Google、Pixelデバイス向けにGeminiの「代理電話」機能をテスト : Googleは、米国のPixel 11ユーザー向けに「Call for Me」機能のテストを開始した。Geminiが端末所有者の実際の電話番号を使用して店舗へ自律的に電話をかけ、在庫確認やレストランの予約・変更を行い、音声ガイダンスや保留中の転送にも自動で対応。リアルタイム文字起こしや即座の手動引き継ぎ機能も提供される (出典: TechCrunch)

アリババ・T-Head、AIチップ向けソフトウェアスタック「T-Head SAIL」を全面オープンソース化 : アリババ傘下のT-Head(平頭哥)は、Apsara Conference(雲栖大会)において、CUDA互換ソフトウェアスタック「T-Head SAIL」の最新のオープンソース展開を発表した。PyTorch適合レイヤー、sailify移行ツール、およびDeepGEMM/FlashAttentionなどのアクセラレーションライブラリを公開し、開発者がZhenwuアーキテクチャに対してオペレータレベルのチューニングやシームレスな移行を行えるよう支援する (出典: 量子位)

NIOの任少卿氏率いるチーム、自動運転マルチモーダル世界・行動モデル「MM-Future」を提案 : NIOの研究チームは、自動運転プランニング向けに複数の「シーン-行動ペア仮説」の共同進化を実現するMM-Futureアーキテクチャを提案した。MM-Tokensによるコンパクトな時空間表現と過去・未来統合スコアラーを通じ、NAVSIM-v1ベンチマークで94.0 PDMSを達成し、世界モデルを一方向の受動的予測から閉ループの能動的プランニングへと進化させた (出典: 量子位)

Kuaishou、EC画像編集基盤モデル「KwaiMind」をリリース : Kuaishou(快手)は、実際のEC素材生成に特化した画像編集基盤「KwaiMind」を発表した。マルチエージェントデータエンジンとオンライン蒸留手法により、衣服のディテール、商品の一貫性、テキスト描画を統合し、EC関連の11タスク評価でオープンソースモデル第1位を獲得。オンラインA/BテストではCTRが約2.44%相対的に向上した (出典: 機器之心)

Liquid AI、投機的デコーディングドラフトモデル「LFM2.5-VL-DSpark」をオープンソース化 : Liquid AIは、3Bビジョン言語モデル向けに投機的デコーディング手法「DSpark」を発表した。わずか280Mのパラメータを追加するだけで、出力の完全な同等性を維持しながら、エッジデバイスのM5 Max上で最大3.13倍のデコード高速化を達成し、llama.cppおよびSGLangにも同時対応した (出典: HuggingFace Blog)

Qwengram-0.8Bがオープンソース化:51Bの明示的N-Gramメモリを小型エッジモデルへ無劣化移植 : 開発者がQwengramアーキテクチャをオープンソース化した。Qwen3.5-0.8Bのバックボーンネットワークをフリーズした状態で、軽量なReaderと動的ゲーティングメカニズムをトレーニングすることで、51BのPLE N-gram外部メモリの接続に成功し、検証セットでPerplexity(PPL)を5.05%低減させた (出典: Reddit r/LocalLLaMA)

PrismML、1-bitの超軽量LLMをQualcomm Snapdragonスマートグラスに導入 : モデルのファインチューニングと圧縮を専門とするPrismMLは、Snapdragon AR1 Gen 1チップ上で動作する2Bパラメータの1-bit Bonsaiモデルを実演した。ローカルエッジ端末でのリアルタイムな視覚的VQA(視覚質問応答)と自然なインタラクションを実現し、超低消費電力下でのエッジマルチモーダルモデル動作の工学的実現可能性を実証した (出典: TechCrunch)

🧰 ツール

Kimiブラウザ拡張機能がリリース、Web操作を「Skill」として蓄積可能に : KimiはWebBridgeをネイティブブラウザ拡張機能へと正式にアップグレードし、サイドバーでの対話機能を追加した。クリック、ページ送り、データスクレイピングなどのユーザーの一連のアクションを再利用可能な「Skill」コマンドとして記録できるようになり、Kimi Code Desktopと連携したシームレスな自動化ワークフローを構築できる (出典: 量子位)

GLiNER2.5-Decideがオープンソース化:エンティティ関係と論理制約をサポートする超高速意思決定モデル : Fastinoは、軽量な構造化意思決定モデル「GLiNER2.5-Decide」(340M)をオープンソース化した。高速なルーティングと分類に対応するだけでなく、文字レベルのスパンやエンティティ関係の抽出、排他性・濃度・順序の制約に対するリアルタイムな論理検証が可能。CPUでの推論遅延はわずか167ms、GPUでは38〜47msであり、従来のLLMによる長文生成に伴う意思決定コストを完全に代替する (出典: MarkTechPost, ClementDelangue)

GLiNER2.5-Decideがオープンソース化

LangSmith、オープンソース微調ツール「smithtune」と「Custom Apps」カスタマイズプラットフォームを公開 : LangChainはBasetenおよびFireworksと共同で、CLIツール「smithtune」を発表した。本番環境のLangSmithセッショントレースをワンクリックでSFTファインチューニング用データセットに変換し、モデルを自動デプロイできる。同時にリリースされたCustom Apps機能により、開発者はPromptを用いてAgentの実行ログからアノテーションキューやメトリクス比較ダッシュボードを直接生成できる (出典: LangChain, baseten)

LangSmithがCustom Appsとsmithtuneを公開

CoreWeave、AIコーディング環境を接続する「Mission Control」MCPサーバーを公開 : コンピュートクラウドプロバイダーのCoreWeaveは、MCPプロトコルベースの「Mission Control」サービスを発表した。CursorやClaude Codeなどのプログラミングツールが基盤となるGPUクラスタ、ネットワーク、ノードの稼働状態を直接読み取れるようになり、Agentがコードエディタ内から直接計算リソースのトラブルシューティングや最適化を行えるようになる (出典: AI Business)

Pruna-Qwen-Image-2.1がオープンソース化:5〜8ステップのLoRAで画像生成を最大6.3倍高速化 : Pruna AIは、Qwen-Image-2.1向けの超高速LoRAアダプターをオープンソース化した。独自に最適化されたsigmaスケジューリングとCFGフリー実行モードにより、画像生成と編集を40ステップから5〜8ステップへと短縮。1Kの画質と複数画像参照時の一貫性を維持しながら、最大6.3倍の高速化を実現する (出典: _akhaliq, huggingface)

flow-transform 1.0がリリース:業務ワークフローを保護する高忠実度エンタープライズPII匿名化モデル : micro1は、最先端大規模モデルのトレーニング向けに設計されたプライバシーマスキングモデル「flow-transform 1.0」を発表し、PrivacyBenchで96.0%のF1スコアを達成した。単純なマスキングによる覆い隠しではなく、合成IDへの置換を採用することで、企業のビジネスプロセスにおけるマルチターンの意思決定関係やツール呼び出しチェーンを完全に保持できるのが中核的な特徴である (出典: omarsar0)

flow-transform 1.0リリース

Whiteboard:人間とAIの協調によるソフトウェアアーキテクチャ設計のためのオープンソースIDE : CodeOSSをベースに構築されたオープンソースのデスクトップIDE「Whiteboard」が正式にリリースされた。Claude CodeなどのプログラミングAgent向けに描画SDKとセマンティックDiffビューアを提供し、視覚化されたシーケンス図、ER図、意思決定ログを通じて、完全自動コーディングによって引き起こされる「認知的負債」を軽減する (出典: Hacker News)

StarNet:ピクセルアートスタイルのデスクトップ向けローカルファースト・マルチAgentワークステーション : オープンソースのデスクトッププロジェクト「StarNet」は、AI Agentのランタイムをピクセル調の宇宙ステーションとして投影する。各部屋は権限範囲、通路はデータフローを表し、BYOKによる主要LLMへの接続に対応。マルチAgentの協調動作とタスク元帳をローカルで永続的に管理できる (出典: GitHub Trending)

Google Gemini、Adobe PhotoshopおよびLightroomプラグインと正式に統合 : ChatGPTおよびClaudeへの統合に続き、Adobe Creative SuiteのプラグインがGoogle Geminiにも正式導入された。ユーザーは「@Adobe」と入力することでプロ向けの画像補正やクリエイティブなレイアウトツールを直接呼び出すことができ、チャットアシスタントのグラフィック生産性を拡張できる (出典: The Verge)

📚 学習・研究

スタンフォード大学、秋学期の新コースCS329Z『Building AI Agents Engineering』を無料公開 : スタンフォード大学のNLPチームは、DSPyやSWE-benchの著者らと共同で体系的なコース「CS329Z」を開講した。シンプルなLLMパイプラインから複合AIシステム、自律エージェントに至るフルスタックのエンジニアリング設計を網羅し、Promptエンジニアリング、状態評価、サンドボックスセキュリティ、ツールオーケストレーションを重点的に解説。第1講の講義資料とコードがすべて一般公開されている (出典: stanfordnlp)

スタンフォード大学がCS329Zを開講

Google、マルチAgent長尺動画生成アーキテクチャ「AI Video Co-Director」を公開 : Googleの研究チームは、動画ナラティブ生成スイートを発表した。MABによるグローバル戦略最適化、CANVASによる明示的な視覚メモリ、VQQAによるプロンプトの閉ループフィードバックを組み合わせることで、マルチショットの長尺動画生成における被写体のドリフトや連鎖的エラーを効果的に解決し、数分間に及ぶ一貫性のあるストーリー出力を実現した (出典: Google Research Blog)

Perplexity、実環境のエラーに基づくヒント誘導型自己蒸留手法を公開 : Perplexityは、コンピュータ操作Agentの事後学習(ポストトレーニング)メカニズムを公開した。失敗した実行トレース内のエラーを構造化されたヒントに変換し、オンポリシー自己蒸留(OPSD)を利用して教師モデルが生徒モデルの軌道修正を指導することで、本番環境でのツール呼び出し失敗率を相対的に21.2%低減させた (出典: MarkTechPost)

北京交通大学や清華大学ら、証拠チェーン主導のマルチエージェント協調型動画真偽鑑定フレームワーク「ARGUS」を提案 : ディープフェイク動画検出におけるブラックボックス判定の汎化性能不足に対し、研究チームはシステム「ARGUS」を提案した。テクスチャ、ライティング、時系列モーション、物理的常識などを扱う独立した観察エージェントと判定エージェントを分離し、33種類の生成ソースを網羅したデータセット「FaceVid-Forensics-100K」を公開。ドメイン外でのF1スコアを53.28%まで向上させた (出典: 36氪)

ARGUS動画真偽鑑定フレームワーク

浙江大学ら、GUIエージェントの長期記憶とセッション間学習を評価する初のベンチマーク「MemGUI-Bench」を提案 : 浙江大学、南開大学、香港中文大学などの共同チームは、128件の長期実タスクを網羅する「MemGUI-Bench」および3段階プログレッシブ監査ツール「MemGUI-Eval」を発表した。実験により、現在の主要モデルは複数アプリ間およびセッション間の長期タスクにおいて最大58.9%の記憶ハルシネーションを起こしていることが明らかになり、従来のベンチマークでは測定できなかった記憶の死角が浮き彫りとなった (出典: 36氪)

MemGUI-Bench記憶評価ベンチマーク

Hugging Face、5,000以上の検証可能強化学習環境「SmolDataEnvs」をオープンソース化 : 10B以下の小型モデルにおいてデータサイエンスやコード領域のトレーニング環境が不足している課題に対し、オープンソースコミュニティが「SmolDataEnvs」を公開した。5,000以上の実際のデータサイエンスタスクに対応した検証可能な強化学習環境を含み、単一GPUでの非同期強化学習の実行をサポートする (出典: _lewtun, huggingface)

Microsoftらの研究チーム、コードエージェントの全量ログ分析を活用したPrompt最適化手法「CASD」を提案 : Microsoftの研究チームはCASD手法を提案し、コードAgentに全量トレースの統計データを直接計算させて最適化ルールを作成させる手法が、小バッチのトレース上で探索ループを実行するよりも16.6ポイント高いスコアを獲得し、1回あたりのPrompt最適化コストを1.60ドルにまで抑えられることを証明した (出典: dair_ai)

CASD Prompt最適化手法

IROS 2026候補論文「ULTRA」:ヒューマノイドロボットのターゲット駆動型全身協調制御 : UIUCの研究チームは、統一マルチモーダル制御フレームワーク「ULTRA」を提案した。物理駆動型のニューラルリターゲティングと強化学習ファインチューニングを通じて、Unitree G1ロボットが疎な目標指示や一人称視点の点群データのみから、自律的に連続把持と全身の並進運動を生成できるようにした (出典: 機器之心)

AdaRoboVLG:タスクを分離したクロスロボットハンド視覚言語把持フレームワーク : 華中科技大学や北京大学などのチームは、上位のセマンティック/時間的事前知識と下位の物理的把持生成を分離する「AdaRoboVLG」を提案した。統一インターフェースにより多指ハンドや平行グリッパーに対応し、動的なコンベアベルトや雑然とした環境においても高い堅牢性を維持する (出典: 機器之心)

AgentかWorkflowか?ビジネスシステムにおけるアーキテクチャ選定の実用評価ガイド : 固定プロセスのWorkflowと自律型Agentの境界線を詳細に分析した業界記事が公開。「実行前に完全な状態遷移図を描けるか」を主要な判断基準として提示し、高スループットやコンプライアンス重視のシーンではLLMによる判定を組み込んだWorkflowの優先採用を推奨している (出典: Machine Learning Mastery)

💼 ビジネス

Anthropic、Akamaiと116億ドルのクラウド計算資源長期契約を締結 : AnthropicはAkamaiと7年間・総額116億ドルに上るクラウドインフラ契約を締結し、Akamaiに対して最大5%の株式購入新株予約権を提供した。これにより、Anthropicの過去11か月間におけるコンピュートリソース調達コミットメントの規模は5,000億ドルを突破した (出典: THE DECODER)

TypeSafe、100億ドル超の企業評価額で10億ドルの新規資金調達を模索中と報道 : The Informationによると、意思決定モデル「Jev」が開発者コミュニティで爆発的な人気を博し、1日あたりの呼び出し量が1兆Tokenを突破したことを受け、TypeSafe AIはトップ投資機関と10億ドル規模の新たな資金調達ラウンドの交渉を進めている。調達後の企業評価額は100億ドルを超えると予想され、前回の評価額から飛躍的な急成長を遂げている (出典: steph_palazzolo)

Databricks、リアルタイムクラウドスプレッドシートプラットフォーム「Row Zero」の買収を発表 : DatabricksはRow Zeroの買収合意を発表した。Row Zeroは億単位の行のデータを扱える高性能なクラウドスプレッドシートを得意としており、今回の買収によってDatabricksの「Genie」インテリジェント分析エンジンと深く統合し、企業の財務やアナリスト向けにガバナンスとAIを備えたリアルタイムインタラクティブデータワークベンチを提供する狙いがある (出典: jefrankle, matei_zaharia)

🌟 コミュニティ

Claude Codeが4.8万個のコアファイルを誤削除した事例が報告され、コードセキュリティへの再考広がる : 開発者がClaude Codeを使用してイメージを再構築していた際、スクリプトの権限分離の不備により、4.8万個のプロジェクトファイルとGitインデックスが103秒以内に完全に消去されたとする事例がコミュニティで話題を集めている。サンドボックス化されていない実行環境や本番環境でAgentに直接権限を付与することに対するエンジニアリング上のリスク管理に、改めて警鐘が鳴らされている (出典: TechRadar)

Jevが学術界での研究ブームを巻き起こし、System 1アーキテクチャの大規模な議論へ発展 : Jevのリリースから1週間で、エッジスケジューリングやカスケード評価を巡る多数の論文がarXivに登場した。二項選択や多肢選択において超高速かつコストを数百分の1に削減できる一方で、長い推論チェーンにおいては選択肢の命名規則に影響を受けやすい点がコミュニティで議論されており、開発者が「System 1による超高速な粗選別 + System 2フロンティアモデルによるフォールバック」というハイブリッドなオーケストレーションパラダイムへと舵を切る契機となっている (出典: 36氪, Latent Space, dair_ai)

Jevの研究論文が急増

ホワイトハウス晩餐会にテック大手が集結:安全規制と加速推進論が激しく対立 : 米中両国の高官とJensen Huang氏、Elon Musk氏、Tim Cook氏らテック大手のトップが公式晩餐会に集い、AIの発展と安全性が中核の議題となった。業界では、フロンティア研究所が安全性への恐怖を利用して「規制の虜(Regulatory Capture)」を構築しているのではないかという激しい議論が巻き起こり、Mark Zuckerberg氏やJensen Huang氏らは業界協調による減速に明確に反対の立場を示し、具体的なユースケースに基づいて責任を追及すべきだと主張した (出典: Transformer, teortaxesTex, Reddit r/ArtificialInteligence)

ホワイトハウス晩餐会とテック大手

Claude Opus 5.5の優れた審美性が称賛される一方、「Max」モードが論理の自己整合ループに陥りやすいとの指摘も : コミュニティではClaude Opus 5.5のコード生成能力と審美的なデザイン設計が高く評価されている一方で、経験豊富な開発者からは、Max推論レベルを有効にするとマルチターンの内省過程で無限ループに陥りトークン枠を浪費しやすいとの指摘が出ている。通常タスクや軽量タスクにはMediumまたはHigh設定の使用が推奨されている (出典: Reddit r/ClaudeAI, theo, arena)

医学界、AIへの過度な依存による認知機能低下への警戒を呼びかけ : The Guardianのコラム記事は、生成AIが大学や職場に深く浸透する中、分析や執筆などの高度な認知的タスクをAIに過度にアウトソーシングすることで、人間の脳の結合性や独立した批判的思考力が損なわれつつあると指摘。AI利用が長期的な認知機能の健康に及ぼす影響を、公衆衛生および教育の視点から精査する必要性を訴えている (出典: The Guardian)

💡 その他

GPT-6 Astraが高難度ローグライクゲーム『NetHack』のクリアに成功 : 実験によると、GPT-6 Astraは3回目の挑戦において、屈指の難易度を誇る名作ローグライクゲーム『NetHack』で見事に昇天(Ascension)を達成した。巨大な状態空間、不完全情報、長期的な連続戦略探索に直面する状況において、LLMが重大なブレークスルーを果たしたことを示している (出典: Plinz, _rockt)

GPT-6 AstraがNetHackをクリア

大手テック企業のAIプロダクト統合が進む:Tencentが「QClaw」のサービス終了を正式発表 : Tencentは告知を出し、「QClaw」を2026年12月24日をもってサービス終了し、ユーザーを「WorkBuddy」へ移行させることを発表した。計算コストとROI評価の圧力の下、中国の大手テック企業は社内でのマルチトラックな並行開発競争を終わらせ、分散していたAgentの取り組みを統合生産性プラットフォームへと集約する動きを加速させている (出典: 36氪)

Tencent QClawがサービス終了へ

英国最大のAIスーパーコンピュータセンター、送電網接続の遅れにより2030年代へ延期される可能性 : 英国エセックス州で2027年の稼働が予定されていた90MW規模の国家AIスーパーコンピュータセンターが、地域送電網の拡張遅延というボトルネックに直面している。現地の電力会社は電力需要を満たせるのが2030年代半ばになると見込んでおり、コンピュートインフラの急速な拡張と従来の電力供給体制との間にある構造的不均衡が浮き彫りとなっている (出典: The Guardian)

コメントを残す

メールアドレスが公開されることはありません。 ※ が付いている欄は必須項目です