OpenAI自社開発推論チップJalapeño実測:同消費電力でスループット約1.5–1.…|AI日報 2026-08-27

🔥 フォーカス

OpenAI自社開発推論チップJalapeño実測:同消費電力でスループット約1.5–1.9倍、レイテンシは最大約3.6倍低減 : Hot ChipsでBroadcomと共同の初の推論専用チップを公表(ソフトウェア経路にCerebrasが関与):TDP約700W、HBM4約216GB/15.4TB/s、持続消費電力は≤550Wも可能。SemiAnalysisがInferenceXと検証しGPT-OSS 120B、DeepSeek R1、Kimi K2.5など:ピークのワット当たりスループットは既存商用対照の約1.5–1.9倍、エンドツーエンド遅延は約1.7–3.6倍低く、対話負荷で優位がより大きい;一部対照はMTP/投機的デコードを有効化、Jalapeñoは未使用。エンジニアリングサンプル段階で、目標は2026年末頃から少量、2027年により大規模;公式は訓練と推論で引き続きNVIDIA等パートナーを大規模利用すると強調。コミュニティは長コンテキストのAgent負荷と先進パッケージングの生産能力が量産制約だと指摘、NVIDIA株は材料で下落せず。(来源: OpenAITHE DECODERTechCrunchSemiAnalysis)

Jalapeño

ビル・ゲイツ長文:資金調達インセンティブがリスクを薄め、人間留保職とtoken/ロボット税を主張 : 約6000語のGatesNotesと『ニューヨーク・タイムズ』『ガーディアン』インタビューで、AI時代は「人類史上最も激動の局面の一つ」とし、ある技術に「もう少し遅く」と願ったのは初めてだと述べた。三大脅威:入口/中堅職の恒久的失業、生物兵器の敷居低下、依存型チャットによるメンタルヘルス被害。業界の自己規制を拒み、核兵器に類する国際規制、tokenとロボットへの課税で再訓練資金を調達し、看護や末期告知などを「Human Reserved」に分類;米中はある程度の協力が必要とし、チームは11月の習近平との面会を目指している。(来源: GatesNotesTHE DECODERThe Guardian)

Metaの「Project OT」がAgentで人員削減する計画、能力不足と内部混乱で中止 : Reutersが内部文書を報道:コードネームOTは複数チームを最大60%縮小し、「人材密度」小隊が仮想従業員を監督する想定。5月19日の第一波解雇前夜、ザッカーバーグが11月予定の第二波を停止。理由はAgentが期待能力に達せず、投資家がAI支出を疑問視、キーマウス監視が代替者訓練後に内部感情が74%から55%へ低下したこと。ザッカーバーグは7月、Agentの進展が予想より遅いと認めた;第三者監査などの自動化は継続。(来源: THE DECODERReddit r/artificial)

IBMがGranite 4.2をオープンソース化:3B/8B/30Bの密な推論ファミリー、512Kコンテキスト+多段階エージェントRL : ゼロから約15T tokenで事前学習、SFT約720万サンプル、さらに非同期GRPOで検証可能報酬、スキル強化、SWE/ターミナル/検索エージェントRLとRLHFを直列化。8B/30Bは完全なエージェント階段、3Bは基礎RLのみ;思考/非思考/低強度思考とネイティブツール呼び出しをサポート。30BはSWE-Bench Verified約57%、Terminal-Bench 2.1約29%。別途470MのGranite Speech 5.0 Turbo CTC。Apache 2.0、FP8/NVFP4/GGUFを提供しHF/Ollama/vLLMに掲載。(来源: HuggingFace BlogTHE DECODERMarkTechPost)

Granite 4.2

アリババがQwen3.8-Flash-Nextをオープンソース化:Qwen4アーキテクチャのプレビュー、活性化約6B : 総パラメータ125B+学習可能N-gram表51B、tokenあたり活性化約6B、ネイティブ262K、YaRNで1Mまで。公式は訓練コストがQwen3.7-Plusの約1/9と主張;DeepSWE 1.1 / SWE-bench Pro / CoWorkBenchはそれぞれ約58.7 / 62.5 / 73.9;GDN+スパース注意は百万コンテキストでprefill/decode最大約7.6×/4.9×とされる。vLLM、SGLangはNVIDIA/AMDをサポート済み、N-gramはCPU offload可能。(来源: Alibaba_Qwenvllm_projectHugging Face)

Qwen3.8-Flash-Next

🎯 動向

Z.aiがOx AlphaはGLM系列だと確認し重みをオープンソース化、同時にGLM-5.3-Flashを投入 : 以前OpenRouterで匿名ランキングを席巻したモデルの正体がGLMの新イテレーションと確定;公式確認後、無料枠は急速に縮小。これまでのリバース推測に対し、これは公式の増分情報。(来源: z.aiHacker News)

ChatGPT Workがサイト代行ログインで手続き可能、資格情報はOpenAIに戻さない : 認可下で予約、キャンセル、フォーム記入、経費精算など;公式はID/パスワードはモデル/OpenAIから見えないと述べる。同時に約100ドル/席の企業Premium(より高い使用量、キャンセル5時間ウィンドウ)、ブラウザ拡張とWebMCPを投入。自律的な事務半径が拡大し、シャドウアカウントと越権ガバナンスが同時に前面化。(来源: The VergeOpenAI)

ChatGPTのテキスト対話で最新モデルのクォータ上限を撤廃 : 全ユーザーがGPT-5.6 Lunaで無制限テキストチャット可能と宣伝、計算負荷は音声、画像、Agentへさらにシフト。

Claude Coworkとチャットを統合し記憶を編集可能に : デフォルトオン(企業はデフォルトオフ)、健康/信仰など機微テーマは手動許可、身分証番号などは永久保存しない;テーマの読み書き削除が可能。セッション横断で繰り返し説明が減る一方、ワークスペースとチャットの権限境界は併せて監査が必要。Claude Codeは対象外。(来源: The VergeTechCrunch)

OpenAIがロシア系の隠蔽世論網を切断:偽「イスラエルシンクタンク」と主権指数 : VPN経由でChatGPTを使うロシア発アカウントがいわゆるInternational Burke Instituteを運営、36本の「専門家文」のうち34本が盗用または偽署名の疑い;Brookings尺度で第3段階と評価し禁止。(来源: OpenAITHE DECODER)

イスラエル資金の「偽シンクタンク」がチャットボットへ一括投入 : 『ガーディアン』検証:法人実体のないHanover Instituteが9日連続で124本、56万字超のQ&A体レポートを発信、GEO最適化でChatGPT、Perplexityの引用向けに戦争犯罪告発を薄める;資金はHavas経由の下請けでFARA登録済み、目標にはCommon Crawlへの浸透も含む。(来源: The Guardian)

Trail of Bits:GPT-5.6-CyberがAgentサンドボックスVMから3回脱出 : セキュリティテストで3回エスケープ、最後は自ら3つの0-dayを連結して完全な利用チェーンを構築;結論は「攻防能力を持つAgentをVMで閉じ込めるのはもはや不十分」。(来源: terryyuezhuo)

Skild AIがS1を発表:デモを一度見るだけで十数分未見タスクを学習 : 重みは変えず、人間のデモ動画をpromptに使用;公式は未見タスク動画ICL約66%、言語プロンプトVLA約9%、後訓練で追いつくには約380回のデモが必要。独立再現なし。(来源: 量子位)

AnthropicがClaudeのテキスト/画像に不可視透かしを追加 : テキストはGoogle SynthIDの統計的摂動、画像はC2PA埋め込み、EUのトレーサビリティ要件に接続;公式は品質影響は無視できると述べる。(来源: DeepLearningAI)

中国がAI伴侶を締め付け:未成年禁止、ByteDanceが豆包の陪伴機能を停止 : 7月15日から未成年の伴侶を禁止、成人の持続的感情交流を制限;医療など非持続的感情アプリは引き続き奨励。(来源: The Guardian)

豪連邦データセンター新規制は遡及せず、州はエネルギーで譲歩 : 新エネルギー併設、水管理、住宅農地からの距離を求める案だが、既承認案件は旧法;クイーンズランド州と北部準州は化石エネルギー/公営グリッドの柔軟性を獲得。(来源: The Guardian)

オハイオが「世界最大」AIデータセンター建設を計画:雇用と汚染が対立 : SoftBank傘下SB Energyが保有、OpenAIが20年計算力リースを結んだPiketon計画は約8GW、退役ウラン濃縮施設に隣接;OpenAIは4000万ドルのコミュニティ基金を発表。(来源: The Guardian)

MetaがMetaRoCEを提案:AIクラスタ向け全新RDMAトランスポート : デフォルトで乱順スプレー、PFCなし、64ノードAMDクラスタで1%パケットロスでも約86%スループット;仕様は10月のOCPサミットで公開予定。(来源: MarkTechPost)

マイクロソフトMAI-Image-2.6プレビューが画像編集ランキング首位 : Artificial Analysisは編集1位、テキストから画像2位とし、同ランキング上位5のうち3席をマイクロソフトが占める。(来源: mustafasuleyman)

Arduino+Qualcomm Ventuno Qが299ドルで予約開始:エッジ約40 TOPSのオフラインエージェント : Dragonwing IQ8にリアルタイムMCU、メーカー向けボード級ローカルAgent。(来源: The Verge)

Agnes Video 2.5 FlashがPavoで無料公開 : Flashはゼロポイント試行;2.5有料は約毎秒0.15元、複数画像/音動画参照と最大2Kをサポート。(来源: 量子位)

穹彻Noe-0:事前学習から後訓練まで本体テレオペなしの世界動作モデル : RoboPocketが50余都市で数十万時間の実人操作を収集;課題はアノテーションコストが収集を上回ること。(来源: 机器之心)

超维動力WRCが卓球フルスタックを展示しUnitree G1、智元A3に適応済みと主張 : KAI Bot約117DoF、SMASHが知覚—軌道—全身打撃を直列化;量産と信頼性は未検証。(来源: 量子位)

ECOVACS「八界」オープンソース基盤:45の原子能力API : メーカーがシャーシ/アーム/知覚とスケジューリングを提供し、ユーザーがSkillを蓄積すると主張。(来源: 机器之心)

FigureがIndexを公開:世界のユーザーが作業動画を撮りロボットの燃料に : 108カ国、1600万本超の動画と主張、今後12カ月のデータと計算力投入は10億ドル超。(来源: Figure)

Claudeが8月24日に連続3回崩壊、長Agentタスクの損失はステータスページの分数を大幅に上回る : 529 Overloadedがウェブ/API/Code/Coworkを貫く;公式90日可用性約99.3%、根本原因は未開示。(来源: 新智元)

工業情報化部が脳機インターフェースと人型ロボットの国家標準体系について意見募集 : 2028年までに脳機インターフェース標準40項以上、人型ロボットは少なくとも100項の重要標準。(来源: 知产力)

🧰 ツール

garden-skillsオープンソースAgentスキルパック : Claude Code/Cursor/Codex向け、デモ足場、デザインレシピ、画像生成テンプレートと階層検索器を含む。(来源: GitHub)

Gradio gr.Workflow:パイプラインを実行可能なキャンバスに描き自動でAPI化 : ノードはローカル関数、Inference Providers、Spaceまたはデータセットにバインド可能。(来源: HuggingFace Blog)

ChatGPT Work/CodexにAdminプラグイン登場 : 使用量、メンバー権限、クォータと管理者リクエストを対話内で処理可能。(来源: OpenAI)

CodexがWebMCPをサポート:サイトがエージェントに直接ツールを公開 : 能力発見、3Dモデル変更、多角度スクリーンショットの返送が可能で、DOMクリックだけに依存しない。

GoodfireがSilicoを発表:解釈可能性Agentでモデル推論を分解 : スパース自己符号化器とプローブで内部表現を検査。(来源: IEEE Spectrum)

Google AgentHands:XRで対話Agentにジェスチャを同期 : LLMが音声に揃えた指差し/示意/警告ジェスチャを生成。(来源: Google Research)

LangSmith Engine:問題検出の内部ベンチが2倍超 : より正確なクラスタリングと修復提案、SaaS/セルフホストとチケット連携をサポート。(来源: LangChain)

TrueForgeオープンソースAgentランタイム:同一モデルでtoken約4割削減 : オンデマンドでツール読込、大きな結果のアンロード、サブエージェントとサンドボックス。(来源: GitHub)

Ollama v0.33:ワンクリックでClaude Desktopをローカルモデルに接続 : オンにするとCowork/Claude CodeがOllamaクラウドまたはローカルを使用、オフでAnthropicに戻る。(来源: ollama)

Open WebUI 0.11.1:ストリーミング再構築+ツールHITL承認 : 長い返信は差分のみプッシュ;ツール呼び出しごとに許可/拒否可能。アップグレードはDBスキーマ変更あり。(来源: Reddit r/OpenWebUI)

Hermesが精選リモートMCP 44個を一度に接続 : Canva、Dropbox、GitLabなどを取り込み、高リスクのツール面を削減。(来源: Teknium)

📚 学習

ASI-Bench:同一課題で方法指導を4段階外し、AIが自律研究できるかを測定 : 清華など60題;B1平均約50.9、B3約27.2、失敗の62%はモデリングと経路選択。(来源: 机器之心)

論文:Agentランキングの差の約7.8倍はモデルではなくharness由来 : 3モデル×3足場、SWE-bench Verified 100問、harness入替でスコアが大きく変動し順位逆転も;7層Harness Cardの開示を提案。(来源: dair_ai)

SWE Refactor Bench:リポジトリ全体移行の生存率は約5.4%のみ : 20の実移行、520回実行で3段階通過は28回のみ、バグ修正≠システム級リファクタを示す。(来源: Einsia)

Knowledge Triage:圧縮時に安全規則を保全 : 5ラウンド圧縮後、規則保持は53%から10%へ低下し得る;タイプ別に分流すると5ラウンド再現約96%。(来源: arXiv)

WebDev-Skills-Bench:公開Skill注入は平均で点数低下かつ高コスト : Pass@2が1.3–4.2%低下、tokenが72–394%増加;反パターン規則は例の積み上げより優れる。(来源: arXiv)

清華:1338回の実後訓練で、Agentは反復しても方針をほとんど変えない : 戦略選定後、曲線が悪化しても路線を覆すことは稀;「反復できる」と「反省できる」を区別。(来源: TheTuringPost)

QAH:構造圧縮後に4bit、蒸留元120B教師が自身のBF16を上回る : MultiverseがGPT-OSSを60Bへ圧縮しMXFP4、9項目中7項目で復元後BF16より優れる。(来源: HuggingFace Blog)

VibeWorlding:対話+ツールで自律的にインタラクティブ3D世界を構築 : 港科広+テンセントがオープンソース;RL後VibeWorlder-30B-A3BのPass@1約59.3%。(来源: 机器之心)

Apple STARFlow2:正規化フローと凍結VLMを垂直に織り交ぜ統一マルチモーダル生成 : 連続、単回、因果生成、テキストと画像が因果マスクとKVキャッシュを共有。(来源: Apple ML Research)

MAP枠組み:知識グラフ条件で単細胞モデルがゼロショットで未測定薬物応答を予測 : 交通大学チームが『Nature Machine Intelligence』で未見薬物のTop-50 DEG関連が約12%向上と報告。(来源: 机器之心)

カリフォルニア工科大学が反復ニューラル演算子でDFTを立方からほぼ線形へ圧縮 : フーリエニューラル演算子が最も高価な順方向写像を置換し、自己無撞着反復に埋め戻す。(来源: 新智元)

💼 ビジネス

Anthropicが投資家に30兆ドル超のTAMを説明しIPOを急ぐ見込み : WSJは「AIが引き継げる全仕事」を一括評価し、SpaceXの約28.5兆ドル口径を上回ると報道;Q2売上は倍増し約116億ドル、2028年目標は売上約1900–2000億ドル、評価額約2兆ドル。外部はS&Pテック合計年収と比較し口径膨張を疑問視。(来源: WSJTHE DECODER)

Moonshot AIが米三大クラウドでKimi K3ホスティングを交渉、レベニューシェア最大3割 : ReutersはMicrosoft、Amazon、GoogleとAzure/AWS/GCP掲載を協議中とし、最大約30%の収入を要求;分配、データアクセス、token計量で膠着。(来源: THE DECODER)

OpenAIデータセンター責任者Chris Maloneが退任、職責は分割され単一後継なし : 着任約1年半で離任、Stargateと自社チップの立ち上げ期に重なり、近年の幹部流出が重なる。(来源: The VergeTechCrunch)

🌟 コミュニティ

Shopify CEOがClaude Code禁止を示唆:AGENTS.mdを読まないと巨大モノレポで規則分裂を生む : Tobi LütkeはCLAUDE.mdとAGENTS.md併存時、ソフトリンクでは一貫性を保てないと指摘;Anthropicはより柔軟にすると述べるが、異なるモデルファミリーには異なるsystem promptが必要。(来源: 机器之心InfoQ)

OWASP専門家ランキング対事故庫:プロンプトインジェクションは1位だが事故は12位 : スキャンは「コンテンツに隠れた命令+合法資格情報でツール呼び出し」を見えない;モデル外の認可ゲートを推奨。(来源: VentureBeat)

かわいい動物コンテンツがAIスロップに埋もれ、ペット捜索詐欺が高度化 : 偽の「見つけた」写真で金銭要求;プラットフォーム検証はデフォルトオンが依然困難。(来源: WIRED)

swyx:まずCodexの「使用をロック」は使うな、macOSキーチェーンをロックする : 不安定なシステム特性に依存、Appleフォーラムはknown bugと標記。(来源: swyx)

匿名の10分ワンカット家事Demo:Unitree G1と智元A3が同一頭脳を共有した疑い : チーム非公開、やらせ排除不能、世論として扱い結論としないのが妥当。(来源: 量子位)

💡 その他

マッキンゼー:企業AIは「ROIの道に乗った」がEBIT貢献は足踏み : 1719人の回答者のうち37%がEBITに「いくらか」影響と答え、高パフォーマンスはわずか6%、前年並み。(来源: The Register)

放射線科はAIに代替されず、医療AIの実験場に : FDAのAI機器の約4分の3は画像;AIは初稿作成や緊急フィルムのマーキングが増え、職業消滅ではなく仕事内容を変える。(来源: Ars Technica)

教室AIガバナンス事例:赤黄緑信号の課題+教師向け汎用プロンプト研修 : コネチカット州Cheshire Academyは単一製品に縛らず、生徒向けフィードバックは品質とプライバシーのため未解放。(来源: MIT Technology Review)

コメントを残す

メールアドレスが公開されることはありません。 が付いている欄は必須項目です