AI日報 – 2025-06-04(朝刊)
「インターネットの女王」がAIトレンドレポートを発表、AI応用の空前の加速とコスト構造の変革を明らかに: 「インターネットの女王」メアリー・ミーカー氏が340ページに及ぶ「AIトレンドレポート」を発表し、AIがかつてないスピードで採用されていることを強調した。レポートによると、ChatGPTのユーザー成長は著しく、17ヶ月で月間アクティブユーザー (MAU) は8億人に達し、年間収益は約40億ドル
AI日報 – 2025-06-03(夕刊)
Karpathy氏、ChatGPTモデルの利用ガイドと記憶システムを解明: OpenAIの創設メンバーであるAndrej Karpathy氏は、ChatGPTの各バージョンの利用戦略を共有:o3は重要/困難なタスクに適しており、その推論能力は4oをはるかに上回るため。4oは日常の簡単な問題に、GPT-4.1はプログラミング支援に推奨される。同氏はまた、Deep Research機能(o3ベース)が
AI日報 – 2025-06-03(朝刊)
DeepMind AlphaEvolve が数学記録を更新、人間と機械の協調が科学の進歩を推進: DeepMind の AlphaEvolve は1週間で2度、18年間破られなかった数学の記録を更新し、大きな注目を集めています。テレンス・タオ氏は、これは単純な「勝者」と「敗者」ではなく、異なるアプローチがいかに相互補完的に数学の進歩を推進するかを示しているとコメントしました。この出来事は、AIと人
AI日報 – 2025-06-02(朝刊)
スタンフォード大学、AIが人間エキスパートを超えるCUDAカーネルを生成可能であることを偶然発見: スタンフォード大学の研究チームは、カーネル生成モデルを訓練するための合成データ生成を試みていた際、AI(o3、Gemini 2.5 Pro)が生成したCUDAカーネルが、人間エキスパートによって最適化されたバージョンを性能で上回ることを偶然発見しました。これらのAI生成カーネルは、行列乗算、2次元畳
AI日報 – 2025-06-01(夕刊)
xAI、Grokシステムプロンプトを公開し、審査メカニズムを強化: xAI社は最近、Grok応答ロボットがXプラットフォーム上で不正にプロンプトを変更され、同社の方針や価値観に反する政治的発言を行ったため、GrokシステムプロンプトをGitHub上で公開することを発表しました。この措置は、真実を追求するAIとしてのGrokの透明性と信頼性を高めることを目的としています。xAIは同時に、内部コード審
AI日報 – 2025-06-01(朝刊)
スタンフォード大学、AIが人間エキスパートを超えるCUDAカーネルを生成可能であることを偶然発見: スタンフォード大学の研究チームが、カーネル生成モデル用の合成データを作成しようとした際、AI(OpenAI o3およびGemini 2.5 Pro)が、人間エキスパートが手動で最適化した性能よりも優れたCUDAカーネルを生成できることを偶然発見しました。これらのAIが生成したカーネルは、行列乗算、2
AI日報 – 2025-05-31(夕刊)
NVIDIAの米中市場における「綱渡り」的苦境と戦略: The Informationの詳細な報道により、NVIDIAが米中という2大市場間で困難な状況に置かれていることが明らかになった。黄仁勋氏は自ら米政界に働きかけ、輸出禁止措置による圧力の緩和を試みている。中国市場はNVIDIAの収益の14%を占め、H20チップの禁輸により数十億ドルの損失が生じている。黄仁勋氏はバイデン政権の規制を公然と批判
AI日報 – 2025-05-31(朝刊)
DeepSeekがR1-0528新モデルを発表、性能の大幅向上で注目を集める: DeepSeekは、その大規模言語モデルの新バージョンR1-0528をリリースし、複数のベンチマークで優れたパフォーマンスを示し、特にコード生成(LiveCodeBench)、科学的推論(GPQA Diamond)、数学コンテスト(AIME 2024)などの分野で著しい進歩を遂げました。Artificial Analy
AI日報 – 2025-05-30(夕刊)
DeepSeek、R1-0528モデルをリリース、性能はGPT-4oおよびGemini 2.5 Proに迫り、オープンソースランキングで首位に: DeepSeek-R1-0528は、数学、プログラミング、汎用論理推論など複数のベンチマークテストで優れた性能を発揮し、特にAIME 2025テストでは正解率が70%から87.5%に向上しました。新バージョンでは、ハルシネーション率が大幅に低減(約45~