AI日報 – 2025-05-16(朝刊)
DeepMind、AlphaEvolveを発表:Gemini駆動の進化的コーディングエージェント、アルゴリズム発見を推進 : AlphaEvolveは、Geminiモデルの創造性と自動評価器を結びつけ、進化的フレームワークを利用してアルゴリズムを最適化します。これはすでに複数の分野でブレークスルーを達成しており、例えば48回のスカラー乗算で4x4の複素行列乗算を完了し、Strassenアルゴリズム
AI日報 – 2025-05-15(夕刊)
Google DeepMind、AIプログラミングエージェントAlphaEvolveを発表、アルゴリズムの自己進化と最適化を実現: Google DeepMindは、AIプログラミングエージェントAlphaEvolveを発表しました。このエージェントは、大規模言語モデルGeminiの創造性と自動評価器を組み合わせることで、アルゴリズムを自律的に発見、最適化、反復します。AlphaEvolveはGo
AI日報 – 2025-05-15(朝刊)
Google DeepMind、AlphaEvolveを発表:Gemini駆動のコーディングエージェント、アルゴリズム発見に革命: Google DeepMindは、Gemini駆動のAIコーディングエージェントであるAlphaEvolveを発表しました。これは、大規模言語モデルの創造性と自動評価器を組み合わせることで、複雑なアルゴリズムを発見・最適化することを目的としています。AlphaEvol
AI日報 – 2025-05-14(朝刊)
OpenAI HealthBenchベンチマーク発表、AI医療能力が著しく向上: OpenAIは、世界の医師262名と協力して構築した医療AI評価ベンチマークであるHealthBenchを発表しました。テストによると、最新のAIモデル(o3、GPT-4.1など)は、医療対話シナリオにおいて、AIが医師を支援した場合の最高レベルに匹敵するパフォーマンスを示し、独立した医師のパフォーマンスをはるかに上
AI日報 – 2025-05-13(夕刊)
OpenAIチーフサイエンティストJakub Pachocki氏インタビュー:AIは5年以内に自律的な科学的発見が可能になる可能性、World ModelとReinforcement Learningが鍵: OpenAIのチーフサイエンティストであるJakub Pachocki氏は、『Nature』誌のインタビューで、AIは5年以内に自律的な科学的発見を実現し、経済に大きな影響を与える可能性がある
AI日報 – 2025-05-13(朝刊)
OpenAIがHealthBenchを発表、医療AIの性能を評価: OpenAIは、医療シナリオにおける大規模言語モデル(LLM)の性能と安全性を測定することを目的とした新しいベンチマーク、HealthBenchを発表しました。このベンチマークは、世界中の250人以上の医師の参加を得て開発され、5000件の実際の医療対話と48562件の医師が作成した独自の評価基準を含み、救急医療、グローバルヘルス
AI日報 – 2025-05-12(夕刊)
Prime Intellect、INTELLECT-2モデルをオープンソース化: Prime Intellectは、320億パラメータを持つモデルINTELLECT-2を発表し、オープンソース化した。これは世界初の分散型強化学習によって訓練されたモデルであるとされている。今回のリリースには、詳細な技術レポートとモデルのチェックポイントが含まれる。このモデルは、複数のベンチマークにおいてQwen 3
AI日報 – 2025-05-12(朝刊)
NVIDIA、汎用人間動作モデルGENMOを発表: NVIDIAは、GENMO (GENeralist Model for Human MOtion) と名付けられたAIモデルを発表しました。これは、テキスト、ビデオ、音楽、さらにはキーフレームのシルエットなど、さまざまな入力をリアルな3D人間の動きに変換できます。このモデルは、ビデオから動きを学習し、テキストプロンプトに基づいて修正したり、音楽の
AI日報 – 2025-05-11(夕刊)
AIの安全リスクへの関心高まる、専門家は核セキュリティの経験を参考にリスク評価を提言: 人工知能の潜在的リスクに対する国際社会の懸念が日増しに高まっており、一部の専門家(Max Tegmark氏など)は、AI企業が危険なAIシステムをリリースする前に、ロバート・オッペンハイマーが最初の核実験の際に行った安全計算手法に倣い、人工知能が制御不能になる確率(コンプトン定数)を厳格に評価すべきだと呼びかけ