AI日報 – 2025-05-02(朝)
Karpathy氏の未来のLLMインタラクションインターフェース構想: Karpathy氏は、将来のLLMとのインタラクションは現在のテキストターミナルモードを超え、視覚的、生成的、インタラクティブな2Dキャンバスインターフェースに進化すると予測しています。このインターフェースはユーザーの要求に応じて即座に生成され、画像、グラフ、アニメーションなどの多様な要素を統合し、より情報密度が高く直感的な体
AI日報 – 2025-05-01(夕方)
Microsoft、Phi-4シリーズの小型推論モデルを発表: MicrosoftはPhi-4シリーズモデルを発表しました。これには14BパラメータのPhi-4-reasoningとPhi-4-reasoning-plus(後者は少量のRLを追加)が含まれます。これらのモデルは、推論および一般的なベンチマークテストで優れたパフォーマンスを示し、小型ながら強力な性能を備えています。Phi-4-rea
AI日報 – 2025-05-01(朝)
DeepSeek、数学推論大規模モデルDeepSeek-Prover-V2を発表:DeepSeekは、形式的な数学的証明と複雑な論理推論のために設計されたDeepSeek-Prover-V2シリーズモデル(671Bおよび7Bバージョンを含む)を発表しました。このモデルはDeepSeek V3 MoEアーキテクチャに基づいており、数学推論、コード生成、法律文書処理などの分野でファインチューニングされ
AI日報 – 2025-04-30(夕方)
Meta AI 独立アプリがリリース、ソーシャルエコシステムを統合し ChatGPT に対抗: Meta は LlamaCon カンファレンスで、独立 AI アプリ Meta AI を発表しました。これは Llama 4 モデルをベースとし、Facebook、Instagram などのソーシャルプラットフォームデータを深く統合し、高度にパーソナライズされたインタラクション体験を提供します。このアプ
AI日報 – 2025-04-30(朝)
Alibaba、Qwen3シリーズモデルを発表、オープンソースモデルランキングで首位に: Alibabaは、Qwen3シリーズの大規模言語モデルを発表し、オープンソース化しました。これには0.6Bから235Bパラメータまでの8つのモデル(6つの密モデル、2つのMoEモデル)が含まれ、Apache 2.0ライセンスを採用しています。フラッグシップモデルのQwen3-235B-A22Bは、コード、数学
AI日報 – 2025-04-29(夕方)
Qwen3シリーズモデルが発表されオープンソース化: アリババは新世代の通義千問モデルQwen3シリーズを発表し、オープンソース化しました。これには0.6Bから235Bパラメータまでの8つのモデル(MoEモデル2つ、Denseモデル6つ)が含まれます。フラッグシップモデルQwen3-235B-A22Bは性能でDeepSeek-R1およびOpenAI o1を上回り、グローバルオープンソースモデルのト
AI日報 – 2025-04-29(朝)
アリババ、Qwen3シリーズモデルを発表、0.6Bから235Bパラメータまでをカバー: Alibaba CloudはQwen3シリーズを正式にオープンソース化しました。これにはQwen3-0.6BからQwen3-32Bまでの6つの稠密モデルと、Qwen3-30B-A3B(3Bアクティベーション)、Qwen3-235B-A22B(22Bアクティベーション)の2つのMoEモデルが含まれます。Qwen3
AI日報 – 2025-04-28(夕方)
OpenAI GPT-4.5コア開発者Kai Chen氏のグリーンカード却下、米国のAI人材危機への懸念を呼ぶ: カナダ国籍のAI研究者Kai Chen氏は、米国に12年間居住した後、グリーンカード申請が却下され、強制退去の危機に直面している。Chen氏はOpenAI GPT-4.5のコア開発者の一人であり、彼の境遇は、米国の移民政策が同国のAIにおけるリードを損なうことへのテクノロジー界の広範な
AI日報 – 2025-04-28(朝)
DeepSeek R1、世界的な注目と議論を呼ぶ: DeepSeek R1モデルが発表後、広範な注目を集めている。同モデルはその「思考プロセス」を示し、コスト効率が高く、オープン戦略を採用している。OpenAIなどの西側研究所は後発者の追随は困難であり、チップ制限にも直面していると考えていたが、DeepSeekは一連の技術革新(MoEルーティング最適化、GRPOトレーニング手法、Multi-Hea