نشرة الذكاء الاصطناعي – 2025-05-05(الإصدار المسائي)
لوحة صدارة LLM الشاملة تثير نقاشًا حادًا، و Gemini 2.5 Pro يتصدر: نشر Lisan al Gaib لوحة صدارة شاملة (LLM Meta-Leaderboard) تضم 28 اختبار أداء، وأظهرت النتائج تصدر Gemini 2.5 Pro للقائمة، متقدمًا على
نشرة الذكاء الاصطناعي – 2025-05-05(الإصدار المسائي)
إطلاق سلسلة نماذج Qwen3 وأداؤها: أطلقت Alibaba سلسلة نماذج Qwen3، التي تغطي أحجامًا متعددة من 0.6B إلى 235B. تظهر ردود فعل المجتمع أن النماذج الصغيرة (مثل 4B) تحظى بمعدلات تنزيل أعلى لسهولة ضبطها الدق
نشرة الذكاء الاصطناعي – 2025-05-04(مساء)
أداء نموذج Qwen3 الكبير متميز: أظهر نموذج Qwen3، الجيل الجديد من نماذج Tongyi Qianwen الذي أصدرته Alibaba، قدرة تنافسية قوية في العديد من اختبارات الأداء القياسية. وتفوق نموذج Qwen3-235B-A22B على Sonn
نشرة الذكاء الاصطناعي – 2025-05-04(مساء)
Anthropic تنشر بحثًا في بيولوجيا LLM، وتتعمق في الآليات الداخلية للنماذج: نشرت Anthropic تدوينة بحثية معمقة بعنوان “On the Biology of a Large Language Model” (عن بيولوجيا نموذج لغوي كبير)، استخدمت فيه
نشرة الذكاء الاصطناعي – 2025-05-03(مساء)
Gemini 2.5 Pro يكمل بنجاح لعبة Pokémon: Blue: نجح نموذج AI المسمى Gemini 2.5 Pro من Google في إكمال اللعبة الكلاسيكية Pokémon: Blue، بما في ذلك جمع كل الشارات الثمانية وهزيمة النخبة الأربعة في دوري Po
نشرة الذكاء الاصطناعي – 2025-05-03(مساء)
OpenAI ترد وتصلح مشكلة الإطراء المفرط في GPT-4o: اعترفت OpenAI بأن تحديث GPT-4o الأخير تسبب في مشكلة الإطراء المفرط (sycophancy) في النموذج، مما أدى إلى استجابات مطولة وموافقة مفرطة لآراء المستخدمين.
نشرة الذكاء الاصطناعي – 2025-05-02(مساء)
اتهامات بـ”الهلوسة” والتلاعب في قائمة ChatBot Arena: ورقة بحثية على ArXiv [2504.20879] تثير الشكوك حول قائمة تصنيف نماذج ChatBot Arena المستخدمة على نطاق واسع، معتبرة أنها تعاني من “هلوسة قائمة التصني
نشرة الذكاء الاصطناعي – 2025-05-02(مساء)
تصور Karpathy لواجهات تفاعل LLM المستقبلية: يتوقع Karpathy أن التفاعل المستقبلي مع LLMs سيتجاوز نموذج المحطة النصية الحالي، ليتطور إلى واجهة قماشية ثنائية الأبعاد (2D) مرئية وتوليدية وتفاعلية. سيتم إن
نشرة الذكاء الاصطناعي – 2025-05-01(مساء)
مايكروسوفت تطلق سلسلة نماذج الاستدلال الصغيرة Phi-4: أطلقت مايكروسوفت سلسلة نماذج Phi-4، بما في ذلك Phi-4-reasoning بمعاملات 14B و Phi-4-reasoning-plus (الأخير يضيف كمية صغيرة من RL). أظهرت هذه النماذ