🔥 في بؤرة الضوء
Anthropic تطلق معيار عتاد النماذج MHS لفتح آفاق التفاعل مع الذكاء الاصطناعي الفيزيائي : أطلقت Anthropic رسميًا النسخة التجريبية البحثية من “معيار عتاد النماذج” (Model Hardware Standard، MHS)، وهو مواصفة تشغيل مفتوحة موجهة للأجهزة الفيزيائية. يُنظر إلى هذا المعيار على أنه بمثابة “MCP للعالم الفيزيائي”، حيث يوفر ملفات وصف موحدة للأجهزة وواجهات تشغيل قياسية، مما يُمكّن وكلاء الذكاء الاصطناعي مثل Claude من اكتشاف والتحكم التشاركي في الأجهزة الدقيقة عبر الشبكات كالمجاهر، الأذرع الآلية، الماصات الآلية، وليزر الكم تمامًا مثل استدعاء برمجيات API. وخلال الاختبارات الفعلية، نجح Claude عبر MHS في تقليص وقت معايرة الليزر الدقيق من عدة أسابيع إلى بضع ساعات مع تحقيق معدل استقرار بلغ 99.3%. وتجري الاختبارات حاليًا بالتعاون مع HHMI Janelia وGenentech وDoosan Robotics وAWS، مما يشير إلى انتقال الذكاء المجسد والأتمتة البحثية من معالجة الأكواد الرقمية إلى حلقة مغلقة ومستقلة ومعيارية للتجارب الفيزيائية الواقعية. (المصدر: Anthropic News)

قاضٍ فيدرالي أمريكي يقضي بعدم دستورية إدراج البنتاغون لشركة Anthropic في القائمة السوداء ويلغي العقوبات : قضت المحكمة الجزئية الفيدرالية لشمال كاليفورنيا بأن قرار وزارة الدفاع الأمريكية السابق بإدراج Anthropic كـ “خطر على الأمن القومي لسلسلة التوريد” وحظر المشتريات الفيدرالية منها هو إجراء انتقامي غير قانوني ينتهك بنود الإجراءات القانونية الواجبة في التعديلين الأول والخامس لدستور الولايات المتحدة. وأشار القاضي إلى أن معاقبة الجيش لشركة انتقدت علنًا سياسات الذكاء الاصطناعي الحكومية بدعوى الأمن القومي تفتقر إلى الأساس الواقعي وتتعارض مع الواقع التقني المتمثل في سعي البنتاغون المستمر لشراء نماذج الأمان المتقدمة الخاصة بالشركة. يدخل الحكم حيز التنفيذ فورًا ويلغي الحظر الإداري ضد الشركة، مما يرسي سابقة قضائية بالغة الأهمية لمختبرات الذكاء الاصطناعي الرائدة في مواجهة متطلبات الامتثال الحكومي والخطوط الحمراء للأمن العسكري. (المصدر: The Guardian)

أكثر من 100 من عمالقة التكنولوجيا عالميًا يوقعون مبادرة مشتركة: مواجهة الهجمات السيبرانية الجديدة بالدفاع الذاتي بالذكاء الاصطناعي : أصدرت 116 شركة ومؤسسة أمنية وتقنية، من بينها OpenAI وAnthropic وGoogle وMicrosoft وAWS وOracle وCrowdStrike وHugging Face، رسالة مفتوحة تدعو القطاعين العام والخاص للتنسيق لبناء منظومة دفاع سيبراني متعمقة وشاملة بالذكاء الاصطناعي. وحذر الموقعون من أن الهجمات السيبرانية المؤتمتة المدفوعة بالذكاء الاصطناعي المتقدم ستشهد نموًا هائلاً خلال أشهر، وأن البنية التحتية الحيوية تواجه مخاطر اختراق غير مسبوقة بالذكاء الاصطناعي؛ ويتعين على الصناعة التحول من أساليب الحماية الثابتة التقليدية إلى التمويل المباشر ونشر أنظمة ذكاء اصطناعي دفاعية قادرة على الاستدلال الذاتي والإصلاح في الوقت الفعلي، وتأسيس آلية لمشاركة الحوادث الأمنية عبر المؤسسات. (المصدر: OpenAI, THE DECODER)

Google تطلق Gemini Omni 1.1 Flash لتعزيز التوليد القابل للتحكم للفيديوهات الطويلة : أطلقت Google DeepMind رسميًا الجيل الجديد من نموذج توليد وتحرير الصوت والفيديو متعدد الوسائط Gemini Omni 1.1 Flash، مع إتاحته عبر Gemini API وGoogle AI Studio ومنصات الوكلاء للمؤسسات. يركز النموذج الجديد على تعزيز اتساق المشاهد متعددة اللقطات، ويدعم قراءة حتى 10 ثوانٍ من الفيديو التمهيدي وتمديد المشهد بسلاسة حتى 40 ثانية، مع إمكانية إكمال الإطارات المفتاحية للبداية والنهاية واستيعاب فيديوهات مرجعية للحركة لمدة 3 ثوانٍ؛ كما أطلقت نمط المسودة بدقة 360p الذي يرفع إنتاجية النظام بنسبة 60% ويخفض التكلفة بمقدار الثلثين، ويدعم الإخراج فائق الدقة 4K، محققًا المركز الأول في فئة Text-to-Video والمركز الثاني في Image-to-Video على منصات التقييم التنافسية. (المصدر: Google DeepMind Blog, Google DeepMind)

🎯 اتجاهات ومستجدات
Tencent Hunyuan تطرح النموذج الرائد مفتوح المصدر Hy4 preview بحجم 770B : فتحت Tencent Hunyuan المصدر لنموذج MoE الرائد من الجيل الجديد Hy4 preview، بإجمالي 770B معلمة و49B معلمة نشطة، ويدعم سياقًا طويلاً بحجم 1M بموجب ترخيص Apache 2.0. يعتمد المعمار على انتباه Gated DSA المتناثر، والروابط المتبقية عبر الطبقات iHC، وآلية التنبؤ متعدد الرموز (MTP) بحجم 10B، محققًا مكانة ضمن الفئة الأولى مفتوحة المصدر في 203 اختبارات عمياء للمهام الهندسية والرياضية المعقدة، وحصل منذ اليوم الأول على دعم وتوافق عميق مع vLLM ومنصة عتاد NVIDIA Blackwell. (المصدر: Hugging Face, 机器之心)
.jpg)
OpenAI تختبر داخليًا “الوضع الدائم” في Codex لمنح الوكلاء قدرة على العمل المستقل : كشفت مراجعة لمستودع الأكواد مفتوح المصدر لـ Codex CLI عن قيام OpenAI باختبار تجريبي داخلي لـ Persistent Mode. يكسر هذا النمط الحد الأقصى الحالي للجلسات المقتصر على بضع دقائق أو جولة محادثة واحدة، حيث تم ضبطه لـ “الاستمرار في العمل حتى الإيقاف الإجباري المؤقت”، مما يسمح للنموذج بتوليد المهام اللاحقة ذاتيًا عبر الجلسات قبل السكون، واستكشاف السياق بنشاط وإرسال إشعارات للمستخدمين، مما يعكس مسارًا واضحًا لـ OpenAI نحو تطوير موظفين رقميين مستقلين يعملون على مدار 24 ساعة. (المصدر: WIRED)

Google DeepMind تطلق تجريبيًا أول إطار تقييم مزدوج التعمية وسري للذكاء الاصطناعي : قامت Google DeepMind بالتعاون مع معهد أمان الذكاء الاصطناعي في سنغافورة وMLCommons ببناء أول خط أنابيب لتقييم النماذج مزدوج التعمية في العالم بالاعتماد على بيئة Google Cloud Confidential Space للحوسبة السرية. تضمن هذه الآلية من خلال العزل المشفر على مستوى العتاد عدم قدرة جهات التقييم على سرقة أوزان النماذج الخاصة، وعدم قدرة مطوري النماذج على معرفة أسئلة الاختبار مسبقًا، مما يقضي جذريًا على مشكلة تلوث المعايير المرجعية في تقييم النماذج المتقدمة عبر التشفير. (المصدر: THE DECODER)

NVIDIA توسع منظومة NVLink Fusion وتطلق معيار الذاكرة المخصصة NVHBM : أعلنت NVIDIA عن توسيع منظومة الربط المتبادل في الخوادم NVLink Fusion لتشمل تقنية الذاكرة المخصصة ذات النطاق الترددي العالي NVHBM. تقوم هذه المعمارية بتضمين وحدة التحكم في الذاكرة مباشرة داخل شريحة القاعدة 3D HBM، مما يوفر ما يصل إلى 25% من مساحة نوى الحوسبة لشرائح المعالجة، ويزيد من عرض نطاق الذاكرة بنسبة 30% مع تقليل استهلاك الطاقة بنسبة 15%، وقد أكدت AWS Annapurna Labs أنها ستكون أول من يتبنى المعيار في الجيل القادم من شرائح Trainium. (المصدر: NVIDIA Blog)
فريق من جامعة Tsinghua وجامعات أخرى يطور FormaTheoria: الذكاء الاصطناعي يبني مليون سطر برمجي للتحقق من النظريات الرياضية الكبرى : بمبادرة من البروفيسور Shing-Tung Yau، اقترح فريق من كلية Qiuzhen بجامعة Tsinghua وجامعة Warwick مسار عمل FormaTheoria، الذي يستخدم الذكاء الاصطناعي لاستخراج الاعتماديات ذاتيًا من الأوراق البحثية غير المنظمة وتحويلها إلى براهين صارمة بلغة Lean. نجح النظام في صياغة النظريات الأربع الكبرى في تصنيف الزمر البسيطة المنتهية (CFSG)، مولدًا أكثر من 994 ألف سطر برمجي ومخطط اعتماديات، ومحققًا في غضون 7 أشهر حجم عمل صياغة تطلب تقليديًا 15 خبيرًا على مدار 6 سنوات في مجتمع الرياضيات. (المصدر: arXiv)

Cartesia تطلق رسميًا نموذج الصوت الفوري Sonic-3.6 للإتاحة العامة (GA) : أعلنت شركة Cartesia الناشئة في مجال الذكاء الاصطناعي الصوتي عن وصول نموذج توليد الصوت Sonic-3.6 إلى مرحلة الإتاحة العامة (General Availability). أعاد النموذج بناء معمارية الشبكة الأساسية، مما عزز الطبيعية والانغماس بشكل ملحوظ مع الحفاظ على زمن استجابة فائق الانخفاض. وعلى منصة التقييم المرموقة Voice Arena، تعادل Sonic-3.6 في المركز الأول برصيد 1085 نقطة Elo مع Gemini 3.1 Flash TTS. (المصدر: Cartesia)

Amap تطلق نموذج إعادة البناء ثلاثي الأبعاد المتدفق ABot-Recon بدقة تدعم عشرات الآلاف من الإطارات : أطلقت Amap التابعة لمجموعة Alibaba نموذج إعادة البناء ثلاثي الأبعاد المتدفق أحادي العدسة RGB باسم ABot-Recon، والذي يعتمد معمارية “التنبؤ بالوضع المحلي لـ 12 إطارًا + التحسين المتبقي”، مستغنيًا تمامًا عن نقاط ارتكاز الذاكرة طويلة المدى. يقلص هذا التصميم ذروة استهلاك ذاكرة الرسوميات إلى 6.71GB، محققًا رسم خرائط شامل في الوقت الفعلي بمعدل 24.45FPS دون أي انزياح لمشاهد تصل لعشرات الآلاف من الإطارات على بطاقة رسوميات استهلاكية واحدة، مما يقلل بدرجة كبيرة من عتبة الإدراك المكاني للذكاء الاصطناعي المجسد. (المصدر: 量子位)

Alibaba ترقي منصة وكلاء البرمجة Qoder لتعزيز إتاحة قدرات التطوير للجميع : أطلقت Alibaba رسميًا الترقية الشاملة لمنصة Qoder، لتتحول من أداة برمجية أحادية إلى منصة عمل شاملة لوكلاء الذكاء الاصطناعي موجهة لجميع الموظفين. أضافت المنصة مساعدًا تفاعليًا دائمًا على سطح المكتب وتفاعلاً صوتيًا في الوقت الفعلي، وتدعم وضعي البرمجة المتخصصة والاستخدام العام لغير التقنيين، مع تزويدها بمحرك الجدولة الذكي Auto والربط مع أكثر من 70 إضافة، مما يتيح تغليف القدرات التطويرية المعقدة في إنتاجية رقمية يمكن لجميع موظفي الأعمال توظيفها. (المصدر: 智东西)

Apple تقدم Luce: تمثيل توليد ثلاثي الأبعاد متعدد الوسائط قائم على Gaussian من صورة واحدة : قدم فريق أبحاث التعلم الآلي في Apple مشروع Luce، الذي يدمج الشبكات الهندسية ثلاثية الأبعاد مع معايير المواد الرسومية القائمة على الفيزياء (PBR) مثل الانعكاسية والخشونة داخل فضاء كامن لنقاط Gaussian ثلاثية الأبعاد المقسمة حجميًا (Voxelized). عبر استخدام محول التدفق المصحح والمحاذاة متعددة الطبقات للميزات، يحقق Luce إعادة إضاءة عالية الدقة والحفاظ على التفاصيل النصية عند توليد نماذج ثلاثية الأبعاد من صورة واحدة، مع تحسين مقياس FID بنسبة 28%. (المصدر: Apple Machine Learning Research)

Midjourney تطلق الاختبار العام لنموذج تحرير الصور وإعادة الرسم الجزئي V8.2 : بدأت Midjourney الاختبار العام لنموذج تحرير الصور V8.2. يدعم الإصدار الجديد كليًا تعديل الصور بدقة عبر الأوامر النصية الطبيعية، والتوليد المرجعي المدمج لعدة صور، وإعادة الرسم الداخلي التفاعلي بالفرشاة (Inpainting) والتوسيع الخارجي (Outpainting)، بالإضافة إلى الوراثة السلسة للمعلمات الشخصية ولوحات الإلهام، مما يعزز بشكل كبير من إمكانية التحكم في التصاميم الرسومية التجارية. (المصدر: DavidSHolz)

🧰 أدوات
Tailcat: نفق P2P بدون خادم يعتمد على مستوى بيانات WireGuard : أطلقت Tailscale أداة الشبكات خفيفة الوزن مفتوحة المصدر Tailcat، والتي تستخرج النواة الأساسية لـ magicsock ومكدس بروتوكولات TCP/IP في فضاء المستخدم، مما يسمح باختراق NAT والاتصال المشفر طرفًا لطرف عبر WireGuard باستخدام رموز مؤقتة دون الحاجة للاتصال بمستوى تحكم مركزي، مما يوفر قنوات تدفق بيانات خاصة ومستقلة عن الصلاحيات بين الوكلاء الموزعين. (المصدر: GitHub Trending)

LlamaParse تطلق نمط الاستخراج المنظم للجداول الأصلية والنماذج المعقدة : أطلقت LlamaIndex محرك استخراج معتمد على الوكلاء مخصصًا لجداول البيانات والنماذج الكثيفة لمنصة التحليل الخاصة بها. تقرأ الأداة مباشرة معادلات الخلايا، المناطق المدمجة، الصفوف المخفية والمنطق الممتد عبر الجداول المتعددة، مع دعم التعيين الدقيق المعتمد على Schema والكشف التلقائي عن التعليقات التوضيحية، مما يقلل بشكل ملحوظ من معدل أخطاء التحليل لدى وكلاء RAG والتحليل المالي. (المصدر: LlamaIndex)

Cohere تطلق Parse 5: نموذج تحليل مستندات طرف إلى طرف بحجم 2.3B : أطلقت Cohere رسميًا نموذج تحليل الرؤية واللغة خفيف الوزن Parse (parse-v5.0). يقوم النموذج مباشرة ضمن سياق 8K بتحويل المستندات الممسوحة ضوئيًا المعقدة وعروض PPT التقديمية والجداول إلى صيغة Markdown مع بنية HTML ومربعات الإحاطة، متجاوزًا الحاجة لوحدات OCR منفصلة، مع تقديم أداء متميز من حيث كفاءة التكلفة والإنتاجية والتحليل المنظم متعدد اللغات. (المصدر: MarkTechPost)
Nous Research تطلق واجهة HUD لسطح المكتب مع تعليقات توضيحية فورية واستضافة المتصفح لـ Hermes : أطلق الفريق مفتوح المصدر Nous Research نمط التحليل البصري HUD وإضافة وكيل المتصفح لـ Hermes Agent. يمكن لنمط HUD رسم طبقات تحليلية مثل مستويات الدعم والمقاومة مباشرة فوق المخططات على شاشة المستخدم، بينما تتيح بيئة المتصفح الجديدة إعادة استخدام بيانات تسجيل الدخول عبر نسخ معزولة لملف Chrome Profile، مما يتيح للوكيل تنفيذ الإجراءات المعقدة على الويب نيابة عن المستخدم مع ضمان أمان الحساب الأساسي. (المصدر: Teknium)

منصة مطوري Perplexity تطلق موصلات موحدة لتبسيط تكامل بيانات المؤسسات : أعلنت Perplexity عن توفير ميزة الموصلات بنقرة واحدة في Agent API، حيث يحتاج مسؤولو المؤسسات فقط إلى تكوين الإعداد لمرة واحدة ليتمكن الوكلاء من الوصول بسلاسة إلى GitHub وSlack وGoogle Drive وDatadog دون الحاجة لتمرير رموز المصادقة المتكررة مع كل طلب، مما يبسط إلى حد كبير تنسيق مسارات عمل الوكلاء على مستوى المؤسسات. (المصدر: AravSrinivas)
screenshot-to-code يطور تجربة توليد الواجهات الأمامية متعددة الوسائط : طورت الأداة مفتوحة المصدر الشهيرة screenshot-to-code مصفوفة النماذج ومسار التحقق البصري بالكامل، مع دعم إدخال تسجيلات التفاعل أو لقطات التصميم مباشرة لتوليد أكواد React وVue وTailwind، وإضافة حلقة تحقق فوري عبر متصفح بدون واجهة لتقليل الهلوسة البصرية. (المصدر: GitHub Trending)

Open WebUI تطلق حزمة Quick Actions لتوفير أكثر من 40 إجراءً سياقيًا بنقرة واحدة : طور مجتمع المطورين إضافة Quick Actions (v3.0.0) لمنصة Open WebUI. تدمج هذه الميزة قائمة تكيفية خفيفة الوزن أسفل ردود النماذج، وتقدم ديناميكيًا أكثر من 40 إجراءً جاهزًا بدون الحاجة لأوامر نصية، مثل إعادة الصياغة والتحقق من الحقائق والتدقيق الأمني والتحويل بين التنسيقات، بناءً على ما إذا كان الناتج كودًا برمجيًا أو مستندًا أو بيانات. (المصدر: GitHub)
📚 أبحاث ودراسات
فريق Fei-Fei Li يقترح TrAct: المسارات البصرية كلغة وسيطة بين السياسات ونماذج العالم : اقترح فريق Fei-Fei Li وJiajun Wu من جامعة Stanford استخدام “المسارات البصرية” ثنائية الأبعاد كواجهة موحدة متعددة الوسائط، مما يسمح لشبكة السياسات بالتنبؤ المشترك بالحركات وتنقلات البكسل، ليقوم بعدها نموذج العالم القائم على الانتشار بتوليد فيديوهات المعاينة وتقييم القرارات، وهو ما يعالج بفعالية مشكلة ارتباط أوامر الحركة الأساسية الوثيق بالأجسام وصعوبة توجيهها للتنبؤ البصري، محققًا تفوقًا ملحوظًا على النماذج المرجعية في المهام خارج التوزيع وعبر الأجسام المختلفة. (المصدر: arXiv)

Science Robotics: فريق مشترك من Berkeley وStanford يقترح إطار حركات الروبوتات الشبيهة بالبشر BeyondMimic : اقترح فريق بحثي مشترك إطار تتبع الحركة بالتعلم التعزيزي BeyondMimic. يعتمد الحل على مكافأة تتبع موحدة للتعلم من العروض التوضيحية البشرية لمئات المهارات الديناميكية العالية مثل الشقلبات والركلات الالتفافية، ومن ثم استخدام نموذج انتشار الحالة والحركة الكامن لإجراء الاستيفاء بين المهارات والتوجيه نحو الأهداف، مما مكن الروبوتات بنجاح من التبديل بين الحركات وتفادي العوائق في الوقت الفعلي وبشكل مستقر في تضاريس خارجية حقيقية. (المصدر: Science Robotics)

Harness Continual Learning: تطور التعلم المستمر نحو هياكل دعم الوكلاء : قدم فريق مشترك من جامعة Nanjing وجامعة Wollongong نموذجًا جديدًا باسم HCL، موضحين أنه في ظل تجميد أوزان النماذج، يمكن للوكلاء تحقيق تعلم مستمر على مستوى النظام من خلال تحديث واجهات المهام، ذاكرة الخبرات، رسوم القدرات البيانية واستراتيجيات التوجيه. كما قدمت الورقة تعريفًا رياضيًا للنسيان الكارثي على مستوى طبقة Harness، واقترحت آلية التطور الحارس لموازنة المرونة والاستقرار. (المصدر: 机器之心)

Code-as-World: إعادة بناء آليات التطور الفيزيائي عبر الشيفرات البرمجية القابلة للتنفيذ : اقترح فريق MirroS إطار عمل Code-as-World، الذي يدعو إلى تحويل الملاحظات البصرية عبر الاستدلال العكسي إلى كود قابل للتنفيذ يتضمن خصائص الكيانات والقوانين الديناميكية وشروط التصيير، مما ينقل الذكاء الاصطناعي من مجرد مطابقة المظاهر السطحية للبكسل إلى اكتشاف الآليات السببية الفيزيائية الكامنة، موفرًا أساسًا تمثيليًا متينًا للاستدلال والتفاعل المستمر في العالم الحقيقي. (المصدر: 机器之心)

بحث مقبول في ICML 2026 بعنوان GRACE: تحسين مشترك بين التدريب المدرك للتكميم وتقطير المعرفة : اقترح باحثون من ETH Zurich إطار GRACE، منتقدين المسار المنفصل الذي يعتمد على التقطير بدقة كاملة أولاً ثم التكميم بعد التدريب. ومن خلال تقطير المخرجات القائم على بوابات الثقة ومحاذاة علاقات الميزات البصرية، يتعلم النموذج الطالب مباشرة التمثيلات الأساسية من المعلم تحت قيود التكميم المنخفض بدقة 4-bit، مما مكن نموذج رؤية ولغة بحجم 2B من الاقتراب من مستوى المعلم بحجم 7B والتفوق عليه في الاستدلال الفعلي. (المصدر: arXiv)

MIT تقترح SceneSmith لتوليد مساحات محاكاة فيزيائية عبر تعاون متعدد الوكلاء : طور مختبر MIT CSAIL بالتعاون مع معهد Toyota للأبحاث نظام SceneSmith، الذي يستفيد من حلقة محادثة مغلقة بين ثلاثة أنواع من وكلاء VLM (التصميم، النقد، والتنسيق) لبناء مشاهد داخلية ثلاثية الأبعاد عالية الكثافة ومزودة بخصائص فيزيائية واقعية (الكتلة، الاحتكاك، الآليات المفصلية) بشكل مؤتمت بالكامل، مما يسرع التدريب منخفض التكلفة لسياسات الروبوتات الفعلية في الذكاء الاصطناعي المجسد. (المصدر: aihub.org)

جامعة بكين وKling تطرحان MAVIN لتحقيق التوليد المخصص المشترك للصوت والفيديو متعدد اللقطات : لمواجهة مشكلات عدم تطابق الحوار وانزياح الشخصيات عبر الخطوط الزمنية المعقدة في نماذج الفيديو الحالية، اقترح فريق من جامعة بكين وجهات أخرى نموذج المعمار المزدوج MAVIN (المقبول كعرض شفهي في ECCV 2026)، والذي يتيح لنظام التوليد جدولة العناصر السمعية والبصرية واتساق الشخصيات بدقة وفقًا للسيناريو المقسم للقطات عبر الانتباه المدرك للحدود والنشر المدرك للهوية. (المصدر: 机器之心)

TTPO: استغلال عدم تناسق عينات الخطأ لتحسين السياسات في وقت الاختبار دون إشراف : اقترحت الورقة البحثية خوارزمية تحسين السياسات في وقت الاختبار TTPO، بناءً على ملاحظة أن المسارات التي تنحرف عن تصويت الأغلبية في الاستدلال متعدد الجولات تكون على الأرجح خاطئة تمامًا. وعبر التقطير الذاتي للمسارات المتسقة وفرض عقوبات جماعية على أخطاء التباين، حققت الخوارزمية طفرة جديدة في حدود الاستدلال الرياضي والمنطقي دون الحاجة لأي تسميات حقيقية. (المصدر: arXiv)
Self-OPD: تقطير السياسات عبر الإنترنت دون معلم لنماذج Flow Matching : قدمت الورقة البحثية إطار عمل Self-OPD، الذي يتفرع إلى مسارات SDE عشوائية متعددة في خطوة توليد واحدة ويقيم الأفضلية باستخدام تنبؤ ODE الخاص به كخط أساس، متخلصًا تمامًا من الاعتماد على نماذج المعلم الخارجية المعقدة، ومخففًا بفعالية من أخطاء تراكم انزياح التوزيع أثناء محاذاة ما بعد التدريب في نماذج الانتشار ومطابقة التدفق. (المصدر: arXiv)
مقابلة مع باحث من Stanford: نقاش متعمق حول قابلية تفسير النماذج الكبيرة وآليات الاستدلال الداخلي : حلل الباحث في علوم الحاسوب بجامعة Stanford، أريامان أرورا، في مقابلة خاصة الفروع المتقدمة لأبحاث قابلية تفسير الذكاء الاصطناعي. وقارن بين مزايا وعيوب التشفير التلقائي المتناثر (SAE) والتجريد السببي، مشيرًا إلى وجود خطوات استدلال داخلية غير معلنة داخل النماذج، ومؤكدًا أن فهم الآليات الداخلية لا يقتصر على تدقيق الأمان فحسب، بل يمثل الأساس النظري لتوجيه تطور البنى المعمارية. (المصدر: 硅谷101)

💼 أعمال وتجارة
Amazon تعلن إغلاق منصة التعهيد الجماعي Mechanical Turk في سبتمبر بعد 21 عامًا من التشغيل : أكدت Amazon أن منصتها الرائدة في التعهيد الجماعي لتسمية البيانات Mechanical Turk (MTurk) ستوقف عملياتها تمامًا في 30 سبتمبر 2026. جمعت MTurk سابقًا أكثر من 500 ألف عامل مستقل ودعمت بناء مجموعات البيانات الأساسية للتعلم العميق مثل ImageNet، ولكن مع انتشار النماذج الكبيرة متعددة الوسائط والتحول نحو التسمية المتخصصة من قبل الخبراء، انكمش سوق التعهيد الجماعي البسيط التقليدي متسارعًا نحو نهايته التاريخية. (المصدر: CNBC)

ByteDance وجمعية السينما الأمريكية تتوصلان إلى إطار عالمي لحماية حقوق التأليف والنشر في إنتاج الفيديو بالذكاء الاصطناعي : وقعت ByteDance مذكرة تفاهم مع جمعية السينما الأمريكية (MPA) الممثلة لكبرى استوديوهات هوليوود لتأسيس إطار تعاون عالمي لحماية الملكية الفكرية والترخيص الأصلي لنماذج الذكاء الاصطناعي التوليدي. يمثل هذا التعاون تحول عمالقة صناعة السينما من المواجهة القانونية السابقة إلى تبني تقنيات الفيديو بالذكاء الاصطناعي وإنشاء قنوات منتظمة لترخيص الملكية الفكرية ومشاركة الإيرادات، مما يزيل العقبات التجارية أمام إنتاج الأفلام الطويلة والمحتوى المشتق الاحترافي بالذكاء الاصطناعي. (المصدر: 雷科技)

نجاح المرحلة الثالثة السريرية لأول لقاح سرطان بتقنية mRNA مصمم بمساعدة الذكاء الاصطناعي يثير جدلًا حول التسعير المرتفع : أعلنت شركتا Moderna وMerck عن نتائج إيجابية للمرحلة الثالثة من التجارب السريرية للقاح الميلانوما المخصص Intismeran، حيث تم توظيف الذكاء الاصطناعي طوال مراحل فحص المستضدات والجدولة المخصصة للإنتاج. تقدر بنوك الاستثمار أن تكلفة العلاج بنظام “تحضير مخصص لكل مريض” قد تصل إلى 475 ألف دولار، مما أثار نقاشًا حادًا في الأوساط الصناعية حول إمكانية الوصول التجاري للعلاجات الحيوية الرائدة المدعومة بالذكاء الاصطناعي. (المصدر: 量子位)

🌟 مجتمع
مجلة TIME تنشر قائمة أكثر 100 شخصية تأثيرًا في الذكاء الاصطناعي لعام 2026 وتثير جدلًا حول معايير الاختيار والتمثيل : نشرت مجلة TIME قائمتها السنوية لأكثر 100 شخصية تأثيرًا في الذكاء الاصطناعي عالميًا لعام 2026، متضمنة Taihua Deng من AgiBot والعديد من القادة الصينيين. أثارت القائمة نقاشات واسعة في المجتمع التقني، حيث انتقد بعض الأكاديميين والمطورين تركيزها المفرط على الشهرة العامة والزخم التجاري مع إغفال علماء أساسيين وضعوا اللبنات النظرية الأولى، مما يعكس فجوة في تقييم قيمة الذكاء الاصطناعي بين وسائل الإعلام الجماهيرية والأوساط المتخصصة. (المصدر: TIME, 量子位)

المطورون يناقشون معضلة التوزيع وجذب الانتباه بعد وصول “تكلفة تطوير البرمجيات إلى الصفر” : مع خفض Claude Code وCodex عتبة بناء التطبيقات إلى أدنى المستويات، أبدى مجتمع المطورين إدراكًا عامًا بأن تكلفة إنتاج البرمجيات تقترب من الصفر، في حين تحول المورد الشحيح الحقيقي بسرعة إلى “جذب انتباه المستخدمين وتوزيع الثقة”. وباتت العديد من التطبيقات الخفيفة الممتازة التي بناها مطورون أفراد تفتقر إلى الانتشار بسبب غياب قنوات التوزيع، مما دفع المطورين لإعادة التفكير في أن ميزة المنتجات المستقبلية تتحول من كفاءة كتابة الكود إلى تراكم تدفقات العمل وتصميم المعماريات القابلة للتوسع. (المصدر: Reddit r/ClaudeAI)
دراسة من Wharton School تكشف أن قرارات وكلاء التسوق الذكية معرضة بشدة للانحياز : كشفت أحدث دراسة من Wharton School أن متانة اتخاذ القرار لدى وكلاء التسوق متعددي الوسائط الحاليين ضعيفة للغاية؛ فحتى مع إدخال إشارة تقييم طفيفة أو جزء من ذاكرة المستخدم السابقة، ينقلب تفضيل النموذج للمنتجات المثلى موضوعيًا بنسبة حادة تصل إلى 90 نقطة مئوية، مما يوضح أن الاستهلاك عبر الوكلاء المستقلين بالكامل لا يزال بحاجة إلى قيود حتمية أكثر صرامة قبل التطبيق الصناعي. (المصدر: THE DECODER)

منصة Beatport لمنسقي الأغاني تحظر تمامًا الموسيقى المولدة بالكامل بالذكاء الاصطناعي : أعلنت منصة الموسيقى الإلكترونية Beatport عن نشر خوارزميات كشف لحظر المقاطع المولدة بالكامل بالذكاء الاصطناعي بشكل شامل. وأظهرت استطلاعات رسمية أن ما يقرب من 80% من منسقي الأغاني المحترفين يرفضون استخدام الموسيقى المولدة بالذكاء الاصطناعي الخالص في العروض، مؤكدين أن الذكاء الاصطناعي يجب أن يظل أداة لمساعدة الإلهام البشري وليس بديلاً يمحو فاعلية الإبداع. (المصدر: THE DECODER)

مسؤولة سابقة في Meta تناقش كيف تعيد وكلاء الذكاء الاصطناعي تشكيل الهياكل التنظيمية والوظائف المبتدئة : أوضحت Clara Shih، المسؤولة السابقة عن الذكاء الاصطناعي في Meta وSalesforce، في مقابلة أن خطوط أنابيب الوكلاء تلتهم بسرعة أدوار التطوير والتصميم والتحليل في المستويات المبتدئة. وتتسارع الشركات في التحول نحو هيكل “قلة من الخبراء المتمرسين + مجموعات الوكلاء الذكية”، مما يضع الأدوار الوسيطة التقليدية للموظفين أمام إعادة هيكلة شاملة، ويفرض على المؤسسات إعادة التفكير في تدريب المواهب المبتدئة وصون القيمة الجوهرية للبشر. (المصدر: Platformer)
تسارع تبني وكلاء الذكاء الاصطناعي في المؤسسات وتناقضه مع “الازدهار السطحي” يثير اهتمام المجتمع التقني : أظهرت دراسة استقصائية أنه على الرغم من تجاوز معدل تبني الذكاء الاصطناعي في الشركات الكبيرة والمتوسطة 80%، إلا أن ما يقرب من 70% منها لا يزال متوقفًا عند مرحلة الاستكشاف الفردي، مع دخول أقل من 10% منها مرحلة التحسين المنهجي للأعمال. وأشار المجتمع التقني إلى أن عقبة تطبيق الذكاء الاصطناعي في المؤسسات لا تكمن في ذكاء النماذج، بل في تعقيدات التحكم في الصلاحيات وعزل البيانات وقياس مؤشرات العائد على الاستثمار، مما يدفع الشركات لتوجيه جهودها نحو بناء مستويات تحكم موحدة وأنظمة حوكمة شاملة. (المصدر: 艾瑞咨询)

💡 أخرى
Micron تكشف أن مساحة رقاقة HBM تعادل ثلاثة أضعاف DDR5 مما يفاقم الضغط على الطاقة الإنتاجية لأشباه الموصلات : كشفت Micron خلال قمة Hot Chips التقنية أن مساحة رقاقة HBM4 تشغل نحو ثلاثة أضعاف مساحة DDR5 القياسية لنفس السعة، فضلًا عن انخفاض معدل الإنتاجية بسبب التعقيد التصنيعي الفائق وتقنية الفتحات عبر السيليكون (TSV). وتؤدي إعادة توجيه الطاقة الإنتاجية لمصنعي الذاكرة نحو HBM إلى تقليص العرض الفعلي للذاكرة التقليدية DRAM عالميًا، مما يتسبب في شح المعروض لمراكز الحوسبة والذواكر الاستهلاكية. (المصدر: Reddit r/LocalLLaMA)

مبدعون مناهضون لزواحف الذكاء الاصطناعي يتعاونون مع مخترق سابق لإطلاق أداة البصمات مفتوحة المصدر Lantern لمنع تجريف البيانات : بعد تعرض منصة الفنانين Cara لعمليات تجريف واسعة، توصل مؤسس المنصة إلى تسوية مع الشخص المتورط في التجريف ليتعاونا معًا في تطوير الأداة مفتوحة المصدر Lantern، والتي تتيح توليد بصمات أحادية الاتجاه لخصائص الصور وإجراء فحص دوري لمجموعات تدريب الذكاء الاصطناعي العامة، مما يوفر وسيلة تقنية للمبدعين لجمع الأدلة والدفاع عن حقوقهم. (المصدر: WIRED)

AWS وHeidi تخفضان تكاليف الحوسبة للتعرف على الصوت بنسبة 75% باستخدام CUDA MPS : كشفت التجربة العملية بين AWS ومنصة الذكاء الاصطناعي الإكلينيكي Heidi Health أنه عبر نشر خدمة العمليات المتعددة CUDA (MPS) وخوادم Triton على وحدات GPU في مثيلات EC2، تم القضاء على فترات خمول العتاد أثناء استدلال نماذج ASR الصغيرة، مما قلص حجم عنقود GPU المطلوب من 16 بطاقة إلى 4 بطاقات فقط مع الحفاظ على زمن استجابة دون الثانية. (المصدر: AWS Machine Learning Blog)