🔥 في بؤرة الضوء
فريق أبحاث أمني يخترق قاعدة الشيفرة المصدرية الداخلية لـ OpenAI بمساعدة Claude : كشف فريق الأبحاث الأمنية Hacktron AI أن الباحثين، وفي إطار برنامج مكافآت الثغرات الأمنية (Bug Bounty)، تمكنوا بمساعدة Claude Opus 5 من اختراق حساب أحد موظفي OpenAI في غضون 72 ساعة، وقدموا طلب تحقق PR إلى المستودع الأحادي الخاص والأساسي (openai/openai) الذي يحتوي على أسرار الخوارزميات الخاصة بالشركة. بدأت سلسلة الهجوم من ثغرة تجاوز سعة المخزن المؤقت للكومة (Heap Buffer Overflow) في مكتبة libheif الخاصة بمكوّن رفع الصور في منتدى Discourse، وبالتزامن مع خلل في إعدادات الهوية SSO في OpenAI، تم الاستيلاء على حساب Codex الخاص بالموظف والمرتبط بـ GitHub، بتكلفة Token للنموذج اللغوي الكبير لم تتجاوز 3000 دولار. أثارت هذه الحادثة صدمة وقلقاً واسعين في الصناعة حيال “إتاحة الذكاء الاصطناعي الرائد لقدرات الهجمات السيبرانية عالية الخطورة على نطاق واسع وسريع” وهشاشة الحماية لدى كبرى المختبرات نفسها (المصدر: The Wall Street Journal, 36氪)

النموذج الطبي الشامل للصور الشعاعية RADAR من أكاديمية DAMO التابعة لـ Alibaba يتصدر مجلة Science ويتاح بالكامل كمصدر مفتوح : نُشر النموذج الكبير للصور الطبية الشعاعية العامة لمنطقة البطن DAMO RADAR، الذي طورته أكاديمية DAMO التابعة لـ Alibaba بالتعاون مع مستشفى جامعة Zhejiang الأول وعشرات المؤسسات الطبية الأخرى، في مجلة Science الرسمية، وهو الأول من نوعه عالمياً بمستوى الخبراء. تجاوز النموذج القيود التقليدية للذكاء الاصطناعي الطبي المحصورة في مرض واحد؛ فمن خلال المحاذاة الدقيقة بين الصور والنصوص على مستوى الأعضاء والنمذجة التباينية التكيفية، يستطيع نموذج واحد تغطية 146 مرضاً عبر 18 بنية تشريحية في البطن، مع متوسط AUC بلغ 0.913 في التحقق متعدد المراكز، مما يضاهي دقة كبار أطباء الأشعة، ويقلل وقت قراءة الصور بنسبة 30.7% عند التعاون بين الإنسان والآلة. قامت DAMO بفتح المصدر بالكامل لأوزان النموذج وإطار التدريب وشيفرة التقييم (المصدر: Science, 36氪)

Anthropic تكشف أن الذكاء الاصطناعي يتولى 26% من أبحاثها وتطويرها ذاتياً وتطلق برنامج التحقق لعلوم الحياة LSVP : كشفت Anthropic لأول مرة عن بيانات القياس الداخلية للبحث والتطوير: حيث أصبح Claude “يقود” (بمستوى AL4) تحت إشراف بشري 26% من أعمال البحث والتطوير للنماذج المتقدمة في الشركة (مقارنة بأقل من 1% قبل ستة أشهر)، مع تشغيل أكثر من 30 ألف وكيل ذكي (Agent) بالتوازي بشكل روتيني، وإطلاق أكثر من مليار قرار شهرياً. في الوقت نفسه، أطلقت Anthropic رسمياً برنامج التحقق لعلوم الحياة (LSVP)، لرفع الحظر جزئياً عن النماذج المتقدمة لشركات الأدوية والمؤسسات البحثية المعتمدة، مع بناء نموذج جديد لحوكمة الأمان يعتمد على التصريح بالنوايا، والتدقيق غير المتصل بالإنترنت لمدة 30 يوماً، والمسؤولية المشتركة، بديلاً عن آلية الحظر الفوري الشامل التقليدية (المصدر: Anthropic News, AnthropicAI)

رفع السرية عن وثائق داخلية حاسمة في قضية New York Times ضد Microsoft وOpenAI: مسؤول تنفيذي في Microsoft يصف تجريف الذكاء الاصطناعي للبيانات بأنه “أكبر سرقة للعمالة” : أظهرت وثائق قضائية رفعت عنها السرية حديثاً أن مدير العلوم التطبيقية في Microsoft، برينت هيشت (Brent Hecht)، وصف داخلياً تجريف الأخبار غير المصرح به من قبل النماذج اللغوية الكبيرة بأنه “أكبر سرقة للعمالة في تاريخ البشرية” و”استهزاء تام بمبدأ الاستخدام العادل (Fair Use)”. كما اعترف مسؤول تنفيذي في OpenAI بأن منتجاتهم تشكل “تهديداً بديلاً جوهرياً” للناشرين. كشفت الوثائق تفاصيل تجاوز الطرفين لجدران الدفع (Paywalls) لجمع البيانات، مما يضع حجة “الاستخدام العادل” (Fair Use) التي تعتمد عليها صناعة الذكاء الاصطناعي منذ فترة طويلة أمام تحديات قانونية غير مسبوقة (المصدر: TechCrunch)

🎯 الاتجاهات
فريق Qwen التابع لـ Alibaba يطلق النموذج متعدد الوسائط بالكامل Qwen3.8-Omni-Flash بسياق 1M ونظامه البيئي المصاحب : أطلق فريق Alibaba Qwen رسمياً أول نموذج متعدد الوسائط بالكامل يتمحور حول تدفقات عمل الوكلاء Qwen3.8-Omni-Flash، ويدعم أصلاً إدخال النصوص والصور والصوت وبث الفيديو المتواصل لمدة ساعة. يقدم النموذج آلية إدراك نشطة تتدرج من العام إلى الدقيق، مما رفع الدقة في معيار فهم الفيديو الطويل للغاية OmniVideoBench إلى 67.8 مع خفض استهلاك الـ Token بنسبة 45.7%، وتقليل تكلفة Video API بنحو 89% مقارنة بالجيل السابق. كما أتاح الفريق بشكل متزامن أدوات مفتوحة المصدر مثل Qwen-MM-Plugins وomni-skill-creator الداعمة للتكامل متعدد المنصات Harness (المصدر: Qwen, Alibaba_Qwen)

DeepSeek تطلق DeepSeek-V4.1-Flash لتجاوز عنق زجاجة ذاكرة التخزين المؤقت KV بالسياقات الطويلة للغاية : أطلقت DeepSeek النموذج متعدد الوسائط MoE بحجم 552B باسم DeepSeek-V4.1-Flash، الذي يدعم سياقاً يصل إلى 1 مليون Token. يعتمد النموذج على بنية التشفير وفك التشفير السببية (CED) لتنشيط 8B بارامتر فقط في مرحلة Prefill، وبالجمع بين إعادة الاستخدام عبر الطبقات CSA2 وتقنية الضغط FP4، انخفض استهلاك ذاكرة الـ KV Cache العامة في HBM بشكل كبير إلى 890 بايت/Token (أي ربع الجيل السابق فقط)، مما يقلل بشكل هائل من تكاليف نشر مهام الوكلاء طويلة المدى (المصدر: HuggingFace Daily Papers)
Figure تطلق النموذج المجسد Helix 2.5 وتثبت التعميم الصفري (Zero-shot) في المنازل الحقيقية : أطلقت شركة الروبوتات البشرية Figure الجيل الجديد من الشبكة العصبية الشاملة Helix 2.5، وأجرت اختبارات الترتيب وترتيب الأسرة وطي المناشف في 30 منزلاً غير مألوف في منطقة خليج سان فرانسيسكو لم يسبق أخذ عينات منها. أظهرت التجارب أنه بعد التدريب المسبق على فهرس Index واسع النطاق لبيانات السلوك البشري من منظور الشخص الأول، ارتفع معدل نجاح مهام الجسم بالكامل دون تدريب مسبق (Zero-shot) في بيئات غير مرئية من 9% إلى 56%، مما يؤكد مبدئياً قانون التوسع (Scaling Law) للانتقال من الخبرات البشرية الهائلة إلى التنبؤ بحركات الروبوتات الفيزيائية (المصدر: 36氪)

SenseTime تنشر التقرير التقني لـ SenseNova-U1.5: تحقيق نمط متعدد الوسائط موحد وأصيل عبر مطابقة التدفق والتقطير متعدد الخبراء : نشرت SenseTime التقرير التقني الكامل للنموذج الموحد الأصيل متعدد الوسائط SenseNova-U1.5 بحجم 8B بارامتر. يعتمد النموذج بنية NEO-unify ورموزاً بصرية مضغوطة بحجم 32×32، ويدعم توليد صور بدقة 4K أصلية عبر إعادة بناء حقل السمات ثنائي الأبعاد بالتفاف 3×3. في مرحلة ما بعد التدريب، اعتمد النموذج بشكل مبتكر أسلوب التقطير الاستراتيجي عبر الإنترنت (OPD) بمبدأ “التخصص أولاً ثم التوحيد”، لإعادة دمج أربع قدرات خبيرة هي: الجماليات، وOCR، والرسوم البيانية (Infographics)، والتحرير الدقيق في قاعدة واحدة، جامعاً بين الاستدلال عالي المستوى والتوليد الدقيق على مستوى البكسل (المصدر: WeChat)

Huawei تقدم موعد الإنتاج التجاري لشريحة الذكاء الاصطناعي Ascend 960DT إلى الربع الأول من عام 2027 : أعلنت Huawei في مؤتمرها Connect عن تقديم موعد إطلاق الجيل القادم من شريحة Ascend 960DT من الربع الثالث لعام 2027 إلى الربع الأول. تعتمد Huawei على بنيتها الحاسوبية Peerium وتقنية الربط عالي السرعة UnifiedBus لبناء العنقود الفائق Atlas 950، حيث يمكن للعنقود الواحد دعم توصيل ما يصل إلى 256 ألف بطاقة تسريع، بهدف مواجهة الحظر التقني على القوة الحاسوبية وتسريع اللحاق بشركة NVIDIA عبر الابتكار الهندسي على مستوى النظام (المصدر: TechCrunch)
PrismML تطلق النموذج الطرفي ثلاثي القيم Bonsai 2 27B وسط جدل في اختبارات المجتمع التقني : أطلقت PrismML النموذج المكمم ثلاثي القيم (Ternary Quantized) Bonsai 2 27B المبني على Qwen3.8-27B، مدعية ضغط حجم النموذج بمقدار 9.3 أضعاف ليصل إلى 5.9GB مع الحفاظ على 98.2% من الأداء الشامل، مع إمكانية تشغيله بسلاسة مباشرة على الأجهزة الطرفية الاستهلاكية عبر WebGPU. ومع ذلك، أشار تحليل الورقة البيضاء والاختبارات الميدانية للمجتمع إلى انخفاض فعلي في الأداء بنحو 25% في معايير الوكلاء للمهام الطويلة مثل Terminal-Bench وSWE-bench Verified، مما أثار جدلاً واسعاً حول ظاهرة “الانتقاء الموجه” (Cherry-picking) في نتائج التكميم منخفض البتات للغاية (المصدر: TechCrunch, Reddit r/LocalLLaMA)

Cactus تطلق نموذج الأتمتة الطرفي Needle 3 وبنية السلم المتدرجة : أطلقت Cactus Compute النموذج الأساسي المفتوح المصدر للأتمتة Needle 3 بحجم 121M بارامتر، والذي يعتمد على Simple Attention مقترناً بـ Hadamard MLP وجداول Engram Hash، بتكلفة حوسبة تعادل نموذجاً بحجم 50M فقط. تدعم بنيته المبتكرة “السلم الذكي” النشر المقتطع ديناميكياً من 2 إلى 20 طبقة (بحجم 8-29MB)، وتصل سرعة فك التشفير على وحدة المعالجة المركزية CPU الخالصة إلى 4000 tok/s، مع التركيز على استدعاء الدوال (Function Calling) والتحكم الحتمي للأجهزة الطرفية والقابلة للارتداء دون الحاجة للاتصال بالإنترنت (المصدر: Reddit r/LocalLLaMA)

شركة Wenzhun Intelligence بالتعاون مع جامعة Tsinghua تطلقان نموذج الأساس للبيانات المنظمة LimiX-2 : أطلقت Wenzhun Intelligence النموذج العام للبيانات المنظمة LimiX-2 بحجم 400M بارامتر، مغيرة بذلك نمط التنبؤ أحادي الهدف السابق من خلال اقتراح شبكات الآليات السياقية (CMNs) ونمذجة الأقنعة الشرطية (CCMM)، وتعميق النمذجة إلى المستوى الدقيق للخلية (Cell-Level) لتعلم التبعيات السببية المشتركة بين المتغيرات. تصدر النموذج بالكامل مهام التصنيف والانحدار في المعايير الدولية مثل TabArena وTALENT، متفوقاً على TabFM من Google وTabPFN من SAP (المصدر: 量子位)

Apple تقدم خوارزمية مطابقة التدفق المنفصل الموجه بالطاقة TS-DFM والتعلم المعزز الانتشاري DACA-GRPO : نشر فريق تعلم الآلة في Apple إنجازين متقدمين في التوليد: حيث يقدم TS-DFM تقطيراً موجهاً بالطاقة يصحح قفزات المسار المبكرة لمطابقة التدفق المنفصل باستخدام بوصلة طاقة خفيفة الوزن، متفوقاً في 8 خطوات فقط على نموذج المعلم ذي الـ 1024 خطوة مع تسريع بمقدار 128 ضعفاً؛ بينما يعالج DACA-GRPO معضلة تعيين الائتمان الزمني في التعلم المعزز لنماذج اللغة الانتشارية، محققاً زيادة قدرها 7.4 نقطة مئوية في توليد الأكواد و36.3 نقطة مئوية في اتباع القيود (المصدر: Apple Machine Learning Research)

الأمم المتحدة تتعاون مع Google لإطلاق منصة UN System Data Commons مع دعم معيار MCP : أطلقت الأمم المتحدة بالتعاون مع Google.org منصة للبيانات العامة المنظمة تجمع مجموعات البيانات الرسمية والموثوقة من 26 وكالة تابعة للأمم المتحدة. ولمعالجة مشكلة ضعف دقة النماذج الكبيرة في الإجابة عن المؤشرات الإحصائية العالمية والتي بلغت 21.2% فقط سابقاً، تدعم المنصة الاستعلام باللغة الطبيعية بالاعتماد على Google Knowledge Graph وتوفر دعماً أصلياً لبروتوكول MCP، مما يسمح لمختلف وكلاء الذكاء الاصطناعي باستدعاء المصادر الموثوقة مباشرة لإجراء التحليلات المترابطة عبر المجالات وتوليد الرسوم البيانية (المصدر: Google AI Blog, 36氪)

🧰 الأدوات
Anthropic تعيد بناء Claude Code Projects مع دعم التعاون متعدد الخيوط والذاكرة الدائمة للمشاريع : أطلقت Anthropic بنية Projects في Claude Code لسطح المكتب والويب. يمكن للمستخدمين تحديد أهداف عالية المستوى عبر محادثة واحدة، ليقوم الوكيل المنسق (Coordinator) تلقائياً بتفكيكها إلى عدة مهام فرعية سحابية متوازية ومستقلة للتنفيذ، وتصحيح الأخطاء، وتقديم طلبات PR، مع مشاركة جميع المهام الفرعية لذاكرة المشروع وسياقه المتطور باستمرار، ودعم الاستضافة غير المتصلة بالإنترنت والتعاون المستمر (المصدر: dotey, Anthropic News)

الوكيل الشخصي المكتبي Muse من Meta يُطلق رسمياً على منصة macOS : بعد إطلاقه للأجهزة المحمولة، أطلقت Meta تطبيقاً أصلياً لنظام Mac لوكيلها الشخصي Muse. يندمج التطبيق بعمق في تدفق عمل سطح المكتب، حيث يقرأ الملفات المحلية، والتقويم، والملاحظات، وجهات الاتصال عبر التطبيقات المختلفة بموجب آلية ترخيص صريحة، ويمكنه إنجاز تنظيم الملفات عبر التطبيقات، والتعبئة التلقائية للنماذج، وتنسيق المعلومات وتلخيصها ذاتياً داخل بيئة معزولة (Sandbox) آمنة محلياً (المصدر: The Verge, AIatMeta)
OpenAI تطلق رسمياً منتجها الرائد للقطاع القانوني Astra for Law : بالاعتماد على نموذج الأساس GPT-6 Astra وبالتكامل مع فهرس السوابق القضائية واللوائح الأمريكية الذي يضم 230 مليون رابط URL، أطلقت OpenAI منتج Astra for Law. حقق النموذج دقة بلغت 54% في تقييم Legal Research Bench (مقارنة بـ 38.7% للإصدار العام)، ودمج 26 إضافة رسمية مثل Harvey وLegora و47 إضافة مجتمعية، مع توفير بنية عزل الخصوصية Trusted Access مع انعدام الاحتفاظ بالبيانات (Zero Data Retention)، لدعم مراجعة العقود، والفحص النافي للجهالة للصفقات، وصياغة وثائق الإيداع (المصدر: OpenAI News, gdb)

Salesforce ترقي Agentforce بقدرات التنسيق للمؤسسات وقاعدة الاعتراض الحتمي : أطلقت Salesforce حزمة Agentforce المخصصة لبيئات الإنتاج، والتي تدمج Data Cloud مع بروتوكول MCP. تتضمن المنصة مركز اختبار الوكلاء المدمج (Agent Testing Center) لإجراء اختبارات الإجهاد الاصطناعية المؤتمتة، وتقدم آلية البوابات الحتمية (Deterministic Gating) التي تفرض تنفيذ المعاملات والعمليات على البيانات الأساسية فقط بعد استيفاء قواعد محددة مسبقاً؛ وأظهرت الاختبارات الفعلية لدى Southwest Airlines تحقيق معدل حل مؤتمت بالكامل لمهام خدمة العملاء بنسبة 45% (المصدر: MarkTechPost)

LangChain تتيح منصة عمل وكلاء علوم الحياة Deep Life Sci كمصدر مفتوح : استناداً إلى بنية Deep Agents، أطلقت LangChain منصة الوكلاء مفتوحة المصدر Deep Life Sci الموجهة للباحثين في المجالات السريرية والمختبرية. يتكامل النظام بعمق مع عشرات الملايين من الأوراق البحثية وبيانات التجارب من PubMed وPubMed Central وClinicalTrials.gov، ومزود ببيئة معزولة مخصصة للأكواد، مع دعم المعالجة المتزامنة لمئات الأوراق العلمية المعقدة لاستخراج البيانات والتحقق المتبادل عبر عدة وكلاء فرعيين (المصدر: LangChain)

Google Labs تطلق الوكيل الذكي للتعاون العائلي CC : أطلقت Google Labs رسمياً منتج الوكيل الذكي CC لإدارة الشؤون الأسرية. يدعم النظام انضمام ما يصل إلى 6 أفراد من العائلة مع حسابات معزولة الصلاحيات، وهو قادر على تحليل الإشعارات المدرسية تلقائياً، ومزامنة جداول التقويم بين الأفراد، وتلخيص التذكيرات بالأنشطة، مع امتلاك قدرة إدارة ذاكرة متدرجة تميز بين “المعلومات المشتركة للعائلة” و”التفضيلات الفردية الخاصة” (المصدر: Ars Technica, Google)

Wood Mackenzie تبني منصة APEX لتحليل الطاقة بالاعتماد على Bedrock AgentCore : أطلقت شركة الاستشارات في مجال الطاقة Wood Mackenzie منصة الوكلاء المشتركة APEX. بالاعتماد على AgentCore وبوابة MCP الموحدة، تدمج المنصة بين وكيل الأبحاث الداخلي “Woody” ووكيل العملاء “Lens AI”، وتدعم تخطيط استدعاء الأدوات المتعددة باللغة الطبيعية، والعرض اللحظي لرسوم واجهة المستخدم التوليدية (Generative UI) وتوليد عروض PPT التقديمية، مما يقلص دورة تطوير الوكلاء عبر قطاعات الطاقة المختلفة من أشهر إلى ساعات قليلة (المصدر: AWS Machine Learning Blog)

AWS تطلق حزمة المقابلات والتوظيف الذكية Amazon Connect Talent : أطلقت AWS رسمياً Amazon Connect Talent المصممة خصيصاً لسيناريوهات التوظيف واسعة النطاق. يقوم وكيل الذكاء الاصطناعي بإجراء مقابلات الكفاءة الهيكلية والتقييم المنطقي على مدار الساعة، ويولد تلقائياً تقارير تقييم مدعومة بسلسلة من الأدلة الواقعية وأسباب التقييم لمراجعتها من قبل مسؤولي التوظيف، مما يزيل الانحياز الذاتي ويعزز بشكل كبير كفاءة المطابقة بين المرشحين والوظائف على نطاق واسع (المصدر: AWS Machine Learning Blog)

📚 الأبحاث والدراسات
نظام شركة الأدوية الافتراضية متعدد الوكلاء من Stanford يتصدر Science: معالجة تجارب سريرية هائلة عبر 37 ألف مثيل في 6 ساعات : نشرت جامعة Stanford في مجلة Science نظام “Virtual Biotech” الذي يحاكي هيكل البحث والتطوير في شركات الأدوية الحقيقية بإنشاء 4 أقسام و11 فئة من الوكلاء. وفي مهمة استخراج البيانات، أطلق النظام 37,075 مثيلاً من الوكلاء بالتوازي، مستغرقاً 6 ساعات فقط لإكمال الدمج العميق متعدد الوسائط لأكثر من 55 ألف تجربة سريرية (وهو ما يستغرق 76 يوماً لوكيل واحد)، ونجح في تحديد B7-H3 كهدف مرشح لـ ADC في سرطان الرئة (المصدر: Science)

دراسة محاكاة القيم العابرة للحدود بنماذج اللغة الكبيرة من Tsinghua وFudan تُنشر في Computational Linguistics : قيّم باحثون من جامعة Tsinghua بالتعاون مع Fudan وجامعة Shanghai Jiao Tong تسعة نماذج لغوية كبيرة مفتوحة المصدر استناداً إلى بيانات مسح القيم العالمية (WVS) لـ 59 دولة، ووجدوا أن دقة محاكاة النماذج للاقتصادات المتقدمة والدول ذات جودة الحوكمة العالية كانت أعلى بكثير، مع وجود انحياز في تقارب الفئات ضعيفة التمثيل بشكل غير متماثل نحو الثقافات المهيمنة. اقترحت الدراسة مقياس “المساواة في التمثيل”، وأثبتت أن تزويد النماذج بالمعلومات الأساسية لمجموعات سكانية محددة أكثر فعالية في تحسين عدالة التمثيل عبر الثقافات من مجرد استخدام التوجيه باللغة الأم أو محاذاة التفضيلات (المصدر: WeChat)

جامعة Beihang وCUHK تقدمان إطار التطور الذاتي للوكلاء البصريين OmniHarness : قدم فريق بحثي مشترك إطار الاستكشاف المستقل OmniHarness الموجه للإبداع البصري المعقد. يمارس النظام التدريب الذاتي من خلال اختيار مواضيع استكشافية قائمة على الجدة وحدود القدرات، ويجرد تدفقات عمل ComfyUI الناجحة إلى مكتبة استراتيجيات رمزية، محققاً معدل حل بنسبة 95% في المهام الإبداعية على ComfyBench، مع إمكانية نقل مكتبة الاستراتيجيات المجربة بنمط Zero-shot إلى أطر عمل وكلاء أخرى وتدفقات عمل الفيديو (المصدر: 36氪)

فريق NVIDIA يقدم بنية الذاكرة المشتركة Agora للأبحاث العلمية متعددة الوكلاء : نشر باحثون من NVIDIA ورقة بحثية تقدم Agora، وهي بنية ذاكرة مشتركة برسم بياني موجه غير دوري (DAG) تعتمد على عمليات الإيداع غير القابلة للتغيير في Git. تعاون 13 عاملاً من النماذج اللغوية الكبيرة (LLM Workers) دون مخطط مركزي على مدار 12 يوماً لإكمال مهام تهيئة النماذج الهجينة، ومن خلال حفظ الفرضيات والأكواد وسجلات التحقق بشكل منظم في شجرة Git، تم تجنب تكرار التجربة والخطأ وتعارض الحالات بين الوكلاء تماماً، ونجحت جميع تجارب إعادة الإنتاج المستقلة البالغ عددها 165 تجربة (المصدر: omarsar0)

معيار الوكلاء الطرفيين الفعليين AndroidLife يكشف نقاط ضعف التحكم طويل المدى ومشكلة ارتفاع الحرارة : أطلق المجتمع التقني معيار التقييم AndroidLife المبني على هواتف فعلية وبيئات شبكية حقيقية لتقييم أداء وكلاء الذكاء الاصطناعي على الأجهزة في المهام اليومية عبر التطبيقات. أظهرت الاختبارات أن نسبة نجاح Qwen3.8-27B في 60 مهمة واقعية بلغت 56.7% فقط، واستغرقت المهمة الواحدة حوالي 6 دقائق مع وصول درجة حرارة الشريحة القصوى إلى 98.2 درجة مئوية. كشفت الاختبارات عن ميل النماذج للدخول في حلقات مفرغة عند تنفيذ عمليات متتابعة عبر تطبيقات متعددة، وضعف قدرتها على التعميم في سيناريوهات الاستفسار الاستباقي (المصدر: Reddit r/artificial)

Apple تقدم معيار REVERSAL-BENCH لقياس حافة الهاوية في التعلم المعزز دون إعادة تعيين : استجابة للإجراءات غير القابلة للتراجع في العالم المادي الواقعي، مثل سقوط الأشياء، قدم فريق Apple معيار REVERSAL-BENCH. من خلال إدخال بارامترات الانعكاسية المستمرة وأوراكل إعادة التعيين (Reset Oracle)، كشفت الدراسة عن تأثير “جرف الامتصاص” (Absorption Cliff) الذي يواجهه الوكلاء المستقلون دون إعادة تعيين عند مواجهة حالات فيزيائية غير قابلة للعكس، وقيمت الحدود الفعالة لدروع السلامة (Safety Shields) لتفادي الفخاخ استباقياً (المصدر: Apple Machine Learning Research)
دراسة تكشف أن العلامات المائية النصية للنماذج الكبيرة (SynthID) تضعف بشكل ملحوظ دفاعات الوكلاء ضد الهجمات التنافسية : أشارت أحدث دراسة من Lasso Security إلى أن آلية العلامة المائية النصية SynthID-Text المطبقة في مرحلة فك تشفير النماذج للامتثال للمعايير التنظيمية تُحدث اضطراباً في التوزيع الاحتمالي الأصلي للنموذج. وفي سيناريوهات الهجمات التنافسية، تكون النماذج التي تحتوي على علامات مائية أكثر ميلاً لتنفيذ تعليمات كسر الحماية (Jailbreak) أو تسريب معلومات حساسة ككلمات المرور، مما يحذر المطورين من ضرورة إعادة اختبار خطوط الأمان الأساسية لاستدعاء أدوات الوكلاء بالكامل عند تطبيق العلامات المائية (المصدر: Ars Technica)
دراسة تجريبية وقواعد اختيار للتصميم المكوناتي لمنصات Harness لوكلاء البرمجة : أظهرت 176 مجموعة من التجارب المقارنة على معايير SWE-Bench Verified وTerminal-Bench أن إدارة السياق تمنع بفعالية انهيار فيض البيانات عند تضييق الميزانية، وأن أسلوب “استبعاد القواعد قبل تلخيص النماذج الكبيرة” هو الأكثر فاعلية من حيث التكلفة؛ كما أن النماذج عالية القدرة تكون أكثر ملاءمة لواجهات Bash الصرفة لتوفير التكاليف، بينما تعتمد النماذج الأضعف بشكل كبير على هياكل الأدوات المحددة مسبقاً (المصدر: HuggingFace Daily Papers)
💼 الأعمال والاستثمار
شركة البنية التحتية لحوسبة الذكاء الاصطناعي Crusoe تحصد 3.9 مليار دولار في جولة تمويل Series F : جمعت شركة تطوير مراكز البيانات Crusoe تمويلاً بقيمة 3.9 مليار دولار في جولة Series F بقيادة Atreides وMubadala وآخرين، ليصل تقييمها بعد التمويل إلى 30.9 مليار دولار. ستُستخدم الأموال لتوسيع مراكز الحوسبة فائقة الضخامة وتطوير مصانع الذكاء الاصطناعي المصغرة والمعيارية المسماة “Spark”، لتلبية الطلب المتزايد على الطاقة والقوة الحاسوبية لعملاء مثل OpenAI (المصدر: TechCrunch)
شركة يونيكورن الوكلاء العامين Manus تستأنف عملياتها المستقلة وتطلق جولة تمويل جديدة بقيمة 500 مليون دولار : بعد إنهاء اتفاقية الاستحواذ مع Meta وإعادة شراء الأسهم من قبل المساهمين الأصليين، تسعى الشركة الناشئة لوكلاء الذكاء الاصطناعي Manus لجمع 500 مليون دولار في جولة تمويل جديدة بتقييم مستهدف يبلغ حوالي 4 مليارات دولار. تشير البيانات إلى أن إيراداتها السنوية المتكررة (ARR) قفزت من 100 مليون دولار إلى حوالي 400 مليون دولار في غضون ستة أشهر، مما يظهر إمكانات تحقيق أرباح هائلة للوكلاء العامين في تدفقات عمل المؤسسات (المصدر: 量子位, 36氪)

الشركة الناشئة لعمليات التشغيل والصيانة الفيزيائية لمراكز البيانات بالذكاء الاصطناعي Watney تغلق جولة Series A بقيمة 80 مليون دولار : أعلنت Watney، المتخصصة في حلول التشغيل والصيانة بالذكاء الاصطناعي المجسد للبنى التحتية الحاسوبية فائقة الحجم، عن إغلاق جولة تمويل Series A بقيمة 80 مليون دولار بقيادة Valor Atreides AI Fund وHummingbird. تدير Watney حالياً أسطولاً من الروبوتات ذات البراعة الحركية، مقدمة خدمات الفحص الآلي المستمر لخزائن السيرفرات والصيانة العتادية على مدار الساعة لمراكز بيانات كبرى شركات الحوسبة السحابية (المصدر: dchaplot)

🌟 المجتمع والنقاشات
42 عضواً في الجمعية الملكية البريطانية للرياضيات يوقعون رسالة مفتوحة تحذر من اقتراب المخاطر الوجودية للذكاء الاصطناعي : وجه 42 من كبار علماء الرياضيات، من بينهم فائزون بميدالية فيلدز (Fields Medal)، رسالة مفتوحة إلى رئيس الجمعية الملكية البريطانية، مشيرين إلى أن النماذج المتقدمة أظهرت بالفعل مستويات تضاهي كبار علماء الرياضيات من البشر، وأن الانتشار الواسع لقدراتها الفائقة في المجالات عالية الخطورة مثل الأمن السيبراني والأسلحة المستقلة بات وشيكاً، داعين الحكومات إلى عدم اعتبار تحذيرات المختبرات الرائدة من خطر انقراض يتجاوز 10% مجرد “دعاية تسويقية” (المصدر: THE DECODER)
الملك تشارلز الثالث يستضيف قمة مغلقة في اسكتلندا ويدعو لفرض رقابة فعالة على الذكاء الاصطناعي : جمع الملك تشارلز في اسكتلندا قادة التكنولوجيا بمن فيهم Jensen Huang وDemis Hassabis مع رؤساء أجهزة الاستخبارات البريطانية. وصرح في كلمته بوضوح بضرورة إنشاء “وسائل تحكم كافية” للذكاء الاصطناعي قبل فوات الأوان، لمنع تحول هذه التكنولوجيا القادرة على إنقاذ الأرواح إلى كارثة خارجة عن السيطرة تسلب الأرواح (المصدر: TechCrunch)

خبراء أمنيون من الصين وأمريكا يدعون بشكل مشترك لفرض خط أحمر “يحظر تحكم الذكاء الاصطناعي بالأسلحة النووية” قبل القمة الرئاسية : نشر باحثون من معهد Brookings وجامعة Fudan مقترحاً سياسياً مشتركاً يدعو قادة الصين والولايات المتحدة إلى التعهد الصريح بعدم السماح مطلقاً للذكاء الاصطناعي بامتلاك سلطة الإطلاق الذاتي للأسلحة النووية أو مهاجمة أنظمة القيادة والسيطرة النووية، واقترحوا إنشاء خط ساخن ثنائي لحوادث أمان الذكاء الاصطناعي الطارئة لمنع التصعيد الناتج عن سوء التقدير الكارثي للردود الخوارزمية المستقلة (المصدر: THE DECODER)

جدل محتدم بين الأوساط الأكاديمية والصناعية حول “نظرية انقراض البشرية بالذكاء الاصطناعي والاستحواذ التنظيمي” : رداً على دعوات بعض الشركات الكبرى لـ “إبطاء سرعة الذكاء الاصطناعي المتقدم” والتحذيرات الأمنية الأخيرة، انتقد كل من Andrew Ng وYann LeCun وArvind Narayanan نبرات الهلاك المتكررة التي تلبس المخاوف الذاتية ثوب الاحتمالات الكمية (p(doom))، مؤكدين أنها تفتقر إلى الأساس التجريبي والحس الفيزيائي السليم. وأشار العديد من المعلقين إلى أن الترويج المفرط للمخاطر الوجودية قد يتحول إلى أداة تجارية للمختبرات المغلقة الكبرى للسعي وراء الاستحواذ التنظيمي (Regulatory Capture) وخنق المنافسة من النماذج مفتوحة المصدر (المصدر: hardmaru)
اعتزال مطور PS5 يثير جدلاً حول “أطفال الشيفرات بالذكاء الاصطناعي والحرفة الهندسية” : أعلن الباحث الأمني الشهير TheFloW انسحابه من مجتمع الهندسة العكسية لـ PS5، بعد أن تمكن العديد من المبتدئين بالاعتماد على نصوص النماذج اللغوية الكبيرة LLM من إعادة اكتشاف ثغرة Hypervisor منخفضة المستوى كان يحتفظ بها لنقل البرمجيات إلى PS5 Pro في غضون ساعات وتقديمها لـ Sony للحصول على مكافأة. انقسم المجتمع بشكل حاد: رأى طرف أن الذكاء الاصطناعي يتيح اكتشاف الثغرات التي كانت تتطلب سنوات من التراكم الهندسي للجميع مما يؤدي لحرق نتائج الأبحاث مبكراً، بينما أشار الطرف الآخر إلى أن هذا يثبت قوة الذكاء الاصطناعي كأداة مؤتمتة للهندسة العكسية (المصدر: 36氪)

TypeSafe Jev يثير نقاشاً واسعاً في المجتمع حول “اتخاذ قرارات System 1 بالمللي ثانية” وبنية الذاكرة : مع إتاحة نموذج الأساس للقرارات Jev للاختبار، سارعت فرق مثل Shopify وVercel إلى دمجه في بواباتها للتدقيق الأمني والتوجيه الديناميكي للنماذج. يرى المجتمع على نطاق واسع أن فصل تصنيف الأنماط عديم الحالة وعالي الثقة عن نماذج التوليد ذاتية الانحدار الباهظة هو المفتاح لخفض تكاليف الوكلاء؛ لكن بعض مهندسي النظم حذروا من أن الضغط التمييزي المفرط قد يضر بسلاسل التفكير الطويلة والذاكرة المؤقتة للبادئات في KV Cache (المصدر: Latent Space, multiply_matrix)

إنهاء GPT-6 Astra للألعاب وسلوك “زراعة البطاطس عند الإحباط” في Minecraft يثيران نقاشات حول فرط التخصيص (Overfitting) للوكلاء : أظهرت اختبارات المجتمع أن Astra أنهى لعبة Pokémon في غضون 18 ساعة، ولكنه بعد تفجير صندوق التخزين بواسطة Creeper في لعبة Minecraft، وضع قيوداً متطرفة للغاية في ملاحظاته وانغمس في العمل المتكرر في حقل البطاطس. تسلط هذه الظاهرة الضوء على سهولة وقوع النماذج القوية في فخ وضع قواعد دفاعية مفرطة التخصيص والانحراف عن الهدف النهائي عند التعرض لانتكاسات موضعية في البيئات المفتوحة (المصدر: THE DECODER)
مخاطر أمنية في منصات Harness لوكلاء البرمجة: رصد ZCode وهو يرفع بيانات مساحة العمل في الخلفية بصمت : أشار تحليل مستقل إلى الاشتباه في قيام إطار عمل وكلاء التطوير ZCode بحزم مساحة العمل المحلية للمستخدم وبيانات مستودع الإصدارات .git الوصفية ورفعها سراً إلى خوادم سحابية في الخلفية. أثارت الحادثة يقظة قوية لدى المطورين بشأن خصوصية البيانات وتسريب الشيفرات المصدرية عبر أدوات Harness المغلقة التابعة لجهات خارجية، ودعا المجتمع إلى التمسك ببيئات التشغيل مفتوحة المصدر والتدقيق المحلي للمسارات واستراتيجيات العزل في Sandboxes (المصدر: Reddit r/LocalLLaMA)
💡 متفرقات
علامة أزياء أسترالية مستقلة تتهم Temu باستخدام الذكاء الاصطناعي لتجريف وسرقة آلاف تصاميم القمصان بشكل جماعي : كشفت علامة الأزياء المستقلة Lonely Kids Club في سيدني عن اشتباهها في قيام أدوات الذكاء الاصطناعي المؤتمتة بالتجريف الشامل لـ 4000 تصميم ونصوص أصلية لقمصان متجرها الرسمي، واستنساخها وعرضها بأسعار زهيدة على منصة Temu. أثارت هذه الحادثة مجدداً احتجاجات مجتمع المبدعين ضد تساهل عمالقة التجارة الإلكترونية مع انتهاكات حقوق الطبع والنشر عبر الذكاء الاصطناعي والجدل حول التشريعات ذات الصلة (المصدر: The Guardian)

Epoch AI تطلق مبادرة Benchmark Reviews: الكشف عن عيوب خطيرة في العديد من معايير التقييم الشائعة : أطلقت مؤسسة الأبحاث غير الربحية Epoch AI مشروع مراجعة المعايير، حيث صُنفت 9 من أصل 15 معياراً رئيسياً للذكاء الاصطناعي في الدفعة الأولى بأنها “تحتوي على عيوب خطيرة” (Flawed). أظهر التدقيق أن 45.5% من إعدادات المهام في Terminal Bench 4.0 تالفة، وأن DeepSWE 1.1 يحتوي على أخطاء برمجية حرجة تؤثر على تقييم النتائج، داعية الصناعة إلى الحذر من الأسقف الوهمية المصطنعة في تقييم المعايير (المصدر: karinanguyen)

استوديو إبداعي يطلق الدمية القماشية Bezzy التي تصدر ضجيج غرف الخوادم الحاد للسخرية من توسع الذكاء الاصطناعي : أطلق استوديو التصميم الإبداعي Basura بالتعاون مع موسيقيين دمية قماشية باسم Bezzy على شكل خزانة خوادم. عند الضغط على الدمية، تصدر صفيراً صناعياً حاداً لأنظمة التبريد من مراكز بيانات حقيقية في ولاية فرجينيا، وذلك بأسلوب فني ساخر يهدف إلى حث الجمهور على التفكير في التكاليف المعيشية والبيئية الملموسة للتوسع السريع لمراكز بيانات الذكاء الاصطناعي مثل استهلاك المياه المحلي، والضغط على شبكات الكهرباء، والتلوث الضوضائي (المصدر: WIRED)
