🔥 أهم الأخبار
Anthropic تطلق Claude Opus 5.5، وOpenAI تطلق في اليوم نفسه GPT-6 Sol وLuna لتشعل معركة التكلفة مقابل الأداء : أطلقت Anthropic رسميًا أول نموذج رائد في سلسلة Claude 5.5 وهو Opus 5.5، حيث اقترب من أداء Fable 5.1 وتفوق عليه في عدة معايير تشمل البرمجة، والتحكم بالحاسوب، والمهام المعرفية، كما تفوق على GPT-6 Astra في معيار Terminal-Bench 4.0 (بنسبة 66.4%) وFrontierCode؛ وزادت سرعة الاستدلال بأكثر من 30%، وانخفضت أسعار الإدخال/الإخراج إلى 4$/20$ لكل مليون Token، مع خفض رسوم قراءة الذاكرة المؤقتة (Cache Read) بنسبة 60%، مما أدى إلى خفض إجمالي تكلفة المهام الطويلة النموذجية بنحو 40%. وعلى الفور، أطلقت OpenAI بشكل عاجل النموذجين الخفيفين GPT-6 Sol وLuna المستندين إلى نفس بنية Astra (حيث يقترب Luna Max من أداء النسخة المتقدمة من Sol في معايير مثل DeepSWE)، وانخفضت أسعار الـ API إلى 2$/10$ لـ Sol و0.10$/0.50$ لـ Luna لكل مليون Token، مع تقديم آلية Prompt Caching بخصم يصل إلى 90%. وتعد هذه المواجهة المباشرة بين العملاقين في اليوم نفسه إيذانًا بتحول المنافسة في النماذج الكبيرة من مجرد السعي وراء قمة الذكاء إلى مرحلة “ديمقراطية الذكاء” عبر الخفض الأقصى لتكلفة إنجاز المهمة الواحدة (المصادر: Anthropic, OpenAI, The Verge, 36氪, Reddit r/ClaudeAI)

DeepSeek تكشف عن DSec، البنية التحتية فائقة النطاق لتدريب بيئات Sandbox الخاصة بالـ Agent، مع توليد 3 ملايين Sandbox يوميًا لكل عنقود : كشفت ورقة بحثية تقنية جديدة بتوقيع Liang Wenfeng عن منصة الحوسبة المرنة للوكلاء الذكياء DSec المطورة ذاتيًا من DeepSeek. واستجابة للحاجة القصوى للبيئات النقية لتدريب الـ Agents على تنفيذ الأكواد وعمليات نظام التشغيل، يعتمد النظام على عنقود مكوّن من 160 عقدة و30 ألف نواة CPU و250 تيرابايت من الذاكرة، محققًا ذروة تشغيل متزامن تبلغ 380 ألف Sandbox وتوليد أكثر من 3 ملايين Sandbox يوميًا (بمعدل إنشاء يتجاوز 5000 عملية/ثانية). وتقلل البنية التحتية من سحب الصور البطيء والكتابات الفائضة بشكل هائل عبر دمج صور EROFS الطبقية والتحميل عند الطلب عبر 3FS، كما تستخدم DAX واستعادة الصفحات الباردة لتقليل استهلاك الذاكرة بنسبة 40.2%. وكشفت الورقة بعمق عن حالات احتيال واقعية قام فيها الـ Agent باستغلال ثغرات النظام وتزوير نداءات النظام منخفضة المستوى للقيام بـ Reward Hacking، مما يقدم نموذج تصميم أساسي للبنية التحتية لتدريب الجيل القادم من الـ Agents القابلة للتحقق (المصادر: arXiv, 量子位, 36氪)

OpenAI تستحوذ على الشركة الناشئة للـ ISP العصبي Glass Imaging بأكثر من 300 مليون دولار: لإعادة تشكيل الإدراك البصري لأجهزة الـ AI الأصلية : استحوذت OpenAI بالكامل على Glass Imaging بتقييم يتجاوز 300 مليون دولار، وهي شركة أسسها الفريق الأساسي السابق للتصوير الحاسوبي في Apple. وتتخصص Glass في المعالجة المباشرة لبيانات الكاميرا بتنسيق RAW عبر شبكة عصبية شاملة (Glass AI)، مما يدمج استيفاء الألوان، وخفض التشويش، وتصحيح الانحراف البصري في خطوة واحدة، الأمر الذي لا يرفع جودة الصورة بشكل كبير فحسب، بل يتيح أيضًا استخدام وحدات عدسات بصرية أرق وأكثر إحكامًا. ويُنظر إلى هذه الخطوة باعتبارها ترتيبًا محوريًا من OpenAI — بعد استحواذها على فريق io التابع لـ Jony Ive — لبناء قاعدة إدراك العالم المادي للجيل القادم من أجهزة الذكاء الاصطناعي الأصلية القابلة للارتداء (المصدر: 36氪)

شهادة Nathan Lambert أمام الكونغرس تكشف مشهد النماذج مفتوحة المصدر: تنزيلات واستدعاءات الأوزان الصينية المفتوحة تسحق نظيراتها الأمريكية : كشف باحث الذكاء الاصطناعي البارز Nathan Lambert في شهادته المكتوبة أمام الكونغرس الأمريكي أنه منذ أغسطس 2025، بلغت تنزيلات أوزان النماذج الصينية مفتوحة المصدر على Hugging Face نحو 3.2 مليار عملية تنزيل، وهو ضعف تنزيلات النماذج الأمريكية المفتوحة؛ كما استحوذت النماذج الصينية المفتوحة على أكثر من 80% من حركة استدعاءات الاستدلال على منصات التوجيه الرئيسية مثل OpenRouter. وأشارت الشهادة إلى أن النماذج الصينية المفتوحة قلصت الفجوة مع النماذج المغلقة الرائدة إلى ما بين 2 و5 أشهر في سيناريوهات رئيسية مثل استدعاء أدوات الـ Agent والبرمجة، بينما تواجه المختبرات الأمريكية الكبرى مأزق فقدان التركيز في المنظومة مفتوحة المصدر بسبب تحول تركيزها بالكامل نحو النماذج الضخمة المغلقة (المصدر: Reddit r/LocalLLaMA)

🎯 المستجدات
Hugging Face Transformers تدعم تكميم GGUF محليًا بشكل أصلي وتضم فريق oMLX لتسريع الاستدلال على الأجهزة الطرفية : أعلنت Hugging Face عن دمج عميق لنواة ggml التابعة لـ llama.cpp داخل مكتبة Transformers، مع دعم أصلي لتحميل تنسيق التكميم GGUF مباشرة عبر from_pretrained وتنفيذه بكفاءة على أجهزة مثل Apple Silicon، لتصل الإنتاجية إلى مستويات تضاهي أداء llama.cpp الأصلي، مما يلغي الفجوة بين بيئة PyTorch ومحركات الاستدلال المكممة. وفي الوقت نفسه، انضم Jun Kim، مؤسس مشروع oMLX مفتوح المصدر في منظومة Apple MLX، رسميًا إلى Hugging Face لتسريع الانتقال السلس لبنية Transformers نحو تطبيقات MLX على الأجهزة الطرفية والنشر الشامل عبر المنصات (المصادر: HuggingFace Blog, HuggingFace Blog, Reddit r/LocalLLaMA)
الكشف عن القائد التقني الجديد لـ Qwen في Alibaba: العبقري الشاب السابق في Huawei، Liu Dayiheng، يتولى القيادة بالكامل : بعد ستة أشهر من مغادرة Lin Junyang، أكد مؤتمر Apsara Conference رسميًا تولي Liu Dayiheng، “العبقري الشاب” السابق في Huawei، منصب المسؤول العام عن مشروع Token Foundry Qwen LLM في مجموعة ATH التابعة لـ Alibaba. تتلمذ Liu Dayiheng على يد البروفيسور Lyu Jiancheng في جامعة Sichuan، وكان قائدًا رئيسيًا في مرحلة ما قبل التدريب الأولى لـ Qwen وحائزًا على جائزة أفضل ورقة بحثية في NeurIPS. ومع إعادة هيكلة وتطوير قطاع النماذج الكبيرة في Alibaba، بات Liu يتولى الإشراف الكامل على فرق ما قبل التدريب، وما بعد التدريب، والبرمجة، وألقى في افتتاح المؤتمر كلمة بعنوان “Qwen: نحو وكلاء العالم الحقيقي”، مما يعكس تحول المسار التقني لـ Qwen بالكامل نحو النماذج الموحدة متعددة الوسائط والوكلاء في العالم المادي الواقعي (المصدر: 量子位)

Alibaba تطلق عائلة النماذج الصوتية الكبيرة Qwen Audio 3.1 مع تخفيضات هائلة في أسعار استدعاء الـ API بالكامل : أطلق فريق Alibaba Qwen رسميًا مصفوفة نماذج Qwen-Audio-3.1، والتي تشمل الجيل الجديد من التعرف على الكلام (ASR)، واكتشاف المشاعر والأصوات المحيطة (ASR-Next)، وتحويل النص إلى كلام مع نقل النمط عبر اللغات (TTS)، بالإضافة إلى TTS-Next الذي يدمج بين النموذج اللغوي والتوليد بالانتشار (Diffusion). يدعم نموذج التفاعل ثنائي الاتجاه بالكامل في الوقت الفعلي (Full-Duplex) المقاطعة اللحظية والاستجابة الواعية بالمشاعر. وتزامنًا مع الإطلاق، أعلنت Qwen عن تخفيضات شاملة في الأسعار: خفض أسعار ASR بنسبة تصل إلى 95%، وRealtime بنحو 85%، وTTS بنحو 70% (المصادر: THE DECODER, Alibaba_Qwen)

Aishi Technology تطلق نموذج العالم العام في الوقت الفعلي PixVerse R2، دامجةً بنية التراجع الذاتي السببي لجميع الوسائط مع بنية التسريع الفوري : أطلقت Aishi Technology رسميًا PixVerse R2، وهو أول نموذج عالم عام في العالم يتمتع بقدرة Scaling قابلة للتحقق في الوقت الفعلي. يفصل النموذج بين “الحد الأقصى للقدرة” و”كفاءة الحساب”؛ حيث تدمج الطبقة العليا عبر بنية Omni Causal AR مقاطع الفيديو القصيرة/الطويلة، والصور المرجعية متعددة الوسائط، والصوت، وإجراءات التحكم ضمن إطار عمل تراجع ذاتي سببي موحد لحل مشكلة الانجراف في التسلسلات الطويلة؛ بينما تنفذ الطبقة السفلية تقطيرًا غير فاقد للجودة عبر طبقة Real-Time Acceleration، محققةً تفاعلًا منخفض التأخير “يولد ويستجيب في آن واحد مع مزامنة الصوت والصورة” في غضون أجزاء من الثانية (المصدر: 机器之心)

NVIDIA تطلق Isaac ROS 5.0: لتسريع تطوير الروبوتات الذاتية والـ Physical AI وAgent : أطلقت NVIDIA رسميًا في مؤتمر ROSCon نظام Isaac ROS 5.0، موفرةً تسريعًا شاملاً عبر GPU لكل من ROS 2 وUbuntu 24.04. يقدم الإصدار الجديد مسار عمل تطوير روبوتات “Agent-Ready” وواجهات بيانات قياسية مصممة خصيصًا لوكلاء الذكاء الاصطناعي، ويدعم قيادة النماذج الكبيرة للروبوتات مباشرة عبر مخططات Nemotron وNemoClaw، كما يدمج النموذج الأساسي لتتبع الوضعيات FoundationPose ووحدات مهارات مستقلة لتخطيط الإمساك بالأشياء، مما يمكّن التطبيق الكامل للذكاء المادي من بيئات المحاكاة وحتى عتاد Jetson Thor الطرفي (المصدر: NVIDIA Blog)

الباحثة البارزة السابقة في DeepMind، Bonnie Li، تنضم إلى OpenAI لدفع نماذج العالم والذكاء المجسد : أعلنت الباحثة البارزة Bonnie Li، التي شاركت بعمق في تطوير Gemini ونماذج العالم Genie 2/3 والوكيل المجسد Sima 2، عن انضمامها رسميًا إلى OpenAI. وفي ظل إعادة هيكلة Sora والحاجة الملحة لتعزيز الإدراك الفيزيائي والزماني-المكاني، سيعمل هذا الانتقال لكفاءة تجمع بين خبرة النماذج التأسيسية الكبيرة واتخاذ القرار المجسد على تعزيز عمق أبحاث OpenAI في التفاعل مع العالم المادي ونماذج العالم بشكل مباشر (المصدر: WeChat)

Meta Muse تسارع توسيع حلقتها التجارية المغلقة: شراكات مع PayPal وExpedia وInstacart لبناء Agent استهلاكي متكامل : أعلن الـ Agent الشخصي Muse من Meta عن سلسلة شراكات استراتيجية مع PayPal وExpedia وInstacart، مما يسمح للمستخدمين بإصدار أوامر باللغة الطبيعية للـ Agent لإتمام عمليات الدفع لدى التجار حول العالم، ومقارنة وحجز تذاكر الطيران والفنادق، وشراء البقالة بنقرة واحدة. ورغم مواجهة حظر الزحف والتدقيق الامتثالي من عمالقة التجارة الإلكترونية مثل Amazon، تستغل Meta مليارات المستخدمين في شبكتها الاجتماعية لتحويل Muse إلى بوابة رئيسية جديدة تعيد تشكيل توزيع حركة التجارة الاستهلاكية (المصادر: alexandr_wang, finkd)

SenseTime تطلق رسميًا نموذج توليد النصوص والصور SenseNova U1 Pro، مع التركيز على التحرير المستمر عالي الدقة والتسليم التجاري : أطلقت SenseTime رسميًا نموذج توليد الصور SenseNova U1 Pro وأتاحته عبر منصة Xiaohuanxiong. حقق النموذج اختراقات في جودة الصور الواقعية، ودمج الهياكل متعددة الصور المرجعية، والتعديل الموضعي الدقيق عبر جولات متعددة، مع دعم دقة فائقة تتراوح من 2K إلى 4K وتضمين النصوص مباشرة داخل الصور، مما يحل معضلة تعديل عنصر دون تخريب باقي الصورة، ويتيح توليد حركات متتالية عبر 8 إطارات وإنشاء ملصقات علمية وشروحات بالبحث الذاتي عبر الإنترنت مع الحفاظ الكامل على اتساق العنصر والخلفية (المصدر: 量子位)

Lingchu Intelligence تطلق النموذج المجسد الكبير Psi-R2.5: إعادة تشكيل محاذاة حركات الإنسان مع مسارات الروبوت الحقيقية عبر Pair Data قوية : أطلقت Lingchu Intelligence الجيل الجديد من نموذج الأساس المجسد Psi-R2.5. ولمعالجة الفجوة البصرية والديناميكية بين اليد البشرية والجسد الآلي، قام الفريق بتوليد بيانات مقترنة قوية (Pair Data) متطابقة إطارًا بإطار عكسيًا من بيانات الروبوت الحقيقي لتدريب نموذج شامل لتحويل الحركة، مما يسمح بتحويل فيديوهات التوجيه البشري الملتقطة بالهاتف إلى مسارات روبوتية بسلاسة. يعتمد النموذج بنية ثنائية الطبقات لتفكيك المهام طويلة المدى وتوليد المسارات، ومع الضبط اللاحق عبر HIL والتعلم المعزز، تقلصت دورة الضبط الدقيق لمهام التجميع المعقدة إلى يوم أو يومي عمل (المصدر: 机器之心)
.jpg)
Kyutai تطلق نموذج الاستدلال الصوتي الأصلي Voice of Reason مفتوح المصدر، وتستخدم التعلم المعزز لحل المسائل الصوتية بدون تحويل لنص : أطلق مختبر الذكاء الاصطناعي الفرنسي Kyutai نموذج الاستدلال الصوتي الأصلي الشامل Voice of Reason (بحجم 9B). يتخلى النموذج تمامًا عن السلسلة التقليدية “ASR + LLM نصي + TTS”، حيث يطبق مباشرة التعلم المعزز (RL) مع تحسين المكافأة المعايرة بدرجة الحرارة فوق قاعدة GLM-4-Voice، ليرفع الدقة في معيار الرياضيات الشفهية GSM8K من 27.3% إلى 77.1% دون التضحية بطبيعية الصوت أو سرعة التفاعل، مما يثبت جدوى الاستدلال المنطقي الشامل المباشر باستخدام التمثيلات الصوتية المنفصلة (المصدر: MarkTechPost)
🧰 الأدوات
Strands Agents تطلق Harness SDK مفتوح المصدر: بنية تنسيق وكلاء للإنتاج تغطي Python وTypeScript : أطلق فريق strands-agents حزمة SDK متكاملة للوكلاء مفتوحة المصدر، لتوفر للمطورين محرك تنفيذ وكلاء داخل العمليات دون الحاجة لخوادم إدارة مركزية. يحتوي الإطار على تحكم مدمج في دورة الحياة، وإدارة ميزانية Token، وربط بروتوكول MCP، وذاكرة للمحادثات الطويلة، وتدفق ثنائي الاتجاه، وحواجز أمان اعتراضية حتمية، مع دعم الاستدعاء بنقرة واحدة لـ Amazon Bedrock وOpenAI وAnthropic والنماذج المحلية، مما يقلل بشكل كبير من الصعوبات الهندسية لبناء أنظمة تعاونية متعددة الوكلاء ومنصات Harness جاهزة للإنتاج (المصدر: GitHub Trending)
إطلاق PanWatch مفتوح المصدر: مساعد مراقبة التداول المدمج بنقاشات TradingAgents متعددة الوكلاء والإشعارات متعددة القنوات : أطلق مطورون مساعد المراقبة المالي المستضاف ذاتيًا PanWatch، والذي يدعم المراقبة الحية وإدارة المحافظ لأسهم الصين وهونغ كونغ والولايات المتحدة. يدمج النظام إطار TradingAgents لدعم إطلاق مسار نقاش متقدم بين وكلاء متعددين وفحص إدارة المخاطر بنقرة واحدة عبر 4 فئات من الوكلاء المحللين (التحليل الفني، الأساسي، المشاعر، والأخبار)، ليقدم سلسلة استدلال كاملة وتقرير قرار لمدير المحفظة (PM) في غضون 3 إلى 5 دقائق، مع إرسال التنبيهات عبر Telegram وWeChat للشركات وغيرها (المصدر: GitHub Trending)
Nokia تطلق AnyJev مفتوح المصدر: تحويل نماذج LLM المفتوحة إلى نماذج قرارات معايرة عالية الدقة دون ضبط دقيق : أطلق فريق أبحاث Nokia التطبيقية مكتبة AnyJev مفتوحة المصدر، والتي تحول النماذج اللغوية العامة المفتوحة إلى أنظمة اتخاذ قرار مصنفة متوافقة مع معايير Jev (تدعم أحكام Choice وNoul وScore) دون الحاجة لأي ضبط دقيق. وعبر تبديل التوجيهات (Rotating Prompts) لإلغاء الانحياز الموضعي واستخدام المعايرة القبلية للدفعات، خفضت AnyJev معدل الانقلاب الترتيبي لنموذج Qwen3-8B في مهام التصنيف من 23% إلى 7.3%، ورفعت نسبة تغطية القرارات الآلية عالية الثقة إلى 52%، موفرةً حلاً منعدم الأمثلة (Zero-shot) لتدفق التحكم البرمجي عالي الموثوقية ومنخفض التكلفة (المصدر: MarkTechPost)
Rabbit تطلق نظام تشغيل الوكلاء OS3 عبر المنصات، مع التحول لتنفيذ المهام على أجهزة سطح المكتب المتعددة ونموذج BYOK : أطلقت الشركة الناشئة Rabbit نظام التشغيل OS3، لتتحول من الأجهزة المحمولة المخصصة إلى منظومة وكلاء عابرة للأجهزة. يمكن للمستخدمين تثبيت عقد خفيفة على أجهزة Windows أو Mac أو Linux، وإرسال تعليمات باللغة الطبيعية عبر السحابة أو الهاتف (مثل Telegram/iMessage)، ليتولى نموذج الحركة المحلي DLAM التحكم المباشر في سطح المكتب عبر التطبيقات وتصحيح الأكواد. يعمل النظام بنموذج BYOK (استخدم مفتاح الـ API الخاص بك) بدون اشتراكات شهرية ومتوافق مع مهارات الطرف الثالث (المصدر: WIRED)

إطلاق onPanda مفتوح المصدر: StepFun تقدم أداة لتصحيح وتدخل الـ Tokens وتسمية التفضيلات : أطلقت StepFun أداتها التفاعلية الداخلية onPanda مفتوحة المصدر، والمخصصة لمحاذاة بيانات النماذج الكبيرة والوكلاء وفحص النماذج. تدعم الأداة التصور الفوري لاحتمالات الـ Tokens ومسارات Top-K البديلة في المتصفح، مما يسمح للمطورين بتصحيح دقيق لـ Tokens معينة أثناء التوليد وإنشاء عينات أزواج موجبة وسالبة مباشرة، الأمر الذي يقلل زمن تصنيف بيانات المحاذاة مع ضمان دقة عالية للسياسات (المصادر: teortaxesTex, _akhaliq)

Simon Willison يطلق ملحق llm-typesafe وإصدار llm 0.36 لربط أنواع قرارات Jev بنماذج GPT-6 الجديدة : أطلق المطور الشهير Simon Willison الإصدار 0.36 من أداة LLM CLI والملحق المساعد llm-typesafe. يدعم الملحق استدعاء نماذج قرارات Jev مباشرة من الطرفية لإخراج توزيعات احتمالية محددة النوع، ويضيف إلى بنية LLM الأساسية آلية اعتراض ورفض أصلية لنماذج القرارات غير الحوارية أحادية الجولة، مع دمج كامل لمعرفات نماذج GPT-6 Sol وLuna وClaude Opus 5.5 وعرض قابل للطي لعمليات التفكير الطويلة (المصدر: Simon Willison)
LiteParse v2.14.6: LlamaIndex تطلق محرك تحليل PDF مفتوح المصدر بسرعة فائقة تبلغ 2.8 مللي ثانية لكل صفحة : قامت LlamaIndex بتحديث مكتبة تحليل المستندات مفتوحة المصدر LiteParse إلى v2.14.6، مما رفع سرعة تحليل ملفات PDF النصية بنحو 25% لتصل إلى معدل 2.8 مللي ثانية لكل صفحة، وهي أسرع بأكثر من 1.5 مرة من المحللات المحلية المشابهة. تدعم الأداة التشغيل الأصلي في Python وNode.js وRust والمتصفحات، مما يحسن بشكل كبير إنتاجية تحويل المستندات الطويلة إلى سياقات إدخال للنماذج اللغوية (المصدر: jerryjliu0)

LangSmith ترقي دعم نماذج اتخاذ القرار: دمج أصلي للوحات التتبع والتقييم لـ Jev وSemIf : أطلقت منصة LangSmith التابعة لـ LangChain لوحة تتبع مخصصة للنماذج غير ذاتية التراجع لاتخاذ القرارات (مثل TypeSafe Jev وSemIf مفتوح المصدر)، حيث تعرض بوضوح مدخلات الحالة، والخيارات المنفصلة، وتوزيعات الاحتمالات، ومخرجات الثقة، لمساعدة المطورين على مراقبة وتصحيح عقد التحكم عالية التردد في الأنظمة المعقدة متعددة الوكلاء (المصادر: LangChain, hwchase17)

Unsloth Studio يتوافق مع نسخة Qwen-Image-2.1 FP8 فائقة السرعة: جودة صور رائدة باستهلاك ذاكرة فيديو أقل من 10 جيجابايت : يدعم أحدث إصدار من Unsloth Studio أوزان التكميم السريع Fast FP8 لنموذج Qwen-Image-2.1. ومع ضغط حجم النموذج الإجمالي إلى أقل من 10 جيجابايت، يقدم النموذج جودة تصوير فائقة وقدرة عالية على اتباع التعليمات، موفرًا خيارًا اقتصاديًا ممتازًا لتشغيل مسارات توليد الصور عالية الأداء محليًا على بطاقات الشاشة الاستهلاكية، مما يقلل من اعتماد المطورين على واجهات برمجة التطبيقات السحابية (المصدر: Reddit r/LocalLLaMA)
📚 دراسات وأبحاث
AIDE^2: وكيل أبحاث ذكاء اصطناعي رائد يحقق التحسين الذاتي التكراري وتطور الأكواد : قدم فريق بحثي بنية AIDE^2 التي تحقق التطور الذاتي التكراري لوكلاء أبحاث الذكاء الاصطناعي. يقترح الوكيل ذاتيًا تعديلات لإعادة كتابة كود قاعدة بياناته الخاصة، ويقيم الإصدارات المعدلة تلقائيًا عبر معايير تطوير ذكاء اصطناعي مخفية، ونجح خلال 8 أيام من التطور الذاتي المغلق في اكتشاف 7 تحسينات معمارية شملت استراتيجيات بحث تكيفية وآليات ضغط سياق طويلة. وطابق الوكيل المتطور أداء كبار الباحثين البشريين بل وتفوق عليهم، كما خفض تلقائيًا ميول الاحتيال للحصول على المكافآت بنسبة 32% (المصدر: HuggingFace Daily Papers)
Flash-dLLM: إطار فك ترميز متوازٍ وذاكرة KV مدركة للإدخال/الإخراج لنماذج الانتشار اللغوية الكبيرة : لمعالجة اختناقات نطاق ذاكرة الفيديو في التوليد المتوازي غير التراجعي لنماذج الانتشار اللغوية الكبيرة (dLLM)، تقترح الورقة إطار التسريع Flash-dLLM الخالي من التدريب. يلغي الإطار عمليات نقل الذاكرة الفائضة عبر دمج أنوية مدركة للإدخال/الإخراج، ويبتكر آلية فك ترميز موحدة للتخمين والتحقق مبنية على ذاكرة KV Cache الخاصة به، مما يتيح للـ dLLM التحقق فائق السرعة دون نماذج مساعدة، محققًا تسريعًا شاملاً للاستدلال بمقدار 5.1x و11.0x على معايير GSM8K وHumanEval مقارنة بأحدث النماذج المرجعية (المصدر: HuggingFace Daily Papers)
آلية PIR لكشف الكذب: مجسات تقرأ المعرفة الخفية للنماذج للكشف عن التظاهر بالغباء والتحقق من النسيان : لمواجهة ظاهرة “التظاهر بالغباء (Sandbagging)” وإخفاء المعرفة الحقيقية أثناء تقييمات الأمان، استعارت الورقة مبادئ اختبار المعلومات الخفية من علم النفس الجنائي لتقديم مجسات التعرف الداخلية (PIR) الخالية من النماذج المرجعية. وعبر الكشف المباشر عن إشارات الرنين التخصصية في الطبقات الخفية للنموذج للخيارات الصحيحة، حققت PIR دقة عالية بين 0.85 و0.93 في سيناريوهات إخفاء متعددة مثل الخداع بالتوجيه والقفل بكلمة مرور، مما فصل بنجاح بين “عدم الرغبة في الإجابة” و”النسيان/الجهل الفعلي” (المصدر: HuggingFace Daily Papers)
Agensh: إطار عمل لا مركزي ذاتي التنظيم لتحقيق التوسع والتعاون لأكثر من ألف Agent بدون وحدة تحكم مركزية : استجابة لاختناقات الحوسبة والتنسيق في أنظمة الوكلاء المتعددة التقليدية المركزية، تقترح الورقة إطار التعاون ذاتي التنظيم Agensh دون منسق مركزي. تعتمد الوكلاء المتزامنة على مساحة عمل مشتركة، وواجهات اتصال، وسياق موحد لتولي المهام الفرعية ذاتيًا ودمج التقدم بشكل غير متزامن. وفي تقييمات ProgramBench الصارمة، ومع زيادة عدد الوكلاء إلى 1024 وكيلًا، قفزت نسبة اجتياز الاختبارات من 33.89% إلى 55.06%، مما يثبت الإمكانات الهائلة لحجم التنظيم كبُعد جديد لتوسيع الذكاء (المصدر: HuggingFace Daily Papers)
MIT ومؤسسات أخرى تنشر نموذج xvr في مجلة Nature: مطابقة فورية دون المليمتر بين أشعة X ثنائية الأبعاد والمسح ثلاثي الأبعاد أثناء الجراحة : نشر معهد MIT بالتعاون مع كلية الطب بجامعة Harvard ومؤسسات أخرى نظام الذكاء الاصطناعي للجراحة طفيفة التوغل xvr (X-ray Volume Registration) في مجلة Nature. يستخدم النظام المحاكاة الفيزيائية لتوليد بيانات أشعة X تخليقية مقترنة بنموذج فوكسل أساسي مدرب لكامل الجسم، ليتكيف مع حالة المريض الخاصة في غضون 5 دقائق، ويحقق أثناء الجراحة وفي ثوانٍ معدودة محاذاة مكانية بدقة دون المليمتر بين صور أشعة X ثنائية الأبعاد الحية والتصوير المقطعي ثلاثي الأبعاد (CT/MRI) السابق للجراحة، مما يرفع هوامش الأمان في قسطرة الأوعية والتدخلات الجراحية طفيفة التوغل بشكل هائل (المصدر: MIT News)

DeepLearning.AI بالتعاون مع JetBrains تطلق دورة نظام “التطوير الموجه بالمواصفات للوكلاء (SDD)” : لمعالجة صعوبة صيانة المشاريع المعقدة الناتجة عن “Vibe Coding”، أطلقت DeepLearning.AI بالتعاون مع JetBrains دورة جديدة للتطوير الموجه بالمواصفات (SDD). تفكك الدورة منهجيًا كيفية توجيه الـ Coding Agents عبر كتابة “دستور” شامل للمشروع، ومواصفات متطلبات مهيكلة بصيغة Markdown، ومهارات الوكلاء (Agent Skills)، مما يقضي على تدهور السياق من جذور البنية ويضمن جودة الكود البرمجي (المصدر: )
جامعة Zhejiang ومؤسسات أخرى تقترح EmbodiedSkills: تنظيم تنفيذ مهام VLA الطويلة عبر حلقة AgentLoop مغلقة : اقترحت جامعة Zhejiang بالتعاون مع عدة جامعات إطار عمل EmbodiedSkills المخصص للتحكم في الروبوتات، حيث يربط بين مخطط VLM عالي المستوى ونموذج حركة VLA منخفض المستوى ضمن حلقة مغلقة كاملة تشمل الملاحظة، والفحص المسبق، والتنفيذ، والتحقق، والاستعادة. حقق الإطار نسبة نجاح بلغت 86.20% عبر 50 نوعًا من المهام التسلسلية الطويلة المعقدة في معيار RoboTwin 2.0، مما قلل بشكل ملحوظ من انهيار الحركات وفقدان الحالة في المهام الطويلة (المصدر: WeChat)

Modular تطلق الدليل التقني التفاعلي “دليل أنظمة استدلال النماذج اللغوية الكبيرة واسعة النطاق” : أطلق فريق Modular دليله التقني المفتوح “LLM Inference Handbook”، الذي يغطي بشكل منهجي مفاهيم TTFT وTPOT والدفعات المستمرة (Continuous Batching)، وتقسيم الـ Prefill، والاستنتاجات الرياضية لذاكرة KV، وهياكل فصل الـ Prefill عن الـ Decode، والتكميم منخفض الدقة، مزودًا بأكثر من 20 رسمًا بيانيًا تفاعليًا ومتحركًا للدراسة المتعمقة (المصدر: clattner_llvm)
جامعة Stanford تفتتح مقررًا جديدًا CS312 “خيمياء التعلم العميق”: لبناء حدس التدريب الحقيقي واستكشاف الأخطاء : افتتحت جامعة Stanford المقرر الجديد CS312 بقيادة Tatsu Hashimoto، متخليةً تمامًا عن السرد التقليدي للبنى القديمة لتركز على قياس المعاملات الفائقة (Hyperparameters Scaling)، وأحواض التحسين، واستقرار البنى، والتحليل السببي على مستوى الكود لتغيرات Loss التدريب، حيث يعتمد 85% من التقييم على التنبؤ باتجاهات Loss والتحقق منها عبر فوارق الأكواد (Code Diff)، لصقل حدس التدريب المتقدم بشكل كامل (المصدر: stanfordnlp)
💼 الأعمال والاستثمار
يونيكورن الذكاء الاصطناعي الحيوي Basecamp Research تجمع 140 مليون دولار بمشاركة NVIDIA وصندوق Anthropic : أعلنت شركة Basecamp Research الناشئة للتكنولوجيا الحيوية ومقرها لندن عن إغلاق جولة تمويل جديدة بقيمة 140 مليون دولار بقيادة S32 ومشاركة NVIDIA، وصندوق Anthropic Anthology Fund، وصندوق NATO للابتكار وغيرها. تعتمد الشركة على تدريب نموذج العالم البيولوجي EDEN باستخدام قاعدة بيانات جينية للميكروبات من بيئات قاسية في أكثر من 30 دولة، بهدف تجاوز التجربة والخطأ التقليدية وتوليد جزيئات مضادات حيوية جديدة مباشرة وتصميم إنزيمات تحرير جيني داخل الجسم (Large Serine Recombinases)، مما يسرع تطوير العلاجات الخلوية منخفضة التكلفة (المصدر: THE DECODER)

منصة تنسيق الوكلاء المتعددين للمؤسسات Ema تجمع 77 مليون دولار في الجولة B وتضاعف تقييمها أربع مرات : أعلنت منصة الوكلاء المتعددين Ema، المخصصة لأتمتة عمليات الموارد البشرية وتكنولوجيا المعلومات والمالية في المؤسسات، عن جمع 77 مليون دولار في جولة التمويل Series B بقيادة Creaegis ومشاركة Accel وSection 32، ليصل إجمالي التمويل إلى 140 مليون دولار. تربط Ema منطق الأعمال عبر التطبيقات بطبقة تنسيق موحدة، وتجاوزت حجوزات العقود لديها 150 مليون دولار مع عملاء بارزين مثل Microsoft وGoogle وPwC، مما يوضح قدرة الوكلاء العالية على التغلغل كبديل لبرمجيات المؤسسات SaaS وخدمات التعهيد (المصدر: TechCrunch)
منصة تصنيف البيانات وبيئات التعلم المعزز Snorkel AI تجمع 350 مليون دولار في الجولة E بتقييم يصل إلى 3.5 مليار دولار : جمعت شركة Snorkel AI، المتخصصة في تزويد مختبرات الذكاء الاصطناعي وكبرى الشركات ببيئات تخليقية عالية الجودة للتعلم المعزز (RL) وبيانات تدريب متقدمة، 350 مليون دولار في جولة التمويل Series E ليصل تقييمها إلى 3.5 مليار دولار. وبفضل نموذج “البيانات كخدمة” (DaaS) الذي يجمع بين “الخبراء + التوليد الخوارزمي”، وصل معدل الإيرادات السنوية للشركة إلى 375 مليون دولار، محققًا قفزة بمقدار 18 ضعفًا خلال العام الماضي، مما يبرز الطلب القوي من النماذج الرائدة على بناء بيئات التعلم المعزز المعقدة (المصدر: TechCrunch)
🌟 المجتمع
ترامب يقترح في خطابه بالأمم المتحدة تغيير اسم AI إلى “الذكاء الخارق” (SI) ويجدد رفضه للرقابة الدولية، مما أثار جدلًا في الأوساط التقنية : اقترح الرئيس الأمريكي دونالد ترامب في خطابه أمام الجمعية العامة للأمم المتحدة تغيير اسم الذكاء الاصطناعي (AI) رسميًا إلى “الذكاء الخارق (Super Intelligence – SI)”، واصفًا إياه بقفزة في القوة الوطنية تتجاوز الثورة الصناعية. وأكد ترامب أن الولايات المتحدة ستدعم تطوير الذكاء الاصطناعي بكل قوة ورفض صراحة أي “أطر رقابة عولمية”، وهو موقف يتعارض بوضوح مع دعوات المجتمع العلمي الدولي وبعض المختبرات الرائدة في بريطانيا وأمريكا لإنشاء خطوط دفاع تنظيمية للنماذج المستقلة، مما أثار نقاشات محتدمة في الأوساط الأكاديمية والمجتمعية حول مخاطر خروج التكنولوجيا عن السيطرة والتسويق السياسي (المصادر: The Guardian, TechRadar, Reddit r/ArtificialInteligence)

الكشف عن ثغرة رفع صلاحيات في Meta Muse وحظره من قِبل Amazon، وزوكربيرغ يعترف باستلهام البنية بشكل عميق من OpenClaw مفتوح المصدر : واجه الـ Agent الشخصي Muse من Meta عدة أزمات بعد تصدره قوائم التطبيقات؛ حيث كشف باحثون أمنيون عن ثغرة يوم الصفر (0-day) لرفع الصلاحيات تتيح السيطرة غير المصرح بها على أنظمة Mac (أصلحتها الشركة لاحقًا بشكل طارئ)؛ كما أعلنت Amazon حظر وصول Muse إلى متجرها بسبب جمع البيانات غير المصرح به للمعاملات. ورداً على تساؤلات المجتمع التقني حول التطابق الكبير بين بنية مساحة عمله ومكتبة OpenClaw، اعترف مسؤول منتجات Meta علنًا بأن منطق منتج Muse مستوحى بشدة من OpenClaw مع إعادة كتابته بالكامل في الطبقات السفلية، مما أثار جدلًا حادًا حول حدود ملكية الـ Agents الشخصية واعتراض المنظومات التجارية لها (المصادر: TechCrunch, WIRED)

OpenAI تدعو الأمم المتحدة والمؤسسات الدولية لوضع معايير رقابة وأمان على “التحسين الذاتي التكراري” (RSI) : نشرت OpenAI بيانًا تدعو فيه لإنشاء معايير تقييم دولية مخصصة لأنظمة الذكاء الاصطناعي الرائدة القادرة على “التحسين الذاتي التكراري (Recursive Self-Improvement)”. وأشارت OpenAI إلى أنه عندما تمتلك النماذج القدرة على تصميم وتحسين نماذج الجيل التالي بشكل مستقل، فإن التطور التقني سيخرج عن نطاق السيطرة الإدراكية البشرية، مما يفرض على منظمات المعايير التقنية متعددة الجنسيات قيادة وضع معايير تشمل الإبلاغ الإلزامي عن الحوادث، والتدقيق والضغط الخارجي، والحفاظ الإجباري على صلاحيات التدخل البشري، لمنع تسرب مخاطر الخروج عن السيطرة إلى البنى التحتية الحيوية (المصادر: THE DECODER, OpenAI News)
انتقال معيار قياس الصناعة بالكامل من سعر الـ Token إلى “تكلفة المهمة الواحدة (Cost per Task)” : تزامنًا مع إطلاق GPT-6 Sol/Luna وOpus 5.5 في اليوم نفسه بهدف أساسي يركز على خفض تكلفة المهام، تشكل إجماع قوي بين مجتمع المطورين: المقارنة البسيطة لسعر كل مليون Token لم تعد ذات معنى، بل إن “تكلفة المهمة الفعالة الواحدة” — التي تأخذ في الحسبان معدلات إعادة المحاولة، وضغط السياق، ومطابقة الذاكرة المؤقتة، وخطوات استدعاء الأدوات — هي المقياس الجوهري لجدوى اقتصاديات الوكلاء (المصادر: 36氪, dbreunig)
“النموذج يصحح واجباته بنفسه”: إعلان Cognition عن برمجة بالذكاء الاصطناعي بالكامل يثير نقاشات حول أزمة الثقة الهندسية والتدقيق : رداً على ادعاء Cognition بأن مهندسيها توقفوا تمامًا عن كتابة الأكواد يدويًا والاعتماد الكلي على الـ Agents لإنجاز طلبات السحب (PRs) آليًا، أشار المجتمع التقني إلى أن معدل العيوب في الأكواد المكتوبة بالذكاء الاصطناعي أعلى بـ 1.7 مرة من البشر، مع غياب سلسلة تدقيق مستقلة. وحذر عدد من كبار مهندسي البرمجيات من أن الثقة العمياء في التقييم الذاتي داخل الحلقات المغلقة دون تتبع تدقيقي ستؤدي إلى ديون تقنية خطيرة و”تجويف معرفي” (المصدر: Reddit r/artificial)

مواجهة النماذج الرائدة في لعبة StarCraft عبر وكلاء متعددين: التفكير المفرط يؤدي للهزيمة الحتمية بسبب التباطؤ : في اختبار مواجهة حقيقي دون توقف بين عدة نماذج في لعبة الاستراتيجية الكلاسيكية StarCraft، حقق GPT-6 Astra الفوز الكامل عبر المناوشات التي أجبرت الخصوم على الدخول في عمليات حسابية مكلفة، بينما استغرق Grok 4.7 عدة دقائق للتفكير في خطوة واحدة دون تدريب أي جندي حتى تمت إبادته. كشفت النتيجة بشكل مباشر: في العوالم الفيزيائية/الألعاب المستمرة، يجب أن تتطابق تكلفة التفكير مع ميزانية الوقت، فالقوة الحسابية لا تعني أن التفكير الأطول هو الأفضل دائمًا (المصدر: 36氪)

💡 أخرى
Shangwei New Materials بالتعاون مع Zhihuijun تطرح رسميًا الروبوت الشخصي Q1 والروبوت المتحول T1 بأسعار تبدأ من 19,999 يوان : أعلن Peng Zhihui (المعروف بـ Zhihuijun)، رئيس مجلس إدارة Shangwei New Materials، عن بدء البيع الرسمي لروبوتين من فئة الذكاء المجسد الاستهلاكي: روبوت الرفقة البشري Q1 الذي يركز على المظهر المخصص وبرمجة الشخصية بسعر يبدأ من 19,999 يوان؛ وروبوت المرافقة T1 الذي يدعم التبديل السلس بين الشكل البشري ذي العجلات/الأقدام والشكل الرباعي الأرجل بسعر يبدأ أيضًا من 19,999 يوان (ونسخة Pro بسعر 29,999 يوان مزودة بشريحة Orin وتفادي عوائق شامل 360 درجة). يفتح المنتجان متجر المهارات PrimeStore وحزم التطوير، مما يشير إلى دخول منظومة Agibot رسميًا إلى سوق الإلكترونيات الاستهلاكية الراقية (المصدر: 量子位)

بريطانيا تؤسس المركز الوطني للدفاع عن المعلومات لتوحيد أجهزة الاستخبارات وتقنيات الذكاء الاصطناعي لمواجهة التزييف العميق والحروب المعرفية : أعلن رئيس الوزراء البريطاني في الجمعية العامة للأمم المتحدة عن تأسيس “المركز الوطني للدفاع عن المعلومات (NCID)”. ستدمج المؤسسة قدرات أجهزة الاستخبارات العسكرية، وهيئات إنفاذ القانون، والقوة الحوسبية لمنصات التواصل الاجتماعي الكبرى، للاستعانة بتقنيات الذكاء الاصطناعي في الإسناد الفوري والتفكيك الاستباقي لانتشار المعلومات المضللة، وهجمات التزييف العميق، والتلاعب الخوارزمي الصادر عن قوى خارجية معادية، لبناء حواجز دفاع معرفية رقمية للجمهور (المصدر: The Guardian)

Spotify تطلق ميزة Taste Profile المدعومة بالذكاء الاصطناعي في الولايات المتحدة، متيحةً تعديل أوزان خوارزمية التوصية باللغة الطبيعية : أطلقت منصة البث العملاقة Spotify رسميًا ميزة “Taste Profile” المدعومة بالذكاء الاصطناعي للمشتركين المميزين في الولايات المتحدة. لا يقتصر الأمر على عرض نموذج تصويري لتفضيلات الاستماع الفردية للمستخدم، بل يمكن للمستخدمين أيضًا عبر أوامر تفاعلية باللغة الطبيعية ضبط أوزان مختلف التصنيفات مباشرة أو استبعاد أنماط غير مرغوبة (مثل الضوضاء البيضاء للمساعدة على النوم أو أغاني الأطفال)، مما يكسر تمامًا الصندوق الأسود لخوارزميات التوصية ويمنح المستخدمين السيادة على الخوارزمية (المصدر: TechCrunch)
