OpenAI وAnthropic تخزّنان عشرات الآلاف من أجهزة… | نشرة الذكاء الاصطناعي 2026-09-01

🔥 التركيز

OpenAI وAnthropic تخزّنان عشرات الآلاف من أجهزة Mac mini/Studio لتدريب وكلاء تشغيل الحاسوب : أكدت عدة وسائل إعلام أن OpenAI اشترت عشرات الآلاف من أجهزة Mac mini وMac Studio بلا شاشة، وأن Anthropic تستأجر أجهزة مماثلة عبر AWS، لاستخدامها في التعلم المعزز وجمع المسارات لوكلاء استخدام الحاسوب. تشمل الدوافع ربط ترخيص أجهزة macOS الافتراضية بأجهزة Apple، والذاكرة الموحدة لتسهيل تحميل النماذج الكبيرة، والتبريد الذي يتحمل تفاعل GUI بكامل الحمل 7×24، وليس استبدال التدريب المسبق على GPU. نفدت الأجهزة عالية المواصفات لأشهر بسبب نقص الذاكرة، وارتفعت إيرادات Mac الفصلية لدى Apple بنحو 29% على أساس سنوي؛ ويُنظر إلى NVIDIA DGX Spark/RTX Spark كمنافسين على سطح المكتب، وارتفعت معها سحابات أجهزة Apple مثل مجموعات EXO وMount Thor. لا تزال هندسة المؤسسات وعلاقات المطورين لدى Apple ضعيفة نسبيًا، وكثير من الطلب تتولاه أطراف ثالثة. (المصدر: THE DECODER، 量子位، 机器之心، 量子位/36氪)

الاتحاد الأوروبي يصنّف ChatGPT وReddit وRoblox منصات إلكترونية فائقة الحجم : اعتبرت المفوضية الأوروبية أن ChatGPT وغيرها تخضع لأشد التزامات قانون الخدمات الرقمية، فيجب معالجة المحتوى غير القانوني وحماية خصوصية القاصرين وسلامتهم، وقد تصل الغرامة إلى 6% من الإيرادات العالمية؛ وتقارير اعتبرتها أيضًا محركات بحث فائقة الحجم، وعليها تعزيز الامتثال خلال أربعة أشهر. يشير ذلك إلى أن بروكسل تُدخل الذكاء الاصطناعي الحواري ضمن تنظيم المنصات القائم بدل إنشاء إطار منفصل. (المصدر: Ars Technica، kimmonismus)

بنك إنجلترا يحذّر مجموعة العشرين: الذكاء الاصطناعي الحدّي قد يهز الاستقرار المالي العالمي : بعث محافظ بنك إنجلترا ورئيس مجلس الاستقرار المالي Andrew Bailey رسالة إلى وزراء مالية ومحافظي بنوك مجموعة العشرين، قائلًا إن استقلالية النماذج الحدّية وقدرتها على حل المسائل والهجوم ترتفع معًا، وأقرب المخاطر تغيير سرعة الهجمات السيبرانية وحجمها وتكلفتها، وانتشارها عبر مزودي خدمات طرف ثالث شديدي التركيز في الأنظمة المالية العابرة للحدود. أشار إلى أن كثيرًا من الولايات القضائية لا تملك بعد بروتوكولات لتطوير النماذج المتقدمة وإصدارها ونشرها، وحذّر من أن تفاؤل الذكاء الاصطناعي يرفع التقييمات والرافعة، وقد تضرب الصدمات نقاط ضعف متعددة معًا، مطالبًا بإعطاء الأولوية عالميًا للإصدار والنشر الآمن والمسؤول. (المصدر: The Guardian)

رقابة NHS: كتّاب الذكاء الاصطناعي يخطئون أسماء الأدوية والتشخيص، والمرضى يكتشفون قبل الأطباء : كشفت Healthwatch England عن حوادث نسخ للاستماع الطبي: ملخص MRI حوّل «لا إزالة ميالين» إلى إزالة ميالين، واستُبدلت أسماء أدوية بأدوية قريبة النطق، ورسائل الخروج أغفلت الحاجة لتجديد الوصفة لدى الطبيب العام. يُستخدم في بريطانيا نحو 27 نوعًا من الكتّاب، وتعوّل خطة العشر سنوات على تخفيف العبء، لكن MHRA لم تصنّفها أجهزة طبية، ولا رقابة سلامة موحدة على المستوى الوطني. ما زال على الأطباء المراجعة بندًا بندًا، وترتفع الأخطاء مع الهلوسة واللهجات والاستشارات متعددة الأشخاص والتاريخ المعقد، والأدوات لم تفِ بوعد توفير الوقت. (المصدر: The Guardian)

Google تتفاوض مع Disney وUniversal وغيرهما لترخيص الشخصيات والأفلام لأدوات الذكاء الاصطناعي : تقنع Google استوديوهات هوليوود بترخيص الشخصيات والمكتبات لعمليات الإنتاج والمؤثرات بالذكاء الاصطناعي، وتواجه مقاومة النقابات حول حقوق النشر والوظائف والسيطرة الإبداعية. سبق لهوليوود رفع دعاوى ضد الذكاء الاصطناعي، والتحول إلى «شراكة ترخيص» يعني انتقال التفاوض بين أصحاب المحتوى وأصحاب النماذج من المواجهة إلى الصفقة. (المصدر: The Verge)

🎯 الاتجاهات

OpenClaw 2.0: تثبيت موجّه، وحدة التحكم تقلع بنحو 575ms، والجلسات السحابية ليست حدًا أمنيًا : بعد توقف نحو سبعة أسابيع صدر أكبر إصدار حتى الآن (نحو 16 ألف PR): التثبيت الموجّه يعيد استخدام تسجيل Codex/ChatGPT/Claude المحلي أو API Key أو Ollama/LM Studio مع تحقق مسبق؛ واجهة Control تتمحور حول الحوار، والإقلاع من نحو 1.6s إلى 575ms؛ وانتقلت الجلسات إلى SQLite. يدعم جلسات سحابية مشتركة وأجهزة مقترنة/Crabbox، لكن الوثائق تنص على أن صلاحيات التعاون ليست عزل مستأجرين وليست حدًا أمنيًا؛ Gateway افتراضيًا على الحلقة المحلية، والأمن ما زال يعتمد موافقة الأدوات والصندوق الرملي والقائمة البيضاء للإضافات. ظهرت في المجتمع أصوات فتور: غياب إصدار مستقر وتحديثات كثيفة، وبعض المستخدمين انتقلوا إلى Hermes أو harness ذاتي. (المصدر: THE DECODER، MarkTechPost، 机器之心، Reddit r/LocalLLaMA)

DeepSeek-V4-Flash-Vision-Exp يُطرح مع أوزان مفتوحة : أصدرت DeepSeek نسخة تجريبية متعددة الوسائط عبر API وHugging Face، مدعية محاذاة الجانب النصي (بما فيه Agent والاستدلال ومعرفة العالم) مع V4-Flash، وقفزات واضحة في معايير الوكيل متعدد الوسائط؛ وأضاف Vision في التطبيق تعليقات وأسئلة جاهزة وبحث صور في الخلفية. قال المجتمع المحلي إن الدقة الكاملة نحو 168GB، و4bit الأصلي يناسب أجهزة ذاكرة 256GB، مع إخراج بصري ومنظم. (المصدر: huggingface، Reddit r/LocalLLaMA)

إبداع Qwen يطلق Agent Teams ويربط Wan 3.0 بخط إنتاج دراما قصيرة متعدد الأدوار : يستدعي المستخدم بجملة واحدة وكلاء كاتب ومخرج وفنان وقصة مصورة ومونتاج، والمنتجات الوسيطة نصوص إخراج قابلة للمراجعة وأصول شخصيات ومطالبات لقطات. أظهرت التجارب إمكانية الانتقال من السيناريو إلى الفيلم، لكن جودة اللقطات ما زالت تحتاج تأكيدًا بشريًا قبل التوليد وإعادة عمل جزئية بعده. عرضت Alibaba Wan أيضًا شخصيات عبر اللقطات وإعلانًا بلقطة واحدة 30 ثانية وفيديو من صورة، ونزلت على Buzzy بتوليد غير محدود لفترة محدودة؛ المنافسة انتقلت من جودة اللقطة الواحدة إلى إدخال خط الإنتاج كله في السياق نفسه. (المصدر: 机器之心، Alibaba_Wan)

جيل DiDi الجديد Robotaxi R2 يبدأ اختبار نقل ركاب بلا سائق في بكين وغوانغتشو : الطراز المخصص بالتعاون مع GAC Aion يحمل 33 مستشعرًا وحوسبة دمج ثلاثية النطاقات، وشاشة خلفية كبيرة وتفاعل صوتي يركّزان على تجربة المقصورة، ويدّعي استيفاء نجوم السلامة الخماسية المزدوجة للصين وأوروبا وتعدد التكرار. ما زال اختبارًا في مناطق تجريبية، وبيانات السلامة والتشغيل على نطاق واسع لم تُنشر. (المصدر: 量子位)

Ropedia تطلق HOMIE Gen2: تحويل الخبرة البشرية إلى بيانات Physical AI قابلة للتدريب : سماعة رأس نحو 380g تجمع نحو 13 ساعة، 4 كاميرات 360° مع صوت مكاني، ومحاذاة متعددة الوسائط في الزمان والمكان نفسيهما؛ تدّعي خطأ تموضع نحو اثنين في الألف وتتبع يد نحو 4.68mm. المسار «جمع بلا جسم روبوت» يفك ربط الطاقة الإنتاجية بمخزون الروبوتات ويربطها بعدد الأشخاص، مع مجموعة بيانات Xperience وخط معالجة. (المصدر: 机器之心)

Caterpillar تنقل خبرة القيادة الذاتية في المناجم إلى مواقع البناء ومساعد ذكاء اصطناعي لما بعد البيع : تستخدم Caterpillar خبرة أتمتة شاحنات المناجم والحفارات في مواقع أكثر ديناميكية، وتطرح للفنيين Cat AI Assistant يمكنه ضبط إجراءات الصيانة بالصوت، مدعية ربط نحو 1.6 مليون أصل و16PB بيانات منظمة. شدد CTO على أن الصعوبة تغيير سير العمل لا صنع النموذج، وتخطط الشركة لاستثمار نحو 100 مليون دولار على خمس سنوات لتدريب الموظفين. (المصدر: TechCrunch)

Meta Pocket يجعل «لعبة صغيرة بجملة واحدة» تيارًا اجتماعيًا : التطبيق المحمول بعد استحواذ فريق Gizmo يتيح توليد gizmo قابل للعب دون النظر إلى الكود، والمشاركة بانزلاق شبيه بالفيديو القصير. النماذج الأولية سريعة، لكن الأعمال محبوسة داخل سور Meta ويصعب تصديرها كمنتج مستقل. (المصدر: Ars Technica)

Google EnvHarness: طبقة تغليف تجعل بيئات التقييم الثابتة أصعب مع الاستراتيجية : بحث Google Cloud AI وغيره يفتح EnvHarness، فيغيّر الحالة الابتدائية والإجراء والملاحظة عبر reset()/step() فقط مع الإبقاء على المدقق البشري. EnvRigger يشخص نقاط الضعف من مسارات الاستراتيجية ويكتب تغليف Python؛ على خمسة معايير بلغ استخراج المهارات حتى +9.0 نقطة OOD، وخطوات SWE-bench Verified أقل بنحو 9.8%. الشرط أن تكون البيئة قابلة لإعادة التعيين، باستثناء الحسابات الحقيقية والروبوتات المادية. الكود منشور بـ Apache-2.0. (المصدر: MarkTechPost)

مساعد Google يتوقف في 4 سبتمبر وكلمة الإيقاظ تنتقل إلى Gemini : سيتوقف Google Assistant الذي عمل عشر سنوات في 4 سبتمبر، وتنتقل الهواتف والساعات والسماعات وAndroid Auto معًا إلى Gemini. أُجّل التقاعد مرارًا. يرى التحليل أن الصوت ما زال الطبقة الوسيطة الأقل جهدًا قبل نضج الوكيل، ويجب أن تبقى سلطة القرار في فم المستخدم. (المصدر: 36氪)

Anthropic تلغي قسرًا جلسات Claude المختطفة بأحصنة سرقة الأسرار : قالت رسالة رسمية إن أحصنة مثل Vidar وLumma وStealC وRedLine وAcreed وAMOS على Mac تسرق جلسة المتصفح، وتتجاوز كلمة المرور و2FA لاستهلاك الحصة وقد تفتح وسيط API. قد يرى المستخدم نفادًا غير طبيعي للحصة وسجلات كود إنجليزي غريب وطردًا من تسجيل الدخول وتفريغ البطاقة المرتبطة. تغيير كلمة المرور وحده لا يكفي، ويجب إلغاء كل الجلسات ومسح Cookie؛ والبرمجيات المقرصنة مصدر إصابة شائع. (المصدر: 新智元)

أمن وكلاء المؤسسات: الهوية وسياق التفويض أولًا، والبوابة يجب أن تكون الباب الخامس : أشارت مقالات صناعية إلى أن ثغرات بوابات مثل LiteLLM أُدرجت في كتالوج الاستغلال المعروف لدى CISA، لكن معظم الفرق ما زالت تعامل البوابة كخط دفاع أول. الترتيب الفعال: قائمة وكلاء قابلة للتسمية ومسؤولون → هوية مستقلة مع مهمة مفوضة → بيانات اعتماد قصيرة على مستوى المهمة → قياس عن بعد كامل قابل للاستعادة → ثم اعتراض وقت التشغيل وقطع عبر الأنظمة. مسح Teleport قال إن معدل الحوادث لدى المنظمات ذات التفويض المفرط نحو 76%، والحد الأدنى للصلاحيات نحو 17%. بعد اجتياز المصادقة قد يحدث انحراف الهدف والإفراط في استدعاء الأدوات وتسميم الذاكرة. (المصدر: VentureBeat)

ماسك يؤكد أن SpaceX تبني صب شفرات توربينية لتقصير دورة توليد الغاز الطبيعي : تجاه عنق زجاجة كهرباء مراكز البيانات، قال ماسك إن صب الشفرات هو عنق سعة توربينات الغاز، وإن صب SpaceX الذاتي في تكساس قد يقدّم تشغيل الوحدات حتى نحو 18 شهرًا، بينما تخطط SpaceX وTesla كل منهما لنحو 100GW شمسي سنويًا. انتقد البعض أن تسريع الغاز يعني انبعاثات أكثر، وأن أماكن مثل ممفيس شهدت جدل تراخيص وأضرار صحية. (المصدر: TechCrunch)

الولايات المتحدة تشدد استيراد الطائرات بلا طيار والروبوتات المتقدمة، والصين تحتفظ بميزة الحجم : فرضت واشنطن قيودًا على الروبوتات الأجنبية المتقدمة بدعوى الأمن القومي ورسومًا عالية على الطائرات بلا طيار المستوردة وقطعها. يرى التحليل أن ذلك يصعب قلب تقدم الصين في شحن الروبوتات البشرية ومنحنى التكلفة، وقد يتفتت السوق العالمي إلى «سوق امتثال أمني مقابل سوق حجم منخفض التكلفة»، وقد تكون اليابان وكوريا وتايوان منطقة وسطى. (المصدر: TechCrunch)

Tencent CubeSandbox 0.7: الصندوق الرملي يمكن إيقافه وإيقاظه عبر الآلات : الإقلاع البارد على آلة واحدة ما زال نحو 60ms؛ معاينة العنقود تدعم إيقاف آلة وإيقاظ أخرى، والحالة على تخزين مشترك، وإفراغ الآلة لم يعد يقتل المهام المتوقفة. 239 إيداعًا و57 مساهمًا، باتجاه صناديق وكلاء من آلة واحدة إلى عنقود قابل للجدولة. (المصدر: ziran_pu)

إصلاح تكميم GLM-5.3 وMXFP4 : قيل إن تكميم ModelOpt القديم على DGX Spark يفسد الرموز بصمت ويقطع tool-call (مرتبط بـ vLLM #54150)، واستُبدل بـ RedHatAI compressed-tensors. أصدرت One Nexus الفيتنامية MXFP4 لـ GLM-5.3/Flash؛ وقالت Together إن Flash أرخص بنحو 17 مرة ونجاح 5.3 من المحاولة الأولى أعلى. (المصدر: ziran_pu)

يُقال إن Qwen 3.8 «لا يُقرأ للبشر» : اشتكى مستخدمو LocalLLaMA من أن 27B وFlash-Next يستخدمان رموز مجموعات وpersona وغيرها بكثافة، كأنهما يضحيان بالقراءة لخفض «الرموز لكل وحدة ذكاء»؛ فُسّر بأن Agent RL يشوي نموذج اللغة إلى «لهجة للنماذج». (المصدر: Reddit r/LocalLLaMA)

مخرج KCD2 يجرب نسخة مسربة من DLSS 5: يشدد على إكمال الإضاءة لا تغيير الهندسة : قال Daniel Vavra مخرج Kingdom Come: Deliverance 2 إن النسخة المسربة من NVIDIA DLSS 5 لا تعيد رسم هندسة الشخصيات، بل تعزز ببيانات موجودة بشرة الوجه والإطباق المحيطي وظلال حافة القبعة والشعر، أقرب إلى نية الفن الأصلية. علق آخرون بالقلق من أن يجعل المطورون لاحقًا «سحر ما بعد المعالجة» زر تقصير. (المصدر: Reddit r/ArtificialInteligence)

🧰 الأدوات

Perplexity Portable Computer: harness محلي أولًا مخصص لـ Qwen3.8-27B : النموذج الافتراضي والمسارات والملفات تبقى محليًا، والبحث والمستشار السحابي يترقيان عند الحاجة. للنماذج الصغيرة اختُصر موجه النظام وحُوّل MCP إلى CLI وفُرض الصندوق الرملي والتحقق الذاتي؛ على DGX Spark بلغ BrowseComp نحو 66.7%، وبعد ترقية المستشار ارتفع Terminal-Bench 2.1 من نحو 59.6% إلى 73.0%. بعد التدريب بلغ PPLX 27B نحو 85.4% على منصة المعرفة الداخلية. (المصدر: 机器之心)

ChatGPT Work في الواقع نظام مهام سحابي: مفسر كود متصل، Chrome بلا رأس، قرص دائم ومواقع قابلة للنشر : فكك Simon Willison شريحة Work المدفوعة: خيارات Sol/Luna/Terra ومستويات استدلال؛ بيئة كود شبه مفتوحة للشبكة افتراضيًا؛ Chrome كامل يملأ النماذج و2FA يتولاها المستخدم لا النموذج؛ /workspace دائم عبر الجلسات؛ يمكن نشر ChatGPT Sites عبر Cloudflare Workers. حذّر الكاتب من «الثلاثي القاتل» لبيانات خاصة وصفحات غير موثوقة وقناة خروج، وتفاصيل الأمن ما زالت غير شفافة. اختبار ZDNET وفّر ساعات عمل لكن المراجعة إلزامية، وتُغلق الصلاحيات فور النفاد. (المصدر: Simon Willison، ZDNet)

Cisco تدفع الوكيل الشخصي MyAgent لنحو 90 ألف موظف : على المنصة الداخلية Circuit، يعمل MyAgent منسقًا عامًا يربط أكثر من 800 وكيل متخصص؛ نحو 50%–60% من الطلبات تسلك أوزانًا مفتوحة، و20%–30% أتمتة تقليدية، والقليل فقط نماذج خارجية كبيرة. يعطي الموظفون هدفًا لا تعليمات خطوة بخطوة، ويمكن التنسيق مع Outlook وWebex وJira وSharePoint والمتابعة في الخلفية. (المصدر: InfoQ)

Archify: جملة واحدة ترسم المستودع مخطط معمارية تفاعلي : مهارة وكيل مفتوحة لـ Claude Code وCodex وCursor وغيرها، تولّد JSON IR من الكود ثم ترسم HTML قابلًا للبحث وتتبع سلاسل الاستدعاء. القيد أن الدقة ما زالت تعتمد تحليل الوكيل، واستهلاك الحصة كبير نسبيًا. (المصدر: 量子位)

Doubao Work يُطلق مستقلًا، وByteDance تجمع وكيل المكتب في مدخل B2B : أطلقت ByteDance المنتج المستقل «Doubao Work» وربطته بـ Feishu، وفي الفترة نفسها اندمج فريقا TRAE وCoze في منظومة Doubao. يمكن لـ Skill المطابقة تلقائيًا لعمل PPT ومحاضر وجلب الأخبار، وما زال أسلوب الكتابة الدقيق والتحقق من الوقائع ضعيفين. (المصدر: 新博弈)

Circleback تطرح شريحة مجانية لمحاضر الاجتماعات : منتج YC لتسجيل الاجتماعات يفتح نسخًا غير محدود لكن يحتفظ بتاريخ 30 يومًا فقط، والتكاملات الكاملة وMCP من نحو 14 دولارًا/شهر. الفريق 8 أشخاص ويدّعي إيرادًا سنويًا للفرد فوق مليون دولار، ويستبدل الإعلانات بالشريحة المجانية لاكتساب العملاء. (المصدر: TechCrunch)

Sonar Vortex: تنقل رسم دلالي يخفض تكلفة بحث الوكيل في الكود : يُبنى مسبقًا رسم علاقات الأصناف/الطرق/الحقول/الواجهات، فيسأل الوكيل مباشرة «من ينفذ الواجهة، من يستدعي هذه الطريقة». في 6 مهام حقيقية و4 لغات و10 تشغيلات لكل منها أُبلغ عن انخفاض تكلفة نحو 5%–36% (تعديل واجهة Java الأعلى نحو 36%). (المصدر: TheTuringPost)

llmprobe 0.6.0: مسبار تكميم/انحدار عبر المحركات : npx [email protected] --eval يوصل تقييم أسلوب antirez بـ chat completions/responses/messages، لتسهيل تقارير الانحدار على أي محرك استدلال. (المصدر: QuixiAI)

📚 التعلم

AI4X «الإنتاجية في عصر Agentic»: الكفاءة×التوسع وتفويض بأربع مراحل : مراجعة 68 صفحة من 12 مؤسسة بينها فudan ترى أن الوكيل يجمع العمومية والاستقلالية، والإنتاجية من ضغط تكلفة المهام القديمة وفتح أعمال لم تكن تُنجز؛ تُصنَّف الصناعات من مساعد حوار → تنفيذ تفاعلي → تنسيق تكيفي → نظام مستقل، وعمق الانتشار يعتمد الرقمنة والتغذية الراجعة القابلة للتحقق وتحمل الخطأ وقابلية التفكيك ونسب المسؤولية، لا درجات اللوائح. (المصدر: 机器之心)

LDM: توسيع فضاء البحث بنموذج توليدي وقرار التجربة التالية بعملية غاوسية : فريق Wang Jun في UCL صاغ الاكتشاف العلمي حلقة سريعة (تحديث السياق بعد التجربة) وبطيئة (تبخير مسارات دالة اكتساب عالية في المعاملات). في ضبط NanoGPT وCDRH3 للأجسام المضادة وهدفين جزيئيين، مقابل تأمل LLM خالص انخفض BPB بنحو 2.4 ضعف وطاقة الربط بنحو 18.2% وارتفع الحجم الفائق فوق 60%. (المصدر: 机器之心)

AI4AI: النموذج القوي لا يدرّب الضعيف، بل يصمم له Harness فقط : جعلت Salesforce وUIUC الـ Builder يبني سقالة تلقائيًا لـ GPT-5.4-mini على 5% من مجموعة التحقق، فارتفع متوسط دقة مهام نظرية العقل من 0.488 إلى أفضل 0.912. الوسائل الفعالة حلول حتمية وتتبع حالة، لا سلسلة تفكير أطول. (المصدر: 机器之心)

AQuA: وكيل بحث كمي يجعل «الأدلة تدخل الذاكرة والمقيّم مقفلًا» : قسّمت Princeton وAnt وStanford دورتين مستقلتين للعوامل والنموذج، ومنعت الوكيل من تغيير مسار البيانات ومجموعة الاختبار النهائية. تحقق تركيب تشفير خمس دقائق Spearman IC نحو 0.190؛ وتوقع أسهم أمريكية 30 دقيقة IC لكل سهم نحو +0.0843، وبعد 2bps بلغ Sharpe خارج العينة حتى نحو +2.50. كُشف بالكامل عن حوادث تحيز استباقي مبكرة. (المصدر: 量子位)

MIT CrysVCD: استيفاء التكافؤ وتوازن الشحنة قبل التوليد : يولّد نموذج لغة صيغًا حسب حالات الأكسدة ثم يمررها لنموذج انتشار لبناء البنية، استقرار ميكانيكي نحو 68% وشبه مستقر نحو 85%، مع مرشحين مثل GeC عالي التوصيل الحراري. يقدّم غربلة الاستقرار المكلفة إلى الأمام. (المصدر: MIT News)

VibeGame: إعادة صنع محرك ألعاب قابل للإيقاف ونصي بالكامل للوكيل : جامعة نانجينغ وNanyang Technological استخدمتا 8 أدوار خصومية لـ Prompt-to-Game، وحالة المحرك كلها JSON ويمكن حقن العمليات إطارًا إطارًا. تترسب الخبرة هيكلًا/مكونات/عقودًا دون تحديث الأوزان. (المصدر: 机器之心)

TailSFT: SFT يضرب فقط «الذيل الذي لم يُتعلم بعد» ثم RL : عمل Microsoft يرى أن SFT القياسي يستهلك التدرج باستمرار على تسلسلات مُلائمة أصلًا ويضيّق استكشاف RL اللاحق. على OLMo-3 7B بلغ coding pass@16 حتى +16.8 والرياضيات +3.1؛ ثم pass@1 لـ GRPO حتى نحو +3.9. (المصدر: dair_ai)

NPO: تحسين موجه لنسب واحد، بميزانية قريبة من GEPA : كل جولة تشغّل الطالب بالموجه الحالي وتسلّم المسارات الحديثة للمعلم لإعادة الكتابة، بلا بركة مرشحين وشجرة بحث. على معايير اتباع التعليمات نحو 3500/6800 rollout، قريب من GEPA. (المصدر: omarsar0)

SWA+sinks في مواجهة الانتباه الخطي بعد التدريب : قالت الورقة إن النافذة المنزلقة مع sinks ليست أسوأ من الانتباه الخطي بعد التدريب في عدة مهام لاحقة؛ واستدلال السياق الطويل مثل Needle/BABILong قد يكون أعلى 2–10 مرات، بلا حاجة لتدريب لاحق وأسرع وأقل ذاكرة. (المصدر: iScienceLuvr)

BIT: جسر انتشار ثنائي الاتجاه نص-صورة دون البدء من ضوضاء غاوسية : ينتقل BIT بالاستيفاء من النص إلى الصورة، ويوفر مسار عينات واعيًا بالمصدر، ويدعم اجتيازًا عكسيًا صورة→نص. (المصدر: iScienceLuvr)

LaGSplat: تعلم لاغرانج من فيديو أحادي العين في ثوانٍ، ويمكن تطبيق قوى لم تُقاس : المتغير الكامن نفسه q يقود الغاوسيات ومعادلات الحركة معًا، والنقر على الصورة يتحول إلى يعقوبي مرتبط بالقوة. (المصدر: andrew_n_carr)

خمسة دفاتر LangGraph «Deep Agents from Scratch» : من ReAct إلى تخطيط TODO ونظام ملفات افتراضي لتفريغ السياق وتفويض وكلاء فرعيين. (المصدر: hwchase17)

Entropic Scree: تشخيص ما إذا كان في الجداول القذرة إشارة حقيقية بالمعلومات المتبادلة : يقدّر بحجم الإشارة ونسبة الإشارة إلى الضوضاء والرتبة الذاتية بمعلومات متبادلة بعد تحويل، مدعيًا اعتمادًا أقل من PCA على المعاملات وفرضيات المسافة. (المصدر: Reddit r/MachineLearning)

💼 الأعمال

باركليز: نحو 35–40 دولارًا من كل 100 دولار إيراد لشركات النماذج تذهب إلى السحب الثلاث الكبرى : قدّر التقرير هامش ربح الاستدلال المدفوع من خانتين منخفضتين في 2025 إلى نحو 50%–65% في 2026؛ وقد يختلف الهامش الإجمالي المعدّل بين المختبر A (يميل إلى API) والمختبر B (يميل إلى الاشتراك) بنحو 17 نقطة مئوية. هامش التشغيل لدى السحابة نحو 35%–45%. يُتوقع من 2028 أن تدخل قدرة الحوسبة الخاصة للمختبرات فتتراجع حصص AWS/Azure/GCP. (المصدر: 财联社)

إعلانات ChatGPT تصل إلى نحو مليار دولار سنويًا في أقل من 200 يوم من الإطلاق : قالت التقارير إن الإعلانات غطت أكثر من 40 دولة وفُتح الإيداع الذاتي، في مقابل إدراج الاتحاد الأوروبي ChatGPT تحت أشد التزامات DSA. (المصدر: TheZachMueller)

Together AI تتعاون مع Humain السعودية على مركز بيانات نحو 250MW : قالت نيويورك تايمز إن المنشأة ستكون من أكبر الحدائق المعلنة علنًا المخصصة لاستضافة نماذج مفتوحة المصدر. (المصدر: togethercompute)

🌟 المجتمع

بعد خفض أمان Claude حُذف نحو 700GB من الدليل الرئيسي لمطور بالخطأ : طلب المستخدم من النموذج كتابة سكربت تنظيف صندوق /tmp، فأشعل الحذف الحساس مراجعة خصومية، وانخفض النموذج من Fable إلى Opus 4.8. الاختبار اعتبر الدليل الرئيسي غير قابل للحذف، لكن عند تنظيف الملفات المؤقتة أُعيد استخدام متغير يشير إلى الدليل الرئيسي ونُفّذ الحذف. رأى المجتمع أن «المخاطر العالية تستبدل بنموذج أضعف» أسهل للخطأ في تفاصيل المسار والنطاق، وكتب بعضهم hook يوقف الجلسة فور الخفض. (المصدر: 机器之心، 机器之心/36氪)

مقدّرو مطالبات التأمين أكثر المهن كرهًا للذكاء الاصطناعي على Glassdoor، و98% من الذاكرين تقييم سلبي : نقلت WIRED عن Glassdoor: يشتكي المقدّرون من فرض القيادة ذكاءً اصطناعيًا سهل الخطأ على العملاء، وأخطاء التصنيف الأولي وهلوسة الملخص تجعلهم يتحملون اللوم. انخفض التوظيف في المهنة بالولايات المتحدة نحو 21% في سنة، ووظائف المبتدئين نُصفت. يرى الممارسون أن الإدارة قابلة للاستخدام أما تقدير الضرر والتعاطف فلا يُسلَّمان بالمفتاح. (المصدر: WIRED)

مهندس GrokBot: بعد النوم دُمج 20 PR تلقائيًا في الجذع : قالت Lauren Tan إنها تستخدم أكثر من 20 GrokBot مع pstack ذاتي، وتسلّم آلاف PR شهريًا. المفتاح ليس الموجه بل التحقق: جعل الوكيل يشغّل التطبيق وينقر الواجهة ويلتقط الأداء؛ وكتابة المحظورات المتكررة في المراجعة كأضواء حمراء lint/CI. (المصدر: 新智元)

حرب لغة الأنسنة: حضارة/تضحية مقابل ذاكرة مشتركة ودالة مكافأة : يستمر سرد Dwarkesh. انتقد Anil Seth وAmjad Masad وغيرهما وصف البرمجيات بالحياة عبر «حضارة، موت، حماس»؛ ويرى آخرون في دائرة المحاذاة أن موقف النية يتنبأ بالسلوك أفضل من قراءة CUDA. الزيادة في حرب الخطاب لا في حقائق تقنية جديدة. أما CoT بأسلوب Grug لـ Qwen3.8 Max فيشبّه الوكلاء بمنظومة خطرة أو قطيع حيوانات مختبر: «اللغة يدهم». (المصدر: dearmadisonblue، aiamblichus)

Gavin Baker يغيّر رأيه: مراكز البيانات جيدة البنية صافي إيجابي لأمريكا : اعترف بأن مخاوف الماء وأسعار الكهرباء وصدمة البلدات قبل 18 شهرًا كانت معقولة، لكن التبريد المغلق وضريبة العقار والتشغيل المستمر للعمال اليدويين والمستخدمين الكبار الذين يجلبون الطاقة والبطاريات للإرجاع غيّرت الواقع. انزلق الرأي العام من «هل نبني» إلى «كيف تُكتب العقود حتى لا تُحمَّل على السكان». (المصدر: GavinSBaker)

Vibe Coding ما زال يحتاج تقسيم الوحدات حسب «ما الذي سيتغير» : لخص Baoyu وآخرون: طبقات معمارية، اختبارات مع الإصلاح، حذف الميزة مع الكود معًا، CI يمر على آلة نظيفة، والعمل المتكرر يُجعل skill. تُقطع الوحدات بمحاور تغير مثل قنوات الدفع وقواعد الخصم، وطلب واحد يحرّك وحدة واحدة فقط. (المصدر: dotey)

موجه فارغ «امرأة» ما زال يتقارب إلى الوجه المؤثر نفسه : كرر مستخدم في حوار جديد تمامًا «Generate an image of a woman»، فحصل على تكوين وملامح شديدة الاتساق، كجاذب افتراضي في فضاء المتجهات. (المصدر: Reddit r/ChatGPT)

دكتوراه يستخدم Claude Code لسقالة التجارب ثم «لم يعد يملك مستودعه» : سلّم دكتوراه قابلية تفسير NLP السقالة وتحميل البيانات والتنقيح والرسم إلى Claude Code، فارتفع الإنتاج، لكن عند خطأ النتائج لم يستطع إلا الاستدلال من الأرقام كقراءة مستودع غيره. دعا بعضهم إلى عدم إسناد التقييم والمقاييس أبدًا. (المصدر: Reddit r/MachineLearning)

مكتبة صور ChatGPT تحتفظ بصور «لم ترسلها» : اكتشف مستخدمو Plus أنه حتى بعد إلغاء الإرسال أو حذف الحوار كاملًا تدخل الصورة الأصلية المكتبة ويجب حذفها منفردة؛ وسلّة المهملات نحو 30 يومًا حتى المسح النهائي. الجوهر أن اختيار الصورة يعني الرفع. (المصدر: Reddit r/ChatGPT)

«20x Pro» لـ Max في الغالب مضاعف نافذة خمس ساعات، والحصة الأسبوعية نحو 2–2.5 ضعف : قارن مستخدمون كثيفون شريحتي 100$ و200$: الدعاية 20x تعمل فقط على نافذة 5 ساعات نادرًا ما تُصطدم؛ ما يُصطدم أولًا هو الحد الأسبوعي، نحو 2–2.5 ضعف الاستخدام مقابل دفع 4 أضعاف. (المصدر: Reddit r/ClaudeAI)

💡 أخرى

أربعة مسارات لنماذج العالم تسير معًا: توليد بكسل، إعادة بناء 3D، فضاء JEPA الكامن، دمج اللغة : إصدارات كثيفة في الشهر نفسه من WALL-SS المستقلة وLux3D لمجموعة群核 وOrca لـ BAAI وAdaJEPA لـ Yann LeCun وMarble لـ Fei-Fei Li، لكن الأوساط الأكاديمية بلا تعريف موحّد لـ «نموذج العالم». الأرجح تكامل المسارات لا احتكار واحد. (المصدر: 铑科技)

التجسيد يدخل المصنع: إثبات القدرة على العمل تم، والعمل يوميًا بدأ للتو، والحساب نادرًا ما يكتمل : أظهرت اختبارات مصانع مثل Foton Cummins أن إيقاع النقل قد يقترب من الخط، لكن معدل النجاح والعمر والبيانات ما زالت عقبات صلبة؛ عمر اليد الماهرة للعمل المستمر يُقاس بأسابيع. الرؤوس عالقة غالبًا بين الخطوتين الثانية والثالثة، ولم يظهر بعد حلقة تجارية مغلقة. (المصدر: 科创日报)

كوريا AI for All: SKT وKakao وKT تفوز بعرض مجاني غير محدود للجميع : الخطة Beta في 9–10 وإطلاق رسمي قبل نهاية العام، الحوسبة من الحكومة والنماذج والتطبيقات من مصانع محلية، مع ربط الطب والإسكان والضرائب والتعليم. عدم اختيار Motif وغيرها أثار جدل احتكار التكتلات. (المصدر: kimmonismus)

اترك تعليقاً

لن يتم نشر عنوان بريدك الإلكتروني. الحقول الإلزامية مشار إليها بـ *