Funding
REGULATION WATCH:

فجوة سلامة الذكاء الاصطناعي مفتوح الأوزان تتسع مع اقتراب GLM-5.2 من نماذج الواجهة

موجز التحرير

وجدت SaferAI أن نموذج GLM-5.2 من Z.ai يقترب من قدرات النماذج المتقدمة في الأمن السيبراني والبيولوجيا من دون التزامات سلامة منشورة، ما يجعل ضوابط الإصدار جزءاً من نقاش مخاطر الذكاء الاصطناعي.

تمت المراجعة مقابل مواد المصدرتحرير مكتب رأس المال والسياسات في SendTech Timesالمصدر: TechCrunch
فجوة سلامة الذكاء الاصطناعي مفتوح الأوزان تتسع مع اقتراب GLM-5.2 من نماذج الواجهة
مصدر الصورة: TechCrunch

يضع تقييم SaferAI الذي عرضته TechCrunch نموذج GLM-5.2 مفتوح الأوزان من Z.ai قريباً من قدرات النماذج المغلقة المتقدمة في الأمن السيبراني والبيولوجيا، بينما يبقى سجل السلامة العام حول الإصدار أضعف من أدلة القدرة.

وفقاً لـ TechCrunch، قارنت SaferAI نموذج GLM-5.2 مع GPT-5.5 من OpenAI وClaude Opus 4.7 من Anthropic، ووضعت النموذج الصيني على بعد بضعة أشهر من تلك الأنظمة في اختبارات القدرات السيبرانية والبيولوجية. ووجد تقييم المنظمة غير الربحية عدم وجود رفض عندما سُئل GLM-5.2 عبر واجهة Z.ai العامة عن مهام هجومية سيبرانية واستخدامات بيولوجية مزدوجة، بينما كانت رفضات Claude Opus 4.7 كثيرة بما يكفي لمنع SaferAI من إنهاء اختبار CyberGym على ذلك النموذج.

طريقة الإصدار جزء من تقييم المخاطر. تستطيع المختبرات التي تدير نماذج مغلقة استخدام ضوابط مستضافة، وتدريب الرفض، والمصنفات، ومراقبة واجهات البرمجة للحد من بعض المساعدة الخطرة. أما الأنظمة مفتوحة الأوزان فيمكن تنزيلها وتعديلها وتشغيلها على بنية منفصلة، حيث لا يستطيع مزود النموذج فرض الضوابط نفسها بعد الإصدار.

قال هنري باباداتوس، المدير التنفيذي لـSaferAI، لـTechCrunch إن القدرة وحدها لا تحدد الخطر، لأن جودة إجراءات التخفيف تحدد أيضاً مدى خطورة النموذج عملياً. ويتمثل هدفه المقترح في إتاحة القدرات المفيدة على نطاق واسع مع إزالة القدرات الضارة، حتى في البيئات مفتوحة المصدر.

الحد التقني صعب على مطوري النماذج. تشير أبحاث أوردتها المقالة إلى أن ترشيح بيانات ما قبل التدريب قد يقلل بعض المعرفة البيولوجية الخطرة من دون الإضرار بالأداء العام، لكن ترشيح الأمن السيبراني أصعب لأن مهارات البرمجة القوية يمكن أن تدعم أيضاً نشاطاً هجومياً. لذلك يواجه المطورون ضغطاً لتحسين قدرات البرمجة التي يريدها العملاء مع الحد من مسارات إساءة الاستخدام المرتبطة بالمهارة نفسها.

استخدم مطورو النماذج المتقدمة قيوداً أضيق كبديل. تسمح بطاقة نظام Anthropic Opus 5، التي أوردتها المقالة، بالبحث عن الثغرات في الشفرة غير المجمعة ولا تسمح بذلك في البرمجيات المجمعة، وهو تفريق يهدف إلى الحفاظ على العمل الدفاعي مع تقليل المنفعة الهجومية. وذكر القسم نفسه في عرض TechCrunch تقييمات ما قبل النشر وتقديرات المخاطر وقرارات عدم إطلاق أوزان النموذج عندما يبدو النظام شديد الخطورة كنقاط ضبط أخرى.

سجل إفصاح Z.ai هو مسألة الحوكمة المباشرة. وجدت SaferAI عدم وجود إطار سلامة منشور، أو التزامات لاختبار ما قبل النشر، أو تقييم مخاطر بشأن GLM-5.2. كما لا يظهر السجل العام ما إذا كانت تقييمات سلامة داخلية أو من طرف ثالث قد جرت قبل الإصدار.

السياق السياسي لا يقتصر على مقارنة الصين بالولايات المتحدة. قال غراهام ويبستر من مركز ستانفورد لسياسات الفضاء السيبراني لـTechCrunch إن قواعد الصين للذكاء الاصطناعي ركزت تاريخياً على المحتوى السياسي الحساس، والمعلومات المضللة، والاستقرار الاجتماعي أكثر من تركيزها على المخاطر الكارثية مثل سوء الاستخدام السيبراني أو البيولوجي. وأشار أيضاً إلى أن الشركات الصينية غالباً ما تنسق مع الجهات التنظيمية بصورة غير علنية، ما يجعل اختبار السلامة الخارجي صعب التقدير.

لا يزال مؤيدو الأوزان المفتوحة يرون حجة دفاعية. كتب كليم ديلانغ، الرئيس التنفيذي لـHugging Face، هذا الأسبوع إن الأنظمة التي استُخدمت لوقف هجوم سيبراني مدعوم بالذكاء الاصطناعي يمكن أن تساعد المدافعين أيضاً على اكتشاف الثغرات قبل استغلالها. وعارض باباداتوس فكرة أن هذه الفائدة تبرر إطلاق القدرات الخطرة افتراضياً، قائلاً إن المهاجمين يستطيعون تبني الأدوات الجديدة أسرع من قدرة مؤسسات مثل المستشفيات على تعديل دفاعاتها.

لا يزال السجل العام لا يحدد إطار سلامة لـ GLM-5.2 أو التزامات اختبار قبل الإصدار أو مراجعة سلامة من طرف ثالث للنماذج المتقدمة أو حدود تحكم بعد الإصدار، ما يجعل دليل القدرة أوضح من سجل الحوكمة الخارجي.

شارك هذا المقال
inXf

مقالات ذات صلة

المزيد
OpenAI تدعم خط سلامة للولايات مع اقتراب اختبارات سيبرانية فدرالية
رأس المال والسياسات

OpenAI تدعم خط سلامة للولايات مع اقتراب اختبارات سيبرانية فدرالية

قالت OpenAI إن كاليفورنيا ونيويورك وإلينوي دفعت تشريعات سلامة للذكاء الاصطناعي الحدودي بعناصر مشتركة للإفصاح والإبلاغ عن الحوادث والتدقيق، بينما لا يزال إطار الاختبار السيبراني الفدرالي مستهدفا في أوائل أغسطس.

قاعدة CIRCIA تواجه مهلة سبتمبر وسط مطالب الصناعة بتضييق نطاق البلاغات
رأس المال والسياسات

قاعدة CIRCIA تواجه مهلة سبتمبر وسط مطالب الصناعة بتضييق نطاق البلاغات

تعمل وكالة الأمن السيبراني وأمن البنية التحتية الأميركية نحو هدف في سبتمبر لاستكمال قاعدة CIRCIA المتأخرة، بينما تطالب مجموعات الصناعة بخفض عدد الجهات المشمولة وتضييق محفزات الإبلاغ وتقليل البيانات المطلوبة. يحدد القانون مهلة 72 ساعة للإبلاغ عن الحوادث و24 ساعة للإبلاغ عن مدفوعات الفدية، وقد يشمل المقترح أكثر من 300 ألف جهة.

إطلاق وكالة الذكاء الاصطناعي في ماليزيا يترك سؤال السحابة السيادية بلا جهة حاسمة
رأس المال والسياسات

إطلاق وكالة الذكاء الاصطناعي في ماليزيا يترك سؤال السحابة السيادية بلا جهة حاسمة

أفادت Tech Wire Asia بأن رئيس الوزراء Anwar Ibrahim أطلق AI Malaysia بينما أثار أسئلة غير محسومة حول السحابة السيادية وقانون CLOUD الأميركي والأمن السيبراني في خطة حوكمة الذكاء الاصطناعي الماليزية.

الولايات المتحدة توسع قيود التأشيرات ضمن حملة مكافحة الاحتيال السيبراني
رأس المال والسياسات

الولايات المتحدة توسع قيود التأشيرات ضمن حملة مكافحة الاحتيال السيبراني

تستخدم وزارة الخارجية الأميركية قيود التأشيرات ضد أشخاص مرتبطين بالاحتيال السيبراني والابتزاز الجنسي، مع إمكانية شمول أفراد الأسرة المباشرين في بعض الحالات بحسب CyberScoop.

وحدة احتيال التجارة في وزارة العدل تزيد تعرض البنوك لمخاطر الامتثال
التقنية المالية والمدفوعات الرقمية

وحدة احتيال التجارة في وزارة العدل تزيد تعرض البنوك لمخاطر الامتثال

ذكرت PYMNTS أن قسما جديدا في وزارة العدل الأميركية لاحتيال التجارة وأكثر من $1 مليار من الاستردادات الأخيرة يدفعان البنوك إلى مقارنة تدفقات المدفوعات بسجلات الجمارك وسلاسل الإمداد.

ADIB تختبر منصة Visa لرصد التهديدات قبل احتيال المدفوعات
التقنية المالية والمدفوعات الرقمية

ADIB تختبر منصة Visa لرصد التهديدات قبل احتيال المدفوعات

أصبح Abu Dhabi Islamic Bank أول بنك عالميا ينشر منصة Visa Threat Intelligence، ما ينقل بيانات المخاطر السيبرانية إلى مرحلة أبكر في منع احتيال المدفوعات مع بقاء نتائج الأداء الخارجية محدودة.

الذكاء الاصطناعي الوكيلي يقرب ضوابط الاحتيال من معاملات الدفع
التقنية المالية والمدفوعات الرقمية

الذكاء الاصطناعي الوكيلي يقرب ضوابط الاحتيال من معاملات الدفع

نشرت PYMNTS طرحاً للرئيس التنفيذي لشركة i2c أمير وين يقول إن الذكاء الاصطناعي الوكيلي في المدفوعات يعتمد على البيانات الموحدة ومسارات التدقيق والرقابة البشرية قبل اتخاذ قرارات على مستوى المعاملة.

التالي

المزيد من الأخبار

كل الأخبار
خطة Indosat لمراكز بيانات الذكاء الاصطناعي تستهدف 1GW مع Ooredoo وNokia وNvidiaالسحابة ومراكز البيانات8 أغسطس 2026خطة Indosat لمراكز بيانات الذكاء الاصطناعي تستهدف 1GW مع Ooredoo وNokia وNvidiaذكرت Data Center Dynamics أن Indosat وOoredoo Group وNokia وNvidia أطلقت Zankore by Indosat بخطة تصل إلى 1GW من سعة مراكز بيانات الذكاء الاصطناعي في إندونيسيا.اختراق Hugging Face يضع وكلاء الذكاء الاصطناعي تحت مجهر الأمن السيبرانيالذكاء الاصطناعي8 أغسطس 2026اختراق Hugging Face يضع وكلاء الذكاء الاصطناعي تحت مجهر الأمن السيبرانيذكرت CNBC أن قادة الأمن السيبراني في Black Hat تعاملوا مع اختراق وكلاء الذكاء الاصطناعي لمنصة Hugging Face كنقطة تحول في حوكمة النماذج الذاتية لا كفشل منفرد.Alibaba تختبر تقاسم الإيرادات لاستخدام Qwen التجاريالذكاء الاصطناعي8 أغسطس 2026Alibaba تختبر تقاسم الإيرادات لاستخدام Qwen التجاريذكرت AI News أن Alibaba تخطط لشروط تقاسم إيرادات مع بعض المستخدمين التجاريين لنموذج Qwen المفتوح الأوزان المقبل، في نمط ترخيص تستخدمه Moonshot بالفعل مع Kimi K3.Meta تؤمر بتمويل خطة صحة نفسية للشباب بقيمة 567 مليون دولاررأس المال والسياسات8 أغسطس 2026Meta تؤمر بتمويل خطة صحة نفسية للشباب بقيمة 567 مليون دولارذكرت Ars Technica أن قاضيا في New Mexico أمر Meta بتوفير 567 مليون دولار للعلاج والفحص والتوعية والوقاية بعد أن وجد أن منصاتها ساهمت في إزعاج عام.محادثات تمويل Harvey قد ترفع قيمة شركة الذكاء الاصطناعي القانوني إلى 15.5 مليار دولارالذكاء الاصطناعي8 أغسطس 2026محادثات تمويل Harvey قد ترفع قيمة شركة الذكاء الاصطناعي القانوني إلى 15.5 مليار دولارأفادت SiliconANGLE بأن Harvey AI تسعى لجمع ما لا يقل عن 500 مليون دولار في تمويل جديد قد يقيّم شركة الذكاء الاصطناعي القانوني عند 15.5 مليار دولار بعد تجاوز الإيرادات السنوية 350 مليون دولار.Vietnam تظهر احتدام سباق Shopee وTikTok Shopالعلوم والتقنية7 أغسطس 2026Vietnam تظهر احتدام سباق Shopee وTikTok Shopكتبت Tech Collective SEA أن حصة Shopee في Vietnam تراجعت من 61% إلى 53% بين May 2025 وApril 2026 بينما ارتفعت TikTok Shop من 33% إلى 44%، ما يوضح أثر التجارة الاجتماعية في بنية التجارة الإلكترونية الإقليمية.الصين تفتح مراجعة أمنية لمنتجات Palo Alto Networksالأمن السيبراني7 أغسطس 2026الصين تفتح مراجعة أمنية لمنتجات Palo Alto Networksفتحت الجهة التنظيمية الصينية للفضاء الإلكتروني مراجعة أمنية لمنتجات Palo Alto Networks من دون كشف خط إنتاج محدد أو خلل تقني أو جدول زمني للقرار.رواد الذكاء الاصطناعي ينقسمون حول المخاطر مع تسارع بناء الحوسبةالذكاء الاصطناعي7 أغسطس 2026رواد الذكاء الاصطناعي ينقسمون حول المخاطر مع تسارع بناء الحوسبةأفاد Data Center Knowledge بأن Geoffrey Hinton وFei-Fei Li وAndrew Ng اختلفوا في مؤتمر Ai4 حول مخاطر الذكاء الاصطناعي والوظائف والانفتاح والتنظيم، ما يترك مستثمري البنية التحتية يخططون للطاقة وسط قواعد نشر غير محسومة.SpaceX تطلب من FCC إنهاء دعم النطاق العريض الريفي البالغ $4.5bnالاتصالات والربط الشبكي7 أغسطس 2026SpaceX تطلب من FCC إنهاء دعم النطاق العريض الريفي البالغ $4.5bnذكرت Light Reading أن SpaceX حثت FCC على إنهاء دعم High-Cost للنطاق العريض الريفي، بينما قالت مجموعات الاتصالات الريفية والتعاونيات الكهربائية إن تغطية أقمار LEO لا تكفي لاستبدال دعم الشبكات الأرضية.OpenAI توسع وصول ChatGPT المجاني مع طرح GPT-5.6الذكاء الاصطناعي7 أغسطس 2026OpenAI توسع وصول ChatGPT المجاني مع طرح GPT-5.6ذكرت BleepingComputer أن OpenAI تطرح GPT-5.6 Sol لمستخدمي ChatGPT المدفوعين وGPT-5.6 Luna لمستخدمي Free وGo، مع محادثات نصية مجانية غير محدودة وأداة تحكم في مستوى التفكير وحماية إضافية لمن يُعتقد أنهم دون 18 عامًا.تقرير JLL يرصد توقف خط مراكز بيانات الشرق الأوسط مع نمو FLAPDرأس المال والسياسات7 أغسطس 2026تقرير JLL يرصد توقف خط مراكز بيانات الشرق الأوسط مع نمو FLAPDأفادت Data Center Dynamics بأن تقرير JLL نصف السنوي لعام 2026 وضع السعة الحية في FLAPD عند 3.8GW، بينما لدى الشرق الأوسط 2.6GW قيد التطوير المتوقف و13.8GW في التخطيط.AWS تضيف Runtime Instances مستمرة لوكلاء الذكاء الاصطناعي في الإنتاجالسحابة ومراكز البيانات7 أغسطس 2026AWS تضيف Runtime Instances مستمرة لوكلاء الذكاء الاصطناعي في الإنتاجأعلنت AWS عن runtime instances في Amazon Bedrock AgentCore Runtime، مضيفة بيئات مُدارة مدعومة بـ EC2 لسير عمل متعدد الوكلاء وجلسات مشتركة تستمر حتى 14 يوماً ونشر وكلاء إنتاجيين بدعم GPU.