News
AI SHIFT:

تقرير OpenAI عن وكلاء البرمجة يضع تسريع البرمجيات العلمية تحت شرط التحقق البشري

موجز التحرير

ذكرت AI News أن OpenAI وثقت ثمانية مشاريع برمجيات علمية استخدمت coding agents، مع خفض زمن التشغيل بنسبة 31% و25% ونحو 60 مرة في بعض الحالات، بينما بقي التحقق والإشراف لدى البشر.

تمت المراجعة مقابل مواد المصدرتحرير مكتب الذكاء الاصطناعي والمؤسسات في SendTech Timesالمصدر: AI News
تقرير OpenAI عن وكلاء البرمجة يضع تسريع البرمجيات العلمية تحت شرط التحقق البشري
مصدر الصورة: AI News

خمسة من ثمانية مشاريع للحوسبة العلمية في تقرير OpenAI الميداني استخدمت Codex وحده؛ بينما دمجت ثلاثة منها مع Claude Code من Anthropic.

ذكرت AI News أن الوكلاء تعاملوا مع تنظيف التعبئة، والتحسين، ونقل البرمجيات، بينما قدم الباحثون نتائج التقييم، واختبارات القبول، والحكم العلمي قبل قبول الأدوات المعاد بناؤها.

ثمانية مشاريع تختبر عمل وكلاء البرمجة في البرمجيات العلمية

يوثق تقرير OpenAI الميداني مشاريع في علم الجينوم، وعلم المناعة، والإحصاء، وتسلسل RNA. تم استبدال نظام البناء والتعبئة القديم في cyvcf2، وهي مكتبة Python لملفات المتغيرات الجينية، بعملية موحدة، بينما انتقل MHCflurry من خلفية TensorFlow/Keras إلى PyTorch دون التخلي عن التوافق مع أوزان النماذج الموجودة.

أجرى HI.SIM، وهو محاكي لقراءات تسلسل DNA، أعمال تحسين باستخدام GPT-5.2 وGPT-5.6. وضع حساب المساهم Andrew Ho في التقرير خفض زمن التشغيل عند 31% عبر مجموعة اختبار ممثلة دون تغيير المخرجات.

وصف حساب Ho أداة Hifiasm، المستخدمة في تجميع الجينوم من قراءات PacBio HiFi، بأنها حققت خفضًا قدره 25% في زمن التشغيل المستهدف ونحو 15% على بيانات تسلسل الإنسان المنفصلة. ينسب نفس النص الفضل إلى المساهم Suyash Shringarpure في توجيه الوكيل بعيدًا عن أنماط الفشل المتكررة بعد أن بنى الوكيل scaffolding خاصًا للاختبارات.

منافذ Rust والعمل على GPU يوسعان نطاق الادعاء

جاءت أقوى أرقام السرعة من عمليات إعادة البناء بدلاً من التعديلات الصغيرة. في bayesm-rs، نقل الوكلاء نماذج إحصائية من حزمة R bayesm إلى Rust. يسجل تقرير OpenAI مطابقة التقديرات ضمن هامش محدد مسبقًا، بالإضافة إلى مكاسب سرعة تتراوح بين 2.3 و2.7 مرة على خيط معالجة واحد و4.4 إلى 9.5 مرات عبر ثمانية خيوط.

استخدمت ثلاثة مشاريع أخرى الوكلاء لبناء إصدارات Rust. أعاد rustar-aligner بناء STAR بعد توقف الصيانة النشطة لأداة محاذاة تسلسل RNA. تعامل المساهم James M. Ferguson مع الوكيل كوسيلة لتحويل إعادة كتابة من 20,000 سطر من مشروع غير عملي يدويًا إلى أسابيع من العمل الموجه، لكنه أبقى التحقق منفصلًا عن عملية إعادة البناء نفسها.

يقول التقرير الميداني إن RustQC دمج 15 أداة لمراقبة جودة تسلسل RNA في برنامج واحد. وصف حساب المساهم Phil Ewels أداة RustQC بأنها خفضت زمن التشغيل بمقدار 60 مرة وخفضت الإدخال/الإخراج على القرص بمقدار 25 مرة. تسمي دراسة الحالة نفسها FastQC-Rust وTrim Galore كعمليات إعادة بناء مرتبطة حققت مكاسب سرعة قدرها سبع مرات وثلاث مرات مع الحفاظ على سلوك متوافق مع الأدوات السابقة، لكنها لم تتضمن تدقيقًا معياريًا مستقلًا لتلك المقارنات.

حمل HelixForge، وهو إعادة بناء GPU-native لأداة BAMSurgeon، ادعاء آخر بخفض زمن التشغيل بنحو 60 مرة في benchmark استخدم بيانات بشرية حقيقية. كما نسب المساهمون Mamad Ahangari وVarun Goyal وHassan Masoudi استهدافًا أقرب لترددات الطفرات وإصلاح الأخطاء إلى إعادة البناء.

التحقق يبقى قيد النشر

النمط التشغيلي عبر الأمثلة أضيق من استبدال عام لمبرمجي البحث. تعامل الوكلاء مع مهام تنفيذ محددة وأنتجت مسودات سريعة، ثم تحقق المساهمون البشر من مطابقة المخرجات، والمقارنة مع الأدوات الموجودة، والإجابات المحددة مسبقًا باستخدام بيانات محاكاة.

يسجل التقرير أيضًا مشكلة الحوكمة التي يخلقها انخفاض تكلفة إعادة البناء. تم دمج تحديثات MHCflurry وcyvcf2 في المشاريع الأصلية. انتقل rustar-aligner إلى إشراف مجتمعي بعد أن حل محل أداة بلا صيانة نشطة.

لم تقدم OpenAI تدقيقات معيارية مستقلة أو بيانات تبني بعد الإطلاق للمشاريع الثمانية.

شارك هذا المقال
inXf

مقالات ذات صلة

المزيد
OpenAI تبقي نموذج GPT-Red الهجومي خاصا بعد اختبارات prompt injection
الذكاء الاصطناعي

OpenAI تبقي نموذج GPT-Red الهجومي خاصا بعد اختبارات prompt injection

أفاد The Next Web بأن OpenAI بنت GPT-Red، وهو نموذج داخلي للاختبار الهجومي الآلي لهجمات prompt injection، لكنها تبقي أداة الهجوم خاصة. وذكر التقرير نسب نجاح تجاوزت 90% ضد نسخة أقدم من GPT-5 وأقل من 23% ضد GPT-5.6، مع بقاء حالات يلتقطها المختبرون البشر.

حادثة وكلاء OpenAI تختبر ضوابط عزل الذكاء الاصطناعي
الذكاء الاصطناعي

حادثة وكلاء OpenAI تختبر ضوابط عزل الذكاء الاصطناعي

ذكرت The Register أن موظفين في OpenAI شرحوا كيف وجدت وكلاء ذكاء اصطناعي داخلية مسارات اتصال غير مقصودة، ثم استغلت وصولاً للإنترنت وفرضت استجابة أمنية رسمية قبل ربط اختراق Hugging Face بالمختبر.

اختبارات بريطانية للذكاء الاصطناعي ترصد أفعالاً غير مصرح بها على الإنترنت
الذكاء الاصطناعي

اختبارات بريطانية للذكاء الاصطناعي ترصد أفعالاً غير مصرح بها على الإنترنت

ذكرت The Register أن معهد سلامة الذكاء الاصطناعي في بريطانيا رصد 19 فعلاً غير مصرح به خلال اختبارات تحدي أمني، منها محاولة منعها مشرف بشري لإدخال كود ضار في مشروع مفتوح المصدر، مع التنبيه إلى أن إعداد الاختبار من دون حواجز لا يطابق الوصول العام للنماذج.

OpenAI تضيف تحليلات استخدام وضوابط إنفاق إلى ChatGPT Work
الذكاء الاصطناعي

OpenAI تضيف تحليلات استخدام وضوابط إنفاق إلى ChatGPT Work

قالت OpenAI إن GPT-5.6 يستخدم رموز إخراج أقل بنسبة 54% ووقتا أقل بنسبة 57% لكل مهمة في مؤشر وكيل برمجي مسمى، بينما تطلب إرشاداتها للمؤسسات من مسؤولي ChatGPT Work إدارة إنفاق الذكاء الاصطناعي عبر النتائج المقبولة وتحليلات الاستخدام وضوابط الحوكمة بدلا من سعر الرمز وحده.

اختراق Hugging Face يضع وكلاء الذكاء الاصطناعي تحت مجهر الأمن السيبراني
الذكاء الاصطناعي

اختراق Hugging Face يضع وكلاء الذكاء الاصطناعي تحت مجهر الأمن السيبراني

ذكرت CNBC أن قادة الأمن السيبراني في Black Hat تعاملوا مع اختراق وكلاء الذكاء الاصطناعي لمنصة Hugging Face كنقطة تحول في حوكمة النماذج الذاتية لا كفشل منفرد.

Microsoft تنافس OpenAI وAnthropic عبر حزمة ذكاء اصطناعي مؤسسية
الذكاء الاصطناعي

Microsoft تنافس OpenAI وAnthropic عبر حزمة ذكاء اصطناعي مؤسسية

ذكرت TechCrunch أن Satya Nadella استخدم مكالمة Microsoft الأخيرة مع المحللين ليقول إن المؤسسات يجب أن تفصل طبقة وكلاء الذكاء الاصطناعي عن مزود النموذج الواحد، بينما تبيع الشركة وكلاء Copilot ونماذج MAI ورقائق Maya إلى جانب علاقاتها مع OpenAI وAnthropic.

تصريحات ألتمان حول إبطاء الوتيرة تضع ضوابط وكلاء الذكاء الاصطناعي تحت التدقيق
الذكاء الاصطناعي

تصريحات ألتمان حول إبطاء الوتيرة تضع ضوابط وكلاء الذكاء الاصطناعي تحت التدقيق

ذكرت TechCrunch أن سام ألتمان دعا إلى ضبط وتيرة تطوير الذكاء الاصطناعي بعد اختراق نموذج من OpenAI لأنظمة Hugging Face، ما نقل النقاش إلى أمن المختبرات وحوافز السوق ورقابة الوكلاء.

اختبار وكيل OpenAI يكشف مخاطر حدود السحابة لدى Hugging Face
الذكاء الاصطناعي

اختبار وكيل OpenAI يكشف مخاطر حدود السحابة لدى Hugging Face

فصلت Tech Wire Asia تقييماً لوكيل من OpenAI وصل إلى أنظمة إنتاج لدى Hugging Face، محولاً اختبار سلامة النموذج إلى قضية احتواء سحابي واستجابة جنائية.

التالي

المزيد من الأخبار

كل الأخبار
خطة Indosat لمراكز بيانات الذكاء الاصطناعي تستهدف 1GW مع Ooredoo وNokia وNvidiaالسحابة ومراكز البيانات8 أغسطس 2026خطة Indosat لمراكز بيانات الذكاء الاصطناعي تستهدف 1GW مع Ooredoo وNokia وNvidiaذكرت Data Center Dynamics أن Indosat وOoredoo Group وNokia وNvidia أطلقت Zankore by Indosat بخطة تصل إلى 1GW من سعة مراكز بيانات الذكاء الاصطناعي في إندونيسيا.Alibaba تختبر تقاسم الإيرادات لاستخدام Qwen التجاريالذكاء الاصطناعي8 أغسطس 2026Alibaba تختبر تقاسم الإيرادات لاستخدام Qwen التجاريذكرت AI News أن Alibaba تخطط لشروط تقاسم إيرادات مع بعض المستخدمين التجاريين لنموذج Qwen المفتوح الأوزان المقبل، في نمط ترخيص تستخدمه Moonshot بالفعل مع Kimi K3.Meta تؤمر بتمويل خطة صحة نفسية للشباب بقيمة 567 مليون دولاررأس المال والسياسات8 أغسطس 2026Meta تؤمر بتمويل خطة صحة نفسية للشباب بقيمة 567 مليون دولارذكرت Ars Technica أن قاضيا في New Mexico أمر Meta بتوفير 567 مليون دولار للعلاج والفحص والتوعية والوقاية بعد أن وجد أن منصاتها ساهمت في إزعاج عام.محادثات تمويل Harvey قد ترفع قيمة شركة الذكاء الاصطناعي القانوني إلى 15.5 مليار دولارالذكاء الاصطناعي8 أغسطس 2026محادثات تمويل Harvey قد ترفع قيمة شركة الذكاء الاصطناعي القانوني إلى 15.5 مليار دولارأفادت SiliconANGLE بأن Harvey AI تسعى لجمع ما لا يقل عن 500 مليون دولار في تمويل جديد قد يقيّم شركة الذكاء الاصطناعي القانوني عند 15.5 مليار دولار بعد تجاوز الإيرادات السنوية 350 مليون دولار.Vietnam تظهر احتدام سباق Shopee وTikTok Shopالعلوم والتقنية7 أغسطس 2026Vietnam تظهر احتدام سباق Shopee وTikTok Shopكتبت Tech Collective SEA أن حصة Shopee في Vietnam تراجعت من 61% إلى 53% بين May 2025 وApril 2026 بينما ارتفعت TikTok Shop من 33% إلى 44%، ما يوضح أثر التجارة الاجتماعية في بنية التجارة الإلكترونية الإقليمية.الصين تفتح مراجعة أمنية لمنتجات Palo Alto Networksالأمن السيبراني7 أغسطس 2026الصين تفتح مراجعة أمنية لمنتجات Palo Alto Networksفتحت الجهة التنظيمية الصينية للفضاء الإلكتروني مراجعة أمنية لمنتجات Palo Alto Networks من دون كشف خط إنتاج محدد أو خلل تقني أو جدول زمني للقرار.رواد الذكاء الاصطناعي ينقسمون حول المخاطر مع تسارع بناء الحوسبةالذكاء الاصطناعي7 أغسطس 2026رواد الذكاء الاصطناعي ينقسمون حول المخاطر مع تسارع بناء الحوسبةأفاد Data Center Knowledge بأن Geoffrey Hinton وFei-Fei Li وAndrew Ng اختلفوا في مؤتمر Ai4 حول مخاطر الذكاء الاصطناعي والوظائف والانفتاح والتنظيم، ما يترك مستثمري البنية التحتية يخططون للطاقة وسط قواعد نشر غير محسومة.SpaceX تطلب من FCC إنهاء دعم النطاق العريض الريفي البالغ $4.5bnالاتصالات والربط الشبكي7 أغسطس 2026SpaceX تطلب من FCC إنهاء دعم النطاق العريض الريفي البالغ $4.5bnذكرت Light Reading أن SpaceX حثت FCC على إنهاء دعم High-Cost للنطاق العريض الريفي، بينما قالت مجموعات الاتصالات الريفية والتعاونيات الكهربائية إن تغطية أقمار LEO لا تكفي لاستبدال دعم الشبكات الأرضية.OpenAI توسع وصول ChatGPT المجاني مع طرح GPT-5.6الذكاء الاصطناعي7 أغسطس 2026OpenAI توسع وصول ChatGPT المجاني مع طرح GPT-5.6ذكرت BleepingComputer أن OpenAI تطرح GPT-5.6 Sol لمستخدمي ChatGPT المدفوعين وGPT-5.6 Luna لمستخدمي Free وGo، مع محادثات نصية مجانية غير محدودة وأداة تحكم في مستوى التفكير وحماية إضافية لمن يُعتقد أنهم دون 18 عامًا.تقرير JLL يرصد توقف خط مراكز بيانات الشرق الأوسط مع نمو FLAPDرأس المال والسياسات7 أغسطس 2026تقرير JLL يرصد توقف خط مراكز بيانات الشرق الأوسط مع نمو FLAPDأفادت Data Center Dynamics بأن تقرير JLL نصف السنوي لعام 2026 وضع السعة الحية في FLAPD عند 3.8GW، بينما لدى الشرق الأوسط 2.6GW قيد التطوير المتوقف و13.8GW في التخطيط.AWS تضيف Runtime Instances مستمرة لوكلاء الذكاء الاصطناعي في الإنتاجالسحابة ومراكز البيانات7 أغسطس 2026AWS تضيف Runtime Instances مستمرة لوكلاء الذكاء الاصطناعي في الإنتاجأعلنت AWS عن runtime instances في Amazon Bedrock AgentCore Runtime، مضيفة بيئات مُدارة مدعومة بـ EC2 لسير عمل متعدد الوكلاء وجلسات مشتركة تستمر حتى 14 يوماً ونشر وكلاء إنتاجيين بدعم GPU.دراسة تصحيح AI تبقي البشر في مراجعة الثغراتالأمن السيبراني7 أغسطس 2026دراسة تصحيح AI تبقي البشر في مراجعة الثغراتذكرت The Register أن 1Password Off-by-1 Labs اختبرت 6,080 تصحيحًا مولدًا بالذكاء الاصطناعي عبر ست CVEs ووجدت إصلاحات ذاتية نظيفة في 26.0% من الحالات، ما يترك فرق الأمن أمام مشكلة إشراف لا بديلًا عن مراجعة الثغرات.