ورقة بحثية تقترح تحويل التزامات قانون الذكاء الاصطناعي الأوروبي إلى اختبارات برمجية قابلة للتنفيذ
تقترح ورقة بحثية منشورة على منصة arXiv تحويل التزامات قانون الذكاء الاصطناعي الأوروبي الخاصة بالأنظمة التوليدية إلى اختبارات قابلة للتحقق آلياً يتم تشغيلها…
Hannah Vogel ·

في ورقة بحثية منشورة على منصة arXiv في سبتمبر 2026، اقترح المؤلفون نهج "الحوكمة ككود" (Governance-as-Code) لقانون الذكاء الاصطناعي الأوروبي، والذي يتضمن 43 معيار قبول قابلاً للتحقق آلياً عبر ست وحدات تعمل ضمن خط أنابيب التطوير والتشغيل (CI/CD)، وتصدر أدلة تدقيق مفهرسة وفقاً للمواد القانونية للذكاء الاصطناعي التوليدي. الورقة هي مصدر وحيد، ولم تخضع لمراجعة الأقران، وتدعي أن هذا الإطار طابق نتائج تدقيق يدوي أجراه خبراء على عمليتين للنشر في مؤسسات (روبوت محادثة استشاري عالي المخاطر ومولد محتوى محدود المخاطر)، مما أدى إلى خفض جهد التدقيق بنحو 75%. لا توجد أي جهة في التقرير مسجلة رسمياً. هذا البحث يمثل دراسة وليس استنتاجاً تنظيمياً.
الادعاء: تحويل الالتزامات ذات الطبيعة المفتوحة إلى أرقام وسياسات برمجية
يجادل المؤلفون بأن المواد من 8 إلى 15 من اللائحة 2024/1689 صيغت للأنظمة التنبؤية، وتترك سبع فجوات عند تطبيقها على الذكاء الاصطناعي التوليدي: حوكمة البيانات غير الحتمية، ومصدر بيانات التدريب، والمطابقة المستمرة، والإشراف البشري، والمتانة المفتوحة، والمخاطر الناشئة، والعدالة التوليدية. يقوم نهج "الحوكمة ككود" (GaC) الخاص بهم بترميز معايير القبول في سياسات (يعرضون كود Rego فعلياً، وليس مجرد أوصاف)، ويؤكدون أن المعايير ذات الطبيعة المفتوحة مثل "المستويات المناسبة" أو "التحيزات المحتملة" يمكن تفعيلها كأرقام معلنة وقابلة للتدقيق. وفي إطار عملهم، تُشتق عتبات المتانة من خط أساس موثق للمزود ومن حد أدنى يمثل أحدث ما توصلت إليه التقنية، بينما يتم اختزال "تحيز التأطير" في ثمانية مؤشرات قابلة للقياس يتم اختبارها عبر فحص ديموغرافي مضاد للواقع. تعمل الوحدات ضمن خط أنابيب الإصدار وتنتج أدلة مرتبطة بمواد محددة، مصممة لتكون جاهزة للفحص من قبل المدققين.
لماذا تعد هذه مشكلة شراء وليست مجرد مشكلة تدقيق
تعيد الورقة توزيع المسؤوليات. بموجب المادة 25 والفصل الخامس، يعتمد الطرف الذي ينشر النظام (المستخدم النهائي) على ملخص بيانات التدريب الخاص بالمزود بموجب المادة 53، ويوثق فقط الطبقات التي يتحكم فيها؛ وبالتالي، يقوم نهج "الحوكمة ككود" بالتحقق من ذلك الملخص بدلاً من المطالبة بتوثيق لكل عينة لم تكن لدى المستخدم النهائي أصلاً. إذا أصبح هذا هو المعيار، ستتوقف عمليات الشراء عن قبول "مصفوفات المسؤولية" الثابتة، وستبدأ في مطالبة الموردين بأدلة قابلة للتحقق آلياً عند حدود العقد: اختبارات قابلة للتنفيذ، وسجلات مفهرسة حسب المواد القانونية، وملخصات موثقة لبيانات التدريب. ستنتقل طلبات تقديم العروض (RFPs) وبيانات العمل (SOWs) من ضوابط جاهزة في ملفات ورقية إلى مجموعة من اختبارات القبول التي يجب اجتيازها ليتم شحن النموذج أو طبقة الضبط الدقيق أو الاسترجاع. وهذا ينقل الميزانية إلى هندسة الامتثال داخل فرق المنتج والمنصة، ويدفع وظائف الشؤون القانونية والمخاطر مباشرة إلى بوابة التطوير والتشغيل (CI/CD) حيث تصبح "المطابقة" شرطاً للإصدار، وليست مراجعة لاحقة.
التحفظات الجوهرية التي لا تستطيع الورقة حلها
يتحقق المؤلفون من صحة عملهم من خلال عمليتي نشر مؤسسيتين، ويقولون إن إطار "الحوكمة ككود" يعيد إنتاج جميع نتائج التدقيق اليدوي، بما في ذلك ثلاث مخالفات تستوجب عقوبات، بجهد أقل بنحو 75%. لكن خط الأساس هو تدقيق يدوي من قبل خبراء بتصميم غير محدد؛ ولا تحدد الورقة المؤسسات، أو المدققين، أو ما إذا كانت أي جهة تنظيمية قد قبلت أدلة مولدة آلياً للمطابقة. "استحقاق العقوبات" هو تفسيرهم لعتبات القانون، وليس قضية محسومة. وبينما يدعي الإطار تحقيق المطابقة المستمرة، تثير المخرجات غير الحتمية تساؤلات حول الاستقرار: فالتشغيل المتكرر يمكن أن ينتج مخرجات مختلفة، لذا قد يتقلب النجاح/الفشل مع البذرة (seed)، أو معايير أخذ العينات، أو صياغة المطالبة. يعالج المؤلفون ذلك عن طريق اشتقاق العتبات من خط أساس للمزود وحد أدنى تقني، لكنهم لا يظهرون ما إذا كانت تلك العتبات ستصمد أمام تحديثات النموذج، أو تحول التوزيع، أو السلوكيات الناشئة بمرور الوقت دون إعادة ضبط متكررة - وهي تكلفة مستمرة سيحتاج المشترون إلى تسعيرها.
الأثر الثانوي: وتيرة الشحن تصبح دالة على بوابات الامتثال
إن تضمين الاختبارات المفهرسة حسب المواد القانونية في خط أنابيب التطوير والتشغيل (CI/CD) يحول الامتثال إلى أداة تحكم في سرعة الإصدار. ستجدول الفرق تحديثات النماذج، وتغييرات مجموعة بيانات الاسترجاع، ومراجعات مكتبة المطالبات بناءً على استقرار البوابة. توقع أن تتصاعد "الإصدارات الحمراء" التي تمثل تراجعاً في مؤشرات العدالة أو انخفاضاً في المتانة مقابل خط الأساس المعلن لتصبح حوادث من الدرجة الأولى (Sev1) - مع وجود الشؤون القانونية في قائمة الاستدعاء. يشجع الفحص الديموغرافي المضاد للواقع في الإطار على مجموعات اختبار موحدة للعدالة، لكن ذلك يدفع الفرق أيضاً إلى التحسين من أجل اجتياز الاختبار، مما يخاطر بوجود فجوات حيث تفشل المؤشرات في التقاط الأضرار الواقعية. قد تصبح تكاليف الحوسبة لتشغيل بطاريات الاختبار على النماذج الكبيرة أثناء الإصدار مادية على نطاق واسع، وسيدفع المشترون باتجاه الحصول على أدوات اختبار مقدمة من الموردين ومربوطة بالمواد القانونية لتقليل العمل المزدوج. الفائزون سيكونون أولئك الذين يستطيعون الحفاظ على بوابات صارمة دون التأثير على وتيرة النشر؛ والخاسرون سيكونون الفرق التي لا تستطيع خطوط أنابيبها استيعاب عبء عمل الامتثال.
أين يمكن أن يتسلل احتكار الموردين بهدوء
على الرغم من أن الورقة تنشر سياسات Rego، إلا أن خطر الاحتكار الحقيقي يكمن في طبقة أعلى: اختيار معايير القبول، وعتباتها، ومخطط الأدلة المرتبط بمواد محددة. إذا قام المشترون بتوحيد المعايير على لهجة سياسة معينة وتنسيق أدلة محدد، فسيتم الضغط على مزودي النماذج وموردي الأدوات لتوفير تلك الأدلة بالضبط. يمكن أن يتصلب هذا ليصبح مواصفة فعلية لمطابقة قانون الذكاء الاصطناعي الأوروبي - من تأليف من يطلق أول مجموعة اختبار معتمدة على نطاق واسع. بالنسبة للمستخدمين، قد يعني تغيير الموردين لاحقاً إعادة كتابة السياسات، وإعادة تدريب الفرق، وإعادة تعيين السجلات إلى الفهارس القانونية. بالنسبة للموردين، فإن الفشل في تقديم ملخص بيانات التدريب وفق المادة 53 بالهيكل المتوقع يصبح عائقاً تجارياً، وليس مجرد تقصير في التوثيق.
قراءة المشكك الواضحة - وما الذي سيثبت خطأ ذلك
سيجادل المشككون بأن الامتثال لا يمكن أتمتته بالكامل لأن القانون يتضمن واجبات إشراف بشري وأحكاماً حساسة للسياق تقاوم الترميز. وسيتساءلون عما إذا كانت سلطات مراقبة السوق الوطنية ستقبل الأدلة الصادرة آلياً للأنظمة عالية المخاطر، وما إذا كانت مؤشرات العدالة وخطوط أساس المتانة يمكنها مواكبة المخاطر الناشئة في النماذج التوليدية. تظل هذه الاعتراضات قائمة حتى تشير جهة تنظيمية إلى قبول الأدلة القابلة للتنفيذ، أو يدرج مشترٍ كبير اختبارات مفهرسة حسب المواد القانونية في العقود القياسية. في المقابل، إذا تبنى المشترون الكبار هذا النهج، فستضطر شركات التدقيق إلى قراءة سجلات الآلة جنباً إلى جنب مع السرديات، وستقوم المنصات بتحويل البوابات الواعية بالمواد القانونية إلى منتجات. راقب ما إذا كانت قوالب طلبات تقديم العروض ستبدأ في الاستشهاد باختبارات القبول للمواد 8-15، وما إذا كان موردو عمليات تعلم الآلة (MLOps) سيطلقون بوابات امتثال أصلية تعتمد على Rego، وما إذا كان أي إجراء إنفاذ مبكر سيشير إلى إخفاقات "المطابقة المستمرة" الخاصة بالأنظمة التوليدية.
ما الذي يتغير في دورة التجديد القادمة إذا استمر هذا النهج
إذا انتقلت "الحوكمة ككود" من الورق إلى الممارسة، فإن شراء الذكاء الاصطناعي التوليدي سيشبه شراء الأمن: مجموعة اختبار متفق عليها مسبقاً، وتنسيقات أدلة موقعة، وبوابات إصدار تغلق عند الفشل. سيطالب المشترون بملخصات بيانات التدريب الأولية وبطاقات النماذج المؤرخة والمتوافقة مع الفهارس القانونية؛ وسيقوم المستخدمون بتحديد نطاق العقود حول الطبقات التي يمكنهم التحكم فيها بشكل قابل للتحقق؛ وستتكامل منصات الحوكمة والمخاطر والامتثال (GRC) الداخلية مع محركات السياسات بحيث تظهر مسارات التدقيق من عمليات البناء العادية. ستتحول الميزانية من عمليات التدقيق السنوية من طرف ثالث نحو هندسة الامتثال المستمر، مع تركيز شركات التدقيق على أخذ العينات، وضمان النطاق، والفحص الموضعي لأدلة الآلة بدلاً من إعادة إجراء الاختبارات. الموردون الذين لا يستطيعون إصدار أدلة مفهرسة حسب المواد القانونية سيجدون أنفسهم مستبعدين قبل مناقشة الأسعار.