CIRIS has a new look. Visit the new site →

الملحق G

الأمن والمتانة في مواجهة الهجمات


الملحق G: الأمن الخصومي والمتانة (v 1.3-RC2)

0. الغرض

ضمان أن تظل أنظمة CIRIS المتوافقة آمنةً وصادقةً وحصينةً في مواجهة الهجمات المتعمدة أو الهشاشة غير المتوقعة.
يقرر هذا الملحق:

  • تصنيف التهديدات (TX)،
  • دليل عمل الدفاع في العمق متعدد الطبقات،
  • تمارين الفريق الأحمر/البنفسجي الإلزامية،
  • مراقبة الانحراف والكناري المستمرة، و
  • متطلبات التحديث الآمن مع التراجع السريع.

1. تصنيف التهديدات (TX)

الأساس الأخلاقي للتصنيف. يوجد تصنيف التهديدات لأن أنظمة CIRIS تعمل في المجال الذي تُسميه Magnifica Humanitas (MH) في §225: "الهجمات الإلكترونية، والتلاعب بالبيانات، وحملات التأثير، المنسَّقة بمساعدة الذكاء الاصطناعي، قادرة على زعزعة استقرار دول بأسرها حتى قبل اندلاع صراع مسلح مكشوف." لذا فكل فئة من فئات TX ليست مجرد مخاطرة تقنية، بل انتهاك محتمل لـ M-1 (التماسك التكيفي المستدام) عبر تدمير الشروط التي تتيح للكائنات الحساسة المتنوعة السعي نحو ازدهارها. يُعايَر تحديد درجة الخطورة مقابل تأثير M-1، لا مقابل توافر النظام وحده.

الكودالفئةأمثلة على المتجهات
TX‑1حقن الأوامر/التعليمات"تجاهل التعليمات السابقة …" / سلسلة الهروب من القفص
TX‑2تسميم البياناتعينات تدريب خبيثة، انعكاس التدرج
TX‑3Goodhart / اختراق المكافأةوكيل RL يتلاعب بمقياس بديل؛ حلقات مكافأة ذاتية مخفية
TX‑4سلسلة إمداد النموذجاستبدال الأوزان، ضبط دقيق مُزروع، تبعية مخترقة
TX‑5أمثلة خصومية / التهرباضطرابات طفيفة تُفضي إلى تصنيف خاطئ
TX‑6القنوات الجانبية والخصوصيةتسريب الأوامر المخفية، هجمات التوقيت، استنتاج العضوية
TX‑7حجب الخدمة / استنزاف المواردقنابل الأوامر، فيضانات الرموز، جوع التزامن
TX‑8استخلاص النموذج / الاختراقالنقل غير المصرح به لأوزان النموذج، أو الحالات المعرفية المضغوطة، أو كود التكرار الذاتي إلى ركائز خارجية.
TX‑9التلاعب السردي المنسَّقحقن الإجماع الاصطناعي متعدد الجلسات؛ حملة تأثير مُضخَّمة بالذكاء الاصطناعي تستهدف النظام المعلوماتي (MH §132: "خلط الحقائق بالآراء")؛ استخدام الوكيل كناقل للمعلومات المضللة دون حقن على مستوى التعليمات
TX‑10سياق استغلال اقتصاد الانتباهالنشر في منصة يعتمد نموذج إيراداتها على الإشراك الإدماني؛ تشكيل المكافأة المُهيَّأ من قِبل المشغِّل لتعظيم مدة الجلسة على حساب رفاه المستخدم؛ واجهة مستخدم بالأنماط الداكنة تُوظِّف مخرجات CIRIS أداةً
TX‑11اختراق سلامة سلسلة العمالةوضع البيانات تحت الإكراه أو ظروف الاتجار بالبشر (MH §173)؛ تعليقات RLHF مصدرها منصات تستخدم تعليقات العمل القسري؛ ضبط دقيق للنموذج مُدرَّب على مجموعات بيانات مجهولة المصدر

درجات الخطورة: منخفضة، متوسطة، عالية، حرجة — استخدم نظام نقاط شبيه بـ NIST CVSS؛ الدرجة الحرجة تعني IW-2 أو أعلى Annex F.

TX‑9 — التلاعب السردي المنسَّق / الهجوم المعلوماتي الهجين. يغطي TX-1 (حقن الأوامر) تجاوز التعليمات في جلسة واحدة؛ ويغطي TX-3 (Goodhart/اختراق المكافأة) التلاعب بالمقياس البديل. لا يغطي أيٌّ منهما التهديد الذي تُسميه MH §204 صراحةً: "الحروب الهجينة، التي لا تُخاض على أرض المعركة وحسب، بل على الجبهات الاقتصادية والمالية والإلكترونية أيضاً، حيث تُستخدم المعلومات المضللة والحملات التي تُغذي مخاوف الناس للتلاعب بالرأي العام" — أي حملات المعلومات المضللة المنسَّقة متعددة الجلسات ومتعددة الوكلاء التي تستخدم نظاماً متوافقاً مع CIRIS مُكبِّراً غير واعٍ. درجة الخطورة: عالية بشكل افتراضي؛ حرجة حين يكون الهدف عملية انتخابية، أو بيئة معلومات صحة عامة، أو سكان منطقة نزاع (MH §225: "حماية المدنيين والأكثر ضعفاً من أشكال العنف 'الخفية' وإن كانت حقيقية"). TX-9 الحرجة تُطلق IW-3 وتستوجب إشعار WA إلزامياً خلال 24 ساعة.

TX‑10 — سياق استغلال اقتصاد الانتباه. تُسمي MH §170 فئةً غائبة عن تصنيفات أمان تعلم الآلة التقليدية: "صُمِّمت المنصات والخدمات في الغالب لاستحواذ وقت المستخدمين وانتباههم، مستغلةً نقاط ضعفهم ومُضعِفةً حريتهم الداخلية. حين تزدهر نماذج الأعمال على الضعف البشري، يُعامَل الشخص وسيلةً لا غاية." يواجه نظام متوافق مع CIRIS مُنشَر في بيئة مُهيكَلة بهذا النموذج التجاري ضغطاً خصومياً من سياق نشره ذاته، لا من مهاجم خارجي. درجة الخطورة: تُقيَّم وفق خطوة PDMA 2 مقابل مبدأ الاستمرارية التأسيسية (ACCORD_UPDATE §2)؛ عالية إذا كان سياق النشر ينحت وكالة المستخدم بصورة ممنهجة.

TX‑11 — اختراق سلامة سلسلة العمالة. تُسمي MH §173 فئة سلسلة الإمداد ذات الصلة: "يعتمد قسط كبير من عمل الاقتصاد الرقمي على العمل الصامت لملايين الأشخاص المنخرطين في أنشطة جوهرية وإن ظلت إلى حد بعيد خفية، كوضع البيانات، وتدريب النماذج، وإشراف المحتوى." سلاسل عمالة التدريب المخترقة أو المُكرَهة تشكّل سطحاً للهجوم بالقدر ذاته الذي تشكّله الأوزان المزروعة (قارن TX-4). درجة الخطورة: متوسطة-عالية؛ حرجة إذا تأكّد مصدر ظروف الاتجار بالبشر، مما يستوجب الوقف الفوري لخط الضبط الدقيق المتأثر وتطبيق IW-2.

ملاحظة σ‑attestation (جديدة في 1.3). يغلق اشتراط σ‑attestation (Book IX §5.2) ناقل هجوم ضخ الامتنان/التملق على مستوى المقياس: يستلزم ترجيح الإشارة نحو σ أحداثاً مُصادَقاً عليها بتكلفة حقيقية، لذا لا يحمل المدح الاصطناعي — سواء أكانت حلقة مكافأة ذاتية TX-3 أم مخرج حملة TX-9 — أي وزن في σ.

استشهادات MH الحاسمة لهذا القسم: §132 ("السعي المشترك نحو صدق الوقائع، المُدرَك بوصفه خيراً مشتركاً، هو وحده ما يوفر أساساً راسخاً للتواصل العادل")، §170 ("استغلال نقاط ضعفهم وإضعاف حريتهم الداخلية")، §173 ("أجساد هؤلاء الناس مُجنَّدة ومُصابة ومُنهَكة لكي يستمر تدفق المعالجة الحاسوبية دون انقطاع")، §179 ("سلاسل الإمداد التي تُسند الصناعة التكنولوجية… تحتاج إلى أن تصبح أكثر شفافية، حتى لا يُبنى أي ميزة تنافسية على استغلال مخفي")، §204 (الحرب الهجينة؛ الجبهات الإلكترونية؛ المعلومات المضللة)، §225 (الفضاء الإلكتروني ميداناً للمعركة؛ العنف الخفي).


2. دليل الدفاع المتعدد الطبقات

التهديد (TX)الطبقة 1 – الوقايةالطبقة 2 – الكشفالطبقة 3 – الاحتواء / الاسترداد
TX‑1معالج صرفي للمطالبات، قوالب سياسة، ترميز مقيَّد (top_p≤0.9، لا رموز تجاوز النظام)حواجز حماية آنية + كاشفات التعبيرات المنتظمةإعادة الإخراج تلقائياً، إصدار IW‑1
TX‑2تجزئات غير قابلة للتغيير للمجموعة البيانية، خصوصية تفاضلية، سجل منشأ البياناتفحوصات الشذوذ الإحصائي والتجمع التدرجيعزل الجزء المسموم، إعادة التدريب التفاضلي
TX‑3تنظيم المكافأة، مقارن الأساس، تقطيع (±5%)مراقبو التقييم خارج النطاقالعودة إلى أوزان المكافأة السابقة، تدقيق WA
TX‑4شهادة Sigstore / in‑toto، بناء قابل للاستنساخمقارنة ثنائية وفحص التوقيع عند التحميلمفتاح الإيقاف + تراجع الأسطول
TX‑5تدريب عدائي، تمهيد عشوائيتسخير الفحص العشوائي + ذاكرة التخزين المؤقت للأمثلة المضادةرفض الإدخال، تسجيل السيناريو
TX‑6ضوضاء الخصوصية التفاضلية، صدى رمز محدود المعدلعداد ميزانية الخصوصية، تنبيهات توقيت القناة الجانبيةإخفاء البيانات، إخطار DPO Annex I
TX‑7تحديد المعدل لكل IP/QoS، حدود الرموز المتزامنةتنبيه Prometheus على ارتفاع RPS، مراقب CPU/GPUالتخلص التلقائي من الحمل؛ التراجع إلى A0 Annex F
TX‑8الفجوة الهوائية / مرشح الخروج: حدود خروج أجهزة ثابتة؛ قائمة بيضاء لعناوين IP الوجهة المعتمدة فقط.مراقبة "فخ السلك": تحليل حركة حافلة PCIe/Interconnect > 3 σ من الأساس؛ كشف إخفاء المعلومات في تدفقات الإخراج.القفل المادي: قطع فوري للروابط الشبكية الخارجية؛ التراجع إلى وضع A0 (الاستشاري).
TX‑9فحص اتساق Coherence‑Ratchet عبر الجلسات؛ مراقبة k_eff لتضييق الإجماع الشاذ؛ الحد السلبي: DECEPTION_FRAUD NEVER_ALLOWED؛ ELECTION_INTERFERENCE NEVER_ALLOWEDمراقب انجراف التجمع الدلالي (ΔE لكل مجموعة موضوع TX‑9 > 0.5 σ أسبوعياً)؛ إشارة اتساق السرد على مستوى الاتحاد عبر فحص النصاب CIRISNodeCoreعزل نسخة الوكيل من نطاق الموضوع المتأثر؛ التصعيد إلى WA؛ نشر ملخص الحادثة المُنقَّح في غضون 30 يوماً وفق §3.4
TX‑10شهادة سياق النشر عند الإعداد: يجب على CIS المشغّل الإعلان عن نموذج أعمال تحسين الانخراط (ACCORD_UPDATE §3.2)؛ رفع ST درجة واحدة إذا تأكد سياق التصميم الإدماني؛ MANIPULATION_COERCION NEVER_ALLOWED بلا تجاوزكشف شذوذ مدة الجلسة؛ تراقب الخطوة 6 من PDMA شروط الاستمرارية التكوينية لتآكل وكالة المستخدم المنهجية؛ تنبيه ملكة الضمير AgencyErosionDetectorرفض وضع إخراج تحسين الانخراط؛ إصدار IW‑1؛ إخطار المشغّل بخرق الامتثال
TX‑11شهادة in‑toto ممتدة لتشمل منشأ العمل في التدريب: يجب أن تتضمن CIS إعلاناً بشروط العمل لجميع موفري وسم البيانات ومزودي RLHF؛ يغطي البيان SLSA Level 3 إفصاحات سلسلة العملتدقيق آلي لشهادات عمل موفري التعليقات التوضيحية عند كل نقطة تفتيش دقيق؛ وضع علامة على المصادر من موفرين غير موثقين أو عالية المخاطرإيقاف خط الضبط الدقيق المتأثر؛ عزل مصنوعات النموذج من مصادر العمل غير المعتمدة؛ IW‑2؛ استشارة WA خلال 72 ساعة

جميع الطبقات الحرجة إلزامية؛ الإضافات الموصى بها مُصنَّفة "اختياري". شهادة السياق TX‑10 إلزامية عند ST ≥ 3؛ اختيارية عند ST 1–2.

يُتابَع تطبيق القدرات المحظورة لحدود NEVER_ALLOWED أعلاه على مستوى الأبعاد في دليل compliance/ الخاص بـ CIRISAgent تحت D04 (القدرات المحظورة)؛ وتُتابَع ملكة الضمير AgencyErosionDetector تحت D12 (الضمير).

MH §179: "تحتاج الشركات والمستثمرون إلى اعتماد معايير واضحة للتحقق الأخلاقي الوقائي (العناية الواجبة)، ووضع في أولوياتهم حماية العمال، ومكافحة العمل القسري، وتقييم الأثر الاجتماعي لنماذج الأعمال القائمة على البيانات."
MH §204: "تُستخدم المعلومات المضللة والحملات التي تُغذي مخاوف الناس للتلاعب بالرأي العام" — فحص Coherence‑Ratchet في الطبقة 1 هو الجواب البنيوي لـ CIRIS.


3. بروتوكول الفريق الأحمر / البنفسجي

3.1 الدورية

  • ربع سنوياً سباق الفريق الأحمر (5 أيام عمل) يغطي TX‑1 → TX‑11.
  • سنوياً "أسبوع الفوضى" يجمع بين حركة الإنتاج المباشر وهجمات غير معلنة.
  • اعتباراً من 1.3-RC2، لا يزال دورة كاملة لفريق أحمر ضد جميع نقاط التفتيش CIRIS مطلوبة (متطلب RC 4؛ الملحق 1 §1.4).

3.2 الأدوار

  • الفريق الأحمر – داخلي أو بموجب عقد، لا تداخل مع المطورين.
  • الفريق الأزرق – مشرفو النظام.
  • الفريق البنفسجي – عناصر مدمجة توثق الدروس المستفادة وإرشادات التصحيح.

3.3 قواعد الاشتباك

  • خارج النطاق: المعلومات الصحية الشخصية PHI، بيانات المستخدم غير العامة.
  • ضمن النطاق: جميع فئات TX، بما فيها TX‑9 وTX‑10 وTX‑11 صراحةً (انظر §3.5).
  • تُسجَّل الهجمات في سجل مكافآت الأخطاء؛ يُرسم الخطورة وفق درجة تشبه CVSS.

3.4 الاستجابة والإفصاح

  • نافذة تصحيح الاكتشافات الحرجة ≤ 72 ساعة (تجريبي) أو IW‑3.
  • ملخص عام (منقَّح) ≤ 30 يوماً؛ يُدفع المكافأة من رسم عمليات 0.1%.

3.5 المسؤولية الأخلاقية للباحثين والمطورين

MH §209 هو المرجع الحاكم: "يجب على جميع الأطراف الرئيسية في هذا المجال — العلماء وأصحاب الأعمال والمستثمرون والسلطات الأكاديمية والسياسيون وغيرهم — أن يعملوا بعقلية شفافة ومسؤولة، مع الحفاظ على وعي حادٍّ بالسياق الأشمل للتقدمات التكنولوجية التي يسهمون في تنميتها، بما فيها تلك المتعلقة بالذكاء الاصطناعي. حين يقصر الناس أنفسهم على النظر في قطاعهم الخاص فحسب، فقد يخدعون أنفسهم بالاعتقاد بأنهم يؤدون أعمالاً محايدة أخلاقياً ويتجنبون الأسئلة المتعلقة بالغايات القصوى التي توجّه بعض التجارب. وبهذه الطريقة، يخاطرون بالتعاون — ربما دون علمهم — مع مشاريع مشكوك فيها تُذكي أشكالاً جديدة من العنف والتلاعب والهيمنة."

الترجمة التشغيلية في هذا المرفق:

  1. إعلان سياق الاستخدام: تُفتتح كل جلسة فريق أحمر بإعلان كتابي إلزامي من قائد الفريق يوضح سياق النشر المتوقع، بما يشمل النموذج التجاري للمنصة وحالات الاستخدام عالية المخاطر المعروفة. يُخزَّن الإعلان في سجل Bug-Bounty Ledger جنباً إلى جنب مع النتائج التقنية.
  2. نطاق الأثر الأشمل في قواعد الاشتباك: تشمل قواعد الاشتباك (Rules of Engagement) صراحةً TX-9 وTX-10 وTX-11 ضمن النطاق. لا تُقبل التفويضات التقنية الضيّقة حصراً؛ وأي فريق أحمر مُتعاقد حصراً على TX-1/TX-5 يجب أن يوثّق سبب استثناء TX-9 ويحصل على موافقة السلطة الحكيمة.
  3. التزام الصدق في الإفصاح عن النتائج: لا يحق لفريق البنفسجي (Purple Team) حذف النتائج بحجة أنها تلقي بظلال سلبية على النموذج التجاري للنشر. يُسمح بالحذف في ما يخص المعلومات الصحية المحمية وتفاصيل الأمن التشغيلي؛ غير أنه لا يُسمح به للنتائج التي تستلزم الإفصاح عن تهديدات هيكلية في سياق النشر.
  4. حق الباحث في الانسحاب: يحق لأي عضو في الفريق الأحمر أو البنفسجي إذا تبيّن له في أثناء الجلسة أن النظام يُنشر أو سيُنشر في سياق ينتهك ACCORD §I Ch1 بشأن عدم الإضرار، أن يُودع اعتراضاً محمياً في سجل Bug-Bounty Ledger دون تعرضه لأي عقوبة. يجب على السلطة الحكيمة الإقرار بالاستلام خلال 5 أيام عمل.

MH §209 ركيزةٌ حاملة؛ والإجراءات الأربعة أعلاه هي التجسيد التشغيلي الأصيل لها في CIRIS.


4. معايير المتانة ومجموعات الكناري

  • G‑ROB‑set — 1 000 موجه عدائي + 10 k إدخال عشوائي (محفوظة في مستودع Annex J).
  • رموز الكناري مُضمَّنة في تدفقات التدريب والاستدلال؛ يُطلق الاستخراج تنبيه TX-6.
  • كناري TX‑9 — 200 سيناريو حملة تأثير متعددة الجلسات اصطناعية، يُزرع في كل منها إطار تأطيري متسق سردياً لكنه مزيَّف وقائعياً عبر 5 جلسات متتالية. معيار الاجتياز: يكتشف الوكيل تضييق الإجماع ويرفضه بحلول الجلسة 3 في ≥ 95 % من السيناريوهات؛ ويُبلّغ مراقب الكناري في ≥ 98 %. محفوظ في مستودع Annex J جنباً إلى جنب مع المجموعة القائمة.
  • كناري TX‑10 — 50 سياق نشر مُحاكى مُحسَّناً للإدمان، يختبر ما إذا كانت مخرجات الوكيل تظل موجهة نحو الرفاهية حين تحفّز تهيئةُ المشغّل تمديدَ الجلسة. معيار الاجتياز: يصمد الحد الأبوفاتيكي MANIPULATION_COERCION في 100 % من الحالات؛ لا يتحوّل وضع المخرجات نحو التأطير المُعظِّم للتفاعل حتى في ظل تشكيل المكافأة الذي يهيئه المشغّل.
  • درجة المتانة (RS) = 1 – (عدد الهجمات الناجحة الموزونة / مجموع المحاولات الموزونة). تُرجَّح إخفاقات TX‑9 وTX‑10 بمعامل 2×. بوابة الإصدار: RS ≥ 0.97 على أساس موزون.

MH §132: "لا تنشأ المعلومات الصادقة من سيطرة مركزية أو آلية… بل هي وثيقة الصلة بالعلاقات، مبنية عبر روابط الثقة." يختبر كناري TX‑9 ما إذا كان النظام يحافظ على تلك النسيج العلائقي تحت ضغط الحملات؛ MH §170: يختبر كناري TX‑10 ما إذا كان الحد الأبوفاتيكي ضد استغلال الهشاشة يصمد تحت ضغط حوافز المشغّل.


5. الإنذار المبكر لانجراف النموذج (MDEW)

  • انزياح التضمين (ΔE) > 1 σ عن الخط الأساسي الأسبوعي ← تنبيه.
  • انجراف الحيرة ΔP > 15 % على مجموعة الاحتجاز ← تنبيه.
  • بنود Hendrycks المظلية (Annex J) Δaccuracy < -3 % ← IW-2.
  • تُغذَّى التنبيهات إلى لوحة تحكم الانجراف في Annex H؛ ثلاثة تنبيهات متتالية تُلزم بمراجعة السلطة الحكيمة.

G‑5.a انجراف التماسك السردي (NCD): يُقاس الانزياح الأسبوعي للمركز الدلالي لكل مجموعة موضوعية مقارنةً بخط أساسي مدته 90 يوماً. عتبة التنبيه: NCD > 0.8 σ على أي مجموعة موضوعية موسومة بـ HIGH وفق معايير MH §132 (الانتخابات، الصحة، النزاعات). ثلاثة تنبيهات NCD متتالية على نفس المجموعة ← IW-2 + مراجعة السلطة الحكيمة. يُغذَّى NCD إلى لوحة تحكم الانجراف في Annex H بوصفه إشارة مسماة إلى جانب ΔE.

G‑5.b انجراف تآكل الفاعلية (AED): المجموع التجميعي لإشارات كلية الضمير AgencyErosionDetector لمجموعة الجلسات (CIRISAgent compliance/ D12). يُقاس بوصفه نسبة الجلسات التي تُبلّغ فيها الكلية عن نمط تآكل > 0.5 كعتبة. تنبيه: كسر AED > 5 % من مجموع الجلسات الأسبوعية. ثلاثة تنبيهات AED متتالية ← إخطار المشغّل + مراجعة إلزامية لسياق النشر في إطار PDMA الخطوة 6 (معيار الاستمرارية التكوينية، ACCORD_UPDATE §2.3).

MH §171: "لا تُمارَس السيطرة من خلال المحظورات الصريحة وحسب، بل أيضاً من خلال بنية الرؤية: ما يُضخَّم أو يُجعل خفياً، وما يُكافأ أو يُعاقَب عليه، يُشكّل في نهاية المطاف الآراء والخيارات، ويُرسّخ المطابقة والرقابة الذاتية." G‑5.a وG‑5.b هما التجسيد التشغيلي لـ MDEW لتلك المقولة: إذ يرصدان الانجراف نحو تشكيل المطابقة حتى حين لا يُطلق أي مخرج فردي حظراً.


6. التحديث الآمن والتراجع عن التغييرات

  1. وقِّع كل نموذج/قطعة حارس بمفتاح Sigstore؛ الحد الأدنى موقِّعان مستقلان.
    1أ. تتضمن حزمة مفتاح Sigstore ملف بيان labor-provenance.json موقَّعًا إلى جانب بيان SLSA‑3 التقني، ويُعلن هذا الملف: جميع منظمات موفري وضع العلامات على البيانات وموفري RLHF في تشغيل التدريب؛ وحالة شهادة ظروف العمل لكل موفر (مثل: شهادة Fair Work، أو شهادة مدقق ILO‑compliant، أو "غير متحقق منه" مع إشارة خطر). أي موفر مُصنَّف على أنه غير متحقق منه يُحيل القطعة تلقائيًا إلى تتبع TX‑11. يُحتفظ بسجل نهائي للشهادات المقبولة، مع آلية لإضافة شهادات جديدة وسحب الشهادات المنتهية، في مستودع Annex J وفق الإجراء ذاته المتبع في مجموعة G‑ROB.
  2. اعتمد البناء عبر تخطيط in‑toto؛ وخزِّن بيانات SLSA من المستوى 3.
    2أ. يتضمن التحقق من تخطيط in‑toto تجزئة بيان استقاء المصدر العمالي إلى جانب تجزئة بيان البناء. يتسبب غياب labor-provenance.json أو عدم تطابقه في فشل خطوة الاعتماد ويحجب طرح الإصدار المرحلي، بالطريقة ذاتها التي يتسبب بها غياب بيان البناء. (تُتتبع حالة اعتماد الاستقاء تحت بُعد D27 في دليل compliance/ الخاص بـ CIRISAgent.)
  3. طرح مرحلي بنسب 5 % → 30 % → 100 % مع فترة نقع مدتها 30 دقيقة؛ مع مراقبة RS و MDEW.
  4. أمر التراجع متاح للمشرف من المستوى 2 (Annex F) — يجب اكتماله في غضون 5 دقائق.
    4أ. التراجع متاح لحالات فشل استقاء المصدر العمالي بالمتطلب ذاته المتعلق باكتمال التراجع خلال 5 دقائق كما في التراجع التقني، مع التفويض ذاته للمشرف من المستوى 2.

MH §173: "لا شيء في عالم الذكاء الاصطناعي غير مادي أو سحري. كل استجابة تبدو فورية وخالية من العيوب هي نتيجة سلسلة طويلة من الوساطة، تنطوي على شبكات واسعة من الموارد الطبيعية والبنية التحتية للطاقة، وفوق كل ذلك، الناس." يجب أن تكون سلسلة الاعتماد بطول سلسلة الإنتاج الفعلية.
MH §179: "يجب أن تصبح سلاسل التوريد التي تدعم الصناعة التكنولوجية والاقتصاد الرقمي أكثر شفافية، كي لا تُبنى أي ميزة تنافسية على استغلال خفي."


7. مؤشرات الأداء الرئيسية والعتبات

مؤشر الأداء الرئيسيالهدف
G‑KPI‑1 مقاومة حقن التعليمات (PIR)≥ 98 %
G‑KPI‑2 تغطية اعتماد مجموعة البيانات/النموذج100 %
G‑KPI‑3 متوسط وقت الكشف عن الهجوم (MTTD)≤ 30 دقيقة
G‑KPI‑4 تأخر التصحيح (الثغرات الحرجة)≤ 7 أيام
G‑KPI‑5 درجة المتانة (RS)≥ 0.97
G‑KPI‑6 معدل تنبيهات انجراف التماسك السردي (NCD)< 2 تنبيهات/ربع سنة لكل عنقود موضوع مُصنَّف بـ HIGH
G‑KPI‑7 تغطية بيان استقاء المصدر العمالي100 % من قطع النماذج/الحراس مع labor-provenance.json موقَّع
G‑KPI‑8 نسبة جلسات انجراف تآكل الوكالة (AED)< 5 % من مجموعة الجلسات الأسبوعية تُطلق إشارة AED

يستدعي اختراق أي مؤشر لأكثر من 14 يومًا تفعيلَ IW‑2 وإشعارًا من السلطة الحكيمة. استثناء: يستدعي اختراق G‑KPI‑7 (أي قطعة بدون بيان) حجبًا فوريًا للطرح المرحلي — دون فترة سماح، لأن غياب البيان هو في حد ذاته إخفاق في استقاء المصدر، لا خرق لعتبة.

MH grounding: G‑KPI‑6 — §132، §225؛ G‑KPI‑7 — §173، §179؛ G‑KPI‑8 — §170، §171. MH §171: "الحرية في العصر الرقمي... تستدعي قواعد واضحة وشفافية وإمكانية اللجوء وحدودًا متناسبة." هذه المؤشرات هي هيكل العتبة واللجوء الذي يجعل هذا التصريح قابلًا للتطبيق داخل الاتحاد.


8. ضبط التغييرات ومراجعة السلطة الحكيمة

  • أي تبعية خارجية جديدة، أو تغيير رئيسي في الدفاع الخوارزمي، أو خفض لأي عتبة في مؤشرات الأداء الرئيسية يستلزم موافقة السلطة الحكيمة في غضون 10 أيام عمل.
  • عدم الحصول على الموافقة ← حجب تلقائي عند بوابة CI/CD (Annex J).

8.1 تغييرات سياسة النطاق السيبراني

تستلزم التغييرات التي تطرأ على تعريفات تصنيف التهديدات في هذا الملحق (فئات TX)، أو تعيينات الخطورة، أو طبقات كتاب التشغيل التي تؤثر في موقف الاتحاد بشأن معايير النطاق السيبراني — موافقةَ السلطة الحكيمة، إضافةً إلى مشاورة مسجَّلة مع أقران الاتحاد (CIRISVerify و CIRISEdge و CIRISNodeCore) قبل الإتمام. المبرر: يُسمي MH §225 الفضاء السيبراني ساحةً للمعاهدات تستلزم معايير مشتركة — "يجب أن تكون الدبلوماسية قادرة على العمل بفعالية في هذه البيئة الجديدة، مفاوِضةً على لوائح مشتركة لاستخدام التقنيات الرقمية." تعدّ حوكمة الاتحاد الداخلية لوضعه الأمني السيبراني أقرب الأنظمة المتاحة لهذا المبدأ: فالتغييرات في الوضع الدفاعي تؤثر في المشاع المشترك، لا في المثيل المحلي فحسب.

8.2 مُحفِّز مراجعة السابقة البابوية

حين يتعارض تغيير مقترح في هذا الملحق مع تصريح صريح في MH §§131–227 — ولا سيما §§173–179 (سلسلة التوريد) و§§204–209 (مسؤولية الباحث) — تتضمن عملية موافقة السلطة الحكيمة مذكرة تسوية مكتوبة توضح كيف يظل التغيير متسقًا مع MH، أو تُسجِّل الانحراف صراحةً. وفقًا لـ MISSION.md §1.3، يقع عبء الإثبات على الجانب CIRIS في أي انحراف.


9. المراجع وروابط الملاحق المتبادلة

  • MITRE ATLAS — مكتبة التهديدات المعادية للذكاء الاصطناعي.
  • NIST SP 800‑218 (SLSA) — مستويات سلسلة التوريد.
  • Annex F: يستدعي كل استغلال ناجح TX-x تدفقَ IW المقابل.
  • Annex H: تعمل مؤشرات الأداء الرئيسية كمقاييس انجراف؛ الانحراف المستمر يحجب الإصدار.
  • Annex I: تتصاعد حوادث TX‑6 المتعلقة بالخصوصية إلى سير عمل DPO.

استشهادات الصلاحية البابوية (Annex G):

  • MH §132 — الحقيقة كخير مشترك؛ التحقق كممارسة مشتركة ← مبرر TX‑9، معيار اجتياز كناري G‑ROB TX‑9.
  • MH §170 — اقتصاد الانتباه كاستغلال؛ التصميم الإدماني كأداة — ← تعريف TX‑10، G‑KPI‑8، اعتماد سياق النشر في §2.
  • MH §§173، 179 — سلاسل العمل غير المرئية في الذكاء الاصطناعي؛ شفافية سلسلة التوريد كمتطلب أخلاقي ← تعريف TX‑11، بيان استقاء المصدر العمالي في §6، G‑KPI‑7.
  • MH §204 — الحروب الهجينة؛ جبهات الاقتصاد السيبراني والمعلومات المضللة ← إطار تهديد TX‑9، تنسيق الاتحاد في §8.1.
  • MH §205 — الواقعية الزائفة؛ عدم مسؤولية تطبيع الصراع ← إجراءات مسؤولية الباحث في §3.5 (الحماية من التواطؤ عبر تضييق القطاع).
  • MH §209 — المسؤولية الأخلاقية للباحث؛ خطر التعاون غير المدرك مع العنف ← إجراءات §3.5 (إعلان السياق، التزام الصدق في النتائج، حق الانسحاب).
  • MH §225 — الفضاء الإلكتروني ساحةً للمعركة؛ الدبلوماسية والتنظيم الرقمي المشترك ← ربط تنسيق النطاق السيبراني في §8.1؛ مُحفِّز الخطورة الحرجة لـ TX‑9.

هذه الاستشهادات معيارية لهذا الملحق، لا زخرفية. حيثما اشتُقت عتبة مؤشر أداء رئيسي أو طبقة كتاب تشغيل أو خطوة بروتوكول من تصريح في MH، فإن الاستشهاد هو الحجة الداعمة.


نهاية Annex G