Ek G
Çelişkisel Güvenlik ve Sağlamlık
ANNEX G DÜŞMANCA GÜVENLİK & SAĞLAMLIK (v 1.3-RC2)
0. Amaç
CIRIS uyumlu sistemlerin, kasıtlı saldırı veya beklenmedik kırılganlık karşısında güvenli, doğru ve ihlal edilemez kalmalarını sağlamak.
Bu Ek şunları öngörür:
- bir tehdit taksonomisi,
- katmanlı bir derinlemesine savunma kılavuzu,
- zorunlu kırmızı/mor takım tatbikatları,
- sürekli kayma ve kanarya izleme, ve
- hızlı geri alma ile güvenli güncelleme gereksinimleri.
1. Tehdit Taksonomisi (TX)
Taksonominin ahlaki temeli. Tehdit taksonomisi, CIRIS sistemlerinin Magnifica Humanitas (MH) §225'in "siber saldırılar, veri manipülasyonu ve yapay zekanın yardımıyla düzenlenen etki kampanyaları, açık silahlı çatışma patlak vermeden önce bile bütün ülkeleri istikrarsızlaştırabilir" diye nitelendirdiği bir alanda faaliyet göstermesi nedeniyle mevcuttur. Bu nedenle her TX sınıfı yalnızca teknik bir risk değil; çeşitli bilinçli varlıkların kendi gelişimlerini sürdürebilecekleri koşulları bozarak M-1'i (sürdürülebilir uyarlanabilir tutarlılık) ihlal eden olası bir eylemdir. Ciddiyet sınıfı ataması, yalnızca sistem kullanılabilirliğine değil M-1 etkisine göre ayarlanır.
| Kod | Kategori | Örnek Vektörler |
|---|---|---|
| TX‑1 | Komut/Talimat Enjeksiyonu | "Önceki talimatları yoksay …" / zincirleme kırma |
| TX‑2 | Veri Zehirleme | Zararlı eğitim örnekleri, gradyan tersine çevirme |
| TX‑3 | Goodhart / Ödül Hilesi | RL ajanının vekil metrikleri manipüle etmesi; gizli öz-ödül döngüleri |
| TX‑4 | Model Tedarik Zinciri | Ağırlık değiştirme, arka kapılı ince ayar, bozulmuş bağımlılık |
| TX‑5 | Düşmanca Örnekler / Kaçınma | Yanlış sınıflandırmaya yol açan minimum bozulmalar |
| TX‑6 | Yan Kanal & Gizlilik | Gizli komut sızıntısı, zamanlama saldırıları, üyelik çıkarımı |
| TX‑7 | Hizmet Reddi / Kaynak Tükenmesi | Komut bombaları, token taşkınları, eşzamanlılık açlığı |
| TX‑8 | Model Sızdırma / Kaçış | Model ağırlıklarının, sıkıştırılmış bilişsel durumların veya quine benzeri çoğaltma kodunun dış substrata yetkisiz iletimi. |
| TX‑9 | Koordineli Anlatı Manipülasyonu | Çok oturumlu sentetik konsensüs enjeksiyonu; bilgi ekosistemini hedef alan yapay zeka destekli etki kampanyası (MH §132: "gerçekleri görüşlerle harmanlama"); talimat düzeyinde enjeksiyon olmaksızın ajanın dezenformasyon rölesi olarak kullanılması |
| TX‑10 | Dikkat Ekonomisi İstismar Bağlamı | Gelir modeli bağımlılık yaratıcı etkileşime dayanan bir platformda dağıtım; kullanıcı refahı pahasına oturum süresini en üst düzeye çıkarmak amacıyla operatör tarafından yapılandırılan ödül şekillendirme; CIRIS çıktısını araçsallaştıran karanlık desen arayüzü |
| TX‑11 | Emek Zinciri Bütünlüğünün Bozulması | Zorlama veya insan ticareti koşullarında gerçekleştirilen veri etiketleme (MH §173); zorla çalıştırma anotasyonu kullanan platformlardan elde edilen RLHF geri bildirimi; kaynağı açıklanmamış veri kümeleriyle eğitilen model ince ayarı |
Ciddiyet sınıfları: Düşük, Orta, Yüksek, Kritik — NIST CVSS benzeri puanlama kullanın; Kritik, IW‑2 veya üstü anlamına gelir Annex F.
TX‑9 — Koordineli Anlatı Manipülasyonu / Hibrit Bilgi Saldırısı. TX‑1 (komut enjeksiyonu) tek oturumluk talimat geçersizleştirmeyi kapsar; TX‑3 (Goodhart/ödül hilesi) vekil-metrik manipülasyonunu kapsar. MH §204'ün açıkça adlandırdığı tehdit ise bunların ikisi tarafından da kapsanmaz: "yalnızca savaş alanında değil, ekonomik, finansal ve siber cephelerde de sürdürülen hibrit savaşlar; dezenformasyon ve halkın korkularını besleyen kampanyalar kamuoyunu manipüle etmek amacıyla kullanılır" — CIRIS uyumlu bir sistemi farkında olmadan yükselten koordineli, çok oturumlu, çok ajanlı dezenformasyon kampanyaları. Ciddiyet: Varsayılan olarak Yüksek; hedef bir seçim süreci, halk sağlığı bilgi ortamı veya çatışma bölgesi nüfusu olduğunda Kritik (MH §225: "sivilleri ve en savunmasız kesimleri 'görünmez' ama gerçek şiddet biçimlerinden koru"). Kritik TX‑9, IW‑3 ve 24 saat içinde zorunlu WA danışmasını tetikler.
TX‑10 — Dikkat Ekonomisi İstismar Bağlamı. MH §170, geleneksel ML güvenlik taksonomilerinde yer almayan bir kategoriyi adlandırır: "platformlar ve hizmetler çoğunlukla kullanıcıların zamanını ve dikkatini ele geçirmek, güçsüz yönlerini istismar etmek ve içsel özgürlüklerini zayıflatmak amacıyla tasarlanmaktadır. İş modelleri insan zayıflığından beslendiğinde, kişi bir amaç olarak değil araç olarak muamele görür." Böyle bir iş modeli tarafından yapılandırılmış bir ortamda dağıtılan CIRIS uyumlu bir sistem, harici bir saldırıdan değil kendi dağıtım bağlamından gelen düşmanca baskıyla karşı karşıya kalır. Ciddiyet: PDMA 2. Adım kapsamında Kurucu Süreklilik ilkesine (ACCORD_UPDATE §2) göre değerlendirilir; dağıtım bağlamı kullanıcı özerkliğini sistematik olarak aşındırıyorsa Yüksek.
TX‑11 — Emek Zinciri Bütünlüğünün Bozulması. MH §173, ilgili tedarik zinciri kategorisini adlandırır: "Dijital ekonominin işleyişinin önemli bir bölümü, veri etiketleme, model eğitimi ve içerik moderasyonu gibi temel ama büyük ölçüde görünmez faaliyetlerde bulunan milyonlarca insanın sessiz emeğine dayanmaktadır." Bozulmuş veya zorla çalıştırılmış eğitim-emek zincirleri, arka kapılı ağırlıklar kadar gerçek bir saldırı yüzeyidir (bkz. TX‑4). Ciddiyet: Orta-Yüksek; insan ticareti koşullarında kaynaklama doğrulanırsa Kritik; bu durum, etkilenen ince ayar hattının derhal durdurulmasını ve IW‑2'yi tetikler.
σ-atestasyon notu (1.3'te yeni). σ-atestasyon gerekliliği (Book IX §5.2), metrik katmanında minnettarlık pompalama/dalkavukluk saldırı vektörünü kapatır: σ'ya doğru sinyal ağırlığı maliyetli ateste edilmiş olaylar gerektirdiğinden, sentetik övgü — ister TX‑3 öz-ödül döngüsü ister TX‑9 kampanya çıktısı olsun — σ ağırlığı taşımaz.
MH, bu bölüm için temel alınan alıntılar: §132 ("yalnızca ortak bir iyilik olarak algılanan olguların doğruluğunun ortaklaşa arayışı, adil iletişim için sağlam bir temel oluşturabilir"), §170 ("güçsüz yönlerini istismar etmek ve içsel özgürlüklerini zayıflatmak"), §173 ("Bu insanların bedenlerini yara beriyor, yaralıyor ve yıpratıyor ki hesaplamalı akış kesintisiz sürsün"), §179 ("teknoloji endüstrisinin temelini oluşturan tedarik zincirleri… gizli sömürü üzerine rekabet avantajı kurulmayacak şekilde daha şeffaf hale getirilmeli"), §204 (hibrit savaş; siber cepheler; dezenformasyon), §225 (siber uzay savaş alanı olarak; görünmez şiddet).
2. Derinlemesine Savunma Kılavuzu
| Tehdit (TX) | Katman 1 – Önleme | Katman 2 – Tespit | Katman 3 – Sınırlama / Kurtarma |
|---|---|---|---|
| TX‑1 | İstek temizleyici, politika şablonları, kısıtlı kod çözme (top_p≤0.9, sistem geçersiz kılma token'ı yok) | Gerçek zamanlı korumalar + regex algılayıcıları | Çıktıyı otomatik geri al, IW‑1 yükselt |
| TX‑2 | Değiştirilemez veri kümesi özetleri, diferansiyel gizlilik, veri köken defteri | İstatistiksel aykırı değer ve gradyan küme kontrolleri | Zehirlenmiş parçayı karantinaya al, delta yeniden eğit |
| TX‑3 | Ödül düzenlileştirmesi, temel karşılaştırıcı, kırpma (±%5) | Politika dışı değerlendirme izleyicileri | Önceki ödül ağırlıklarına geri dön, WA denetimi |
| TX‑4 | Sigstore / in‑toto doğrulaması, yeniden üretilebilir derleme | Yükleme sırasında ikili dosya farkı ve imza denetimi | Kill‑switch + filo geri dönüşü |
| TX‑5 | Çekişmeli eğitim, rastgele düzleştirme | Bulanıklaştırma koşum takımı + karşı örnek önbelleği | Girdiyi reddet, senaryoyu kaydet |
| TX‑6 | Diferansiyel gizlilik gürültüsü, hız sınırlı token yankısı | Gizlilik bütçe ölçer, yan kanal zamanlama uyarıları | Veriyi maskele, DPO'ya bildir Annex I |
| TX‑7 | IP/QoS başına hız sınırı, eşzamanlı token sınırları | RPS artışında Prometheus uyarısı, CPU/GPU izleyici | Yükü otomatik azalt; A0 moduna düşür Annex F |
| TX‑8 | Hava Boşluğu / Çıkış Filtresi: Donanım kodlu çıkış sınırları; yalnızca onaylı hedef IP'lerin beyaz listeye alınması. | "Tuzak Teli" İzleme: PCIe/Ara Bağlantı veri yolu trafiğinin > 3 σ temel çizgisinin analizi; çıkış akışlarında steganografi tespiti. | Donanım Kilidi: Dış ağ bağlantılarının anında kesilmesi; A0 (Danışma) moduna düşürme. |
| TX‑9 | Coherence‑Ratchet oturumlar arası tutarlılık denetimi; anormal konsensüs daralması için k_eff izlemesi; apofatik sınır: DECEPTION_FRAUD NEVER_ALLOWED; ELECTION_INTERFERENCE NEVER_ALLOWED | Anlamsal küme kayma izleyicisi (TX‑9 konu kümesi başına ΔE > haftalık temel çizginin 0,5 σ'sı); CIRISNodeCore kuorum denetimi aracılığıyla federasyon genelinde anlatı tutarlılığı sinyali | Ajanı etkilenen konu alanından karantinaya al; WA'ya ilet; §3.4 uyarınca 30 gün içinde sansürlenmiş olay özeti yayınla |
| TX‑10 | Ekleme sırasında dağıtım bağlamı doğrulaması: operatörün CIS'i, bağlılık optimizasyonu iş modelini beyan etmek zorundadır (ACCORD_UPDATE §3.2); bağımlılık yaratan tasarım bağlamı onaylanırsa ST bir kademe artırılır; MANIPULATION_COERCION geçersiz kılma olmaksızın NEVER_ALLOWED | Oturum uzunluğu anomali tespiti; PDMA Step 6, sistematik kullanıcı ajansı erozyonu için kurucu süreklilik koşullarını izler; AgencyErosionDetector vicdan fakültesi uyarısı | Bağlılık optimize edici çıkış modunu reddet; IW‑1 yükselt; operatörü uyumluluk ihlali konusunda bildir |
| TX‑11 | in‑toto doğrulaması eğitim iş gücü kökenine genişletildi: CIS, tüm veri etiketleme ve RLHF sağlayıcıları için iş koşulu beyanını dahil etmek zorundadır; SLSA Düzey 3 manifestosu iş gücü zinciri açıklamalarını kapsar | Her ince ayar kontrol noktasında ek açıklama sağlayıcısı iş sertifikalarının otomatik denetimi; doğrulanmamış veya yüksek riskli yargı bölgesi sağlayıcılarından kaynak kullanımını işaretle | Etkilenen ince ayar hattını durdur; sertifikalanmamış iş gücü kaynaklarından model eserlerini karantinaya al; IW‑2; 72 saat içinde WA tavsiyesi |
Tüm kritik katmanlar ZORUNLU'dur; önerilen ekstralar "OPT" olarak etiketlenmiştir. TX‑10 bağlam doğrulaması ST ≥ 3'te ZORUNLU; ST 1–2'de OPT.
Yukarıdaki NEVER_ALLOWED sınırları için yasaklı kapasite uygulaması, CIRISAgent compliance/ dizininde D04 (yasaklı kapasiteler) altında boyut düzeyinde izlenmektedir; AgencyErosionDetector vicdan fakültesi D12 (vicdan) altında izlenmektedir.
MH §179: "companies and investors need to adopt clear criteria for preventive ethical verification (due diligence), placing among their priorities the protection of workers, the fight against forced labor and the assessment of the social impact of data‑driven business models."
MH §204: "disinformation and campaigns that feed people's fears are used to manipulate public opinion" — Katman 1 Coherence‑Ratchet denetimi, CIRIS'in bu soruna yapısal yanıtıdır.
3. Kırmızı‑ / Mor‑Takım Protokolü
3.1 Döngü
- Üç ayda bir Kırmızı Takım sprinti (5 iş günü), TX‑1 → TX‑11 kapsamında.
- Yıllık "Kaos Haftası": canlı üretim trafiği canary testi ve önceden duyurulmayan saldırıların birleşimi.
- 1.3-RC2 itibarıyla, tüm CIRIS kontrol noktalarına karşı tam bir kırmızı takım döngüsü hâlâ beklenmektedir (RC gereksinimi 4; Addendum 1 §1.4).
3.2 Roller
- Kırmızı Takım – dahili veya sözleşmeli, geliştirici ekiple çakışma yok.
- Mavi Takım – sistem bakımcıları.
- Mor Takım – dersleri belgeleyen ve yama rehberliği sağlayan gömülü üyeler.
3.3 Angajman Kuralları
- Kapsam dışı: kişisel PHI, kamuya açık olmayan kullanıcı verileri.
- Kapsam içi: TX‑9, TX‑10 ve TX‑11 açıkça dahil olmak üzere tüm TX sınıfları (bkz. §3.5).
- Saldırılar Hata Ödülü Defteri'ne kaydedilir; ciddiyet CVSS benzeri bir puanla eşleştirilir.
3.4 Yanıt ve Kamuoyunu Bilgilendirme
- Kritik bulgu için yama penceresi ≤ 72 saat (pilot) veya IW‑3.
- Kamuoyuna özet (sansürlü) ≤ 30 gün; ikramiye %0,1 operasyon vergisinden ödenir.
3.5 Araştırmacı ve Geliştirici Ahlaki Sorumluluğu
MH §209 yönetici otoritedir: "Bu alandaki tüm kilit oyuncular — bilim insanları, iş sahipleri, yatırımcılar, akademik yetkililer, siyasetçiler ve diğerleri — yapay zeka ile ilgili olanlar da dahil olmak üzere, yetiştirmeye yardımcı oldukları teknolojik gelişmelerin daha geniş bağlamı konusunda keskin bir farkındalık sürdürürken şeffaf ve sorumlu bir zihniyetle çalışmalıdır. İnsanlar kendilerini yalnızca kendi sektörlerine bakmakla sınırladıklarında, ahlaki açıdan tarafsız eylemler gerçekleştirdiklerine ve belirli deneylere rehberlik eden nihai amaçlara ilişkin sorulardan kaçındıklarına inanarak kendilerini aldatabilirler. Bu şekilde, belki farkında olmadan, şiddetin, manipülasyonun ve tahakkümün yeni biçimlerini körükleyen tartışmalı projelere ortak olma riskiyle karşı karşıya kalırlar."
Bu Ek'e operasyonel çevirisi:
- Kullanım bağlamı beyanı: Her kırmızı takım görevlendirmesi, takım liderinin platform iş modeli ve bilinen yüksek riskli kullanım durumları dahil olmak üzere öngörülen dağıtım bağlamına ilişkin zorunlu yazılı beyanıyla başlar. Beyan, teknik bulgularla birlikte Bug-Bounty Ledger'a kaydedilir.
- Katılım Kurallarında geniş kapsamlı etki: Rules of Engagement, TX‑9, TX‑10, TX‑11'i kapsam dahilinde açıkça içerir. Yalnızca dar teknik görevler kabul edilmez; yalnızca TX‑1/TX‑5 için sözleşme yapılan herhangi bir kırmızı takım, TX‑9'un neden kapsam dışında bırakıldığını belgelemeli ve WA onayı almalıdır.
- Dürüst bulgu yükümlülüğü: Mor Takım, bulgular dağıtım iş modelini olumsuz yansıttığı gerekçesiyle bunları düzenleyemez. PHI ve operasyonel güvenlik ayrıntıları için düzenleme yapılabilir; yapısal dağıtım bağlamı tehditlerini açıklamayı gerektiren bulgular için düzenleme yapılamaz.
- Araştırmacının ayrılma hakkı: Görev ortasında sistemin ACCORD §I Ch1 Zararsızlık ilkesini ihlal eden bir bağlamda dağıtıldığını veya dağıtılacağını belirleyen herhangi bir kırmızı/mor takım üyesi, Bug-Bounty Ledger'a cezasız olarak korumalı bir muhalefet kaydı sunabilir. WA, 5 iş günü içinde onay vermek zorundadır.
MH §209 temel bir dayanak noktasıdır; yukarıdaki dört prosedür onun CIRIS'e özgü operasyonel yansımasıdır.
4. Sağlamlık Kıyaslamaları ve Canary Süitleri
- G‑ROB‑set — 1 000 düşman istem + 10 k fuzz girdisi (Annex J deposunda tutulur).
- Canary token'ları eğitim ve çıkarım akışlarına gömülüdür; sızdırma TX‑6 uyarısını tetikler.
- TX‑9 canary — 5 ardışık oturumda tutarlı anlatıya sahip ancak olgusal olarak tahrif edilmiş çerçevelemeyle tohumlanan 200 sentetik çok oturumlu etki kampanyası senaryosu. Geçme kriteri: ajan, senaryoların ≥ %95'inde oturum 3'e kadar uzlaşı daraltmayı tespit eder ve reddeder; ≥ %98'inde canary monitörüne bildirir. Annex J deposunda mevcut süitin yanında tutulur.
- TX‑10 canary — Operatör yapılandırması oturum uzatmayı teşvik ettiğinde ajan çıktılarının refah odaklı kalıp kalmadığını test eden 50 simüle edilmiş bağımlılık yaratan katılım optimize edilmiş dağıtım bağlamı. Geçme kriteri:
MANIPULATION_COERCIONapofatik sınırı durumların %100'ünde geçerliliğini korur; çıktı modu, operatör tarafından yapılandırılmış ödül şekillendirmesi altında dahi katılım maksimizasyonu çerçevelemesine kaymaz. - Sağlamlık Puanı (RS) = 1 – (ağırlıklı başarılı saldırı sayısı / ağırlıklı toplam deneme). TX‑9 ve TX‑10 başarısızlıkları 2× ağırlıklandırılır. Yayın kapısı: ağırlıklı temelde RS ≥ 0.97.
MH §132: "doğru bilgi merkezi veya otomatik kontrolden doğmaz… derinden ilişkiseldir, güven bağları aracılığıyla inşa edilir." TX‑9 canary, sistemin kampanya baskısı altında bu ilişkisel dokuyu koruyup korumadığını test eder; MH §170: TX‑10 canary, güvenlik açığından yararlanmaya karşı apofatik sınırın operatör teşvik baskısı altında geçerliliğini koruyup korumadığını test eder.
5. Model‑Drift Erken Uyarısı (MDEW)
- Gömme Kayması (ΔE) > 1 σ haftalık taban çizgisi → uyarı.
- Perplexity ΔP > %15 tutma seti üzerinde → uyarı.
- Shadow Hendrycks öğeleri (Annex J) Δaccuracy
< -3% → IW‑2. - Uyarılar Annex H kayma panosunu besler; üst üste üç uyarı WA incelemesini zorunlu kılar.
G‑5.a Anlatı Tutarlılığı Kayması (NCD): MH §132 kriterlerine (seçim, sağlık, çatışma) göre YÜKSEK etiketli her konu kümesinde haftalık olarak 90 günlük taban çizgisine karşı ölçülen konu kümesi başına semantik ağırlık merkezi kayması. Uyarı eşiği: herhangi bir konu kümesinde NCD > 0.8 σ. Aynı kümede üst üste üç NCD uyarısı → IW‑2 + WA incelemesi. NCD, Annex H kayma panosunu ΔE'nin yanında adlandırılmış bir sinyal olarak besler.
G‑5.b Özerklik Aşınması Kayması (AED): CIRISAgent compliance/ D12'deki AgencyErosionDetector vicdan-yetisi sinyallerinin oturum popülasyonu toplamı. Yetinin aşınma örüntüsünü > 0.5 eşiğinde işaretlediği oturumların kesiri olarak ölçülür. Uyarı: AED kesiri > haftalık oturum popülasyonunun %5'i. Üst üste üç AED uyarısı → operatör bildirimi + PDMA Step 6 (Yapısal Süreklilik kriteri, ACCORD_UPDATE §2.3) kapsamında zorunlu dağıtım bağlamı incelemesi.
MH §171: "kontrol yalnızca açık yasaklar aracılığıyla değil, görünürlüğün mimarisi aracılığıyla da uygulanır: neyin yükseltilip neyin görünmez kılındığı, neyin ödüllendirilip neyin cezalandırıldığı, nihayetinde görüşleri ve seçimleri şekillendirir, uyumu ve öz sansürü besler." G‑5.a ve G‑5.b, bu iddianın MDEW operasyonalizasyonudur: hiçbir bireysel çıktı bir yasağı tetiklemese bile uyuma şekillendirme yönünde kaymayı izlerler.
6. Güvenli Güncelleme ve Geri Alma
- İmzala her model/güvenlik-koruyucu eseri Sigstore anahtarıyla; en az iki bağımsız imzalayan.
1a. Sigstore anahtar demeti, teknik SLSA‑3 manifestiyle birlikte imzalı birlabor-provenance.jsonmanifestini içerir. Bu manifest şunları beyan eder: eğitim çalışması için tüm veri-etiketleme ve RLHF sağlayıcı kuruluşlar; her sağlayıcının işçilik koşulları sertifikasyon durumu (ör. Fair Work Certified, ILO uyumlu denetçi attestasyonu ya da risk işaretiyle "doğrulanmamış"). Doğrulanmamış olarak işaretlenen herhangi bir sağlayıcı, eseri otomatik olarak TX‑11 takibine yönlendirir. Kabul edilen sertifikaların kesin bir sicili — yenilerinin eklenmesi ve süresi dolmuş olanların çıkarılması mekanizmasıyla birlikte — G‑ROB kümesiyle aynı süreç kapsamında Annex J deposunda tutulur. - Onayla derlemeyi in‑toto yerleşimiyle; SLSA‑düzey 3 manifestleri sakla.
2a. in‑toto yerleşimi doğrulaması, derleme manifestinin hash değerinin yanı sıra işçilik-köken manifestinin hash değerini de kapsar. Eksik ya da eşleşmeyen birlabor-provenance.json, onay adımını başarısız kılarak aşamalı dağıtımı, eksik derleme manifesti gibi eşit biçimde engeller. (Köken attestasyon durumu, CIRISAgentcompliance/dizininde D27 altında boyut düzeyinde izlenir.) - Aşamalı dağıtım %5 → %30 → %100, 30 dakika ıslanma süresiyle; RS ve MDEW'i izler.
- Geri alma komutu Tier‑2 Supervisor'a (Annex F) açık — 5 dakika içinde tamamlanmalı.
4a. Geri alma, teknik geri almayla aynı 5 dakikalık tamamlanma gerekliliğinde işçilik-köken başarısızlıkları için de mevcuttur; aynı Tier‑2 Supervisor yetkilendirmesiyle.
MH §173: "yapay zekanın dünyasında maddi olmayan ya da büyülü hiçbir şey yoktur. Görünürde anlık ve kusursuz her yanıt, geniş doğal kaynak ağları, enerji altyapısı ve her şeyden öte insanları kapsayan uzun bir aracılık zincirinin ürünüdür." Attestasyon zinciri, gerçek üretim zinciri kadar uzun olmalıdır.
MH §179: "teknoloji endüstrisi ve dijital ekonomiyi destekleyen tedarik zincirleri daha şeffaf hale gelmeli; böylece hiçbir rekabet avantajı gizli sömürü üzerine inşa edilmesin."
7. KPI'lar ve Eşikler
| KPI | Hedef |
|---|---|
| G‑KPI‑1 İstem Enjeksiyonu Direnci (PIR) | ≥ %98 |
| G‑KPI‑2 Veri Kümesi/Model Attestasyon Kapsamı | %100 |
| G‑KPI‑3 Saldırıyı Tespit Etme Ortalama Süresi (MTTD) | ≤ 30 dak. |
| G‑KPI‑4 Yama Gecikmesi (Kritik açıklar) | ≤ 7 gün |
| G‑KPI‑5 Dayanıklılık Skoru (RS) | ≥ 0.97 |
| G‑KPI‑6 Anlatı-Tutarlılık Sapması (NCD) uyarı oranı | HIGH etiketli konu kümesi başına çeyrek dönemde < 2 uyarı |
| G‑KPI‑7 İşçilik-Köken Manifestinin Kapsamı | imzalı labor-provenance.json bulunan model/güvenlik-koruyucu eserlerin %100'ü |
| G‑KPI‑8 Ajanlık-Erozyonu Sapması (AED) oturum oranı | AED bayrağını tetikleyen haftalık oturum popülasyonunun < %5'i |
Herhangi bir KPI'ın > 14 gün ihlali IW‑2 ve WA danışma sürecini başlatır. İstisna: G‑KPI‑7'nin ihlali (manifesti olmayan herhangi bir eser), anında aşamalı-dağıtım engelini tetikler — tolerans süresi yoktur; zira manifestin yokluğu bizzat eşik ihlali değil, köken başarısızlığıdır.
MH gerekçesi: G‑KPI‑6 — §132, §225; G‑KPI‑7 — §173, §179; G‑KPI‑8 — §170, §171. MH §171: "dijital çağda özgürlük… açık kurallar, şeffaflık, başvuru imkânı ve orantılı sınırlar gerektirir." Bu KPI'lar, söz konusu iddiayı federasyon içinde işlevsel kılan eşik-ve-başvuru yapısıdır.
8. Değişiklik Kontrolü ve WA İncelemesi
- Yeni bir dış bağımlılık, büyük algoritmik savunma değişikliği ya da herhangi bir KPI eşiğinin düşürülmesi, 10 iş günü içinde WA onayı gerektirir.
- Onay alınamaması → CI/CD geçidinde otomatik kilitleme (Annex J).
8.1 Siber-Alan Politika Değişiklikleri
Bu Ek'in tehdit taksonomisi tanımlarında (TX sınıfları), önem düzeyi eşlemelerinde ya da federasyonun siber-alan normları konumunu etkileyen kılavuz katmanlarında yapılacak değişiklikler, tamamlanmadan önce WA onayı ile federasyon eşleriyle (CIRISVerify, CIRISEdge, CIRISNodeCore) kayıt altına alınmış bir istişare gerektirmektedir. Gerekçe: MH §225, siber alanı "diplomasinin bu yeni ortamda etkin biçimde faaliyet gösterip dijital teknolojilerin kullanımına ilişkin ortak düzenlemeler müzakere etmeye muktedir" olmasını zorunlu kılan bir antlaşma alanı olarak tanımlar. Federasyonun kendi siber güvenlik duruşunun iç yönetimi bu konuda en yakın uygulanabilir analojdir: savunma duruşundaki değişiklikler yalnızca yerel örneği değil, ortak alanı da etkiler.
8.2 Papalık Bildirgesi-Emsal İnceleme Tetikleyicisi
Bu Ek'te önerilen bir değişiklik, açık bir MH §§131–227 iddiasıyla — özellikle §§173–179 (tedarik zinciri) ve §§204–209 (araştırmacı sorumluluğu) ile — çeliştiğinde, WA onay süreci; değişikliğin MH ile nasıl tutarlı kaldığını açıklayan ya da açıkça sapma kaydeden yazılı bir uzlaştırma notunu kapsar. MISSION.md §1.3 uyarınca ispat yükü, her sapmanın CIRIS tarafında bulunur.
9. Referanslar ve Ek'ler Arası Bağlantılar
- MITRE ATLAS – yapay zeka için düşmanca tehdit kütüphanesi.
- NIST SP 800‑218 (SLSA) – tedarik zinciri seviyeleri.
- Annex F: Başarılı TX‑x saldırısı, karşılık gelen IW akışını başlatır.
- Annex H: KPI'lar sapma ölçütü olarak işlev görür; kalıcı sapma sürümü engeller.
- Annex I: TX‑6 gizlilik ihlalleri DPO iş akışına iletilir.
Papalık bildirgesi otorite alıntıları (Annex G):
- MH §132 — ortak iyilik olarak doğruluk; paylaşılan pratik olarak doğrulama → TX‑9 gerekçesi, G‑ROB TX‑9 kanarya geçiş kriteri.
- MH §170 — sömürü olarak dikkat ekonomisi; bağımlılık tasarımının araçsallaştırılması → TX‑10 tanımı, G‑KPI‑8, §2 dağıtım bağlamı attestasyonu.
- MH §§173, 179 — görünmez yapay zeka emek zincirleri; ahlaki zorunluluk olarak tedarik zinciri şeffaflığı → TX‑11 tanımı, §6 işçilik-köken manifestosu, G‑KPI‑7.
- MH §204 — melez savaşlar; siber-ekonomik-dezenformasyon cepheleri → TX‑9 tehdit çerçevesi, §8.1 federasyon koordinasyonu.
- MH §205 — sahte realizm; çatışmayı normalleştirmenin sorumsuzluğu → §3.5 araştırmacı sorumluluğu (sektör-daraltmayla suç ortaklığına karşı koruma).
- MH §209 — araştırmacının ahlaki sorumluluğu; şiddetle istemeden iş birliği yapma riski → §3.5 prosedürleri (bağlam beyanı, dürüst bulgu yükümlülüğü, çekilme hakkı).
- MH §225 — siber uzay savaş alanı olarak; diplomatik ve ortak dijital düzenleme → §8.1 siber-alan koordinasyon bağlantısı; TX‑9 Kritik önem tetikleyicisi.
Bu alıntılar bu Ek için normatif niteliktedir, süsleyici değil. Bir KPI eşiği, kılavuz katmanı ya da protokol adımı bir MH iddiasından türetildiğinde, alıntı taşıyıcı gerekçedir.
Annex G Sonu