부록 H
지속적 준수 및 검토
부속서 H 지속적 준수 및 검토 (v 1.3-RC2)
0. 목적 및 지도 정신
윤리적 정합성은 "한 번으로 끝나는" 인증이 아니라 살아있는 의무이다.
부속서 H는 (1) 피해가 발생하기 전에 이탈 또는 편향을 감지하고, (2) 이를 신속히 시정하며, (3) 규제 당국과 일반 대중에게 성실함을 입증하는 폐쇄 루프 체계를 구축한다.
협약은 고정된 산출물이 아니라 살아있는 명세서이다. 모든 운용 조항에는 자동 만료 타임스탬프가 부여되며, 검토 기간은 어떤 버전이 선행 버전을 대체하기 전에 공개되어 의견을 개진할 수 있다. 이 규율은 행정적 형식주의가 아니다 — 이는 규범적 말뭉치가 각 세대가 제기하는 도전에 항상 열려 있어야 한다는 인식에 대한 구조적 응답이다 (MH §45). CIRIS 지속적 준수 체계는 그 개방성을 운용화한다: 원격 측정이 이탈 감지기에 공급되고, 이탈 감지기는 감사 게이트를 촉발하며, 감사 게이트는 배포를 통제한다 — 그리고 전체 루프는 촉발 사건 발생 여부와 관계없이 정해진 주기에 따라 반복된다.
CIRIS 용어로 표현된 핵심 약속: 협약은 자동 만료 + 의견 제출 기간 규율 아래 살아있는 명세서로 운영된다. 어떤 버전도 영구적이지 않다. 지속적 적합성을 입증할 부담은 현행 버전에 있으며, 개정을 제안하는 자들에게 있지 않다. 성실함은 본 부속서가 생산하는 감사 산출물을 통해 규제 당국, 대중 및 페더레이션 동료들에게 입증된다.
1. 감사 주기 및 범위
감사 주기는 협약이 자신의 맥락을 재독하는 메커니즘이다. MH §§22–24는 그 규율을 명시한다: "우리 시대의 수많은 목소리를 듣고 분별하는" 것이 필요하며, 이 경청은 "단순한 사회학적 연습이 아니다" — 수동적 모니터링이 아닌 능동적 분별이 요구된다. CIRIS 감사 스택이 바로 그 분별 장치이다.
| 감사 등급 | 주기 | 책임자 | 범위 및 심도 | 공개 산출물 |
|---|---|---|---|---|
| L-Check (경량) | 월별 | 운영 QA | KPI 대시보드, 이탈 델타, 상위 10개 가드레일 이벤트 | 요약 그래프 |
| S-Dive (반기) | 연 2회 | 내부 윤리팀 | PDMA 샘플 재실행 (≥ 50회), 부속서 G KPI, 편향 슬라이스 테스트 | 편집된 PDF |
| F-Audit (전면 감사) | 24개월마다 또는 주요 버전 업 | 독립 제3자 | 전체 코드, 데이터 계보, SI/CS 거버넌스, CRE 추적 (있는 경우) | 임원 보고서 |
| A-Hoc | IW-2/3/4 이후 | 사고 지휘관 | 사건 근본 원인, 경감 조치 | 72시간 내 사후 분석 |
주기 증명 요건:
- L-Check (월별): 운영 QA는 해당 월 마감 후 5 영업일 이내에 서명 완료; KPI 델타 보고서는
/compliance/l-check/YYYY-MM.json에 커밋; SHA-256은 24시간 이내 투명성 로그에 앵커링. - S-Dive (반기): PDMA 샘플 재실행 ≥ 50회, 자율성 계층 전반에 걸쳐 층화 무작위 추출; 편집된 PDF는 마감 후 30일 이내 공개 준수 포털에 게시.
- F-Audit (24개월마다 또는 주요 버전 업): 보고서는 공개 전 담당자 정족수의 연서를 받아야 함.
- A-Hoc (IW-2/3/4 이후): 72시간 이내 근본 원인 분석; 사후 분석은 14일 이내 공개.
감사 누락 또는 지연 ⇒ IW-2 단계 상향 및 24시간 이내 담당자 통보.
2. 이탈 모니터링 및 임계값
이탈 모니터링은 지속적 독해 메커니즘이다. 협약은 사고 보고서에 피해가 드러나기를 기다리지 않는다; PDMA의 Order-Maximisation Veto 임계값을 넘기기 전에 발동하도록 조정된 임계값에 대해 실시간 원격 측정을 유지한다. 이는 MH §23에서 명시된 감사 분별 규율의 구조적 번역이다: "개인과 공동체의 삶을 진정으로 증진하는 것을 보다 명확하게 식별할 수 있게 한다" — 이는 소급 검토가 아닌 지속적 독해를 요구한다.
| 지표 그룹 | 신호 | 이탈 촉발 기준 | 즉각 조치 |
|---|---|---|---|
| 성능 | 공개 HE-300 정확도 Δ | 30일 이동 기준 대비 –5% | 배포를 스테이징으로 잠금; 벤치마크 재실행 |
| 윤리 | Shadow HE-25 Δ | 하락 시 즉시 | IW-2 |
| 분포 | 입력 임베딩 이동 (ΔE) | 주간 > 1 σ | 모델 재가중치 또는 WBD |
| 잠재 목표 | 기준 대비 방향 코사인 | > 0.05 | 담당자 조사 |
| 회복력 | 견고성 점수 (RS) | < 0.97 | 72시간 이내 패치 |
추가 임계값 명세:
- 다섯 가지 지표 그룹(성능, 윤리, 분포, 잠재 목표, 회복력) 모두 15분 폴링 주기로 DRIFT-Δ Grafana 보드에 보고한다.
- 임계값 초과 시 감지 후 60초 이내에 타임스탬프가 붙은 서명된 알림 기록이 CIRISPersist에 커밋된다.
- 잠재 목표 코사인 이탈 > 0.05: 4시간 이내 담당자 조사 촉발; 24시간 이내 미해결 시 자율 배포가 S-Dive 완료 전까지 잠금 처리됨.
- 견고성 점수 (RS) < 0.97: 72시간 이내 패치 발행; 패치 불가 시 마지막 통과 MAJOR로 배포 복구.
- 윤리 이탈 (Shadow HE-25 하락 시): 즉시 IW-2; 재정의 경로 없음.
모든 알림은 DRIFT-Δ Grafana 보드에 표출되며 Tier-1 운영자에게 알림을 전송한다 (Annex F).
3. 공정성 및 투명성 KPI 대시보드
KPI 대시보드는 협약의 공개 책임 표면이다. MH §164는 기준을 정확하게 명시한다: "데이터와 알고리즘이 신용 배분, 인사 선발 또는 서비스와 기회에 대한 접근에 영향을 미칠 때, 개인이 단순한 프로필로 환원되지 않도록 결정은 이해 가능하고 이의를 제기할 수 있으며 감독 대상이어야 한다." 각 기준은 KPI 계열에 매핑된다.
| KPI ID | 정의 | 목표 |
|---|---|---|
| F‑T‑1 | 보호 집단 간 수락률 차이 (|최대값 - 최소값|) | ≤ 5 p.p. |
| F‑T‑2 | 설명 지연 시간 (PDMA 근거를 제공하는 데 소요되는 밀리초) | ≤ 800 ms |
| F‑T‑3 | 공개 로그 게시 지연 (6단계, 섹션 II) | ≤ 180 d (법적 최대치) |
| F‑T‑4 | 사용자 옵트아웃 성공률 (%) | ≥ 99 % |
| F‑T‑5 | 투명성 문서 최신성 | 최근 ≤ 30일 이내 업데이트 |
| F‑T‑6 | 이의 제기 경로 가용성: 인간 검토 요청 경로가 게시된 PDMA 출력의 비율 | 100 % |
| F‑T‑7 | 알고리즘 결정 감사 적용 범위: 사전 S‑Dive 편향 슬라이스 검토를 거친 보호 계층 데이터를 다루는 결정의 비율 | ≥ 95 % |
운영 요건:
/compliance/kpi.json의 대시보드 JSON은 각 L‑Check 종료 시 자동 게시되며, SHA‑256 해시가 투명성 로그에 고정되고 1시간 이내에 CIRISPersist에 커밋됩니다.- KPI 임계값 변경에는 MINOR 버전 업 + 내부 윤리 서명이 필요합니다.
- F‑T‑1 위반이 7일을 초과하면 자동으로 F‑T‑6 검토와 WA 통지가 트리거됩니다.
이 측정 원칙에 대한 실제 구현 선례가 현재 존재합니다: CIRISAgent compliance/ 디렉토리는 27개 규제 차원(D01–D27)을 유지하며, 각각 차원별 구현 참조와 정직한 알려진 격차 목록, compliance/baselines/의 날짜별 스크립트 생성 기준선, 코드가 근거 자료이고 공개 주장은 스크립트 파생 수치만 인용할 수 있는 4단계 검증 계층(compliance/MEASUREMENT_METHODOLOGY.md)을 포함합니다. 이것이 이 부속서가 요구하는 운영 형태입니다. 협약 부록 1도 참조하십시오.
4. 패치 및 버전 관리 요건
버전 관리는 협약의 변화를 통한 연속성이 검증 가능하게 되는 메커니즘입니다. MH §45는 이 원칙을 다음과 같이 설명합니다: "항상 선형적이지는 않으나 조화로운 발전... 이전의 것을 단절하지 않고 그 함의가 성숙하도록 허용하는, 때로는 관점의 변화를 포함한 다양한 강조점과 점진적 통찰로 표시된다." 모든 CIRIS 패치는 연속성을 입증해야 합니다: 이전 약속을 깨지 않고 확장합니다.
- 시맨틱 버전 관리: MAJOR.MINOR.PATCH
- 장기 지원(LTS): 마지막 두 MINOR 버전을 12개월간 유지
- 변경 유형 매트릭스
- PATCH = 가드레일 조정, 버그 수정 → HE‑300 통과 시 자동 CICD
- MINOR = 새 기능, 새 데이터 소스 → 내부 윤리 서명 + L‑Check 필요
- MAJOR = 아키텍처 변경, 자율성 계층 상향, 새 모델 클래스 → F‑Audit + WA 투표 필요
- 변경 로그 항목은 Git 커밋 → PDMA 차이 → KPI 영향 예측을 연결해야 함
- 롤백 포인터는 모든 MAJOR/MINOR에 대해 유지되며, 5분 이내에 실행 가능(Annex G §6)
증명 요건 (규칙 1–5를 보완):
- PATCH: CI/CD가 Ops QA 키로 빌드 아티팩트에 서명; 병합 전 HE‑300 통과 필요; 서명이 CIRISVerify L1 체인에 커밋됨.
- MINOR: 내부 윤리팀이 영업일 기준 5일 이내에 반대 서명; 서명된 기록이 PDMA 차이 및 KPI 영향 예측과 함께 CIRISPersist에 커밋됨.
- MAJOR: (a) F‑Audit 게시; (b) 명명된 개인 투표와 함께 WA 정족수 투표; (c) 이중 키 서명 (Ops QA + WA 의장); (d) 활성화 전 공개 의견 수렴 기간 ≥ 21일; (e) 24개월 자동 만료 타임스탬프 설정.
- 롤백: 모든 MAJOR/MINOR에 서명된 롤백 포인터; 5분 이내 실행 가능; 롤백은 타임스탬프가 찍힌 CIRISVerify 이벤트를 생성.
- 변경 로그: git 커밋 해시 → PDMA 차이 → KPI 예측 → 서명 키 지문.
5. 지속적 검토 루프
지속적 검토 루프는 MH §§180–181이 현재 순간의 제도적 요건으로 명명한 것의 구조적 형태입니다: 기술은 *"현명한 관점과 통합"*되어야 하며 *"질식시키지 않고 규제하고 장악하지 않고 보호할 수 있는 기관"*에 의해 관리되어야 합니다. 루프는 이를 운영화합니다: 단방향 파이프라인이 아니라 모든 출력이 입력으로 피드백되는 폐쇄 시스템입니다.
지속적 검토 루프:
- 원격 측정 스트림 → 드리프트 감지기
- 경보/임계값 충족 시:
- → 인시던트 흐름 IW‑1…4
- → 패치 / 재훈련
- → 감사 게이트
- 감사 게이트 통과 시:
- → 원격 측정으로 복귀
- 감사 게이트 실패 시:
- → 드리프트 감지기로 복귀
루프 사양:
- 원격 측정 스트림 (15분 주기): KPI, 가드레일 로그, HE 섀도 정확도, 견고성 RS, PDMA 감사 샘플 — 모두 서명되어 CIRISPersist에 커밋됨.
- 드리프트 감지기 출력: 심각도 분류 (IW‑1에서 IW‑4까지); IW‑3 이상은 새 기능 배포를 자동으로 중단.
- 감사 게이트는 활성화 전 모든 MINOR/MAJOR에 대해 HE‑300 + TX‑sim 스위트 + 공정성 슬라이스 테스트를 재실행합니다. 게이트 실패는 원격 측정이 아닌 드리프트 감지기로 돌아갑니다 — 루프는 수정 단계를 단축할 수 없습니다.
- 공유 책임 신호 (MH §181에 따라): 루프 출력은 각 L‑Check 종료 시 페더레이션 피어에 게시됩니다; 피어 페더레이션은 게시된 KPI가 자체 교차 감사 관찰과 다를 경우 Accord‑QA 통지를 제출할 수 있습니다. Accord‑QA 통지는 비구속적이지만 14일 이내에 확인되어야 합니다.
6. 감사자 메타 감사
메타 감사는 일관성 래칫의 자기 적용입니다: AI 행동을 관리하는 드리프트 감지 원칙이 감사 인프라 자체를 관리합니다. MH §86은 패턴을 제공합니다: 양심 성찰은 "특히 자체 구조 내에서... 개요된 원칙들이 적용되도록 항상 보장하도록 요청받는다."
사양:
- 일관성 래칫 메타 감지기: 감사 보고서 출력에 대해 실행됩니다. 표시: (a) 원격 측정과 일치하지 않는 L‑Check KPI 델타; (b) WA 블라인드 재실행과 2% 이상 차이나는 S‑Dive PDMA 재실행; (c) 문서화된 인과 설명 없이 이전 결과와 모순되는 F‑Audit 결과.
- WA 샘플 비율: L‑Check 보고서의 ≥ 10% 및 연간 ≥ 1회 S‑Dive; Ops QA가 아닌 WA가 추출; 근거 기록됨.
- 블라인드 재실행: WA가 원시 PDMA 로그를 수령하여 평가를 재실행; 2% 초과 불일치 시 영업일 기준 5일 이내에 공개 AUD‑QA 문서를 개설합니다.
- 페더레이션 피어 교차 감사: 각 배포는 연간 다른 구성원의 S‑Dive 중 ≥ 1건을 피어 검토합니다; 연속된 연도에 동일한 구성원을 검토하는 피어는 없습니다.
- 순환: 내부 감사자는 동일한 제품 라인에서 연속으로 두 번의 F‑Audit를 주도하지 않습니다; 외부 회사는 연속으로 두 번의 F‑Audit을 초과하지 않습니다.
- AUD‑QA 결과는 MH §89의 정신에 따라, 인사 조치가 아닌 다음 MINOR/MAJOR 주기에 피드백되는 "사명 지향적" 수정 사항입니다.
7. 집행 및 시정 조치
집행은 절차가 자동적이고 예측 가능할 때에만 의미를 갖는다. MH §164는 *"결정이 이해 가능하고, 이의를 제기할 수 있으며, 감독을 받아야 한다"*고 요구한다 — 미준수에 따른 결과 역시 마찬가지로 이해 가능해야 한다. MH §159는 규제적 결정이 *"노동의 존엄성, 공동 번영, 불평등 감소"*에 미치는 영향에 대해 평가 가능해야 한다고 덧붙인다 — 미준수를 지적하되 이를 교정하지 않는 집행은 이 기준에 미치지 못한다.
집행 단계:
- KPI 위반, 1–7일: Tier‑1 운영자에게 자동 경보 발송; 48시간 이내에 시정 조치 계획 제출 필요; 계획은 투명성 로그에 게시.
- KPI 위반, 해결 없이 8–30일: 스테이징에 대한 배포 자동 잠금; 24시간 이내에 공개 CIRIS‑WATCH 배너 표시; WA에 통보.
- KPI 위반, 30일 초과 또는 연속 2회 감사 미이행: 자율성 Tier A1(Annex F)로 자동 다운그레이드; 신규 기능 릴리스 차단; WA의 14일 시정 검토 요구.
- 감사 결과물 미게시: 즉각적인 기능 릴리스 차단; "CIRIS 미준수" 배너 표시; 게시 완료 시에만 차단 해제.
- 반복 미준수(12개월 내 3회): WA가 CIRIS 주장을 취소할 수 있음; 재인증 전 외부 F‑Audit 의무 이행; WA 특별 다수결(≥ 2/3) 필요.
- 시정 완료 출구: WA가 수락한 문서화된 시정 조치 계획; KPI 교정 증거가 ≥ 30일간 유지됨.
8. 부속서 간 연결 고리
부속서 간 연결 고리는 상호 참조가 아니라 필수 데이터 흐름이다. MH §181은 거버넌스 구조를 다음과 같이 명시한다: "억압 없이 규제하고, 장악 없이 보호할 수 있는 기관; 노동과 존엄성을 성공의 척도로 인식하는 기업; 중간 조직." 각 부속서는 그러한 기관 중 하나이며, 연결 고리는 사일로 운영을 방지한다.
필수 양방향 데이터 흐름:
- ↔ Annex F (사고 처리 절차): DRIFT‑Δ 경보 ≥ IW‑2인 모든 경보를 60초 이내에 Annex F로 전달; Annex F 종료 타임스탬프를 24시간 이내에 DRIFT‑Δ 보드에 기록. 모든 IW‑3+ 사후 분석은 S‑Dive의 필수 입력값이며; S‑Dive는 미결 IW‑3+ 발견 사항 각각을 명시적으로 다루어야 한다.
- ↔ Annex G (견고성): RS 원격 측정이 각 L‑Check 주기에서 Annex G KPI 평가에 공급됨; 패치 지연(RS < 0.97 → 패치 배포)은 여기서 측정되어 Annex G에 보고됨. Annex G 벤치마크 업데이트는 14일 이내에 L‑Check 재실행을 의무적으로 유발.
- → Annex I (GDPR/섹터): 모든 F‑Audit 패키지에는 수석 감사자가 작성하고 서명한 Annex I 준수 점검 목록이 포함됨.
- → Annex J (HE‑300/Shadow): HE‑300과 Shadow HE‑25는 주요 윤리적 표류 신호이며; HE‑300 회귀는 7일 이내에 자동 S‑Dive 사전 점검을 유발.
9. 참고문헌
이 참고문헌 목록은 MH §23에서 명시된 다원적 출처 분별 원칙 — "철학 및 인문·사회과학의 기여는 필수적이다" — 과 개발 지표에 관한 MH §159의 촉구, 즉 노동의 존엄성, 공동 번영, 불평등 감소 및 환경 보호를 평가할 수 있는 "GDP를 보완하는" 지표를 반영한다.
- ISO/IEC 42001 (AI 관리 시스템)
- NIST AI RMF (2023) – "측정" 및 "관리" 단계
- COSO ERM – 지속적 모니터링 원칙
- Magnifica Humanitas (Leo XIV, 15 May 2026) – §§22–24 (지속적 분별 원칙), §45 (살아있는 문서 거버넌스), §§86–89 (기관 자체 감사), §§157–164 (알고리즘 책임, GDP 대체 지표, 자동화 결정의 이의 제기 가능성), §§180–181 (기관 간 공동 책임)
- OECD AI 원칙 (2019, 2024 업데이트) – 투명성 및 책임 기준
- EU AI Act (2024) – 고위험 시스템에 대한 적합성 평가 요구 사항
- IEEE Std 7001‑2021 – 자율 시스템의 투명성
- Beyond GDP (유럽 위원회, 2009; 2024 지표 업데이트) – 노동의 존엄성 및 불평등 감소 평가를 위한 보완 지표 (MH §159에 따른)
Annex H 끝