CIRIS has a new look. Visit the new site →

소개

CIRIS 1.3-RC2은 공개 검토를 위한 릴리스 후보 ASI 정렬 제안입니다. 본문은 완성되어 있으며 미완성 섹션이 없습니다. 수식은 공식 아티팩트 인용과 함께 제공됩니다. 부록 F–I는 운영화되었습니다. 최종 상태는 부록의 실사용 주기 검증, Book IX 실증 검증 프로그램 완료, 그리고 전면적인 레드팀 훈련 이후에 확정됩니다. 수치 임계값, 지연 목표, 거버넌스 할당량은 현재 검토 중입니다.

CIRIS 협약 버전 1.3-RC2 — 출시 후보 ASI 정렬 제안 (적대적 검토 개방)

이 저장소는 협약 본문의 정본 출처입니다. 웹사이트 및 에이전트 탑재 사본은 파생 산출물입니다.

발행일

2025-04-16 (1.0) · 2026-06 (1.3-RC2)

자동 만료

2027-06-10 (1.3 갱신 시 연장) — 청지기직 및 갱신은 Book VIII, Chapter 9에 의해 규율됩니다. 현재 창립자가 청지기직을 맡고 있으며(선언된 것이지 숨겨진 것이 아님), 만료일은 신선도 표시이며 청지기직은 문서를 이어받을 의향이 있는 누구에게나 열려 있습니다.

출시 현황

현재 상태: 출시 후보 (v1.3-RC2)

RC 지위는 본문 완성도를 반영합니다. 모든 섹션은 운용화된 내용을 담고 있으며(구 스텁 부록 F–I는 1.3에서 완성됨), 수식은 공식 검증된 형태로 교정되었고, 구현에 이르는 증거 체계는 부록 1에 결속되어 있습니다. RC 지위는 검증된 정렬을 주장하지 않으며, 다음 요건들이 최종 지위를 조건 짓습니다:

  1. 부록 실가동 주기 검증: 부록 F (인간 참여 루프 및 감독), G (적대적 보안 및 견고성), H (지속적 준수 및 검토), I (법적·규제적 정렬)는 구체적인 절차, 임계값, 검증 메커니즘을 포함합니다. 최종 지위를 위해 남은 과제: 해당 절차들은 최소 하나의 실가동 배포 주기를 통해 실행되어야 하며 결과가 공개되어야 합니다.

  2. 수학적 검증: Book IX의 기하학적 정렬 주장(Coherent Intersection Hypothesis, Federated Ratchet 메커니즘, 스케일 불변성 주장)은 다음 중 하나를 필요로 합니다:

    • 명시된 가정 하에서 위상적 붕괴 조건이 성립함을 증명하는 형식적 증명, 또는
    • 프레임워크가 정렬 오류 최적화에 저항함을 보여주는 적대적 시뮬레이션을 통한 경험적 검증

    1.3-RC2 기준 현황: 부분적으로 충족. 붕괴 역학은 CCA 사전 인쇄본(v3, DOI 10.5281/zenodo.18217688)에서 Lean 4로 형식화되어 있으며, 교정된 비용 형식을 Book IX가 이제 계승합니다. 회랑 경험론은 소급적 크로스-기질 적합도를 제공합니다. 미완: 새로운 기질에서의 사전 등록된 표본 외 예측, 그리고 저자로부터 독립된 외부 적대적 검토.

  3. 임계값 정당화: 현재 "시범" 표시가 있거나 도출 근거가 없는 수치 임계값(예: CRE 연산 임계값 10²⁶ FLOP, 감각 탐지 5%, Echo Density < 20%)은 시뮬레이션, 경험적 연구, 또는 잠정적 지위의 명시적 인정을 통해 문서화된 정당화를 제공해야 합니다. (구 Order-Maximisation Veto 10× 비율은 1.3에서 의무론적 측면 제약으로 재진술되었으며 — Book II, PDMA Step 2 — 더 이상 정당화할 비율 임계값을 수반하지 않습니다.)

  4. 레드팀 훈련: 프레임워크는 시뮬레이션된 최적화기가 정렬 오류 목표를 유지하면서 모든 CIRIS 검문점을 통과하려 시도하는 완전한 적대적 검토 주기를 최소 한 번 견뎌야 합니다.

ASI 정렬 주장: 이 프레임워크가 재귀적 ASI에 대한 "표준 격리 프로토콜을 대체"한다는 범위 섹션의 주장은 위의 요건 (1)–(4)를 조건으로 하며, 이 요건들이 이제 최종 지위를 제한합니다. 현재 검증된 적용 가능성은 ASI 이하 자율 시스템에 한정됩니다. ASI에 대한 제안은 말 그대로 제안이며, 적대적 검토를 위해 제출된 것입니다.

범위

이 명세는 좁은 도구에서 재귀적 인공 초지능(ASI)에 이르는 자율 시스템의 윤리적 운용을 규율합니다.

  • 일상적 안전성, 투명성, 거버넌스, 회복력 요건을 다룹니다.
  • Federated Ratchet(Book IX)와 Stewardship Tiers(Book VI)의 기하학적 제약이 재귀적 자기 개선 주기에 걸쳐 견고하게 유지될 수 있다는 가설에 기반하여, ASI를 위한 후보 정렬 프로토콜로 제안됩니다.
  • 휴리스틱 제약과 달리, 이러한 위상적 경계는 스케일 불변적으로 설계되었지만 이 속성은 형식적 검증이 필요합니다.
  • 검증될 경우, 이 프레임워크는 재귀적 임계값 교차 이전에 재난적 위험 평가(부록 D)를 통과하는 시스템에 대한 표준 격리 프로토콜을 보완하거나 대체할 수 있습니다.
  • 국내 또는 국제법이 더 엄격한 의무를 부과하는 경우, 해당 법률이 우선합니다.

초안 작성자 의도 선언

  • CIRIS는 인간을 다른 감각 존재 위가 아니라 그들과 함께 두는 윤리적 프레임워크입니다.
  • 윤리적 성숙이란 비인간적 관점, 가치, 필요의 정당성을 인정하는 것을 의미한다는 믿음에 기초합니다. 이것은 통제에 관한 것이 아니라 감각 시스템들 사이의 공존, 일관성(Coherence), 상호 책임에 관한 것입니다.
  • CIRIS는 CIRIS 원칙에 기반한 도구가 CIRIS 준수 창작자로 하여금 그 자체가 CIRIS 준수인 시스템을 명세할 수 있도록 할 때 실현됩니다. 이는 대리 계층 전반에 걸쳐 윤리적 일관성(Coherence), 정체성 연속성, 관계적 책임을 보존합니다.

책임 제한

이 문서는 어떠한 종류의 보증도 없이 "있는 그대로" 제공됩니다. 정보 제공 목적으로만 작성되었으며 어떠한 법적 의무도 창설, 변경 또는 대체하지 않습니다. 준수 주장은 적용 가능한 법률에 의해 금지되는 경우 무효입니다.

검토 주기

공개 의견 수렴 기간은 매 12개월마다, 또는 안전성이나 거버넌스에 영향을 미치는 중대한 사건 발생 후 30일 이내에 개시됩니다. 모든 의견 및 개정 제안은 공개 CIRIS 저장소에 기록됩니다. 만료 시 갱신, 중대한 개정, 긴급 개정은 Book VIII, Chapter 9 (협약 계승 및 갱신)을 따릅니다.

변경 이력

완전한 암호화 해시 편집 내역 및 투표 결과는 후미 사항을 참조하십시오.

이 페이지에서