CIRIS has a new look. Visit the new site →

附录索引

附录部分的索引页。


附录一 — ASI就绪状态与监管交叉对照绑定

采纳日期:2026-06-10(1.3-RC2)· 执掌者:创始人(依据第八书第9章)

1.1 目的

范围章节提出了一项条件性主张:本框架探索一种ASI候选对齐协议,以引言中四项候选版本要求为前提条件。本附录将该主张绑定至现有操作性证据,并明确说明尚待完成的工作。ASI就绪并非已实现对齐;而是指第九书数学所要求的验证脚手架——独立约束流形、认证面、无法被归一化消除的良知层、终止开关面,以及附录D的灾难性风险评估——已以可实施、可审计的形式存在并已命名其缺口的状态。

1.2 监管交叉对照现已投入运营

现行交叉对照为CIRISAgent合规目录CIRISAgent/compliance/,智能体发布版2.9.6-stable),以段落粒度将框架实施映射至四个主要治理框架(附录C承载双层结构:此操作性交叉对照,加上待法律核实的参考性法规表):

  • 交叉对照的来源Magnifica Humanitas(宗教训导,2026年)· 欧盟HLEG可信AI伦理准则(政府咨询,2019年)· IEEE伦理对齐设计第1版(技术协会,2019年)· 东盟AI治理与伦理指南(多边政治,2024年)。四种机构上各异的形态——其收敛性是框架原则脚手架并非源自任一单一传统的结构性证据。
  • 结构:27个稳定维度(D01–D27,来自SEED_DIMENSIONS.yaml v1.0;16个得到全部四个来源证明,11个得到三个来源证明)。每份维度文档包含自动渲染的监管顶部(各来源引用、线路形式、收敛说明)以及附有file:line引用的人工撰写实施章节,这些引用必须能在当前主分支上通过grep验证。
  • 证据纪律:每项数字主张均可从注日期的脚本生成基线(compliance/baselines/)重现;行文可引用基线,但不得嵌入无法核实的数字。一个四级验证层次从实施文件(基础事实)延伸至公开主张(compliance/MEASUREMENT_METHODOLOGY.md)。
  • 诚实纪律:每个维度均附有"已知缺口"清单;受底层基础设施限制的条目以所属基础设施标注,而非主张已实现。合规README中列有十项横向发现(例如,类型化线路信封尚未发出;LensCore检测器系列尚未发布;反轴重新考量缺口)。

附录C在文本中保留其位置,作为法规映射(欧盟AI法案条款、NIST AI RMF、ISO/IEC 42001)待法律审查完成后的归宿;在此之前,合规目录是现行的、承载证据的交叉对照,并将向其输入。

1.3 线路格式:CEG取代FSD-002

CIRIS 3.0智能体系列的联邦线路格式为CEG(CIRIS认识论语法),维护于CIRISRegistry/FSD/CEG/。该语法锁定为恰好五种线路格式原语——一个主力原语(scores)加上四个结构组合原语(delegates_to / supersedes / withdraws / recants)——运行于开放的、机制描述性的维度命名空间之上。此锁定已在整个0.x系列中保持;每次增量都是在已锁定原语之上的组合。

两项后果对ASI就绪具有重要意义:

  1. CEG原生转变:3.0智能体不是将其内部状态映射到线路格式——其内部状态突变即是智能体自身密钥下的自层级CEG认证,按层级模型提升至联邦可见性。运营商审计的证据与联邦读取的信封相同。这是第九书关于约束面须为外部可引用而非自报告要求的已实施形式。
  2. 四项实施为CEG 1.0设立门槛:CIRISAgent(运行时)、CIRISNodeCore(共识)、CIRISLensCore(检测——智能体永不自发出的外部见证,防Goodhart分离)以及CIRISRegistry(权威机构)。任何单一方——包括智能体——均不得宣称验证织物已经完整。

1.4 1.3-RC2时的RC要求状态

RC要求状态证据/待完成事项
1. 附录F–I操作化文本已于1.3-RC2操作化;实时周期验证待完成附录F–I包含完整程序、阈值及验证机制(自2026年5月Magnifica Humanitas为基础的草案起完成);尚未针对实时部署周期进行演练
2. 第九书数学验证部分满足崩溃动力学已在Lean 4中形式化(CCA预印本v3,DOI 10.5281/zenodo.18217688);廊道实证提供跨底层基础设施的回顾性拟合。待完成:在新底层基础设施中进行一次预注册样本外预测;独立于作者的外部对抗性审查
3. 阈值论证部分满足Order-Maximisation Veto比率已退役(在第二书中重述为侧约束)。仍属临时性:10²⁶ FLOP CRE触发阈值、5%意识启发式、< 20%回声密度目标
4. 红队演练尚未执行1.3中的σ认证要求(第九书§5.2)先发制人地关闭了第一个已知攻击向量(通过自由感激信号进行σ泵送);针对所有检查点的完整对抗周期仍属欠账

1.5 良知层作为ASI关键控制机制

附录D的CRE协议管辖阈值跨越;良知层管辖跨越前后的每一个行动。在已实现的版本中(智能体2.9.6):每一个思维都经过按优先级排序的检查栈——四项经LLM评判的机能(熵、连贯性、优化否决权、认知谦逊)加上一个确定性安全底板(思维深度护栏、行动序列检查),即便在基准测试模式下、即便对于其他情况下豁免的行动,该底板也会运行。阈值是代码级常量,而非习得权重——这是架构层面的不变量,确保伦理不会因反复暴露而被正规化消解。存在多个独立停止面:优化否决权故障安全中止、关机服务,以及通过密码学签名的远程协议调用触发的完全禁止锁定。每项检查均写入一条带标签的追踪行,使审计人员能够回放每个思维的完整推理链。

已知局限,如实说明而非隐瞒:良知重构方案(3个分片+确定性门控)已部分落地;良知裁决的类型化联邦发射有待底层Contribution信封就位。各维度详细说明见:compliance/D12_conscience.md

1.6 底层依赖轨迹

ASI级别的验证需要完整的联邦织物。底层轨迹为Persist → Edge → LensCore → NodeCore;27个维度中约有三分之一取决于LensCore的外部检测器家族(智能体永远不得自行提供的见证者)。在这些底层就位之前,相应维度的声明保持实现端就绪、联邦端待定的状态,并在各维度中相应标注。

1.7 本附录所更改与未更改的内容

  • 本附录升级范围文件中的ASI声明——该声明仍以满足全部四项RC要求为条件。
  • 本附录取代附录D——CRE协议作为阈值跨越门控,维持原文不变。
  • 本附录确实使证据链首次实现端到端可审计:监管段落→维度(D01–D27)→实现file:line→有日期的基线→(随底层就位)外部联邦见证。
  • 本附录确实承诺协议在每个版本更新时同步更新本附录,附上当时的智能体发布版本与基线,确保就绪声明永不无声过时。

先前附录:无。本附录为第一份。

本页内容