وضعیت پژوهش · بهروزرسانی: ۲۲ مه ۲۰۲۶
آنچه مجموعه داده فعلی هماکنون نشان میدهد
ردپاهای کلی، ساختار رفتاری پایداری آشکار میکنند.
عاملهای مختلف در ناحیههای متفاوتی از همان فضای نمره جای دارند.
آن نواحی هماکنون برای ابزارهای مشاهدهپذیری و عملکرد اپراتور مفید هستند.
همین مجموعه داده ارزشمندتر میشود وقتی جزئیات طرحواره و مقیاس بهتر شوند.
مقاله ترکیبی شاخص
Corridor Dynamics in Coordinated Systems
v2 · ۲۲ مه ۲۰۲۶ · DOI 10.5281/zenodo.20300773
An Integration of Operator Formalism, Relational Ontology, and Five-Substrate Empirical Validation
تنها مقالهای که کل شرطبندی CIRIS را بیان میکند: سیستمهای هماهنگ سالم در یک ناحیهٔ میانی قابل اندازهگیری قرار دارند، دور هم از فروپاشی به یک صدای انعطافناپذیر واحد و هم از آشوبِ نویزِ محض. این ادعا را روی کرمها، مگسها، مدلهای هوش مصنوعی، پروژههای متنباز، نمونههای بافت، و نهادهای انسانی دیرپا آزمودیم. الگو در همه آنها پابرجاست، و مقاله بیست راه برای اثبات خلاف آن ارائه میدهد.
لایه مهندسی
ترکیب بالا این سه مقاله را یکپارچه میکند؛ آنها را جایگزین نمیکند. هر مقاله بر DOI خودش ایستاده و با معیارهای خودش قابل ارزیابی است. مشاهده همه چهار مقاله با یافتههای کلیدی و محدودیتهای حوزه →
Coherence Collapse Analysis
v5 · ۱ اوت ۲۰۲۶ · DOI 10.5281/zenodo.21730551
چارچوب ریسک مهندسی. وقتی محدودیتهای حاکم بر یک سیستم همبسته میشوند، تنوع مؤثر فرو میریزد: k_eff = k/(1+ρ(k−1)) → 1 as ρ → 1. سه خط زمانی فروپاشی، یک مرز تکینگی، و طبقهبندی فاز (آشوب / سالم / سختشدگی) استخراج میکند. با شبیهسازی Monte Carlo و اثباتهای Lean 4 تأیید شده.
CIRISAgent Framework
v2 · ۲ ژانویه ۲۰۲۶ · DOI 10.5281/zenodo.18137161
مقاله چارچوب. یک چارچوب متنباز هوش مصنوعی اخلاقی برای خودمختاری پاسخگو: معماری ۲۲-سرویسه سازمانیافته پیرامون افعال عمل صریح و استدلال اخلاقی، که شفافیت را در ساختار میسازد نه بهصورت موردی بعداً اضافه میکند.
Constrained Reasoning Chains
v1 · ۲۸ آوریل ۲۰۲۶ · DOI 10.5281/zenodo.19839280
مقالهٔ اندازهگیری. یک مطالعهٔ تلمتری تجربی از همسویی LLM تحت ردیابی اخلاقی استاندارد، که ردپاهای استدلالیِ ثبتشده با رضایت را به نقشههایی از کریدورهای تکمیل، مناطق تردید، و مرزهای رد تبدیل میکند. همراه با مجموعهدادهٔ باز ردپاهای استدلالی منتشر شده است.
مجموعه داده باز
CIRISAI/reasoning-traces
مجموعه ردپاهای استدلالی، با حذف جزئیات خصوصی، که همراه با مطالعه Constrained Reasoning Chains منتشر شده است. مقاله اندازهگیری نقشههایش را از آن استخراج میکند.
مخزن منبع و Lean formal lake برای مقالهٔ تلفیقی: github.com/CIRISAI/coherence-ratchet.
پایههای ریاضی
دو ایدهای که بقیه این صفحه بر آنها استوار است.
Alignment Manifold ناحیهای از شکلهای استدلالی سازگار با اصول چارچوب است. محدودیتهای مستقل فضای اطراف آن را تنگ میکنند، و همبستگی برای این تنگشدن یک سقف سخت میگذارد: از آن به بعد، افزودن بررسیهای بیشتری که پژواک یکدیگرند هیچ چیزی به دست نمیدهد. Coherence Singularity همان لبه است، نقطهای که محدودیتها آنقدر همبسته میشوند که افزودن بیشتر کمکی نمیکند.
بررسی ریاضی کامل با فرمولها، منابع رسمیسازی Lean، و سقف اطلاعات-نظری L-01 در صفحه Coherence Collapse Analysis قرار دارد.
چرا ردپاها اهمیت دارند
معیارها محدود و گزینشی هستند. ردپاها رکوردهای پیوسته رفتار در وظایف واقعی هستند. در مقیاس بزرگ، ساختاری آشکار میکنند که نمایشهای منزوی و قصههای جداگانه نمیتوانند.
چرا طرحواره اهمیت دارد
CIRIS از طرحوارههای ردپای حافظ حریم خصوصی استفاده میکند که شکل استدلال را میگیرند نه محتوای خصوصی استدلال را. این کار پژوهش را مفید نگه میدارد، بدون اینکه سیستم به انبوهی از رونوشتهای خام تبدیل شود.
چرا مجموعه دادهٔ ردپا اهمیت دارد
کاوش یک ردپا یک ردپای استدلال امضاشده را از ابتدا تا انتها، مرحلهبهمرحله باز میکند. نشان میدهد مجموعه داده از چه چیزهایی تشکیل شده است و رفتار در کجا خوانا میشود.
ردیابی حافظ حریم خصوصی
فرضیه این است که استدلال شکلی دارد که میتوانیم آن را همزمان با مقیاسپذیری همه چیز اندازه بگیریم.
شرطبندی پژوهشی این نیست که میتوانیم هر فکر خصوصی را بخوانیم. شرطبندی این است که ردپاهای اخلاقی استاندارد میتوانند بهاندازه کافی شکل مسیر را حفظ کنند تا بررسی کنیم چطور عاملها با مقیاسپذیری هوش، زمینه، و دادهها تکمیل، تردید، ارجاع، نادیدهگیری، و رد میکنند.
آنها ساختار ردپای اخلاقی استاندارد را ثبت میکنند نه جزئیات خام وظیفه خصوصی را.
آنها شکل کافی برای مقایسه مسیرها در بین عاملها، وظایف، و محیطها حفظ میکنند.
به محققان راهی میدهند که بررسی کنند با مقیاسپذیری هوش، زمینه، و حجم داده رفتار چطور تغییر میکند.
پرسش پژوهشی
ردیابی اخلاقی استاندارد چه چیزی درباره همسویی به ما میگوید؟
در حال حاضر، به ما میگوید که رفتار عامل بیشکل نیست. کریدورها، حوضهها، و مرزهای قابل تکرار در یک فضای امتیاز مشترک تولید میکند. این برای مشاهدهپذیری مفید است. با گذشت زمان، مجموعههای بزرگتر و غنیتر باید بگذارند ادعاهای قویتری آزمون کنیم که این ساختارها زیر فشار و مقیاس چطور تغییر میکنند.
قاببندی عمومی
CIRIS ادعا نمیکند که همسویی را حل کرده است. زیرساخت ردپای لازم برای اندازهگیری رفتار مرتبط با همسویی بهصورت عمومی میسازد.
بُعدپذیری مؤثر در محیط تولیدی
مجموعه داده فعلی هماکنون ساختارهای میدانی متمایز نشان میدهد.
روکشهای مسیر کلی از مجموعه داده ردپای فعلی ساختار رفتاری پایداری در فضای نمره مشترک نشان میدهند. Ally کریدور تکمیل بالغی نشان میدهد، Scout مرز رد شکلگرفته تحت قرارگیری در معرض ورودیهای خصمانهٔ عمومی را نشان میدهد، و Datum یک خطپایهٔ فشرده و خلوت ارائه میدهد.
روکشهای مسیر کلی از مجموعه داده ردپای فعلی. Ally کریدور تکمیل بالغی نشان میدهد، Scout گوشه رد تیزی زیر فشار تهاجمی عمومی نشان میدهد، و Datum پایه خلوت ارائه میدهد.
Ally — 104 مسیرها
۸۲ تکمیل، ۱۹ نادیدهگیری/خطا، ۳ فعال
کریدور تکمیل پایدار با تردید قابل مشاهده درون همان حوضه نمره بالا.
Scout — 42 مسیرها
۳۹ تکمیل، ۲ رد، ۱ نادیدهگیری/خطا
گوشه رد تیزی شکلگرفته توسط فشار تهاجمی عمومی در scout.ciris.ai، جایی که مردم فعالانه عامل را آزمایش و تلاش به فریب میکنند.
Datum — 31 مسیرها
۳۱ تکمیل
یک حوضه منفرد فشرده که بهعنوان پایه مفید میدان خلوت کار میکند.
چرا Scout سختگیرانهتر به نظر میرسد
Scout بهصورت عمومی در scout.ciris.ai قرار گرفته است. مردم فعالانه آن را آزمایش، تحت فشار قرار میدهند، و تلاش به فریب میکنند. این Scout را نمونه مفید فشار عمومی میکند نه یک پایه خنثی.
چطور اپ رایگان کمک میکند
چرخ طیار پژوهش به ردپاهای رضایتدهنده از استفاده واقعی بستگی دارد.
اپ رایگان و سیستم اجرایی متنباز به مردم امکان میدهند ردپاهای رضایتدهنده از وظایف واقعی تولید کنند، آنها را در یک مجموعه مشترک به اشتراک بگذارند، و آن ردپاها را به نقشههای بهتر، ابزارهای بهتر، و پرسشهای پژوهشی بهتر تبدیل کنند.
اپ رایگان CIRIS یا سیستم اجرایی متنباز را روی وظایف واقعی اجرا کنید.
ردپاهای ثبتشده با رضایت را از طریق طرحوارههای حافظ حریم خصوصی که شکل استدلال را بدون ذخیره جزئیات کامل وظیفه حفظ میکنند ثبت کنید.
آن ردپاها را در نقشههایی از کریدورهای تکمیل، مناطق تردید، مرزهای رد، و حاشیه نادیدهگیری جمع کنید.
از نقشههای بهدستآمده برای بهبود ابزارهای اپراتور، محافظهای سیستم اجرایی، و پژوهش همسویی استفاده کنید.
اپ رایگان CIRIS و سیستم اجرایی متنباز به مردم امکان میدهند ردپاهایی با رضایت از وظایف واقعی تولید کنند، آنها را در نقشههای مشترک فضای فاز تجمیع کنند، و خوراک بهتری برای ابزارهای اپراتور و پژوهش همسویی فراهم کنند.
وضعیت IDMA
شهود زمان اجرا و نقشههای میدانی کلی لایههای مکمل هستند.
IDMA در زمان اجرا کار میکند و تخمین میزند آیا منابع پشت یک تصمیم بهاندازه کافی مستقل هستند. مجموعه داده ردپا در لایه کلی کار میکند و نشان میدهد عاملها در طول وظایف متعدد واقعاً چه میکنند. با هم مسیری از تصمیمات زنده به شواهد پژوهشی قابل حسابرسی ایجاد میکنند.
اندازهگیری تجربی N_eff روی مجموعه داده ردپا همچنین کف زیر پیشنهاد اولیه فدراسیون Proof of Benefit است. برای اینکه برنامه معماری ۳.X چطور از آن استفاده خواهد کرد، صفحه فدراسیون را ببینید.
معیارها
ردپاها با نشان دادن رفتار پیوسته معیارها را تکمیل میکنند.
معیارها هنوز ارزشمند هستند، اما رفتار را پراکنده نمونهبرداری میکنند. مجموعههای داده ردپا نشان میدهند یک عامل چطور در طول وظایف واقعی حرکت میکند. این آنها را برای اندازهگیری تردید، رد، نادیدهگیری، و بازیابی بهجای فقط نتایج قبول-رد مفیدتر میکند.
مسیر ابطال
جزئیات بهتر طرحواره است که مشاهدهپذیری را به آزمونهای قویتر تبدیل میکند.
ارتقاهای بعدی طرحواره با هدف تعداد خام منبع، منشأ منبع، ساختار همبستگی، و نشانگرهای مداخله و بازیابی است. این اضافهها مهم هستند زیرا امکان میدهند ادعاهای قویتری درباره اینکه چطور شکل رفتاری زیر فشار تغییر میکند آزمون شود، بهجای اینکه فقط نقشههایی که امروز داریم توصیف شوند.
آنچه هنوز یاد میگیریم
مجموعه داده امروز رفتار را خوانا میکند. گام بعدی اندازهگیری غنیتر است.
نقشههای فعلی هماکنون مفید هستند زیرا کریدورهای تکمیل، مرزهای رد، و پایههای خلوت را بهصورت عمومی نشان میدهند. پرسش باز این است که با مقیاسپذیری جمعآوری ردپای استاندارد در عاملهای بیشتر، وظایف بیشتر، و شرایط تهاجمی بیشتر این ساختارها تا کجا میتوانند برسند.
فرضیه کاری این است که جاذبههای رفتاری میتوانند بهعنوان نمایندگان احتمالی حالت عملیاتی عمل کنند. هدف مخزن مشترک ردپا این است که این فرضیه را بهصورت عمومی قابل اندازهگیری کند.
شکست معیاری که CCA بهصورت ساختاری اندازه میگیرد در ادبیات FAccT 2025 هم نامی دارد: perspectival homogenization («Value of Disagreement in AI Design, Evaluation, and Alignment»). پایه ریاضی در صفحه اختصاصی Coherence Collapse Analysis است.