एक पूर्ण, नौ आंशिक, कोई भी बनावटी नहीं। एक पेज जो सभी दस का दावा करता, वह ठीक वही मार्केटिंग होती जिस पर भरोसा न करने को हम आपसे कहते हैं। नीचे दिए गए कवरेज स्तर एक अलग संशयवादी की जांच से बचकर निकले, जिसका काम उन्हें गिराना था, और जहां कोई बचाव आधार-तंत्र में मौजूद है पर तैनात एजेंट ने अभी उसे नहीं अपनाया है, वहां हम पंक्ति में यह बता देते हैं।
| जोखिम | कवरेज | CIRIS इसे कैसे संबोधित करता है |
|---|---|---|
| ASI01 एजेंट गोल हाईजैक | आंशिक | गहराई में बचाव: आयातित स्किल्स और संदेशों पर प्रॉम्प्ट-इंजेक्शन स्कैनिंग, विज़ुअल-इंजेक्शन आइसोलेशन (कॉन्शन्स मूल्यांकक कभी कच्चे इमेज बाइट्स नहीं देखते), और एक कॉन्शन्स पाइपलाइन जो हर परिणामी क्रिया को चलने से पहले उपयोगकर्ता के मूल इरादे के विरुद्ध फिर से जांचती है। कमी: इनपुट स्कैनिंग पैटर्न-आधारित है और पुनर्प्राप्त डेटा को निर्देशों से औपचारिक रूप से अलग नहीं करती। |
| ASI02 टूल का दुरुपयोग | आंशिक | CIRISServer एक क्षमता-क्रिया की अनुमति/निषेध सूची भेजता है, साथ ही एक सर्वर-प्रवर्तित नेवर-लिस्ट, जिसे किसी ऑपरेशन के चलने से पहले जांचा जाता है, ताकि एक प्रत्यायोजित एजेंट कोई विध्वंसक क्रिया न कर सके जिसकी उसे अनुमति नहीं दी गई। चेतावनी: यह आज फैब्रिक परत की रक्षा करता है और अभी तक तैनात एजेंट के अपने LLM टूल कॉल को नियंत्रित नहीं करता; एजेंट इनहेरिटेंस एक योजनाबद्ध चरण है। |
| ASI03 पहचान और विशेषाधिकार दुरुपयोग | आंशिक | आधार-तंत्र में सीमित, प्रत्यायोजित, रद्द करने योग्य अधिकार: हस्ताक्षरित एज में वहन की गई सीमाएं, एक नेवर-लिस्ट जो सर्वोच्च शक्तियों को पुनः-प्रत्यायोजित होने से रोकती है ताकि अधिकार न बढ़ सके, केवल-कसने वाली स्वीकृति, और तुरंत रद्दीकरण। चेतावनी: यह आज फैब्रिक के ओनर-ऑप सतह पर लागू है; तैनात-एजेंट इनहेरिटेंस एक योजनाबद्ध चरण है। |
| ASI04 एजेंटिक सप्लाई चेन | आंशिक | CIRISVerify के पोस्ट-क्वांटम साइन किए गए मॉड्यूल मैनिफेस्ट (पूरे फाइल-ट्री हैश पर Ed25519 + ML-DSA-65) के जरिए बिल्ड इंटिग्रिटी, साथ ही फेडरेटेड घटकों के लिए हस्ताक्षरित, अटेस्टेड पहचान। कमी: यह CIRIS की अपनी बिल्ड और मॉड्यूल चेन को कवर करता है, किसी भी तीसरे-पक्ष के MCP सर्वर को नहीं। |
| ASI05 अप्रत्याशित कोड निष्पादन | आंशिक | सिमेंटिक कॉन्शन्स गेट्स (एंट्रॉपी, कोहेरेंस, ऑप्टिमाइज़ेशन-वीटो) हर टूल क्रिया पर उसके चलने से पहले चलते हैं, और अनिश्चितता होने पर मामला किसी मनुष्य पर टाल दिया जाता है। कमी: यह सिमेंटिक समीक्षा है, कोई निश्चयवादी कोड सैंडबॉक्स नहीं। |
| ASI06 मेमोरी और कॉन्टेक्स्ट पॉइज़निंग | आंशिक | ग्राफ मेमोरी पर हर लेखन एक शासित, कॉन्शन्स-जांचित क्रिया है जो एक सीमित, संस्करणबद्ध ग्राफ में जाती है, कोई मूक साइड-इफेक्ट नहीं, इसलिए एक पॉइज़निंग लेखन खुद एक ऑडिट योग्य निर्णय बन जाता है। कमी: पुनर्प्राप्त सामग्री की ट्रस्ट-स्कोरिंग आंशिक है। |
| ASI07 असुरक्षित इंटर-एजेंट संचार | आंशिक | CIRISEdge हर इंटर-एजेंट संदेश को सात-चरणीय पाइपलाइन से गुजारकर सत्यापित करता है जो हाइब्रिड Ed25519 + ML-DSA-65 हस्ताक्षर सत्यापन पर समाप्त होती है (आकार सीमा, टाइप्ड डीसीरियलाइज़, स्कीमा अनुमति-सूची, गंतव्य-कुंजी जांच, रीप्ले विंडो)। कमी: फेडरेशन ट्रांसपोर्ट अभी भी निर्मित हो रहा है। |
| ASI08 कैस्केडिंग विफलताएं | पूर्ण | तीन स्वतंत्र परतों पर सीमित: जोखिम भरे कॉल के आसपास प्रति-सेवा सर्किट ब्रेकर (बंद / खुला / आधा-खुला), कॉन्शन्स पाइपलाइन जो किसी खराब क्रिया को फैलने से पहले रोकती है, और मेश आइसोलेशन जो 50 से 400 नोड्स में शून्य क्रॉस-ग्रुप लीकेज पर मापा गया। |
| ASI09 मानव-एजेंट भरोसे का शोषण | आंशिक | कॉन्शन्स पाइपलाइन एजेंट के अपने व्याख्यात्मक पाठ को, जिसमें मानव समीक्षक को दिखाया गया कारण भी शामिल है, अति-आत्मविश्वास और हेरफेर के लिए स्कोर करती है, इससे पहले कि कोई मनुष्य उसे देखे। कमी: यह उसी मॉडल परिवार से ऑडिट करता है जिसकी वह जांच कर रहा है। |
| ASI10 दुष्ट एजेंट | आंशिक | तीन परतें: छह कॉन्शन्स हर परिणामी क्रिया को उसके निष्पादन से पहले गेट करते हैं, एक हैश-चेन्ड हस्ताक्षरित ऑडिट ट्रेल छुपाव को बाद में पहचान योग्य बनाता है, और सुरक्षित-विफलता वाला किल स्विच नामित मनुष्यों को एक कुसंरेखित एजेंट को रोकने देता है। कमी: सूक्ष्म रूप से कुसंरेखित पर सुसंगत एजेंट को पकड़ना स्वाभाविक रूप से सीमित है। |
एजेंटिक एप्लिकेशनों के लिए OWASP टॉप 10, दिसंबर 2025 में प्रकाशित। जुलाई 2026 तक CIRIS से मैप किया गया; अगर कोई सेल गलत है तो हमें बताएं और हम उसे ठीक कर देंगे।
स्रोत
- ASI01 एजेंट गोल हाईजैकCIRISAgent skill-import SECURITY.md + conscience pipeline
- ASI02 टूल का दुरुपयोगCIRISServer auth/gate.rs + DELEGATION_CONSTRAINTS.md (shipped 0.5.72)
- ASI03 पहचान और विशेषाधिकार दुरुपयोगCIRISServer auth/gate.rs (never-list, tighten-only) + adoption plan
- ASI04 एजेंटिक सप्लाई चेनCIRISVerify Threat Model, §3.4 Supply Chain
- ASI05 अप्रत्याशित कोड निष्पादनCIRISAgent conscience/core.py (semantic action gates)
- ASI06 मेमोरी और कॉन्टेक्स्ट पॉइज़निंगCIRISAgent ciris_engine (governed graph memory)
- ASI07 असुरक्षित इंटर-एजेंट संचारCIRISEdge README (verify-before-dispatch pipeline)
- ASI08 कैस्केडिंग विफलताएंCIRISAgent circuit_breaker.py + CIRISServer measured mesh isolation
- ASI09 मानव-एजेंट भरोसे का शोषणCIRISAgent epistemic-humility conscience prompt
- ASI10 दुष्ट एजेंटCIRISVerify HUMANITY_ACCORD kill switch + conscience pipeline
यह वर्गीकरण एक ही नज़रिया है। देखें कि AI जवाबदेही के हर दृष्टिकोण के बीच CIRIS कहां खड़ा है, और किल स्विच कैसे स्वतंत्र रूप से सत्यापित किया जा सकता है।