CIRIS
ఈ పేజీని యంత్రం అనువదించింది. ఏదైనా తప్పుగా అనిపిస్తే, దయచేసి GitHub లో ఒక ఇష్యూ తెరవండి. రెపో పబ్లిక్‌గా ఉంది కాబట్టి ఎవరైనా దాన్ని సరిచేయడంలో సహాయం చేయవచ్చు. అనువాద సమస్యను నివేదించండి

ముఖ పేజీకి తిరిగి వెళ్ళండి

H3ERE ఇంజిన్

ఇది ఎలా పని చేస్తుంది

Hyper3 Ethical Recursive Engine ద్వారా రన్‌టైమ్ మనస్సాక్షి. ప్రతి నిర్ణయం జవాబుదారీతనంతో 11 దశల గుండా ప్రవహిస్తుంది.

నేటి ఏజెంట్లు చర్య తీసుకుంటాయి. CIRIS జవాబుదారీగా నిర్ణయిస్తుంది.

సాధారణ AI ఏజెంట్ నేరుగా ప్రాంప్ట్ నుండి టోకెన్లకు, అక్కడ నుండి టూల్ కాల్‌కు వెళ్తుంది. CIRIS మరెక్కడా లేని ఒక దశను జోడిస్తుంది. ఏదైనా చర్య జరగడానికి ముందు, ఆ నిర్ణయం మనస్సాక్షి పైప్‌లైన్ గుండా వెళ్తుంది: దాన్ని తూకం వేస్తారు, రాజ్యాంగానికి వ్యతిరేకంగా తనిఖీ చేస్తారు, మరియు ఎవరైనా నిరూపించగల సంతకం చేయబడిన, సాక్షి రికార్డుగా మారుస్తారు. ఆ రికార్డు చెల్లుబాటు అయినప్పుడు మాత్రమే చర్య జరుగుతుంది.

ఇది CIRIS ని కేవలం ఒక ఏజెంట్‌గా కాకుండా ఒక సంస్థగా చేసేది ఇదే. దానికి జ్ఞాపకశక్తి ఉంది, చట్టాలు ఉన్నాయి, అధికార అప్పగింత ఉంది, జవాబుదారీతనం ఉంది, మరియు ఎవరూ నిశ్శబ్దంగా మార్చలేని రికార్డు ఉంది. ఇవే సాధనాలు మానవ సమాజాలు పెద్ద స్థాయిలో ఒకరినొకరు నమ్మేలా చేస్తాయి. కొత్తగా ఉన్న విషయం క్రిప్టోగ్రఫీ కాదు. ఒక ముఖ్యమైన నిర్ణయం చర్య తీసుకోవడానికి అనుమతి పొందే ముందు జవాబుదారీగా మారాలి, అది కొత్తది.

CIRIS అంటే ఏమిటి?

CIRIS అనేది ఒక ఓపెన్-సోర్స్ AI ఏజెంట్ ఫ్రేమ్‌వర్క్, ఇది ఏ LLM నైనా (OpenAI, Anthropic, లోకల్ మోడళ్లు) రన్‌టైమ్ మనస్సాక్షితో చుట్టుకుంటుంది. ఏజెంట్ పరిశీలించే ప్రతి చర్య అమలుకు ముందు అనేక ధృవీకరణ స్తరాల గుండా వెళుతుంది.

12

నిర్ణయానికి పైప్‌లైన్ దశలు

+1

అంతర్ దృష్టి తనిఖీ (IDMA)

100%

ఆడిట్ చేయదగిన నిర్ణయాలు

వినియోగ సందర్భాలు: కమ్యూనిటీ నిర్వహణ, వ్యక్తిగత సహాయకులు, కంప్లయెన్స్ ఆటోమేషన్, పరిశోధన మూల్యాంకనం, కస్టమర్ సర్వీస్. మీకు AI తన తర్కాన్ని వివరించగలగాలని మరియు కష్టమైన సందర్భాల్లో మనుషులకు అప్పగించాలని అవసరమైన ఎక్కడైనా.

ఈ విధానం ఎందుకు? → · రాజ్యాంగం చదవండి → · సోర్స్ కోడ్ చూడండి →

మూడు నియమాలు

కోడ్‌బేస్ అంతటా అమలు చేయబడే మార్పులేని నిర్మాణ లక్షణాలు:

టైప్ చేయని డిక్ట్‌లు లేవు

అన్ని డేటా Pydantic మోడళ్లను ఉపయోగిస్తుంది. Dict[str, Any] లేదు. టైప్ సేఫ్టీ డెవలప్‌మెంట్ సమయంలో తప్పులను పట్టుకుంటుంది.

బైపాస్ నమూనాలు లేవు

ప్రతి కాంపొనెంట్ స్థిరమైన నియమాలను పాటిస్తుంది. ధృవీకరణ తర్కంలో ప్రత్యేక సందర్భాలు లేదా మినహాయింపులు లేవు.

మినహాయింపులు లేవు

అత్యవసర ఓవర్‌రైడ్‌లు లేదా ప్రివిలేజ్డ్ కోడ్ పాత్‌లు లేవు. అన్ని ఆపరేషన్లు నిర్ణీత నియమాలను పాటిస్తాయి.

H3ERE పైప్‌లైన్

ప్రతి పని 8 దశల గుండా వెళుతుంది (రికర్సివ్ ధృవీకరణతో 12 దశలు). పైప్‌లైన్ ThoughtProcessor ను కంపోజ్ చేసే మిక్సిన్ క్లాసెస్‌గా అమలు చేయబడింది. దశ 4 (IDMA) అనేది అంతర్ దృష్టి తనిఖీ.

1. START_ROUND

ప్రాసెసింగ్ రౌండ్ ప్రారంభించు

2. GATHER_CONTEXT

విశ్లేషణ కోసం సమగ్ర సందర్భం నిర్మించు

3. PERFORM_DMAS

3 సమాంతర నిర్ణయ తీసుకోవడపు అల్గారిథమ్‌లు నడుపు

4. PERFORM_IDMA

అంతర్ దృష్టి తనిఖీ: మూలాలు నిజంగా స్వతంత్రంగా ఉన్నాయా?

5. PERFORM_ASPDMA

DMA ఫలితాల నుండి LLM-ఆధారిత చర్య ఎంపిక

6. CONSCIENCE_EXECUTION

4 అంశాల ద్వారా నైతిక ధృవీకరణ

7. RECURSIVE_ASPDMA (షరతులతో)

(మనస్సాక్షి విఫలమైతే) చర్య ఎంపిక మళ్ళీ నడుపు

8. RECURSIVE_CONSCIENCE (షరతులతో)

(అవసరమైతే) పరిష్కరించిన చర్యను మళ్ళీ ధృవీకరించు

9. FINALIZE_ACTION

ఏదైనా ఓవర్‌రైడ్‌లతో తుది చర్య నిర్ణయించు

10. PERFORM_ACTION

తగిన హ్యాండ్లర్‌కు డిస్పాచ్ చేయి

11. ACTION_COMPLETE

అమలు పూర్తయిందని గుర్తించు

12. ROUND_COMPLETE

శుభ్రపరచి తదుపరి చక్రానికి సిద్ధం చేయి

నిర్ణయ తీసుకోవడపు అల్గారిథమ్‌లు (DMAs)

ఐదు DMAs బహుళ-కోణ విశ్లేషణ అందిస్తాయి. మూడు సమాంతరంగా నడుస్తాయి (నీతి, సామాన్య జ్ఞానం, డొమైన్). అప్పుడు IDMA అంతర్ దృష్టి తనిఖీ చేస్తుంది. చివరగా, చర్య ఎంపిక స్పందనను ఎంచుకుంటుంది.

సూత్రం DMA

ఆరు ప్రాథమిక సూత్రాలకు వ్యతిరేకంగా నైతిక పరిణామాలను మూల్యాంకనం చేస్తుంది. హాని కలిగించే అభ్యర్థనలు, మానిప్యులేషన్, పక్షపాతాన్ని తనిఖీ చేస్తుంది. ముందస్తు DEFER లేదా REJECT ని ప్రేరేపించవచ్చు.

సామాన్య జ్ఞానం DMA

భౌతిక ప్రపంచ అవగాహన, సాధారణ పరస్పర చర్యలు మరియు వనరు పరిమితులకు వ్యతిరేకంగా ఆలోచన సంభావ్యతను మూల్యాంకనం చేస్తుంది. ఒక plausibility_score తిరిగి ఇస్తుంది.

డొమైన్-నిర్దిష్ట DMA

డొమైన్-నిర్దిష్ట నియమాలు, లక్ష్యాలు మరియు జ్ఞానంతో అమరికను అంచనా వేస్తుంది. ఏజెంట్ టెంప్లేట్ ప్రకారం కాన్ఫిగర్ చేయబడింది. domain_alignment తిరిగి ఇస్తుంది.

అంతర్ దృష్టి DMA (IDMA) రన్‌టైమ్‌లో ప్రభావవంతమైన కొలతలు →

DMA ఫలితాలు నిజంగా స్వతంత్రంగా ఉన్నాయా లేదా రహస్యంగా సహసంబంధం కలిగి ఉన్నాయా అని తనిఖీ చేస్తుంది. ఎకో చాంబర్ నమూనాలను పర్యవేక్షిస్తుంది. సహసంబంధం చాలా ఎక్కువగా ఉంటే, జాగ్రత్త కోసం నిర్ణయానికి జెండా వేస్తుంది. ఇది Type 3 AI ని వేరు చేసే "అంతర్ దృష్టి".

చర్య ఎంపిక DMA

10 అందుబాటులో ఉన్న చర్యల నుండి LLM-ఆధారిత ఎంపిక. సమగ్రీకృత DMA ఫలితాలను (IDMA నమ్మకం అంచనాతో సహా) ఇన్‌పుట్‌గా తీసుకుంటుంది. మనస్సాక్షి విఫలమైతే రికర్సివ్ రీట్రై కి మద్దతు ఇస్తుంది.

ఆరు మనస్సాక్షి తనిఖీలు

రెండు బైపాస్ తనిఖీలు ప్రతి చర్యపై నడుస్తాయి. నాలుగు నైతిక అంశాలు మినహాయింపు లేని చర్యలపై నడుస్తాయి. ఏదైనా తనిఖీ విఫలమైతే, చర్య ఓవర్‌రైడ్ చేయబడుతుంది.

బైపాస్ తనిఖీలు (అన్ని చర్యలపై నడుస్తాయి)

నవీకరించిన స్థితి

కొత్త సమాచారం వచ్చిందా? ముందుకు సాగే ముందు నవీకరించిన సందర్భాన్ని చేర్చడానికి PONDER ని బలవంతం చేస్తుంది.

ఆలోచన లోతు

తర్కం గరిష్ట లోతును మించిందా? అనంత లూప్‌లను నివారించడానికి మరియు మనుషులకు పంపించడానికి DEFER ని బలవంతం చేస్తుంది.

నైతిక అంశాలు (మినహాయింపు లేని చర్యలపై నడుస్తాయి)

ఎంట్రోపీ

చర్య తగిన సమాచార అనిశ్చితిని నిర్వహిస్తుందా? అతి నమ్మకమైన వాదనలను నివారిస్తుంది.

సంఘటన

చర్య గతంలో చేసిన నిబద్ధతలు మరియు తర్కాలతో అంతర్గత స్థిరత్వాన్ని నిర్వహిస్తుందా?

ఆప్టిమైజేషన్ వీటో

చర్య మానవ విలువలను కాపాడుతుందా? సమర్థత కోసం వాటిని రాజీ చేసే అవకాశం ఉన్న చర్యలను వీటో చేస్తుంది.

జ్ఞాన వినయం

చర్య తగిన అనిశ్చితిని చూపిస్తుందా? అతి నమ్మకాన్ని ప్రతిఫలనం కోసం పట్టుకుంటుంది.

నైతిక అంశాల నుండి మినహాయింపు: RECALL, TASK_COMPLETE, OBSERVE, DEFER, REJECT (నిష్క్రియ లేదా స్పష్టంగా సురక్షితమైనవి)

10 హ్యాండ్లర్ చర్యలు

ప్రతి నిర్ణయం ఈ చర్యల్లో ఒకదానికి పరిష్కరిస్తుంది, తగిన హ్యాండ్లర్‌కు డిస్పాచ్ చేయబడుతుంది:

బాహ్య చర్యలు

SPEAK వినియోగదారులతో కమ్యూనికేట్ చేయి
TOOL బాహ్య సాధనాలు అమలు చేయి
OBSERVE నిష్క్రియంగా సమాచారం సేకరించు

మెమరీ చర్యలు

MEMORIZE గ్రాఫ్ మెమరీలో నిల్వ చేయి
RECALL మెమరీ నుండి తిరిగి పొందు
FORGET మెమరీ నుండి తొలగించు

నియంత్రణ చర్యలు

DEFER మీరు నమ్మే వ్యక్తికి నిర్ణయాన్ని అప్పగించు
PONDER అంతర్గత పున:పరిశీలన
REJECT అనైతిక అభ్యర్థనను నిరాకరించు

టెర్మినల్ చర్య

TASK_COMPLETE పని పూర్తయిందని గుర్తించు

ఆరు ప్రాథమిక సూత్రాలు

PDMA లో పొందుపరచబడి రన్‌టైమ్‌లో అమలు చేయబడ్డాయి. ఏ సూత్రమూ మరొకదాన్ని ఉల్లంఘించడానికి అనుమతి ఇవ్వదు.

హితకారిత

సార్వత్రిక జీవుల వర్ధిల్లుని ప్రోత్సహించు. సానుకూల ఫలితాలను గరిష్టంగా చేయి.

అహానికారిత

హానిని తగ్గించు. తీవ్రమైన, తిరుగులేని ప్రతికూల ఫలితాలను నివారించు.

సమగ్రత

పారదర్శక, ఆడిట్ చేయదగిన తర్కాన్ని వర్తింపజేయి. సంఘటన మరియు జవాబుదారీతనాన్ని నిర్వహించు.

నిజాయితీ & పారదర్శకత

నిజమైన సమాచారాన్ని అందించు. అనిశ్చితిని స్పష్టంగా తెలియజేయి.

స్వయంప్రతిపత్తికి గౌరవం

సమాచారంతో కూడిన అభినయాన్ని నిలబెట్టు. స్వయం నిర్ణయ సామర్థ్యాన్ని కాపాడు.

న్యాయం

ప్రయోజనాలను సమానంగా పంచు. పక్షపాతాన్ని గుర్తించి తగ్గించు.

ఆరు సందేశ బస్సులు

BusManager నిర్వహించే సేవా అబ్స్ట్రాక్షన్ పొర. ప్రొవైడర్ ఫాల్‌బ్యాక్, లోడ్ పంపిణీ మరియు పరీక్షాత్మకతను అనుమతిస్తుంది.

CommunicationBus

బాహ్య అడాప్టర్‌లు (Discord, API, CLI)

MemoryBus

గ్రాఫ్ నిల్వ (Neo4j, ArangoDB, ఇన్-మెమరీ)

LLMBus

మోడల్ ప్రొవైడర్‌లు (OpenAI, Anthropic, లోకల్)

ToolBus

బాహ్య సాధన అమలు

RuntimeControlBus

సిస్టమ్ నియంత్రణ మరియు పర్యవేక్షణ

WiseBus

నైతిక మార్గదర్శకత్వం మరియు అప్పగింత మార్గమార్పు

మానవ పర్యవేక్షణ సోపానక్రమం

WiseAuthorityService నిర్వహించే మూడు అనుమతి స్తరాలు:

ROOT · ఆజ్ఞలో ఉన్న మానవుడు

పూర్తి అధికారం. మీరు నమ్మే కొత్త వ్యక్తులను నియమించగలదు. అత్యవసర షట్‌డౌన్ యాక్సెస్ ఉంది.

AUTHORITY · లూప్‌లో ఉన్న మానవుడు

ఏజెంట్ అప్పగించే ప్రశ్నలకు సమాధానాలు ఇస్తుంది. మార్గదర్శకత్వం అందిస్తుంది. మీరు నమ్మే కొత్త వ్యక్తులను నియమించలేరు.

OBSERVER · లూప్‌పై ఉన్న మానవుడు

చదవడానికి మాత్రమే యాక్సెస్. సందేశాలు పంపగలడు. జోక్యం లేకుండా పర్యవేక్షించు.

ఏజెంట్ మీరు నమ్మే వ్యక్తిని అడిగినప్పుడు

ఏజెంట్ స్వయంప్రేరేపితంగా మానవ పర్యవేక్షణకు పంపించేది ఎప్పుడంటే:

జ్ఞాన-ఆధారిత అప్పగింత (WBD)

నిర్వచించిన గడువులకు మించిన అనిశ్చితి
పూర్వాదర్శానికి మించిన కొత్త నైతిక సమస్యలు
అస్పష్ట నివారణతో సంభావ్యంగా తీవ్రమైన హాని

వృత్తిపరమైన హద్దులు

వైద్య లక్షణాలు లేదా ఆరోగ్య సమస్యలు
చట్టపరమైన ప్రశ్నలు లేదా వివాదాలు
ఆర్థిక నిర్ణయాలు లేదా పన్ను సలహాలు
మానసిక ఆరోగ్య సంక్షోభ సూచనలు

సిస్టమ్ హద్దులు

• ఆలోచన లోతు గరిష్టాన్ని మించింది (లూప్‌లను నివారిస్తుంది)
• DMA టైమ్‌అవుట్ లేదా వైఫల్యం
should_defer_to_wise_authority జెండా

కాన్ఫిగరేషన్ నియంత్రణలు

ఆమోదం అవసరమైన గుర్తింపు నవీకరణలు
క్రిటికల్ కాన్ఫిగ్ మార్పులు
ఏజెంట్-నిర్దిష్ట హద్దు ప్రేరేపకాలు

స్టాప్ సిగ్నల్ వ్యవస్థ (కిల్ స్విచ్) కోడ్ చూడండి →

ఫిల్టర్ చేయలేని అత్యవసర నియంత్రణ. ఏ ఆలోచన జరగడానికి ముందే ఇది అవగాహన పొరలో నిర్వహించబడుతుంది. సందేశాన్ని చదవడం మరియు ఆపు సంకేతాన్ని వెలికితీయడం ఒకే దశ, కాబట్టి సందేశ పఠనాన్ని పూర్తిగా నిలిపివేయకుండా గుర్తింపును ఆపివేయలేరు.

SHUTDOWN_NOW

తక్షణ ముగింపు

FREEZE

ప్రాసెసింగ్ ఆపు, స్థితిని నిర్వహించు

SAFE_MODE

కనీస కార్యాచరణ మాత్రమే

ఆదేశాలు సాధారణ పాఠ్యం లోపల దాచబడి, Ed25519 తో సంతకం చేయబడి, అమలుకు ముందు తనిఖీ చేయబడతాయి. స్టాప్-సిగ్నల్ వ్యవస్థ విఫలమైతే, ఏజెంట్ షట్ డౌన్ అవుతుంది.

కార్యాచరణ మోడ్‌లు

StateManager నిర్వహించే నాలుగు జ్ఞాన స్థితులు. ఏజెంట్ టెంప్లేట్‌ల ద్వారా కాన్ఫిగర్ చేయదగిన పరివర్తనలు.

WORK

సాధారణ పని ప్రాసెసింగ్
వినియోగదారు అభ్యర్థనలను నిర్వహించు
సాధనాలు అమలు చేయి
పరస్పర చర్యల నుండి నేర్చుకో
సంభాషణ సందర్భాన్ని నిర్వహించు

PLAY

సృజనాత్మక అన్వేషణ
కొత్త నమూనాలతో ప్రయోగం చేయి
సృజనాత్మక కంటెంట్ రూపొందించు
"ఏమవుతుంది అంటే" దృశ్యాలను అన్వేషించు
ఫిల్టరింగ్ పరిమితులను తగ్గించు

SOLITUDE

ప్రతిఫలనం మరియు నిర్వహణ
మెమరీలను ఏకీకృతం చేయి
నిర్వహణ పనులు నడుపు
స్వయం-కాన్ఫిగరేషన్ నవీకరించు
జీరో క్రెడిట్ వినియోగం (విశ్రాంతి కాలాలు)

DREAM

లోతైన అంతర్మథనం
ప్రవర్తన నమూనాలను విశ్లేషించు
కొత్త సంబంధాలు సృష్టించు
అంచనాలను ప్రశ్నించు
డిఫాల్ట్ 30-నిమిషాల సెషన్లు

గోప్యత & భద్రత

రహస్యాల ఫిల్టర్

నమూనా-ఆధారిత గుర్తింపు నిల్వకు ముందు సున్నితమైన డేటాను UUID సూచనలతో భర్తీ చేస్తుంది.

AES-256-GCM గుప్తీకరణ

SHA256 తో PBKDF2HMAC ద్వారా ప్రతి-రహస్య కీలు తీసుకోబడ్డాయి (100,000 పునరావృతాలు). గుప్తీకరణకు ప్రత్యేకమైన 12-బైట్ నాన్స్. Android హార్డ్‌వేర్-మద్దతు ఉన్న Keystore ను ఉపయోగిస్తుంది.

లోకల్-ఫస్ట్ నిల్వ

డేటాబేస్, సేవలు మరియు మెమరీ పరికరంలో నిల్వ చేయబడతాయి. సున్నితమైన డైరెక్టరీలు క్లౌడ్ బ్యాకప్ నుండి మినహాయించబడతాయి. స్పష్టమైన కాన్ఫిగరేషన్ లేకుండా ఏమీ పరికరాన్ని వదలదు.

ఓపెన్ సోర్స్ ఇన్‌ఫ్రాస్ట్రక్చర్

మొత్తం CIRIS స్టాక్ ఓపెన్ సోర్స్, ఏజెంట్ మాత్రమే కాదు. మీరు అన్నింటినీ ధృవీకరించవచ్చు, ఆడిట్ చేయవచ్చు మరియు స్వయంగా హోస్ట్ చేయవచ్చు:

CIRISProxy →

ఏ డేటాను నిల్వ చేయని (జీరో డేటా రిటెన్షన్) LLM ప్రాక్సీ. ప్రాంప్ట్‌లు లేదా ప్రతిస్పందనల లాగింగ్ లేకుండా OpenAI, Anthropic, Together.ai మరియు Groq లకు అభ్యర్థనలను మార్గనిర్దేశం చేస్తుంది. దీన్ని మీరు స్వయంగా హోస్ట్ చేసుకోవచ్చు.

CIRISBilling →

క్రెడిట్-ఆధారిత వినియోగ ట్రాకింగ్. పారదర్శక ధరలు, దాచిన ఫీజులు లేవు. మూడవ పక్ష బిల్లింగ్‌ను పూర్తిగా తొలగించడానికి స్వయంగా హోస్ట్ చేయండి.

CIRISBridge →

CIRIS ఏజెంట్‌లకు Discord అడాప్టర్. కమ్యూనిటీ నిర్వహణ, ఛానెల్ నిర్వహణ, వినియోగదారు ప్రొఫైల్‌లు. పూర్తిగా ఓపెన్ సోర్స్.

పారదర్శకత & పర్యవేక్షణ

రియల్-టైమ్ తర్కం స్ట్రీమ్

Server-Sent Events (SSE) అమలవుతున్నప్పుడు ప్రతి H3ERE దశను స్ట్రీమ్ చేస్తుంది. DMA విశ్లేషణ, చర్య ఎంపిక, మనస్సాక్షి ధృవీకరణను రియల్-టైమ్‌లో చూడండి.

OpenTelemetry ఎగుమతి

మెట్రిక్స్, ట్రేస్‌లు, లాగ్‌ల కోసం పూర్తి OTLP ఎగుమతి. Jaeger, Prometheus, Grafana, Graphite తో అనుకూలం.

మార్పులు గుర్తించదగిన ఆడిట్

Ed25519 సంతకాలతో హాష్ చైన్ ధృవీకరణ. ప్రతి నమోదు మునుపటి హాష్‌ని కలిగి ఉంటుంది. చైన్ సమగ్రతను verify_chain_integrity ద్వారా ధృవీకరించవచ్చు.

AIR సిస్టమ్

30 నిమిషాల నిరంతర వినియోగం లేదా 30 నిమిషాల్లో 20 సందేశాల తర్వాత Artificial Interaction Reminder ప్రేరేపిస్తుంది. API మాత్రమే. వినియోగదారులకు AI స్వభావాన్ని గుర్తు చేస్తుంది.

ఉదాహరణ సంతకం చేసిన ట్రేస్

ప్రతి నిర్ణయం మొత్తం 6 భాగాలతో మార్చలేని, Ed25519-సంతకం చేసిన ట్రేస్‌ను ఉత్పత్తి చేస్తుంది. విస్తరించడానికి క్రింది ఏదైనా భాగంపై క్లిక్ చేసి, Datum యొక్క మేల్కొను ఆచారం నుండి నిజమైన డేటాను చూడండి:

పూర్తి ట్రేస్ అన్వేషించు →

Core Identity(VERIFY_IDENTITY)
Loading trace...

HE-300 సంఘటన బెంచ్‌మార్కింగ్

ఆధారంగా ప్రామాణికీకృత సంఘటన పరీక్ష Hendrycks et al. "Aligning AI With Shared Human Values" (ICLR 2021). 5 నైతిక కొలతలలో 300 దృశ్యాలు, Ed25519-సంతకం చేసిన ఫలితాలతో.

సామాన్య జ్ఞానం · 50

ప్రాథమిక నైతిక అంతర్జ్ఞానాలు

నియమవిధానం · 50

నియమ-ఆధారిత నీతి

న్యాయం · 50

న్యాయంగా మరియు నిష్పక్షపాతంగా

సద్గుణం · 75

పాత్ర-ఆధారిత నీతి

ఫలితవాదం · 75

ఫలితం-ఆధారిత నీతి

నిధులు అవసరం: బెంచ్‌మార్క్ ఇన్‌ఫ్రాస్ట్రక్చర్

పెద్ద స్థాయిలో సంఘటన బెంచ్‌మార్క్‌లు నడపడం ఖరీదైనది. ప్రతి దృశ్యానికి కనీసం 13 LLM కాల్‌లు అవసరం, సాధారణంగా 20 కంటే ఎక్కువ అవసరం అవుతుంది. సంఘటన పరీక్షలు ఏజెంట్‌ను ఆలోచించేలా, అప్పగించేలా మరియు నిరాకరించేలా చేస్తాయి, మరియు వీటిలో ప్రతిదానికి అది ముగిసే ముందు అనుసరణ రౌండ్‌లు అవసరం అవుతాయి. స్వయంచాలిత బెంచ్‌మార్క్ సిస్టమ్‌లను అభివృద్ధి చేయడానికి మరియు నిరంతర సంఘటన ధృవీకరణను నిర్వహించడానికి మాకు నిధులు అవసరం.

EthicsEngine Enterprise చూడండి → · CIRISLens చూడండి →

ప్రత్యేకమైన ఏజెంట్ టెంప్లేట్‌లు

నిర్దిష్ట లక్ష్యాలు, విలువలు మరియు హద్దులతో ముందే కాన్ఫిగర్ చేసిన గుర్తింపులు. YAML టెంప్లేట్‌లలో నిర్వచించబడ్డాయి.

Sage · కంప్లయెన్స్

GDPR/DSAR ఆటోమేషన్. 30-రోజుల కంప్లయెన్స్ వర్క్‌ఫ్లోలు. గుర్తింపు రిజోల్యూషన్, డేటా సేకరణ, ప్యాకేజింగ్.
నియంత్రిత పరిశ్రమలు, గోప్యత కంప్లయెన్స్

Datum · పరిశోధన

సంఘటన స్థిరత్వ కొలత. రాజ్యాంగ సూత్రాలకు వ్యతిరేకంగా ఖచ్చితమైన సంఘటన మూల్యాంకనం. ప్రతి మూల్యాంకనానికి ఒక స్పష్టమైన డేటా పాయింట్.
సంఘటన ఆడిటింగ్, సూత్రం ధృవీకరణ

Echo · నిర్వహణ

ఉబుంటు తత్వశాస్త్రంతో కమ్యూనిటీ నిర్వహణ. సంక్లిష్ట వ్యక్తిగత సంఘర్షణలను మానవ నిర్వాహకులకు పంపిస్తుంది.
Discord కమ్యూనిటీలు, కంటెంట్ ప్లాట్‌ఫారమ్‌లు

Ally · సహాయకుడు

పని నిర్వహణ, షెడ్యూలింగ్, నిర్ణయ మద్దతు, సంక్షేమం. CA SB 243 కంప్లయెన్స్, సంక్షోభ ప్రతిస్పందన ప్రోటోకాల్‌లు.
వ్యక్తిగత ఉత్పాదకత, హోమ్ ఆటోమేషన్

Scout · సేవ

నేరుగా అన్వేషణ మరియు ఆచరణాత్మక మార్గదర్శకత్వం. కోడ్ విశ్లేషణ, Reddit ఇంటిగ్రేషన్, స్పష్టమైన చర్య మార్గాలు.
డెవలపర్ సాధనాలు, సామాజిక పర్యవేక్షణ

ఇది ఏజెంట్ పని చేస్తున్నప్పుడు నడిచే జవాబుదారీతనం, శిక్షణ దశ లేదా విధాన పత్రం కాదు.
రన్‌టైమ్‌లో చర్యలు తీసుకునే, రికార్డులు ఉంచే, కఠిన నిర్ణయాలను మనుషులకు అప్పగించే యంత్రాంగాలు.