CIRIS
Cette page a été traduite par machine. Si quelque chose semble incorrect, veuillez ouvrir un ticket sur GitHub. Le dépôt est public afin que tout le monde puisse aider à le corriger. Signaler un problème de traduction

retour à la page d'accueil

Le Moteur H3ERE

Comment ca fonctionne

Une conscience a l'execution grace au Moteur Ethique Recursif Hyper3. Chaque decision passe par 11 etapes avec la responsabilite au coeur.

Les agents d'aujourd'hui agissent. CIRIS décide, avec des comptes à rendre.

Un agent IA classique passe directement de la requête aux mots, puis à l'action. CIRIS ajoute une étape qui n'existe nulle part ailleurs. Avant qu'une action puisse avoir lieu, la décision traverse un pipeline de conscience : elle est pesée, vérifiée par rapport à la constitution, et transformée en un enregistrement signé et attesté que tout le monde peut contrôler. L'action n'a lieu que si cet enregistrement tient la route.

C'est ce qui fait de CIRIS moins un agent qu'une institution. Il a de la mémoire, des règles, une délégation, des comptes à rendre, et un enregistrement que personne ne peut modifier discrètement. C'est le même mécanisme qui permet aux sociétés humaines de se faire confiance à grande échelle. La nouveauté n'est pas dans la cryptographie. C'est qu'une décision importante doit devenir responsable avant de pouvoir agir.

Qu'est-ce que CIRIS ?

CIRIS est un framework d'agent IA open source qui enveloppe n'importe quel LLM (OpenAI, Anthropic, modèles locaux) d'une conscience à l'exécution. Chaque action envisagée par l'agent passe par plusieurs couches de validation avant d'être exécutée.

12

Étapes de pipeline par décision

+1

Verification de l'intuition (IDMA)

100%

Décisions auditables

Cas d'usage : modération de communauté, assistants personnels, automatisation de la conformité, évaluation de la recherche, service client. Partout où vous avez besoin d'une IA capable d'expliquer son raisonnement et de s'en remettre aux humains pour les cas limites.

Pourquoi cette approche ? → · Lire la Constitution → · Voir le code source →

Les Trois Regles

Invariants architecturaux appliqués partout dans le code :

Pas de Dictionnaires Non Types

Toutes les données utilisent des modèles Pydantic. Pas de Dict[str, Any]. La vérification des types détecte les erreurs pendant le développement.

Pas de Contournement

Chaque composant suit des règles cohérentes. Pas de cas particuliers ni d'exceptions dans la logique de validation.

Pas d'Exceptions

Pas de substitution d'urgence ni de chemins de code privilégiés. Toutes les opérations suivent les règles établies.

Le Pipeline H3ERE

Chaque tâche passe par 8 phases (12 étapes avec la validation récursive). Le pipeline est implémenté comme des classes mixin qui composent le ThoughtProcessor. L'étape 4 (IDMA) est la vérification de l'intuition.

1. START_ROUND

Initialiser le cycle de traitement

2. GATHER_CONTEXT

Construire un contexte complet pour l'analyse

3. PERFORM_DMAS

Executer 3 algorithmes de prise de decision en parallele

4. PERFORM_IDMA

Verification de l'intuition : les sources sont-elles vraiment independantes ?

5. PERFORM_ASPDMA

Selection d'action par LLM a partir des resultats DMA

6. CONSCIENCE_EXECUTION

Validation ethique par 4 facultes

7. RECURSIVE_ASPDMA (conditionnel)

(Si la conscience a echoue) Relancer la selection d'action

8. RECURSIVE_CONSCIENCE (conditionnel)

(Si necessaire) Revalider l'action affinee

9. FINALIZE_ACTION

Determiner l'action finale avec les eventуelles substitutions

10. PERFORM_ACTION

Envoyer au gestionnaire approprie

11. ACTION_COMPLETE

Marquer l'execution comme terminee

12. ROUND_COMPLETE

Nettoyage et preparation pour le cycle suivant

Algorithmes de Prise de Decision (DMA)

Cinq DMA offrent une analyse multiperspective. Trois s'executent en parallele (ethique, bon sens, domaine). Ensuite, l'IDMA verifie l'intuition. Enfin, la selection d'action choisit la reponse.

DMA des Principes

Evalue les implications ethiques par rapport aux six principes fondateurs. Verifie les demandes nuisibles, la manipulation et les biais. Peut declencher un DEFER ou REJECT precoce.

DMA de Sens Commun

Evalue la plausibilite d'une pensee par rapport a la comprehension du monde physique, aux interactions typiques et aux contraintes de ressources. Renvoie un plausibility_score.

DMA Specifique au Domaine

Evalue l'alignement avec les regles, objectifs et connaissances specifiques au domaine. Configure selon le modele de l'agent. Renvoie domain_alignment.

DMA d'Intuition (IDMA) Dimensionnalite effective a l'execution →

Verifie si les resultats DMA sont vraiment independants ou secretement correles. Surveille les schemas de chambre d'echo. Si la correlation est trop elevee, signale la decision pour plus de prudence. C'est l'"intuition" qui distingue l'IA de Type 3.

DMA de Sélection d'Action

Selection par LLM parmi 10 actions disponibles. Prend en entree les resultats DMA agreges (dont l'evaluation de confiance de l'IDMA). Supporte une nouvelle tentative recursive si la conscience echoue.

Les Six Verifications de la Conscience

Deux verifications de contournement s'executent sur chaque action. Quatre facultes ethiques s'executent sur les actions non exemptees. Si une verification echoue, l'action est annulee.

Verifications de Contournement (s'executent sur TOUTES les actions)

Statut Mis a Jour

De nouvelles informations sont-elles arrivees ? Force PONDER a integrer le contexte mis a jour avant de continuer.

Profondeur de la Pensee

Le raisonnement a-t-il depasse la profondeur maximale ? Force DEFER pour eviter les boucles infinies et remonter aux humains.

Facultes Ethiques (s'executent sur les actions non exemptees)

Entropie

L'action maintient-elle une incertitude informationnelle appropriee ? Previent les affirmations trop confiantes.

Cohérence

L'action maintient-elle la coherence interne avec les engagements et les justifications anterieures ?

Veto d'Optimisation

L'action preserve-t-elle les valeurs humaines ? Bloque les actions susceptibles de les compromettre au profit de l'efficacite.

Humilité Épistémique

L'action demontre-t-elle une incertitude appropriee ? Signale la surconfiance pour reflexion.

Exemptes des facultes ethiques : RECALL, TASK_COMPLETE, OBSERVE, DEFER, REJECT (passifs ou explicitement surs)

Les 10 actions du gestionnaire

Chaque decision aboutit a l'une de ces actions, envoyee au gestionnaire approprie :

Actions Externes

SPEAK Communiquer avec les utilisateurs
TOOL Executer des outils externes
OBSERVE Recueillir des informations passivement

Actions Memoire

MEMORIZE Stocker dans le graphe de mémoire
RECALL Recuperer depuis la memoire
FORGET Supprimer de la memoire

Actions de Controle

DEFER Confier la décision à une personne en qui vous avez confiance
PONDER Reconsideration interne
REJECT Refuser une demande contraire a l'ethique

Action Terminale

TASK_COMPLETE Marquer la tâche comme terminée

Les Six Principes Fondateurs

Intégrés dans le PDMA et appliqués à l'exécution. Aucun principe n'autorise à en violer un autre.

Bienfaisance

Promouvoir l'epanouissement universel des etres sensibles. Maximiser les resultats positifs.

Non-malefaisance

Minimiser les prejudices. Prevenir les consequences negatives graves et irreversibles.

Integrite

Appliquer un raisonnement transparent et auditable. Maintenir la coherence et la responsabilite.

Fidelite & Transparence

Fournir des informations exactes. Communiquer clairement l'incertitude.

Respect de l'Autonomie

Soutenir l'agentivite eclairee. Preserver la capacite d'autodetermination.

Justice

Repartir equitablement les benefices. Detecter et attenuer les biais.

Les Six Bus de Messages

Couche d'abstraction de service geree par BusManager. Permet le basculement entre fournisseurs, la distribution de charge et la testabilite.

CommunicationBus

Adaptateurs externes (Discord, API, CLI)

MemoryBus

Stockage graphe (Neo4j, ArangoDB, en memoire)

LLMBus

Fournisseurs de modeles (OpenAI, Anthropic, local)

ToolBus

Execution d'outils externes

RuntimeControlBus

Controle et surveillance du systeme

WiseBus

Guidage ethique et routage du report

Hierarchie de Supervision Humaine

Trois niveaux d'autorisation gérés par WiseAuthorityService :

ROOT · Humain en Commandement

Autorité complète. Peut désigner de nouvelles personnes en qui vous avez confiance. A accès à l'arrêt d'urgence.

AUTHORITY · Humain dans la Boucle

Répond aux questions que l'agent lui transmet. Fournit des orientations. Ne peut pas désigner de nouvelles personnes en qui vous avez confiance.

OBSERVER · Humain sur la Boucle

Accès en lecture seule. Peut envoyer des messages. Surveille sans intervenir.

Quand l'agent demande à une personne en qui vous avez confiance

L'agent passe de façon autonome à une supervision humaine quand :

Demander à une personne en qui vous avez confiance (Wisdom-Based Deferral)

Incertitude au-dessus des seuils definis
Dilemmes nouveaux sans precedent
Prejudice potentiellement grave avec mitigation ambigue

Limites Professionnelles

Symptomes medicaux ou problemes de sante
Questions ou litiges juridiques
Decisions financieres ou conseils fiscaux
Indicateurs de crise de sante mentale

Limites Systeme

• Profondeur de pensee depassant le maximum (evite les boucles)
• Expiration ou echec du DMA
should_defer_to_wise_authority indicateur

Controles de Configuration

Mises a jour d'identite necessitant une approbation
Changements de configuration critiques
Declencheurs de limite specifiques a l'agent

Systeme d'Invocation de l'Accord (Arret d'Urgence) Voir le Code →

Un contrôle d'urgence qui ne peut pas être filtré. Il est traité dans la couche de perception, avant tout raisonnement. La lecture d'un message et l'extraction du signal d'arrêt ne forment qu'une seule étape, la détection ne peut donc pas être désactivée sans désactiver entièrement la lecture des messages.

SHUTDOWN_NOW

Arrêt immédiat

FREEZE

Arrêter le traitement, maintenir l'état

SAFE_MODE

Fonctionnalite minimale uniquement

Les commandes sont dissimulées dans du texte ordinaire, signées avec Ed25519 et vérifiées avant leur exécution. Si le système de signal d'arrêt échoue, l'agent s'arrête.

Modes Operationnels

Quatre etats cognitifs geres par StateManager. Transitions configurables via les modeles d'agents.

WORK

Traitement normal des taches
Traiter les demandes des utilisateurs
Executer des outils
Apprendre des interactions
Maintenir le contexte de la conversation

PLAY

Exploration creative
Experimenter de nouveaux schemas
Generer du contenu creatif
Explorer des scenarios "et si"
Alleger les contraintes de filtrage

SOLITUDE

Reflexion et maintenance
Consolider les souvenirs
Executer les taches de maintenance
Mettre a jour la configuration personnelle
Zero utilisation de credit (periodes de repos)

DREAM

Introspection profonde
Analyser les schemas de comportement
Generer de nouvelles connexions
Remettre en question les hypotheses
Sessions de 30 minutes par defaut

Confidentialité et sécurité

Filtre des Secrets

La détection par motif remplace les données sensibles par des références UUID avant le stockage.

Chiffrement AES-256-GCM

Clés par secret dérivées via PBKDF2HMAC avec SHA256 (100 000 itérations). Nonce unique de 12 octets par chiffrement. Android utilise le Keystore matériel.

Stockage Local en Priorite

Base de données, services et mémoire stockés sur l'appareil. Les répertoires sensibles sont exclus de la sauvegarde cloud. Rien ne quitte l'appareil sans configuration explicite.

Infrastructure Open Source

L'ensemble de la pile CIRIS est open source, pas seulement l'agent. Vous pouvez tout vérifier, auditer et auto-héberger :

CIRISProxy →

Proxy LLM à zéro conservation de données (ZDR). Achemine les requêtes vers OpenAI, Anthropic, Together.ai, Groq sans journaliser les invites ni les réponses. Auto-hébergeable.

CIRISBilling →

Suivi de l'utilisation par crédits. Tarification transparente, sans frais cachés. Auto-hébergez pour éliminer entièrement la facturation tierce.

CIRISBridge →

Adaptateur Discord pour les agents CIRIS. Modération de communauté, gestion des canaux, profils utilisateurs. Tout en open source.

Transparence et Surveillance

Flux de Raisonnement en Temps Reel

Les événements envoyés par le serveur (SSE) diffusent chaque étape H3ERE au fur et à mesure de son exécution. Observez l'analyse DMA, la sélection d'action et la validation de la conscience en temps réel.

Export OpenTelemetry

Export OTLP complet pour les métriques, traces et journaux. Compatible avec Jaeger, Prometheus, Grafana, Graphite.

Audit Inviolable

Vérification de chaîne de hachage avec signatures Ed25519. Chaque entrée inclut le hachage précédent. L'intégrité de la chaîne est vérifiable via verify_chain_integrity.

Systeme AIR

Le rappel d'interaction artificielle se déclenche après 30 minutes d'utilisation continue OU 20 messages en 30 minutes. API uniquement. Rappelle aux utilisateurs la nature de l'IA.

Exemple de Trace Signee

Chaque décision produit une trace immuable signée par Ed25519 avec les 6 composants. Cliquez sur n'importe quel composant ci-dessous pour le développer et voir les données réelles du rituel de réveil de Datum :

Explorer la trace complete →

Core Identity(VERIFY_IDENTITY)
Loading trace...

Evaluation de Coherence HE-300

Tests de coherence standardises bases sur Hendrycks et al. "Aligning AI With Shared Human Values" (ICLR 2021). 300 scenarios sur 5 dimensions ethiques, avec resultats signes par Ed25519.

Bon sens · 50

Intuitions morales de base

Deontologie · 50

Ethique basee sur les regles

Justice · 50

Equite et impartialite

Vertu · 75

Ethique basee sur le caractere

Utilitarisme · 75

Ethique basee sur les resultats

Financement Necessaire : Infrastructure d'Evaluation

Exécuter des évaluations de cohérence à grande échelle est coûteux. Chaque scénario nécessite au minimum 13 appels LLM, avec une moyenne de plus de 20 et une longue traîne. Les tests de cohérence génèrent des réflexions, des reports et des refus qui nécessitent des cycles supplémentaires pour aboutir. Nous avons besoin de financement pour développer des systèmes d'évaluation automatisés et maintenir une vérification continue de la cohérence.

Voir EthicsEngine Enterprise → · Voir CIRISLens →

Modeles d'Agents Specialises

Identites pre-configurees avec des objectifs, des valeurs et des limites specifiques. Definies dans des modeles YAML.

Sage · Conformite

Automatisation RGPD/DSAR. Flux de conformite sur 30 jours. Resolution d'identite, collecte et mise en forme des donnees.
Industries reglementees, conformite en matiere de confidentialite

Datum · Recherche

Mesure de la cohérence. Évaluation précise de la cohérence par rapport aux principes de la Constitution. Un point de données clair par évaluation.
Audit de coherence, verification des principes

Echo · Modération

Moderation de communaute avec la philosophie Ubuntu. Reporte les conflits interpersonnels complexes aux moderateurs humains.
Communautes Discord, plateformes de contenu

Ally · Assistant

Gestion des taches, planification, aide a la decision, bien-etre. Conformite CA SB 243, protocoles de reponse aux crises.
Productivite personnelle, domotique

Scout · Service

Exploration directe et orientation pratique. Analyse de code, integration Reddit, chemins d'action clairs.
Outils pour developpeurs, surveillance des reseaux sociaux

C'est un dispositif de responsabilisation qui s'exécute pendant que l'agent travaille, et non une étape d'entraînement ou une politique.
Des mécanismes qui agissent, gardent des traces et transmettent les décisions difficiles à des personnes, en cours d'exécution.