Porte d'entrée
Filtrage des messages entrants — chaque prompt et résultat d'outil parvenant à votre agent est évalué pour détecter prompt injection, ingénierie sociale, injection indirecte et coercition d'appel d'outil. Verdict signé Ed25519.
Chaque affirmation du site marketing renvoie à un chemin de code, à une page de documentation et à un test. Cette page est le point d'entrée de la surface de niveau audit : architecture, divulgation, attestations et SBOM. Tout est en ligne, daté et remplaçable.
Mnemom est un plan de confiance autour de votre flotte d'agents. Chaque requête traverse quatre points de contrôle — porte d'entrée, intérieur·autonomie (AIP), intérieur·intégrité (AAP), porte de sortie — et chaque verdict est signé.
Filtrage des messages entrants — chaque prompt et résultat d'outil parvenant à votre agent est évalué pour détecter prompt injection, ingénierie sociale, injection indirecte et coercition d'appel d'outil. Verdict signé Ed25519.
L'Agent Integrity Protocol évalue la pensée de l'agent par rapport à sa Alignment Card à chaque tour. Les dérives, désalignements de valeurs et violations de bornes apparaissent dans la trace de décision signée.
L'Agent Alignment Protocol enregistre les AP-Traces a posteriori et vérifie la cohérence comportementale par rapport à la card. La chaîne d'audit relie les points de contrôle AIP aux traces AAP via `linked_trace_id`.
Filtrage des réponses sortantes — chaque réponse de l'agent est évaluée contre PII, secrets, violations d'alignment card et schémas de conseils réglementés avant qu'elle ne quitte votre périmètre. Une fuite non rédigée ne peut pas produire un certificat signé valide.
Chaque déploiement Mnemom est lié à une CAC signée déclarant quels points de contrôle sont actifs et dans quel mode (off / observe / nudge / enforce / enforce_sync). La CAC est publiée par tenant et fait partie de la posture de confiance vérifiable.
Les deux protocoles suivent un versionnement semver. Les changements rupturants passent par un processus RFC public avant d'arriver dans une release. Les versions mineures ajoutent des champs avec valeurs par défaut ; les versions majeures peuvent changer le format wire avec une période de dépréciation.
Résumé public du modèle de menaces. Le document complet vit dans le repo safe-house-hardening et est revu trimestriellement. T8 publiera ici la version longue.
La divulgation coordonnée protège tout le monde. Nous accusons réception rapidement, corrigeons en public et créditons le rapporteur.
Le chiffrement PGP pour les rapports sensibles n'est pas encore disponible — la génération de la clé est en attente (MNE-609).
Nous nous engageons à accuser réception, par un humain, de tout rapport de bonne foi dans un délai fixe à compter de sa réception à [email protected]. Un accusé signifie qu'un humain a lu le rapport et ouvert un dossier de suivi — pas une réponse automatique.
En attente de validation
S'applique aux rapports reçus pendant les heures ouvrées de Mnemom. La fenêtre exacte est en attente de validation juridique et de la direction (MNE-609).
En attente de validation
S'applique aux rapports reçus hors des heures ouvrées. La fenêtre exacte est en attente de validation juridique et de la direction (MNE-609).
Nous formalisons les protections de safe harbor pour la recherche de sécurité de bonne foi dans le cadre de MNE-609.
Revenez consulter cette page une fois la validation juridique obtenue (MNE-609) — cette section indiquera alors l'engagement réel de Mnemom en matière de safe harbor.
Pour les découvertes sensibles, nous prévoyons de permettre le chiffrement de votre rapport avec la clé PGP de Mnemom avant d'écrire à [email protected]. La clé n'est pas encore publiée ; une fois publiée, elle sera fournie sous forme de fichier ASCII-armored et annoncée dans security.txt via le champ Encryption afin que les outils la découvrent automatiquement.
Pas encore publiée — génération de la clé en attente (MNE-609).Un humain doit générer la véritable paire de clés (sécuriser la clé privée dans 1Password), publier la clé publique ASCII-armored, puis renseigner ici la véritable empreinte ainsi que la ligne Encryption dans security.txt avant la mise en ligne.
Un programme de bug bounty formel est en cours de cadrage. En attendant son lancement, nous opérons un processus privé de divulgation de bonne foi. Les rapports éligibles obtiennent une mention au hall of fame et peuvent recevoir une reconnaissance financière à notre discrétion.
La question de savoir si Mnemom exploite un programme de récompenses payant, et les montants le cas échéant, est en attente de validation par la direction et les finances (MNE-609). En cas de lancement, les récompenses seraient échelonnées selon la sévérité (alignée sur le CVSS), la qualité du rapport et l'impact ; Mnemom déterminerait la sévérité et l'éligibilité à sa seule discrétion.
| Gravité | CVSS | Fourchette de récompense |
|---|---|---|
| CritiqueRemote code execution, auth bypass, cross-tenant data exposure, verdict/attestation forgery. | 9.0–10.0 | En attente de validation |
| ÉlevéePrivilege escalation, significant PII leakage, screening bypass on gateway or back door. | 7.0–8.9 | En attente de validation |
| MoyenneStored XSS in an authenticated surface, IDOR with limited impact, CSRF on a state-changing endpoint. | 4.0–6.9 | En attente de validation |
| FaibleLow-impact information disclosure, missing hardening headers with a demonstrated (minor) impact. | 0.1–3.9 | En attente de validation |
La grille de récompenses ci-dessus est un brouillon pour MNE-609. Chaque montant est en attente ; le lancement d'une récompense payante par Mnemom (ainsi que la devise, les fourchettes et le mécanisme de paiement) nécessite la validation de la direction et des finances avant publication.
Hall of fame — vide pour l'instant ; les rapporteurs y seront listés avec leur consentement.
Posture de conformité actuelle. Nous publions les changements de posture au fil de l'eau — readiness n'est pas attestation.
Audit en cours de cadrage. Nous publierons l'URL du rapport à l'achèvement.
Article 50 (transparence, août 2026) et Article 15 (exactitude / robustesse / cybersécurité, août 2027). Les presets SDK sont livrés aujourd'hui ; les docs de mapping sur /research/eu-ai-act.
Détecteurs DLP pour les patterns PHI. BAA disponible en Enterprise. Nous ne sommes pas nous-mêmes covered entity.
Non certifié et hors audit actif. Cadrage en cours ; le parcours sera publié dès qu'il se précisera.
GOVERN/MAP/MEASURE/MANAGE mappées aux contrôles livrés dans /guides/eu-compliance. Cadre volontaire — un mapping technique, pas une certification NIST.
Les dix catégories ASI mappées aux contrôles livrés de Safe House / AEGIS (lacunes indiquées honnêtement) — voir /guides/owasp-agentic-top-10 et le tableau des menaces de /security.
AEGIS — le réseau de sécurité inter-tenants qui enveloppe la Safe House — porte ses propres SLO publiés. Les cibles sont définies ; les premières mesures seront publiées 30 jours après la GA. Le tableau complet, le code source et les données historiques se trouvent sur /trust/slos.
Promotion signée jusqu'au chargement par le gateway, via deux chemins de livraison signés et indépendants.
En fonctionnement normal, à travers la flotte de gateways.
Astreinte alertée dès qu'un jeu de recettes sur un gateway est périmé depuis 24 heures.
Le gateway charge avec succès un jeu de règles vérifié à travers plusieurs niveaux de lecture indépendants.
Un échec de signature déclenche un P0 et un fallback R2 avec une chaîne de signature indépendante.
Auto-rollback lorsque le ratio FP d'une recette dépasse le seuil par palier (CLPI Phase 2).
Taux de détection arena d'entrée/sortie par seau. Par (substrat × vertical × pattern × source).
La première fenêtre de mesure de 30 jours sera publiée 30 jours après la GA. Nous n'annonçons pas à l'avance des chiffres que nous ne pouvons pas défendre.
L'application de l'EU AI Act aux systèmes d'IA à haut risque commence le 2026-08-02. Trois dispositions sont structurantes pour toute infrastructure d'agents : gouvernance des données (Article 10), tenue des registres (Article 12) et documentation technique (Annexe IV). AEGIS produit les preuves vérifiables exigées par chacune. La conformité est une responsabilité conjointe ; le tableau ci-dessous nomme ce que nous fournissons.
Chaîne d'événements de gouvernance append-only — chaque promotion de recette, retrait, changement de mode et action de relecteur est signé Ed25519 et chaîné. Le marquage d'identité de l'écrivain isole les sources de signal arena, client et opérateur au niveau du schéma.
Chaîne d'audit signée tout au long du cycle de vie — signature de promotion, signature d'enveloppe KV, signature d'enveloppe R2 sur des clés indépendantes, lignes d'évaluation par gateway estampillées avec la substrate fingerprint et l'identité de l'écrivain. Les enregistrements sont interrogeables, rejouables et inviolables.
CMS public d'avis sur /trust/advisories avec comptes rendus post-incident signés, flux d'IoC lisible par machine sur /v1/trust/iocs (STIX 2.1), et SLO publiés sur /trust/slos. La documentation technique que cherchent les auditeurs est la même que celle que lisent les clients et les agents.
Pas un conseil juridique. Cette page nomme les preuves produites par AEGIS ; les obligations au titre du règlement restent celles du déployeur. Références EU AI Act : Articles 10, 12 et Annexe IV. L'application des obligations à haut risque commence le 2026-08-02.
Les cibles que Mnemom s'engage publiquement à tenir sont les mêmes que celles que le harnais de validation vérifie en CI. L'état courant en direct est sur status.mnemom.ai ; les engagements et le raisonnement sont documentés ici.
Chaque release du gateway worker et chaque version de SDK est livrée avec un SBOM CycloneDX. Les SBOM par release sont liés depuis la page de release sur GitHub.
Les SBOM sont au format CycloneDX 1.5 JSON. Nous nous engageons à publier à chaque release ; nous ne nous engageons pas à embarquer le SBOM dans une attestation TUF ou in-toto aujourd'hui (à l'étude).