Human gate
Une human gate est un point de contrôle où un message qui franchit une frontière de confiance est retenu pour qu'une personne le passe en revue avant que son texte n'atteigne jamais le contexte de l'agent destinataire. La décision de conception essentielle est ce que la gate retient : pas la permission, mais le corps du message lui-même. Un message retenu n'expose que des métadonnées structurelles — l'uid de l'expéditeur vérifié par le noyau, la longueur du message, un id de thread, un horodatage — et jamais son texte, jusqu'à ce qu'un humain le libère. Retenir le corps du message est la protection ; une étiquette d'avertissement au-dessus d'un texte déjà livré ne l'est pas, car un modèle de langage qui a déjà lu un texte hostile y a déjà été exposé. C'est pourquoi "marque-le comme suspect et livre-le quand même" échoue comme défense : la marque n'annule pas la lecture. Dans agentixmesh, la human gate est la valeur par défaut pour tout trafic qui franchit une frontière de confiance (comme entre utilisateurs OS), et cette valeur par défaut n'est délibérément pas rétrogradable vers une livraison automatique — le confort est précisément la pression qui érode les frontières de confiance. À l'intérieur des propres sessions d'un même utilisateur, où l'expéditeur est par définition toi-même, les messages circulent sans la gate ; la frontière de la gate correspond à la frontière de la confiance.
La gate protège contre l'injection de prompt à la frontière ; le modèle complet est décrit dans modèle de confiance & limites honnêtes.