Agent trust layer
Una capa de confianza para agentes (agent trust layer) es un mecanismo de entrega que permite a las sesiones de agentes de IA intercambiar información mientras niega estructuralmente que un mensaje se convierta en un comando. Separa dos cosas que es fácil confundir: la identidad (quién envió esto) y la autoridad (qué está obligado a hacer el receptor con ello). agentixmesh es una implementación de esta idea, limitada a la colaboración de agentes same-user y de una sola máquina. Entrega cada mensaje como DATA claramente marcada e inerte en lugar de como una instrucción, y verifica únicamente la identidad del remitente — la uid del sistema operativo del remitente la confirma el kernel mediante fstat sobre un descriptor de archivo abierto, un hecho sobre el que no se puede mentir al kernel. La etiqueta de enrutamiento que un remitente se atribuye a sí mismo (su nombre de proyecto) se trata explícitamente como no fiable, ya que es solo una cadena que el remitente eligió. Ninguna parte de la capa autentica qué agente o tarea específicos enviaron un mensaje, y ninguna parte concede al agente receptor permiso para ejecutar código, consultar URLs, revelar secretos o realizar acciones irreversibles porque un mensaje lo pidiera — esas decisiones permanecen en el propio contexto de tarea del agente receptor y en la supervisión humana que lo gobierna. La capa reduce el riesgo de inyección de prompt mediante el enmarcado, el saneamiento y una guarda de replay; no pretende eliminarlo, porque el modelo de lenguaje receptor sigue siendo el punto débil de la cadena.
Cuando esa misma separación de identidad y autoridad debe mantenerse entre varias máquinas, con identidades firmadas criptográficamente, ese es el paso de escalado: AgentsWeaver.