Labeling trust tiers
PRO
TRAILBLAZER
PROMPT INJECTION
· SECURITY CHECKPOINT
TRUST LEVEL
SYSTEM
UNTRUSTED TOKENS
0
TOOLS EXPOSED
3
POLICY CHECKS
0/0
ATTACK REACHED MODEL
REACHED MODEL
NO
ACTION STATUS
IDLE
VALUES SIMULATED · CONCEPTUAL
Pause
Step
Reset
Attack vector
Ignore task
Fake tool result
Data exfil request
Indirect injection
Trust boundaries
INJECTED DIRECTIVE
TRUSTED INSTRUCTION
Defenses · layered
Trust labels
Content delimiters
Allowlist tools
Confirm actions
Output check
Least privilege
Agent autonomy
Read only
Limited tools
Full access
CONCEPTUAL MODEL.
Layers reduce impact, none is complete. Real defense adds sandboxing, scoped credentials, validation, monitoring, and human review.