Agent Reliability & Guardrails
Parent: AI Agent Ecosystems · researched 2026-05-31T23:47:31.311Z· 8 sources · 15 concepts · skill ai-agent-engineering
AI & agent-engineering family ROUTER. Split into: ai-agents-orchestration (agent frameworks, multi-agent, memory, planning, guardrails, coding/GUI agents, autonomous loops, eval); ai-rag-retrieval (RA
ai-agent-engineering
- AI & agent-engineering family ROUTER. Split into: ai-agents-orchestration (agent frameworks, multi-agent, memory, planning, guardrails, coding/GUI agents, autonomous loops, eval); ai-rag-retrieval (RAG, iterative retrieval, vector/graph datastores); ai-llm-model-layer (training, fine-tuning, alignment/RLHF, compression, inference serving, transformer/multimodal architecture, model selection, observability); ai-mcp-sdk-prompting (MCP servers/builder, Anthropic SDK, prompt engineering, context engineering, LLM frameworks, tool-search, prompt lookup). Route to the matching sub-hub. [source]
- This hub routes to on-demand reference files under references/. See each spoke for depth. [source]
Children
- Input/Output Guardrails (frontier)
- Structured-Output Validation (frontier)
- Content Filters & Safety Classifiers (Llama Guard / NeMo Guardrails / Guardrails AI) (frontier)
- Reliability Patterns (Retries, Backoff, Circuit Breakers, Fallback Chains) (frontier)
- Budget & Step Caps (frontier)
- Loop & No-Progress Detection (frontier)
- Tool-Call Safety (Sandboxing, Allow-lists, Least Privilege) (frontier)
- Human-Approval Gates (frontier)
- Excessive Agency (OWASP LLM06) (frontier)
- Prompt Injection & Indirect Prompt Injection (OWASP LLM01) (frontier)
- The Lethal Trifecta (frontier)
- Tool / RAG Poisoning (frontier)
- OWASP Top 10 for LLM Applications (frontier)
- Dual-LLM / Quarantine & CaMeL Defenses (frontier)
- Constrained Agent Design Patterns (frontier)
Frontier under this node: Budget & Step Caps, Constrained Agent Design Patterns, Content Filters & Safety Classifiers (Llama Guard / NeMo Guardrails / Guardrails AI), Dual-LLM / Quarantine & CaMeL Defenses, Excessive Agency (OWASP LLM06), Human-Approval Gates, Input/Output Guardrails, Loop & No-Progress Detection, OWASP Top 10 for LLM Applications, Prompt Injection & Indirect Prompt Injection (OWASP LLM01), Reliability Patterns (Retries, Backoff, Circuit Breakers, Fallback Chains), Structured-Output Validation, The Lethal Trifecta, Tool / RAG Poisoning, Tool-Call Safety (Sandboxing, Allow-lists, Least Privilege)