llm-guardrails
Implement safety guardrails for LLM applications. Covers input validation and content filtering, output validation and safety checks, NeMo Guardrails, Guardrails AI, LLM Guard, toxicity detection, PII detection and redaction, hallucination detection and mitigation, jailbreak prevention, topic restriction, output format enforcement, rate limiting, content moderation pipelines, red teaming, safety benchmarks, and compliance requirements. Use when adding safety measures to LLM apps, preventing harmful outputs, detecting PII, or building content moderation systems.
- Version
- 1.0
- License
- Apache-2.0
Pinned to revision 45cf0fa3c5e7, so it is the text this page describes rather than whatever the author pushed since.
Files
- skills/llm-guardrails/SKILL.md
- skills/llm-guardrails/references/REFERENCE.md
- skills/llm-guardrails/scripts/guardrails_pipeline.py
- skills/llm-guardrails/scripts/red_team.py
Every link opens the file at its source, pinned to the revision this page describes.