LLM Guard
活跃简介
LLM 交互安全工具包,提供提示词注入检测、敏感信息脱敏、内容安全审计等防护能力,保障生产环境 LLM 调用的安全性。
核心特性
- 全面的提示词扫描器:提示词注入检测、毒性检测、敏感信息检测、情感分析等
- 输出扫描器:偏见检测、事实一致性、恶意 URL 检测和敏感数据过滤
- PII 匿名化与反匿名化,防止数据泄露
- 即插即用,兼容任何 LLM 提供商(OpenAI、Anthropic 等)
- 可作为独立 API 或嵌入式 Python 库部署
- 生产就绪,支持自定义扫描器管道
适用场景
💡 保护生产环境 LLM API 免受提示词注入攻击
💡 在发送至云端 LLM 前对用户输入中的 PII 进行匿名化处理
💡 审计 LLM 输出中的有毒、偏见或不实内容
💡 通过扫描密钥和敏感信息防止数据泄露
💡 构建符合合规要求的 AI 安全防护管道
快速开始
```bash
pip install llm-guard
```
```python
from llm_guard.input_scanners import PromptInjection, Toxicity
from llm_guard.output_scanners import Bias, Relevance
# 扫描用户提示词
scanners = [PromptInjection(), Toxicity()]
sanitized_prompt, results, scores = scan_prompt(scanners, user_input)
# 扫描 LLM 输出
output_scanners = [Bias(), Relevance()]
sanitized_output, results, scores = scan_output(output_scanners, user_input, llm_output)
```