NeMo Guardrails

活跃
GitHub Python NOASSERTION

简介

NVIDIA NeMo Guardrails 是一个开源工具包,用于为基于 LLM 的对话系统添加可编程的安全护栏,支持话题控制、安全防护和对话引导。

核心特性

  • 为 LLM 对话应用添加可编程护栏
  • 输入、对话和输出轨道的全面控制
  • 防止越狱和提示注入攻击
  • 支持多种 LLM 包括 GPT-4、LLaMa-2、Falcon
  • Colang 编程语言用于定义轨道流程
  • 异步优先设计,提供同步和异步 API

适用场景

💡 需要事实核查和审核的 RAG 应用
💡 保持指定话题的领域专用聊天机器人
💡 面向客户的 LLM 端点安全保护
💡 LangChain 链的附加安全层
💡 具有合规要求的企业 AI 助手

优势与不足

优势

  • 活跃维护,近期持续更新
  • 社区热度高(7.1k stars)
  • 项目有一定历史沉淀(已维护 3 年)

⚠️ 不足

  • 缺少明确的开源许可证

快速开始

通过 pip install nemoguardrails 安装。加载护栏配置并创建 LLMRails 实例。使用 rails.generate() 进行受保护的 LLM 调用。支持 Python 3.10-3.13 和多种 LLM 提供商。

相关项目

Guardrails AI

7.4k · Python
活跃 A+

Guardrails AI 为大语言模型添加可编程的安全护栏,通过输入输出验证、结构化数据提取和自定义校验器确保 LLM 应用的可靠性和安全性。

guardrailsllm-safetyvalidation +2
  • · Input/Output Guard 输入输出护栏:检测、量化和缓解 LLM 特定风险
  • · Guardrails Hub 预构建验证器生态:RegexMatch、CompetitorCheck、ToxicLanguage 等开箱即用
  • · Pydantic 结构化输出:通过函数调用或 prompt 优化强制 LLM 输出指定格式

UQLM

1.2k · Python
活跃 A+

CVS Health 开源的 LLM 不确定性量化库,用于基于 UQ 的幻觉检测,提供置信度评分和幻觉缓解工具,帮助识别和降低 LLM 输出的不可靠内容。

hallucination-detectionuncertainty-quantificationllm-evaluation +2
  • · 提供五类不确定性量化评分器:Black-Box(一致性)、White-Box(Token 概率)、LLM-as-a-Judge、Ensemble 和 Long-Text
  • · Black-Box 评分器通过多次生成和比较测量响应一致性,兼容任何 LLM,开箱即用
  • · White-Box 评分器利用 Token 概率估算不确定性,单次生成即可评分,速度快成本低

OpenAI Evals

19.4k · Python
不活跃 B

OpenAI 推出的 LLM 评估框架,提供标准化的基准测试注册表和工具集,用于系统评估大语言模型和 LLM 系统的性能表现。

llm-evaluationbenchmarkevals +2
  • · 开源评估注册表,用于测试 LLM 性能的不同维度
  • · 使用基本和模型评分模板创建自定义评估,无需编写代码
  • · 支持私有评估,在不暴露数据的情况下评估工作流中的 LLM 模式

Giskard

5.8k · Python
活跃 A+

开源 LLM Agent 评估与测试库,提供自动化模型扫描、偏见检测、性能基准测试和合规检查,帮助团队在部署前全面验证 AI Agent 质量。

evaluationtestingllm-safety +3
  • · Scenario API 用于创建评估测试非确定性 LLM 输出
  • · 内置检查项包括 Groundedness、Conformity 和 LLM-as-Judge 评估
  • · 红队漏洞扫描器自动生成覆盖 OWASP LLM Top-10 类别的对抗性测试套件

相关文章