AI-Infra-Guard

活跃
GitHub Python Apache-2.0

简介

腾讯开源的全栈 AI 红队平台,集成 OpenClaw 安全扫描、Agent 扫描、Skills 扫描、MCP 扫描、AI 基础设施扫描及 LLM 越狱评估能力。

核心特性

  • ClawScan:OpenClaw 安全扫描,检测 OpenClaw 配置和技能中的漏洞
  • Agent Scan:跨 AI 代理的漏洞扫描,支持 WebSocket 代理提供商
  • AI 基础设施漏洞扫描,覆盖 68+ AI 组件,包含 600+ CVE 规则
  • MCP Server 和 Agent Skills 扫描,检测供应链安全和配置暴露
  • LLM 越狱评估,包含 26 种攻击算子,支持单轮和多轮攻击

适用场景

💡 对 AI 部署在基础设施、代理和 MCP 服务方面的安全态势进行自评
💡 供应链安全扫描,检测恶意软件包和暴露的配置文件
💡 通过越狱测试和提示注入攻击模拟进行 LLM 安全评估
💡 基于 Docker 的自动化扫描管道对 AI 组件进行持续安全监控

优势与不足

优势

  • 活跃维护,近期持续更新
  • 社区热度高(6.2k stars)
  • 开源许可证友好(Apache-2.0)
  • Issue 响应及时,积压少

快速开始

git clone https://github.com/Tencent/AI-Infra-Guard.git && cd AI-Infra-Guard && docker-compose -f docker-compose.images.yml up -d。通过 http://localhost:8088 访问 Web UI。从 OpenClaw:clawhub install aig-scanner,然后配置 AIG_BASE_URL 指向运行中的服务。

相关项目

Garak

9.1k · Python
活跃 A

NVIDIA 开源的 LLM 漏洞扫描器,可自动检测大语言模型中的安全漏洞、幻觉倾向、越狱风险和提示注入等安全问题,是 LLM 安全评估的核心工具。

llm-securityvulnerability-scannerllm-evaluation +2
  • · 自动扫描 LLM 漏洞,检测幻觉、数据泄露、提示注入和越狱攻击
  • · 结合静态、动态和自适应探针进行全面安全评估
  • · 广泛支持 LLM:Hugging Face、OpenAI、AWS Bedrock、Replicate、llama.cpp 及 REST 接口模型

Agentic Security

2.0k · Python
活跃 A

开源的 LLM 漏洞扫描器和 AI 红队工具包,支持对 LLM 应用进行自动化安全模糊测试,检测越狱、提示注入和对抗性攻击等风险。

llm-securityred-teamingllm-fuzzer +2
  • · 支持文本、图像和音频的多模态攻击探测,全面测试 LLM 鲁棒性
  • · 多步骤越狱模拟,使用迭代攻击序列发现安全机制弱点
  • · 综合模糊测试引擎,通过随机输入对 LLM 进行压力测试发现边界情况

OpenAI Evals

19.4k · Python
不活跃 B

OpenAI 推出的 LLM 评估框架,提供标准化的基准测试注册表和工具集,用于系统评估大语言模型和 LLM 系统的性能表现。

llm-evaluationbenchmarkevals +2
  • · 开源评估注册表,用于测试 LLM 性能的不同维度
  • · 使用基本和模型评分模板创建自定义评估,无需编写代码
  • · 支持私有评估,在不暴露数据的情况下评估工作流中的 LLM 模式

Promptfoo

24.9k · TypeScript
活跃 A

LLM 提示和 Agent 测试评估工具,用于测试提示词、Agent 和 RAG 管道,内置红队测试和安全评估功能。

testingevaluationred-teaming +2
  • · 自动化 LLM 评测 — 批量测试提示词、模型和 RAG 管道的输出质量
  • · 红队安全测试 — 内置漏洞扫描和对抗性测试,发现 LLM 应用的安全风险
  • · 多模型对比 — 并排比较 OpenAI、Anthropic、Azure、Bedrock、Ollama 等模型表现