AxonHub

活跃
GitHub Go NOASSERTION

简介

开源 AI 网关,用任意 SDK 即可调用 100+ LLM,内置故障转移、负载均衡与成本控制。

核心特性

  • 统一 LLM 网关 — 用 OpenAI/Anthropic 兼容协议调用 100+ 模型
  • 自动故障转移 — 主 Provider 故障时切换到备用 Provider
  • 智能负载均衡 — 在多模型实例间分配请求,避免单点过载
  • 成本治理 — 按项目/团队设置预算、配额与单价告警
  • 端到端追踪 — 完整请求链路追踪,集成 OpenTelemetry
  • 可插拔鉴权 — 支持 API Key、OIDC 与团队 SSO

适用场景

💡 在多模型生产环境中统一接入,避免应用层重复实现 Provider 切换
💡 为多团队 AI Agent 平台提供预算、配额和成本看板
💡 在本地和托管模型之间做负载均衡,控制单家厂商依赖
💡 给 LLM 调用加入端到端追踪,便于排查 Agent 失败原因
💡 用一套 SDK 同时对接私有部署和公有云模型

优势与不足

优势

  • 活跃维护,近期持续更新
  • 社区热度高(5.1k stars)

⚠️ 不足

  • 缺少明确的开源许可证

快速开始

# 使用 Docker 启动 AxonHub
docker run -d --name axonhub -p 8080:8080 \
  -e AXONHUB_MASTER_KEY=sk-xxx \
  looplj/axonhub:latest

# 通过 OpenAI 兼容协议调用任意模型
curl http://localhost:8080/v1/chat/completions \
  -H "Authorization: Bearer sk-xxx" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude-3-5-sonnet","messages":[{"role":"user","content":"Hello"}]}'

相关项目

Plano

7.0k · Rust
活跃 A

AI 原生代理和数据平面,内置编排、安全防护、可观测性和智能 LLM 路由功能,帮助开发者专注于 Agent 核心逻辑,简化 LLM 应用的生产部署。

llm-gatewayllm-routingobservability +2
  • · AI 原生代理服务器和数据平面,内置编排和安全防护
  • · YAML 配置 Agent 描述即可实现智能路由,无需手写路由逻辑
  • · Agentic Signals 零代码捕获全链路可观测性数据

TensorZero

11.7k · Rust
正常 B

TensorZero 是开源 LLMOps 平台,统一 LLM 网关、可观测性、评估、优化与 A/B 测试,专为生产 Agent 设计。

observabilityllmllm-gateway +2
  • · 统一 LLM 网关 - 一套 API 接入 Anthropic、OpenAI、Bedrock、Gemini、vLLM 等 20+ 提供方
  • · 10k+ QPS 下 p99 延迟开销 < 1ms - Rust 核心面向生产吞吐优化
  • · 推理与反馈存储 - 数据存放在你自己的数据库中