Agent 工具

AI Agent 开发工具与函数库,覆盖工具调用、prompt 模板、评估测试、数据集管理等场景,帮助开发者加速 Agent 应用的构建、调试与迭代。

341 个项目

OpenClaw

386.5k · TypeScript
活跃 A+

OpenClaw 是一个开源个人 AI 助手平台,支持 25+ 消息通道(WhatsApp、Telegram、Slack 等),可连接多种 LLM 并管理个人知识库。

assistantmulti-channelllm +2
  • · 25+ 消息通道 — 支持 WhatsApp、Telegram、Slack、Discord、微信、QQ 等主流即时通讯平台统一接入
  • · 多 LLM 提供商 — 支持 OpenAI、Anthropic 等多种模型,可通过 OAuth 订阅或自带 API Key
  • · 语音交互 — macOS/iOS/Android 端支持语音输入输出,实现免手操对话体验

ECC

240.5k · JavaScript
活跃 A+

Agent 线束操作系统,提供技能、本能、记忆优化、持续学习和安全扫描的完整 Agent 工程系统。

agent-harnessskillsclaude-code +2
  • · 跨线束工作流 — 支持 Codex / Claude Code / Cursor / OpenCode / Gemini 等多种 Agent 线束
  • · 技能系统 — 可复用的 Agent 技能包,覆盖代码生成、审查、测试等场景
  • · 持续学习 — 从失败会话中挖掘经验,自动写入修正到配置文件

Firecrawl

168.2k · TypeScript
活跃 A+

Firecrawl 是一个专为 AI Agent 设计的网页抓取和搜索引擎,支持将任意网页转换为结构化的 Markdown 数据,提供搜索、抓取和清洗功能,适合构建基于网页数据的 AI 应用。

web-scrapingsearch-enginemarkdown +2
  • · Search 端点 — 搜索互联网并获取搜索结果页面的完整内容,一步完成搜索+抓取
  • · Scrape 端点 — 将任意 URL 转换为 Markdown、HTML、截图或结构化 JSON
  • · Interact 端点 — 先抓取页面,再通过 AI 提示词或代码与页面交互(点击、搜索等)

llama.cpp

124.2k · C++
活跃 A+

llama.cpp 是一个用 C/C++ 编写的轻量级 LLM 推理引擎,可在消费级硬件上高效运行各类开源大语言模型。

llm-inferencellamagguf +2
  • · 极轻量推理 — 纯 C/C++ 实现,零依赖即可在 CPU 上运行量化 LLM
  • · GGUF 模型格式 — 统一的量化模型格式,跨平台、可分块加载
  • · 多硬件加速 — 支持 Apple Silicon Metal、NVIDIA CUDA、AMD ROCm、Vulkan、OpenCL

Pi Mono

91.5k · TypeScript
活跃 A+

Pi Mono 是一个全面的 AI 智能体工具包,包含编码智能体 CLI、统一 LLM API、TUI 与 Web UI 组件库、Slack 机器人及 vLLM Pod 管理,一站式覆盖智能体开发全链路。

agent-toolkitclillm-api +1
  • · 交互式编码智能体 CLI — 基于终端的 AI 编码助手,支持代码生成、重构和调试
  • · 统一多提供商 LLM API — 一套接口同时支持 OpenAI、Anthropic、Google 等主流 LLM 供应商
  • · Agent 运行时引擎 — 内置工具调用和状态管理,支持复杂多步骤任务执行

Pi

91.5k · TypeScript
活跃 A+

Pi 是一个全栈 AI Agent 工具包,包含编码 Agent CLI、统一 LLM API、TUI 与 Web UI 库、Slack 机器人以及 vLLM 推理 Pod,为构建和运行 AI Agent 提供一站式基础设施。

coding-agentclillm +2
  • · 统一多 Provider LLM API — pi-ai 包提供统一接口支持 OpenAI、Anthropic、Google 等多个 LLM 提供商
  • · 交互式编码 Agent CLI — pi-coding-agent 提供命令行界面的交互式编码 agent,支持工具调用和状态管理
  • · Agent 运行时 — pi-agent-core 提供工具调用和状态管理的 agent 运行时,支持多步骤任务执行

vLLM

89.2k · Python
活跃 A

vLLM 是一个高吞吐量、低内存占用的 LLM 推理与服务引擎,支持连续批处理、PagedAttention 等优化技术,广泛用于生产环境中的大模型部署。

llmpythonframework +2
  • · PagedAttention 内存管理 — 通过分页机制高效管理注意力 KV cache,大幅降低显存占用
  • · 连续批处理与分块预取 — 支持 continuous batching、chunked prefill 和 prefix caching,实现高吞吐推理
  • · 多量化格式支持 — 覆盖 FP8、INT8、INT4、GPTQ/AWQ、GGUF、compressed-tensors 等主流量化方案

PaddleOCR

87.7k · Python
活跃 A+

PaddleOCR 是百度开源的多语言 OCR 与文档智能工具箱,支持 80+ 语言与 PP-Structure 版面分析。

ocrpaddlepaddledocument-ai +2
  • · 多语言识别 — 内置 80+ 主流语言模型,简体中文、繁体、英文、阿拉伯文等
  • · PP-Structure 版面分析 — 文本块、表格、图、公式自动分类与定位
  • · PP-OCRv4 高精度 — 业界领先的检测 + 识别端到端精度

WorldMonitor

82.4k · TypeScript
活跃 A+

worldmonitor 是一个 AI 全球事件监测仪表盘,聚合新闻、地缘政治、能源、市场等实时数据并自动生成简报。

monitoringworld-newsai +2
  • · 全球新闻聚合 — 跨语言新闻源、地缘政治事件、市场舆情
  • · 事件关联 — 自动把新闻事件与能源、航运、币种价格关联
  • · AI 简报生成 — 每天、每周自动产出可订阅的事件简报

DeerFlow

80.1k · Python
活跃 A+

字节跳动开源的长周期 SuperAgent 框架,支持研究、编码和创作任务,具备沙箱环境、记忆系统、工具调用和子 Agent 协同能力,可处理从分钟到小时级别的复杂任务。

super-agentmulti-agentresearch +4
  • · Super Agent 框架 — 编排子 Agent、记忆系统和沙箱环境执行从分钟到小时级的复杂长周期任务
  • · 可扩展技能系统 — 基于技能的模块化架构,支持自定义技能扩展 Agent 能力边界
  • · 沙箱代码执行 — 内置安全沙箱环境,Agent 可在隔离环境中安全执行代码和文件操作

Screenshot to Code

74.0k · Python
活跃 A+

利用 AI 模型将截图、设计稿和 Figma 文件转换为干净的代码,支持 HTML/Tailwind、React 和 Vue 等多种前端框架。

screenshot-to-codemultimodalcode-generation +2
  • · 多格式输入支持 — 支持截图、UI 设计稿、Figma 文件和屏幕录制转换为可运行代码
  • · 多技术栈输出 — 生成 HTML+Tailwind、React+Tailwind、Vue+Tailwind、Bootstrap、Ionic 等框架代码
  • · 多 AI 模型集成 — 内置 Gemini、GPT-5 系列、Claude Opus 等顶级视觉模型,支持模型对比

Front-End Checklist

73.5k · MDX
活跃 A+

专为现代 Web 开发和 AI 代理设计的详尽前端检查清单,覆盖 HTML/CSS/JS、性能、可访问性、SEO 等全链路质量标准。

front-endchecklistweb-development +2
  • · 完整质量检查项 — 涵盖 HTML、CSS、JavaScript、图片、字体、性能、可访问性、SEO、安全等 20+ 类别
  • · AI 代理友好 — 每个项目都有清晰的检查提示词,可直接喂给 LLM 做自动化质检
  • · 多语言支持 — 提供中文、英文、葡萄牙文等多个语言版本,覆盖全球开发者

Unsloth

72.6k · Python
活跃 A+

Unsloth Studio 是一个用于本地训练和运行开源大模型的 Web UI 工具,支持 Gemma 4、Qwen3.6、DeepSeek 等模型,为 Agent 开发者提供模型微调和部署能力。

model-trainingfine-tuningllm +2
  • · 高效微调引擎 — 自定义 Triton 内核加速训练,速度提升 2x,显存降低 70%,无精度损失
  • · 多模态训练支持 — 支持文本、视觉、语音(TTS)、Embedding 模型的微调
  • · 强化学习(RL) — 支持 GRPO、FP8 等 RL 方法,显存占用降低 80%

Daytona

72.0k · Unknown
活跃 A

Daytona 提供面向开发 Agent 与自动化任务的安全开发环境基础设施,适合作为代码 Agent、远程执行与开发者工作流自动化的运行底座。

dev-environmentsandboxcoding +1
  • · 沙箱环境 — 完全隔离的计算单元,拥有独立内核、文件系统、网络栈和分配的 vCPU/RAM/磁盘
  • · 毫秒级启动 — 从代码到执行不到 90ms 即可创建沙箱,支持 Python/TypeScript/JavaScript
  • · 多语言 SDK — 提供 Python、TypeScript、Go SDK 以及 REST API 和 CLI 进行编程控制

(24 / 341)

相关文章

Memory记忆系统长期记忆

Agent Memory 架构:短期、长期与共享记忆的设计取舍

系统对比 Agent Memory 的三大类别——短期记忆、长期记忆、共享记忆,从存储介质、生命周期、检索方式、典型框架到设计模式,完整覆盖 Agent 个性化和多 Agent 协作的工程实现。

安全Prompt InjectionOWASP

Agent 提示词注入防御:OWASP LLM01 七层纵深防护

基于 OWASP LLM Top 10 工程实践,系统讲解 Agent 提示词注入的七层纵深防御:输入清洗、指令隔离、最小权限、输出审计、护栏框架、持续红队评估和 Kill Switch,给出可落地的代码与工具链。

small-language-modelsedge-inferencefine-tuning

小模型微调与边缘推理:让 AI Agent 在资源受限场景下跑得更快、更省

本文系统讲解小语言模型(SLM)在 Agent 场景中的微调策略与边缘推理架构,覆盖 QLoRA 量化、推理引擎选型、上下文压缩与工具调用约束,帮助在边缘端以低延迟、低成本、强隐私地部署生产级 Agent。

AI Agent沙箱代码执行

AI Agent 沙箱与代码执行安全:隔离策略与实战方案

对比容器、WebAssembly、进程级隔离三种沙箱方案,结合实战代码讲解如何安全执行 Agent 生成的代码。

browser agentbrowser-usestagehand

Browser Agent 数据提取与表单填写实战:从 LLM 视觉到 DOM 选择器

系统讲解 Browser Agent 在两类高频任务(结构化数据提取 + 表单自动填写)上的工程实践,对比视觉 LLM、DOM 选择器、混合坐标三种动作定位策略,以及 Browser-Use、Stagehand、Playwright MCP、Skyvern 四大框架的取舍。

Browser AgentWeb 自动化Playwright

Browser Agent 实战:让 AI 操控浏览器的架构与陷阱

从裸 Playwright 到结构化提取,拆解三层浏览器自动化抽象的适用场景、生产模式和常见踩坑。