Browser Use Web UI

不活跃
GitHub Python MIT

简介

在浏览器中运行 AI Agent 的 Web 界面,提供可视化的浏览器自动化操作体验。

核心特性

  • 基于 Gradio 的 WebUI,支持绝大多数 browser-use 功能,界面直观易用
  • 支持多种大语言模型,包括 Google、OpenAI、Azure OpenAI、Anthropic、DeepSeek、Ollama 等
  • 支持使用自己的浏览器,无需重新登录或处理认证问题
  • 持久化浏览器会话,AI 任务之间保持浏览器窗口打开,完整记录交互历史
  • 支持 Docker 部署,配备 VNC 查看器实时观看浏览器操作过程
  • 集成 DeepSeek-r1 实现深度思考能力,提升浏览器自动化任务效果

适用场景

💡 网页爬取和数据提取,通过可视化浏览器自动化操作
💡 自动化表单填写和网页交互,用于测试或数据录入
💡 需要多步导航的 AI 驱动浏览器研究任务
💡 无需编程知识的基于浏览器的工作流自动化
💡 通过可视化界面快速原型开发浏览器智能体应用

优势与不足

优势

  • 社区热度高(16.3k stars)
  • 开源许可证友好(MIT)

快速开始

克隆仓库,使用 uv 创建 Python 3.11 虚拟环境,通过 `uv pip install -r requirements.txt` 安装依赖,安装 Playwright 浏览器,在 `.env` 中配置 API 密钥,然后运行 `python webui.py --ip 127.0.0.1 --port 7788` 并打开 http://127.0.0.1:7788。

相关项目

Scrapling

79.4k · Python
活跃 A+

自适应 Web 爬虫框架,智能应对反爬机制,从单次请求到大规模爬取均可处理,专为 AI Agent 数据采集设计。

browserpythontools +2
  • · 自适应选择器 — 解析器学习网站结构变化,自动重新定位元素,即使页面更新也能找到数据
  • · 反爬虫绕过 — 内置 StealthyFetcher 和 DynamicFetcher,可绕过 Cloudflare Turnstile 等反机器人系统
  • · 多模式 Fetcher — 提供 Fetcher、AsyncFetcher、StealthyFetcher、DynamicFetcher 四种模式适应不同场景

Agent Reach

78.9k · Python
活跃 A+

为 AI Agent 赋予全网搜索能力,一键读取和搜索 Twitter、Reddit、YouTube、GitHub、B 站、小红书等平台,无需 API 费用。

browserpythonagent +2
  • · 全平台搜索 — 一键搜索 Twitter、Reddit、YouTube、GitHub、B站、小红书等 14+ 平台
  • · 零 API 费用 — 所有工具开源免费,无需为各平台 API 付费
  • · 一键安装 — 复制一句话给 AI Agent 即可完成安装,支持 Claude Code、OpenClaw、Cursor 等

PPT Master

53.1k · Python
活跃 A+

AI 驱动的 PPT 生成工具,从任意文档自动生成原生可编辑的 PPTX 文件,输出真正的 PowerPoint 图形元素而非图片。

browserpythonagent +2
  • · 原生 PPTX 生成 — 输出真正的 PowerPoint 图形元素而非图片,可直接在 PowerPoint 中编辑
  • · 文档输入解析 — 支持 Markdown、PDF、Word 等多种文档格式自动解析为幻灯片内容
  • · 多风格模板 — 内置 Swiss Grid、Glassmorphism、Memphis Pop 等专业设计风格