Firecrawl
Firecrawl 是一个专为 AI Agent 设计的网页抓取和搜索引擎,支持将任意网页转换为结构化的 Markdown 数据,提供搜索、抓取和清洗功能,适合构建基于网页数据的 AI 应用。
浏览器与 Web 自动化 Agent,包括 Browser-use、Playwright MCP、Skyvern 等,结合 LLM 视觉与 DOM 操作,实现网页数据提取、表单填写、端到端测试等任务。
Firecrawl 是一个专为 AI Agent 设计的网页抓取和搜索引擎,支持将任意网页转换为结构化的 Markdown 数据,提供搜索、抓取和清洗功能,适合构建基于网页数据的 AI 应用。
browser-use 提供浏览器自动化 Agent 能力,让 LLM 可以理解页面并执行复杂网页操作。
专为现代 Web 开发和 AI 代理设计的详尽前端检查清单,覆盖 HTML/CSS/JS、性能、可访问性、SEO 等全链路质量标准。
自适应 Web 爬虫框架,智能应对反爬机制,从单次请求到大规模爬取均可处理,专为 AI Agent 数据采集设计。
为 AI Agent 赋予全网搜索能力,一键读取和搜索 Twitter、Reddit、YouTube、GitHub、B 站、小红书等平台,无需 API 费用。
为编程 Agent 提供浏览器开发者工具能力的 MCP 服务器,支持网页调试、性能分析和 DOM 操作自动化。
零服务器代码智能引擎,完全在浏览器中运行的客户端知识图谱创建工具,内置 Graph RAG 智能体用于代码探索。
AI 驱动的 PPT 生成工具,从任意文档自动生成原生可编辑的 PPTX 文件,输出真正的 PowerPoint 图形元素而非图片。
Vercel 开源的浏览器自动化 CLI 工具,专为 AI Agent 设计,基于 Rust 构建,高性能且可编程。
字节跳动开源的多模态 AI Agent 栈,连接前沿 AI 模型与 Agent 基础设施,支持 GUI 自动化和电脑操作。
Lightpanda Browser 是面向自动化和爬取场景的轻量浏览器运行时,目标是在无头任务中提供比传统浏览器更低的资源开销。它适合大规模 Web Agent、网页抽取和自动化测试,把浏览器能力嵌入后端工作流。
CloakBrowser 是基于源码级补丁构建的反检测 Chromium 浏览器,专为 AI 代理和爬虫场景,绕过 Cloudflare、reCAPTCHA 等主流反机器人检测。
Page Agent 是阿里巴巴开发的 JavaScript 页面内 GUI 智能体,通过自然语言控制网页界面,实现自动化表单填写、页面导航和元素操作等任务。
完全本地化的 Manus AI 替代方案,支持自主浏览网页、编写代码和语音交互,无需任何 API 费用
Open-AutoGLM 是一个开放的手机 Agent 模型与框架,支持 AI 自主操控手机界面完成任务,解锁 AI Phone 体验。
Stagehand 是 Browserbase 推出的浏览器 Agent SDK,为 AI 编码助手提供网页操作能力。支持 act、extract、observe 三种核心原语,让 AI Agent 能够自然地浏览和操作网页,是构建浏览器 Agent 的首选工具。
Skyvern 是面向浏览器任务自动化的 Agent 平台,通过页面理解与操作规划完成复杂网页流程,适合表单处理、后台操作与可重复 Web 自动化场景。
Automa 是一款开源浏览器自动化扩展,通过可视化积木块拼接完成表单填写、网页抓取、定时任务等重复操作,让非编程用户也能快速搭建浏览器工作流。
CUA 是开源的计算机使用 Agent 基础设施,提供沙箱、SDK 和基准测试,支持 AI Agent 控制完整桌面环境。
Obscura 是 Rust 编写的高性能无头浏览器,专为 AI Agent 与大规模 Web 抓取场景设计,强调低资源与反检测能力。
AI 驱动的深度研究助手,结合搜索引擎、网页抓取和大语言模型,通过迭代推理对任意主题进行深入调研
Maxun 是开源的无代码网页数据平台,支持录制式抓取与 LLM 自然语言抽取,可将任意网站转为结构化 API 与定时任务。
在浏览器中运行 AI Agent 的 Web 界面,提供可视化的浏览器自动化操作体验。
browser-harness 是一个自愈测试工具,使 LLM 能够完成任何任务。
(24 / 92)
系统讲解 LLM Agent 在生产环境中的速率限制(Rate Limiting)与成本攻击(Cost Attack)防御:从单用户 Token 配额、多租户滑动窗口、Prompt 注入放大成本,到 DDoS 防护与 LangChain/CrewAI/AutoGen 框架的集成。
系统讲解现代 Web 抓取的反爬对抗:HTTP 层(curl_cffi 模拟 TLS 指纹)+ 浏览器层(Playwright + stealth 隐藏自动化痕迹)+ 行为层(人类行为模拟),覆盖 Cloudflare 绕过、代理 IP、Scrapling 选择器自愈与合法合规边界。
系统讲解 Browser Agent 在两类高频任务(结构化数据提取 + 表单自动填写)上的工程实践,对比视觉 LLM、DOM 选择器、混合坐标三种动作定位策略,以及 Browser-Use、Stagehand、Playwright MCP、Skyvern 四大框架的取舍。
从裸 Playwright 到结构化提取,拆解三层浏览器自动化抽象的适用场景、生产模式和常见踩坑。
详解 browser-use 在网页任务自动化中的优势与限制,并给出稳定执行和失败恢复策略。
拆解五个开源 Deep Research 项目的迭代检索、事实验证、报告生成三大子阶段,附可复制的 query 改造代码。