Skip to main content
通过模型上下文协议(MCP)将 Firecrawl 集成到 Google 的 Agent Development Kit(ADK),以构建具备网页抓取能力的强大 AI 智能体。

概览

Firecrawl 提供一个 MCP 服务器,可与 Google 的 ADK 无缝集成,使你的智能体能够高效地对任意网站进行抓取、爬取,并提取结构化数据。该集成同时支持云端与自托管的 Firecrawl 实例,并通过可流式传输的 HTTP 实现最佳性能。

功能

  • 高效完成任意网站的网页抓取、爬取与内容发现
  • 高级搜索与智能内容提取
  • 深度研究与大规模批量抓取
  • 灵活部署(云端或自托管)
  • 针对现代 Web 环境优化,支持 HTTP 流式传输

前置条件

  • firecrawl.dev 获取 Firecrawl 的 API 密钥
  • 安装 Google SDK

设置

可用工具

配置

必需配置

FIRECRAWL_API_KEY:你的 Firecrawl API 密钥
  • 使用云端 API(默认)时为必需
  • 在配合 FIRECRAWL_API_URL 的自托管实例中为可选

可选配置

Firecrawl API URL(用于自托管实例)
  • FIRECRAWL_API_URL:自定义 API 端点
  • 示例:https://firecrawl.your-domain.com
  • 如未配置,将使用云端 API
重试配置
  • FIRECRAWL_RETRY_MAX_ATTEMPTS:最大重试次数(默认:3)
  • FIRECRAWL_RETRY_INITIAL_DELAY:初始延迟(毫秒,默认:1000)
  • FIRECRAWL_RETRY_MAX_DELAY:最大延迟(毫秒,默认:10000)
  • FIRECRAWL_RETRY_BACKOFF_FACTOR:指数退避因子(默认:2)
额度使用监控
  • FIRECRAWL_CREDIT_WARNING_THRESHOLD:警告阈值(默认:1000)
  • FIRECRAWL_CREDIT_CRITICAL_THRESHOLD:严重阈值(默认:100)

示例:网页研究代理

最佳实践

  1. 为任务选择合适的工具
    • 当你需要先找到相关页面时,使用 firecrawl_search
    • 抓取单个页面时,使用 firecrawl_scrape
    • 抓取多个已知 URL 时,使用 firecrawl_batch_scrape
    • 需要发现并抓取整站时,使用 firecrawl_crawl
  2. 监控使用情况:配置使用额度阈值以避免意外消耗
  3. 妥善处理错误:根据你的用例配置重试策略
  4. 优化性能:在抓取多个 URL 时使用批量操作

使用 Google Agent Development Kit(ADK)与 Firecrawl 构建 AI 代理的完整指南

了解如何基于 Google 的 ADK 框架,结合 Firecrawl 的网页抓取能力,构建强大的多代理 AI 系统。

MCP 服务器文档

进一步了解 Firecrawl 的模型上下文协议(MCP)服务器的集成方式与功能。

Google ADK 官方文档

查阅 Google Agent Development Kit 官方文档,获取完整指南与 API 参考。