Skip to main content
此 SDK 目前使用 Firecrawl API 的 v1 版本,非最新(已提供 v2)。部分功能和改进可能仅在 v2 中可用。

安装

要安装 Firecrawl 的 Rust SDK,请在你的 Cargo.toml 中添加以下内容:
Rust

使用

首先,你需要在 firecrawl.dev 获取一个 API 密钥。接着,初始化 FirecrawlApp。此后即可调用 FirecrawlApp::scrape_url 等函数来使用我们的 API。 下面是在 Rust 中使用该 SDK 的示例:
Rust

抓取单个 URL

要抓取单个 URL,请使用 scrape_url 方法。该方法以 URL 为参数,返回抓取结果,类型为 Document
Rust

使用 Extract 进行提取

借助 Extract,你可以轻松从任意 URL 提取结构化数据。你需要使用 serde_json::json! 宏,以 JSON Schema 格式指定你的 schema。
Rust

爬取网站

要爬取网站,请使用 crawl_url 方法。该方法会等待爬取过程完成;具体耗时取决于起始 URL 和所选参数,可能会较长。
Rust

仅站点地图抓取(v2 API)

Rust SDK 当前仅支持 v1。要使用 sitemap: "only",请直接调用 v2 端点:
Rust

异步爬取

若要在不等待结果的情况下进行爬取,请使用 crawl_url_async 方法。它接受相同的参数,但会返回一个 CrawlAsyncRespone 结构体,其中包含本次爬取的 ID。你可以使用该 ID 调用 check_crawl_status 方法随时查询状态。请注意,已完成的爬取将在 24 小时后被删除。
Rust

映射 URL

从起始 URL 获取其所有关联链接的映射。
Rust

错误处理

SDK 会处理由 Firecrawl API 以及其依赖返回的错误,并将它们统一为 FirecrawlError 枚举,并实现了 ErrorDebugDisplay 接口。我们的所有方法都返回 Result<T, FirecrawlError>