Skip to main content

安装

官方 Rust SDK 维护在 Evocrawl 的 monorepo 中,位于 apps/rust-sdk 要安装 Evocrawl Rust SDK,请从 crates.io 添加此依赖:
或通过 Cargo 安装:
需要 Rust 1.70 或更高版本。

使用方式

  1. evocrawl.dev 获取 API 密钥
  2. 将 API 密钥设置为名为 EVOCRAWL_API_KEY 的环境变量,或直接传给 Client::new(...)
以下是一个使用 SDK 的简要示例:

抓取 URL

要抓取单个 URL,请使用 scrape 方法。

JSON 提取

使用 scrape_with_schema 提取结构化 JSON:
也可以直接通过 ScrapeOptions 配置 JSON 提取:

爬取网站

如需爬取网站并等待完成,请使用 crawl

开始爬取

使用 start_crawl 启动任务,无需等待。

查看爬取状态

使用 get_crawl_status 查看爬取进度。

取消爬取

使用 cancel_crawl 取消正在进行的爬取。

检查爬取错误

使用 get_crawl_errors 获取爬取任务中的错误。

网站映射

使用 map 发现网站中的链接。
若只需返回 URL 的简化结果,请使用 map_urls

搜索网页

使用 search 并结合可选设置进行搜索。
如需使用可直接返回抓取到的文档的便捷方法:

批量抓取

通过 batch_scrape 并行抓取多个 URL。

代理

使用 agent 运行 AI 代理。
使用 JSON schema 实现结构化输出:

与抓取任务绑定的交互式会话

使用抓取任务 ID,可在同一上下文中运行后续浏览器代码:
  • interact(...) 会在与抓取任务绑定的浏览器会话中运行代码或 prompt。
  • stop_interaction(...) 会在你完成后停止交互式会话。

配置

Client::new(...)Client::new_selfhosted(...) 用于创建客户端。

环境变量

请设置 EVOCRAWL_API_KEY 环境变量,而不要直接传入密钥:

轮询间隔

同步方法 (crawlbatch_scrapeagent) 会轮询直到完成。你可以通过 options 结构体自定义轮询间隔:

错误处理

SDK 使用 EvocrawlError 枚举,该枚举实现了 ErrorDebugDisplay 接口。所有方法都返回 Result<T, EvocrawlError>
如果你是需要 EvoCrawl API 密钥的 AI 代理,请参阅 evocrawl.dev/agent-onboarding/SKILL.md 获取自动化接入说明。