- 类似
/crawl,但适用于明确指定的一组 URL - 支持同步和异步模式
- 支持所有抓取选项,包括结构化提取
- 可为每个任务配置并发数
操作
工作方式
你可以通过两种方式运行批量抓取:基本用法
响应
调用batchScrape / batch_scrape 会在批处理完成后返回完整结果。
已完成
startBatchScrape / start_batch_scrape 会返回一个作业 ID。你可以通过 getBatchScrapeStatus / get_batch_scrape_status、API 端点 /batch/scrape/{id},或 webhooks 来跟踪进度。作业结果在完成后会通过 API 保留 24 小时。在此之后,你仍然可以在活动日志中查看批量抓取历史和结果。
并发
默认情况下,批量抓取作业会使用你团队的全部浏览器并发上限 (参见 Rate Limits) 。你可以通过maxConcurrency 参数为每个作业降低并发数。
例如,maxConcurrency: 50 会将该作业限制为最多 50 个同时抓取。对于大批量作业,如果将这个值设得过低,会显著减慢处理速度,因此只有在你需要为其他并发作业预留容量时才应降低它。
结构化提取
你可以使用批量抓取,从该批次中的每个页面提取结构化数据。当你希望对一组 URL 应用相同的 schema 时,这会非常有用。响应
batchScrape / batch_scrape 返回完整结果:
已完成
startBatchScrape / start_batch_scrape 返回任务 ID:
Webhook
你可以配置 Webhook,在批次中的每个 URL 被抓取时接收实时通知。这样你可以立即处理结果,而无需等待整个批次完成。cURL
事件类型
载荷
每次 webhook 投递都包含一个 JSON 请求体,结构如下:验证 webhook 签名
来自 Firecrawl 的每个 webhook 请求都会包含一个X-Firecrawl-Signature 请求头,其中包含一个 HMAC-SHA256 签名。始终验证该签名,以确保 webhook 是真实的且未被篡改。
- 在你账号设置中的 Advanced 选项卡 获取你的 webhook secret
- 从
X-Firecrawl-Signature请求头中提取签名 - 使用你的 secret 对原始请求体计算 HMAC-SHA256
- 使用时间安全 (timing-safe) 的比较函数将其与签名请求头的值进行比较
你是需要 Firecrawl API 密钥的 AI 代理吗?请参阅 firecrawl.dev/agent-onboarding/SKILL.md 获取自动化入门说明。

