- Fonctionne comme
/crawl, mais pour une liste explicite d’URL - Modes synchrone et asynchrone
- Prend en charge toutes les options de scrape, y compris l’extraction structurée
- Concurrence configurable par tâche
Opérations
Fonctionnement
Vous pouvez exécuter un scraping par lot de deux façons :Utilisation de base
Réponse
AppelerbatchScrape / batch_scrape renvoie les résultats complets une fois le lot terminé.
Terminé
startBatchScrape / start_batch_scrape renvoie un ID de tâche que vous pouvez suivre via getBatchScrapeStatus / get_batch_scrape_status, le point de terminaison API /batch/scrape/{id} ou des webhooks. Les résultats de la tâche sont accessibles via l’API pendant 24 heures après son achèvement. Passé ce délai, vous pouvez toujours consulter l’historique et les résultats de vos batch scrapes dans les journaux d’activité.
Concurrence
Par défaut, un job de scraping par lot utilise l’intégralité de la limite de navigateurs concurrents de votre équipe (voir Rate Limits). Vous pouvez la réduire pour chaque job avec le paramètremaxConcurrency.
Par exemple, maxConcurrency: 50 limite ce job à 50 opérations de scraping simultanées. Fixer une valeur trop basse pour de gros lots ralentira significativement le traitement, donc ne la réduisez que si vous devez conserver de la capacité pour d’autres jobs concurrents.
Extraction structurée
Vous pouvez utiliser le grattage en lot pour extraire des données structurées depuis chaque page du lot. C’est utile si vous voulez appliquer le même schéma à une liste d’URL.Réponse
batchScrape / batch_scrape retourne les résultats complets :
Terminé
startBatchScrape / start_batch_scrape retourne un ID de tâche :
Webhooks
Vous pouvez configurer des webhooks pour recevoir des notifications en temps réel à mesure que chaque URL de votre lot est récupérée. Cela vous permet de traiter les résultats immédiatement, sans attendre la fin de l’ensemble du lot.cURL
Types d’événements
Charge utile
Chaque livraison de webhook inclut un corps JSON avec la structure suivante :Vérification des signatures de webhook
Chaque requête de webhook provenant de Firecrawl inclut un en-têteX-Firecrawl-Signature contenant une signature HMAC-SHA256. Vérifiez toujours cette signature pour vous assurer que le webhook est authentique et n’a pas été altéré.
- Récupérez votre secret de webhook dans l’onglet Advanced des paramètres de votre compte
- Extrayez la signature depuis l’en-tête
X-Firecrawl-Signature - Calculez le HMAC-SHA256 du corps brut de la requête en utilisant votre secret
- Comparez-la à l’en-tête de signature à l’aide d’une fonction sécurisée vis-à-vis du temps d’exécution (timing-safe)
Êtes-vous un agent IA qui a besoin d’une API key Firecrawl ? Consultez firecrawl.dev/agent-onboarding/SKILL.md pour obtenir des instructions d’intégration automatisée.

