La journalisation d’audit SIEM est une fonctionnalité Enterprise activée par organisation. Contactez l’équipe en charge de votre compte Firecrawl pour l’activer.
Destinations prises en charge
Éléments journalisés
- La récupération — l’URL et le domaine cibles, le statut HTTP, ainsi que les heures de début et de fin.
- Le résultat — réussite, échec, blocage (une politique de sécurité a refusé la récupération) ou annulation.
EventSeveritydistingue une menace confirmée par le fournisseur d’une récupération bloquée par l’une de vos propres règles de sécurité. - L’attribution — la clé API (ID et nom d’affichage) ayant déclenché la récupération, ainsi que le workflow dont elle provient : extraction, crawl, extraction par lot, recherche, Extract, agent ou parse.
- Le regroupement des jobs — un identifiant de requête partagé par chaque récupération d’une même requête API, afin qu’un crawl complet soit reconstitué comme un seul job dans vos requêtes.
- Vos ID de corrélation — les métadonnées ajoutées par vos systèmes aux requêtes sont répercutées dans la ligne, afin que les événements correspondent à vos propres identifiants de tickets ou de sessions.
Configuration
- Créez une application Entra avec un secret client. Firecrawl s’authentifie à l’aide de ces identifiants ; attribuez à l’application uniquement le rôle Monitoring Metrics Publisher sur le DCR.
- Créez un DCE et un DCR avec une table personnalisée pour les événements — le dashboard fournit le schéma de la table et la transformation qui normalise les événements au format ASIM. Notez l’URL d’ingestion du DCE, l’ID immuable du DCR et le nom du flux.
- Saisissez les informations dans le dashboard : ID de locataire, ID client, secret client, URL du DCE, ID immuable du DCR et nom du flux.
- Save. Firecrawl vérifie la destination en envoyant un événement de test et n’active le streaming qu’une fois que la destination l’a accepté. Vous pouvez envoyer un autre événement de test à tout moment.
Sémantique de livraison
- Par lots et par organisation — les événements sont regroupés et livrés par lots, généralement quelques secondes après la fin de l’extraction.
- Nouvelles tentatives avec backoff exponentiel — en cas d’échec temporaire de la destination, de nouvelles tentatives sont effectuées à intervalles croissants. Une panne de destination n’entraîne pas immédiatement la perte de la piste d’audit, et la livraison reprend lorsque la destination est de nouveau disponible.
- Jamais sur le chemin des requêtes — les problèmes de livraison ne ralentissent ni ne font échouer vos requêtes API. Si la destination reste indisponible au-delà du budget de tentatives, les événements concernés sont abandonnés plutôt que de bloquer les extractions ; l’état de la livraison est visible dans le dashboard.
- Sortie statique — le trafic de livraison provient d’une adresse IP statique dédiée. Vous pouvez ainsi ajouter Firecrawl à une allowlist dans les contrôles réseau placés devant votre point de terminaison de collecte. Demandez l’adresse à votre équipe account.
Référence des erreurs
Notes
- La journalisation d’audit SIEM n’entraîne aucun coût en crédits.
- Les événements décrivent les métadonnées et les résultats des requêtes — le contenu des pages scrapées n’est jamais envoyé à votre SIEM.
- Les équipes utilisant la rétention zéro des données peuvent utiliser la journalisation d’audit SIEM ; les événements sont signalés par
zero_data_retention: true.

