Utilisation de Firecrawl avec CrewAI
Installer les outils Firecrawl dans CrewAI
- Récupérez une clé API depuis votre tableau de bord firecrawl.dev et définissez-la dans vos variables d’environnement (
FIRECRAWL_API_KEY). - Installez le SDK Firecrawl ainsi que le package
crewai[tools]:
Outils
OutilFirecrawlCrawlWebsite
Exemple
Arguments
api_key: Facultatif. Spécifie la clé API Firecrawl. Par défaut, utilise la variable d’environnementFIRECRAWL_API_KEY.url: L’URL de base à partir de laquelle démarrer le crawling.page_options: Facultatif.onlyMainContent: Facultatif. Retourne uniquement le contenu principal de la page en excluant les en-têtes, barres de navigation, pieds de page, etc.includeHtml: Facultatif. Inclut le contenu HTML brut de la page. Un champhtmlsera présent dans la réponse.
crawler_options: Facultatif. Options pour contrôler le comportement de crawling.includes: Facultatif. Modèles d’URL à inclure dans le crawl.exclude: Facultatif. Modèles d’URL à exclure du crawl.generateImgAltText: Facultatif. Génère le texte alternatif des images à l’aide de LLMs (nécessite un abonnement payant).returnOnlyUrls: Facultatif. Sitrue, retourne uniquement les URL sous forme de liste dans le statut du crawl. Remarque : la réponse sera une liste d’URL dansdata, et non une liste de documents.maxDepth: Facultatif. Profondeur maximale à crawler. La profondeur 1 correspond à l’URL de base, la profondeur 2 inclut l’URL de base et ses enfants directs, et ainsi de suite.mode: Facultatif. Mode de crawling à utiliser. Le modefastexplore les sites sans sitemap quatre fois plus vite, mais peut être moins précis et ne devrait pas être utilisé sur les sites fortement rendus via JavaScript.limit: Facultatif. Nombre maximal de pages à crawler.timeout: Facultatif. Délai d’expiration en millisecondes pour l’opération de crawling.
OutilFirecrawlScrapeWebsite
Exemple
Arguments
api_key: Optionnel. Spécifie la clé API Firecrawl. Par défaut, la valeur utilisée est la variable d’environnementFIRECRAWL_API_KEY.url: L’URL à scraper.page_options: Optionnel.onlyMainContent: Optionnel. Retourne uniquement le contenu principal de la page en excluant les en-têtes, barres de navigation, pieds de page, etc.includeHtml: Optionnel. Inclut le contenu HTML brut de la page. Renverra une cléhtmldans la réponse.
extractor_options: Optionnel. Options pour l’extraction, via LLM, d’informations structurées à partir du contenu de la page.mode: Le mode d’extraction à utiliser ; prend actuellement en chargellm-extraction.extractionPrompt: Optionnel. Un prompt décrivant quelles informations extraire de la page.extractionSchema: Optionnel. Le schéma des données à extraire.
timeout: Optionnel. Délai d’attente, en millisecondes, pour la requête.
Outil de recherche Firecrawl
Exemple
Arguments
api_key: Facultatif. Spécifie la clé d’API Firecrawl. La valeur par défaut est la variable d’environnementFIRECRAWL_API_KEY.query: La requête de recherche à utiliser.page_options: Facultatif. Options pour le formatage des résultats.onlyMainContent: Facultatif. Renvoyer uniquement le contenu principal de la page, en excluant les en-têtes, barres de navigation, pieds de page, etc.includeHtml: Facultatif. Inclure le contenu HTML brut de la page. Ajoute une cléhtmldans la réponse.fetchPageContent: Facultatif. Récupérer le contenu complet de la page.
search_options: Facultatif. Options pour contrôler le comportement du crawl.limit: Facultatif. Nombre maximal de pages à crawler.

