Skip to main content
Image d’en-tête claire

Bienvenue sur Firecrawl

Firecrawl est un service d’API qui prend une URL, la explore et la convertit en markdown propre. Nous parcourons toutes les sous-pages accessibles et vous fournissons un markdown propre pour chacune. Aucun sitemap nécessaire.

Comment l’utiliser ?

Nous proposons une API simple à utiliser avec notre version hébergée. Vous trouverez l’aire de test et la documentation ici. Vous pouvez également auto‑héberger le backend si vous le souhaitez. Consultez les ressources suivantes pour démarrer : Auto‑hébergement : Pour auto‑héberger, consultez le guide ici.

Clé d’API

Pour utiliser l’API, vous devez vous inscrire sur Firecrawl et obtenir une clé d’API.

Exploration

Permet d’explorer une URL et toutes les sous-pages accessibles. Cela lance un travail d’exploration et renvoie un identifiant de travail pour vérifier l’état de l’exploration.

Installation

Utilisation

Si vous n’utilisez pas le SDK ou préférez utiliser un webhook ou une autre méthode de polling, vous pouvez définir wait_until_done sur false. Cela renverra un jobId. Avec cURL, /crawl renverra toujours un jobId que vous pourrez utiliser pour vérifier l’état du crawl.

Vérifier une tâche de crawl

Permet de vérifier l’état d’une tâche de crawl et d’en récupérer le résultat.

Réponse

Scraping

Pour récupérer le contenu d’une seule URL, utilisez la méthode scrape_url. Elle prend l’URL en paramètre et renvoie les données extraites sous forme de dictionnaire.

Réponse

Extraction

Avec l’extraction par LLM, vous pouvez facilement extraire des données structurées depuis n’importe quelle URL. Nous prenons en charge les schémas Pydantic pour vous simplifier la vie. Voici comment l’utiliser :

Contribution

Nous apprécions vos contributions ! Veuillez lire notre guide de contribution avant de soumettre une pull request.