Firecrawl : une API open source pour rechercher, scraper et interagir avec le web
L'API pour rechercher, gratter et interagir avec le Web à grande échelle. 🔥
En bref
- De quoi s’agit-il ?
- Un dépôt TypeScript pour l'API de contexte Firecrawl, avec SDK, service hébergé et noyau AGPL-3.0.
- À qui s’adresse-t-il ?
- Firecrawl regroupe la recherche, le scraping et l'interaction navigateur dans une seule API, avec des SDK pour neuf langues et un noyau open source sous AGPL-3.0. Les chiffres de performance du README nécessitent une vérification indépendante, et la licence elle-même ne dit rien sur le support ou la sécurité.
- Puis-je l’utiliser commercialement ?
- Oui, sous conditions strictes. AGPL-3.0 est une licence à copyleft réseau : si des personnes utilisent une version modifiée via un réseau, par exemple comme service hébergé, vous devez leur proposer son code source sous la même licence.
- Est-il encore maintenu ?
- Oui. Le dépôt a reçu de nouveaux commits au cours des dernières 24 heures.
- En quel langage est-il écrit ?
- Principalement TypeScript, d’après les statistiques de langage de GitHub.
Ces réponses reposent sur les données GitHub du projet (dernière synchronisation le 15 septembre 2026) et sur notre analyse. Elles ne constituent pas un avis juridique.
ANALYSE OPEN SOURCE APPROFONDIE
Le cœur du dépôt : une API de contexte web
Le README commence par décrire Firecrawl comme l'API pour rechercher, scraper et interagir avec le web à grande échelle. Le dépôt est écrit en TypeScript et constitue le noyau open source derrière le service hébergé sur firecrawl.dev. Les métadonnées du dépôt enregistrent 161 296 étoiles et 9 103 forks, avec 476 issues ouvertes. Le README renvoie également à un playground et à une documentation, mais le dépôt lui-même est le code source de l'API et de ses SDK.
Opérations proposées par l'API et formats de sortie
Le README présente plusieurs opérations. La recherche renvoie le contenu complet des pages à partir des résultats. Le scraping convertit une URL en markdown, HTML, captures d'écran ou JSON structuré. L'interaction scrape d'abord une page, puis permet à un utilisateur ou à un prompt d'IA de cliquer, défiler, écrire, attendre et appuyer. Crawl collecte toutes les URLs d'un site en une seule requête. Map découvre les URLs d'un site. Batch Scrape traite des milliers d'URLs de manière asynchrone. Un endpoint Agent accepte un prompt et renvoie les données collectées ; il peut être limité à des URLs spécifiques ou utiliser un schéma pour une sortie structurée. Le README ne définit pas les limites exactes de ces opérations, comme la taille maximale d'un lot ou la profondeur de crawl.
Bibliothèques clientes et installation
Des SDK officiels existent pour Python, Node.js, Go, Java, Elixir, Rust, Ruby, .NET et PHP. Le README montre les commandes d'installation pour chacun : pip install firecrawl-py, npm install firecrawl, go get github.com/firecrawl/firecrawl/apps/go-sdk, gem install firecrawl-sdk, dotnet add package firecrawl-sdk, composer require firecrawl/firecrawl-sdk, ainsi que les déclarations de dépendances pour Java, Elixir et Rust. Les exemples Python, Node.js, Go, Rust, Ruby, .NET et PHP passent une clé API commençant par fc- ; l'exemple Java lit la clé depuis une variable d'environnement, et l'exemple Elixir n'affiche pas de clé API dans l'extrait. Le README indique que les SDK gèrent automatiquement le polling pour les opérations asynchrones comme Crawl et Batch Scrape.
Connexion aux agents et intégrations
Pour les agents d'IA, le README décrit une Skill qui peut être initialisée avec npx -y firecrawl-cli@latest init --all --browser, ainsi qu'une configuration de serveur MCP qui connecte un client compatible MCP à l'API Firecrawl. Il nomme Claude Code, Antigravity et OpenCode comme agents compatibles. La liste des intégrations inclut également Lovable, Zapier et n8n, ainsi qu'un dépôt Firecrawl Workflows. Le README ne décrit pas le comportement interne de ces intégrations au-delà des extraits de configuration.
Noyau open source, service hébergé et licence
Le dépôt est open source sous AGPL-3.0, et le README indique que les SDK et certains composants d'interface sont sous licence MIT. L'extrait de licence explique que l'AGPLv3 vise à rendre le code source modifié disponible lorsque le logiciel fonctionne sur un serveur réseau, et qu'il accorde le droit de copier, distribuer et modifier l'œuvre. Le README renvoie pour l'exécution locale à un guide de contribution et pour l'auto-hébergement à un guide séparé. Il mentionne également que la version cloud sur firecrawl.dev inclut des fonctionnalités supplémentaires, sans les énumérer. L'extrait de licence se concentre sur les droits de copie, de distribution et de modification ; il ne décrit aucun engagement de support ou de sécurité.
Affirmations de performance et points à vérifier
Le README fait deux affirmations de performance concrètes : 96% de couverture du web et une latence P95 de 3,4 secondes sur des millions de pages. Il renvoie à un article de blog pour les benchmarks, mais le dépôt lui-même ne contient pas de données de benchmark ni de test reproductible. Le README indique également que Firecrawl respecte robots.txt par défaut et place la responsabilité de suivre les politiques des sites sur les utilisateurs. Le README ne contient pas d'informations sur les mécanismes d'authentification au-delà de la clé API, sur les limites de débit ou sur la conservation des données. Ces détails doivent être vérifiés dans la documentation du service hébergé, qui est distincte de ce dépôt.
Conclusion éditoriale
Firecrawl regroupe la recherche, le scraping et l'interaction navigateur dans une seule API, avec des SDK pour neuf langues et un noyau open source sous AGPL-3.0. Les chiffres de performance du README nécessitent une vérification indépendante, et la licence elle-même ne dit rien sur le support ou la sécurité.
Notes de la communauté