Tools
Firecrawl
OpenClaw peut utiliser Firecrawl de trois façons :
- comme fournisseur de
web_search - comme outils de plugin explicites :
firecrawl_searchetfirecrawl_scrape - comme extracteur de secours pour
web_fetch
Il s’agit d’un service hébergé d’extraction et de recherche qui prend en charge le contournement des protections antibot et la mise en cache, ce qui est utile pour les sites qui utilisent beaucoup JavaScript ou les pages qui bloquent les requêtes HTTP ordinaires.
Installer le plugin
Installez le plugin officiel, puis redémarrez Gateway :
openclaw plugins install @openclaw/firecrawl-pluginopenclaw gateway restartAccès sans clé et clés API
Firecrawl enregistre deux fournisseurs de web_search :
- Recherche Firecrawl (
firecrawl) — utilise l’API/v2/searchhébergée avec votre clé ; détecté automatiquement lorsqu’une clé est présente. - Recherche Firecrawl (gratuite) (
firecrawl-free) — utilise l’offre de démarrage hébergée sans clé ; aucune clé API n’est requise. Cette option est disponible uniquement sur activation explicite et n’est jamais sélectionnée automatiquement, car sa sélection envoie vos requêtes de recherche à l’offre gratuite de Firecrawl.
La solution de secours Firecrawl web_fetch sélectionnée explicitement fonctionne également sans clé. Les
outils explicites firecrawl_search et firecrawl_scrape nécessitent une clé API. Ajoutez
FIRECRAWL_API_KEY à l’environnement du Gateway ou configurez-la pour bénéficier de limites plus élevées.
Configurer la recherche Firecrawl
{ tools: { web: { search: { provider: "firecrawl", }, }, }, plugins: { entries: { firecrawl: { enabled: true, config: { webSearch: { apiKey: "FIRECRAWL_API_KEY_HERE", baseUrl: "https://api.firecrawl.dev", }, }, }, }, },}Remarques :
- Le choix de Firecrawl lors de l’intégration initiale ou dans
openclaw configure --section webactive automatiquement le plugin Firecrawl installé. - Choisissez Recherche Firecrawl (gratuite) lors de l’intégration initiale (ou définissez
provider: "firecrawl-free") pour fonctionner sans clé API. Le fournisseur Recherche Firecrawl avec clé envoieplugins.entries.firecrawl.config.webSearch.apiKeyouFIRECRAWL_API_KEY. web_searchavec Firecrawl prend en chargequeryetcount.- Pour les contrôles propres à Firecrawl, tels que
sources,categoriesou l’extraction des résultats, utilisezfirecrawl_search. baseUrlutilise par défaut Firecrawl hébergé à l’adressehttps://api.firecrawl.dev. Les substitutions auto-hébergées ne sont autorisées que pour les points de terminaison privés/internes ; HTTP n’est accepté que pour ces cibles privées.FIRECRAWL_BASE_URLest la variable d’environnement de secours partagée pour les URL de base de recherche et d’extraction Firecrawl.- Les requêtes de recherche Firecrawl ont par défaut un délai d’expiration de 30 secondes ; le paramètre
timeoutSecondsdefirecrawl_searchle remplace pour chaque appel.
Configurer la solution de secours Firecrawl pour web_fetch
{ tools: { web: { fetch: { provider: "firecrawl", // explicit selection enables keyless fallback }, }, }, plugins: { entries: { firecrawl: { enabled: true, config: { webFetch: { baseUrl: "https://api.firecrawl.dev", onlyMainContent: true, maxAgeMs: 172800000, timeoutSeconds: 60, }, }, }, }, },}Remarques :
- La solution de secours Firecrawl
web_fetchsélectionnée explicitement fonctionne sans clé API. Lorsqu’elle est configurée, OpenClaw envoieplugins.entries.firecrawl.config.webFetch.apiKeyouFIRECRAWL_API_KEYpour bénéficier de limites plus élevées. - Le choix de Firecrawl lors de l’intégration initiale ou dans
openclaw configure --section webactive le plugin et sélectionne Firecrawl pourweb_fetch, sauf si un autre fournisseur de récupération est déjà configuré. firecrawl_scrapenécessite une clé API.maxAgeMscontrôle l’ancienneté maximale des résultats mis en cache (ms). La valeur par défaut est de 172 800 000 ms (2 jours).onlyMainContentutilise par défauttrue;timeoutSecondsutilise par défaut 60.- L’ancienne configuration
tools.web.fetch.firecrawl.*ettools.web.search.firecrawl.*est automatiquement migrée paropenclaw doctor --fix. - Les substitutions des URL d’extraction/de base Firecrawl suivent la même règle d’hébergement/de confidentialité que la recherche : le trafic hébergé public utilise
https://api.firecrawl.dev; les substitutions auto-hébergées doivent se résoudre vers des points de terminaison privés/internes. firecrawl_scraperejette les URL cibles manifestement privées, de bouclage, de métadonnées et non HTTP(S) avant de les transmettre à Firecrawl, conformément au contrat de sécurité des cibles deweb_fetchpour les appels d’extraction Firecrawl explicites.
firecrawl_scrape réutilise les mêmes paramètres plugins.entries.firecrawl.config.webFetch.* et variables d’environnement, y compris la clé API requise.
Firecrawl auto-hébergé
Définissez plugins.entries.firecrawl.config.webSearch.baseUrl, plugins.entries.firecrawl.config.webFetch.baseUrl ou FIRECRAWL_BASE_URL lorsque vous exécutez Firecrawl vous-même. OpenClaw accepte http:// uniquement pour les cibles de bouclage, de réseau privé, .local, .internal ou .localhost. Les hôtes publics personnalisés sont rejetés afin d’éviter que les clés API Firecrawl ne soient envoyées accidentellement à des points de terminaison arbitraires.
Outils du plugin Firecrawl
firecrawl_search
Utilisez cet outil lorsque vous souhaitez employer les contrôles de recherche propres à Firecrawl plutôt que le contrôle générique web_search. Nécessite une clé API.
Paramètres :
querycount(1-100)sourcescategoriesincludeDomains/excludeDomains(noms d’hôte uniquement ; mutuellement exclusifs)tbs(filtre temporel, par exempleqdr:d,qdr:w,sbd:1)locationetcountry(ciblage géographique)scrapeResultstimeoutSeconds
firecrawl_scrape
Utilisez cet outil pour les pages qui utilisent beaucoup JavaScript ou sont protégées contre les bots, lorsque la récupération web_fetch ordinaire est insuffisante.
Paramètres :
urlextractModemaxCharsonlyMainContentmaxAgeMsproxystoreInCachetimeoutSeconds
Mode furtif / contournement des protections antibot
firecrawl_scrape et la solution de secours Firecrawl web_fetch utilisent par défaut proxy: "auto" avec storeInCache: true, sauf si l’appelant remplace ces paramètres. firecrawl_search et le fournisseur Firecrawl web_search ne disposent pas de contrôles proxy/storeInCache ; le mode proxy furtif s’applique uniquement aux requêtes d’extraction/de récupération.
Le mode proxy de Firecrawl contrôle le contournement des protections antibot (basic, stealth ou auto). auto réessaie avec des proxys furtifs si une tentative de base échoue, ce qui peut consommer davantage de crédits qu’une extraction limitée au mode de base.
Comment web_fetch utilise Firecrawl
Ordre d’extraction de web_fetch :
- Readability (local)
- Fournisseur de récupération configuré, tel que Firecrawl (lorsqu’il est sélectionné ou automatiquement détecté à partir des identifiants configurés)
- Nettoyage HTML de base (dernière solution de secours)
Le paramètre de sélection est tools.web.fetch.provider. Si vous l’omettez, OpenClaw détecte automatiquement le premier fournisseur de récupération Web prêt à l’emploi à partir des identifiants disponibles. Le plugin Firecrawl officiel fournit cette solution de secours.
Voir aussi
- Présentation de la recherche Web -- tous les fournisseurs et la détection automatique
- Récupération Web -- outil web_fetch avec solution de secours Firecrawl
- Tavily -- outils de recherche et d’extraction