Tools
Firecrawl
OpenClaw kann Firecrawl auf drei Arten verwenden:
- als
web_search-Provider - als explizite Plugin-Tools:
firecrawl_searchundfirecrawl_scrape - als Fallback-Extraktor für
web_fetch
Es handelt sich um einen gehosteten Extraktions- und Suchdienst, der Bot-Umgehung und Caching unterstützt. Dies hilft bei stark JavaScript-basierten Websites oder Seiten, die einfache HTTP-Abrufe blockieren.
Plugin installieren
Installieren Sie das offizielle Plugin und starten Sie anschließend den Gateway neu:
openclaw plugins install @openclaw/firecrawl-pluginopenclaw gateway restartSchlüsselloser Zugriff und API-Schlüssel
Firecrawl registriert zwei web_search-Provider:
- Firecrawl Search (
firecrawl) — verwendet die gehostete/v2/search-API mit Ihrem Schlüssel; wird automatisch erkannt, wenn ein Schlüssel vorhanden ist. - Firecrawl Search (Free) (
firecrawl-free) — verwendet den gehosteten schlüssellosen Einstiegstarif, kein API-Schlüssel erforderlich. Er ist nur nach ausdrücklicher Aktivierung verfügbar und wird nie automatisch ausgewählt, da bei seiner Auswahl Ihre Suchanfragen an den kostenlosen Tarif von Firecrawl gesendet werden.
Der explizit ausgewählte Firecrawl-Fallback web_fetch ist ebenfalls schlüssellos. Die
expliziten Tools firecrawl_search und firecrawl_scrape erfordern einen API-Schlüssel. Fügen Sie
FIRECRAWL_API_KEY zur Gateway-Umgebung hinzu oder konfigurieren Sie ihn für höhere Limits.
Firecrawl-Suche konfigurieren
{ tools: { web: { search: { provider: "firecrawl", }, }, }, plugins: { entries: { firecrawl: { enabled: true, config: { webSearch: { apiKey: "FIRECRAWL_API_KEY_HERE", baseUrl: "https://api.firecrawl.dev", }, }, }, }, },}Hinweise:
- Wenn Sie Firecrawl beim Onboarding oder in
openclaw configure --section webauswählen, wird das installierte Firecrawl-Plugin automatisch aktiviert. - Wählen Sie beim Onboarding Firecrawl Search (Free) aus (oder legen Sie
provider: "firecrawl-free"fest), um den Dienst schlüssellos und ohne API-Schlüssel zu verwenden. Der Provider Firecrawl Search mit Schlüssel sendetplugins.entries.firecrawl.config.webSearch.apiKeyoderFIRECRAWL_API_KEY. web_searchmit Firecrawl unterstütztqueryundcount.- Verwenden Sie für Firecrawl-spezifische Einstellungen wie
sources,categoriesoder das Scraping von Ergebnissenfirecrawl_search. baseUrlverwendet standardmäßig das gehostete Firecrawl unterhttps://api.firecrawl.dev. Selbst gehostete Überschreibungen sind nur für private/interne Endpunkte zulässig; HTTP wird nur für diese privaten Ziele akzeptiert.FIRECRAWL_BASE_URList der gemeinsame Umgebungsvariablen-Fallback für die Basis-URLs der Firecrawl-Suche und des Scrapings.- Firecrawl-Suchanfragen haben standardmäßig ein Zeitlimit von 30 Sekunden; der Parameter
timeoutSecondsvonfirecrawl_searchüberschreibt es pro Aufruf.
Firecrawl-Fallback für web_fetch konfigurieren
{ tools: { web: { fetch: { provider: "firecrawl", // explicit selection enables keyless fallback }, }, }, plugins: { entries: { firecrawl: { enabled: true, config: { webFetch: { baseUrl: "https://api.firecrawl.dev", onlyMainContent: true, maxAgeMs: 172800000, timeoutSeconds: 60, }, }, }, }, },}Hinweise:
- Der explizit ausgewählte Firecrawl-Fallback
web_fetchfunktioniert ohne API-Schlüssel. Wenn er konfiguriert ist, sendet OpenClaw für höhere Limitsplugins.entries.firecrawl.config.webFetch.apiKeyoderFIRECRAWL_API_KEY. - Wenn Sie Firecrawl während des Onboardings oder in
openclaw configure --section webauswählen, wird das Plugin aktiviert und Firecrawl fürweb_fetchausgewählt, sofern nicht bereits ein anderer Abruf-Provider konfiguriert ist. firecrawl_scrapeerfordert einen API-Schlüssel.maxAgeMssteuert, wie alt zwischengespeicherte Ergebnisse sein dürfen (ms). Der Standardwert beträgt 172,800,000 ms (2 Tage).onlyMainContentverwendet standardmäßigtrue;timeoutSecondsverwendet standardmäßig 60.- Die veraltete Konfiguration
tools.web.fetch.firecrawl.*undtools.web.search.firecrawl.*wird vonopenclaw doctor --fixautomatisch migriert. - Überschreibungen der Firecrawl-Scraping-/Basis-URL unterliegen derselben Regel für gehostete/private Endpunkte wie die Suche: Öffentlicher gehosteter Datenverkehr verwendet
https://api.firecrawl.dev; selbst gehostete Überschreibungen müssen auf private/interne Endpunkte aufgelöst werden. firecrawl_scrapeweist offensichtlich private, Loopback-, Metadaten- und Nicht-HTTP(S)-Ziel-URLs zurück, bevor sie an Firecrawl weitergeleitet werden. Dies entspricht dem Zielsicherheitsvertrag vonweb_fetchfür explizite Firecrawl-Scraping-Aufrufe.
firecrawl_scrape verwendet dieselben plugins.entries.firecrawl.config.webFetch.*-Einstellungen und Umgebungsvariablen einschließlich des erforderlichen API-Schlüssels.
Selbst gehostetes Firecrawl
Legen Sie plugins.entries.firecrawl.config.webSearch.baseUrl, plugins.entries.firecrawl.config.webFetch.baseUrl oder FIRECRAWL_BASE_URL fest, wenn Sie Firecrawl selbst betreiben. OpenClaw akzeptiert http:// nur für Loopback-, private Netzwerk-, .local-, .internal- oder .localhost-Ziele. Benutzerdefinierte öffentliche Hosts werden abgelehnt, damit Firecrawl-API-Schlüssel nicht versehentlich an beliebige Endpunkte gesendet werden.
Firecrawl-Plugin-Tools
firecrawl_search
Verwenden Sie dieses Tool, wenn Sie statt des generischen web_search Firecrawl-spezifische Sucheinstellungen benötigen. Erfordert einen API-Schlüssel.
Parameter:
querycount(1-100)sourcescategoriesincludeDomains/excludeDomains(nur Hostnamen; schließen sich gegenseitig aus)tbs(Zeitfilter, zum Beispielqdr:d,qdr:w,sbd:1)locationundcountry(Geo-Targeting)scrapeResultstimeoutSeconds
firecrawl_scrape
Verwenden Sie dieses Tool für stark JavaScript-basierte oder botgeschützte Seiten, bei denen der einfache web_fetch unzureichend ist.
Parameter:
urlextractModemaxCharsonlyMainContentmaxAgeMsproxystoreInCachetimeoutSeconds
Stealth-/Bot-Umgehung
firecrawl_scrape und der Firecrawl-Fallback web_fetch verwenden standardmäßig proxy: "auto" zusammen mit storeInCache: true, sofern der Aufrufer diese Parameter nicht überschreibt. firecrawl_search und der Firecrawl-Provider web_search verfügen über keine proxy-/storeInCache-Einstellungen; der Stealth-Proxy-Modus gilt nur für Scraping-/Abrufanfragen.
Der Modus proxy von Firecrawl steuert die Bot-Umgehung (basic, stealth oder auto). auto versucht es erneut mit Stealth-Proxys, wenn ein einfacher Versuch fehlschlägt. Dies kann mehr Credits verbrauchen als ausschließlich einfaches Scraping.
So verwendet web_fetch Firecrawl
Extraktionsreihenfolge von web_fetch:
- Readability (lokal)
- Konfigurierter Abruf-Provider, beispielsweise Firecrawl (wenn ausgewählt oder anhand konfigurierter Anmeldedaten automatisch erkannt)
- Einfache HTML-Bereinigung (letzter Fallback)
Die Auswahloption ist tools.web.fetch.provider. Wenn Sie sie weglassen, erkennt OpenClaw anhand der verfügbaren Anmeldedaten automatisch den ersten einsatzbereiten Web-Abruf-Provider. Das offizielle Firecrawl-Plugin stellt diesen Fallback bereit.
Verwandte Themen
- Übersicht zur Websuche -- alle Provider und automatische Erkennung
- Webabruf -- web_fetch-Tool mit Firecrawl-Fallback
- Tavily -- Such- und Extraktionstools