Tools
Firecrawl
OpenClaw може використовувати Firecrawl трьома способами:
- як провайдер
web_search - як явні інструменти плагіна:
firecrawl_searchіfirecrawl_scrape - як резервний засіб видобування для
web_fetch
Це розміщена у хмарі служба видобування даних і пошуку, яка підтримує обхід захисту від ботів і кешування, що допомагає працювати із сайтами, які інтенсивно використовують JS, або сторінками, що блокують звичайні HTTP-запити.
Встановлення плагіна
Установіть офіційний плагін, а потім перезапустіть Gateway:
openclaw plugins install @openclaw/firecrawl-pluginopenclaw gateway restartДоступ без ключа та ключі API
Firecrawl реєструє два провайдери web_search:
- Пошук Firecrawl (
firecrawl) — використовує розміщений у хмарі API/v2/searchіз вашим ключем; автоматично виявляється за наявності ключа. - Пошук Firecrawl (безплатний) (
firecrawl-free) — використовує розміщений у хмарі початковий рівень без ключа; ключ API не потрібен. Він доступний лише за явним вибором і ніколи не вибирається автоматично, оскільки його вибір надсилає ваші пошукові запити до безплатного рівня Firecrawl.
Явно вибраний резервний засіб web_fetch Firecrawl також працює без ключа. Явні
інструменти firecrawl_search і firecrawl_scrape потребують ключа API. Додайте
FIRECRAWL_API_KEY до середовища Gateway або налаштуйте його для вищих лімітів.
Налаштування пошуку Firecrawl
{ tools: { web: { search: { provider: "firecrawl", }, }, }, plugins: { entries: { firecrawl: { enabled: true, config: { webSearch: { apiKey: "FIRECRAWL_API_KEY_HERE", baseUrl: "https://api.firecrawl.dev", }, }, }, }, },}Примітки:
- Вибір Firecrawl під час початкового налаштування або
openclaw configure --section webавтоматично вмикає встановлений плагін Firecrawl. - Виберіть Пошук Firecrawl (безплатний) під час початкового налаштування (або встановіть
provider: "firecrawl-free"), щоб працювати без ключа API. Провайдер Пошук Firecrawl із ключем надсилаєplugins.entries.firecrawl.config.webSearch.apiKeyабоFIRECRAWL_API_KEY. web_searchіз Firecrawl підтримуєqueryіcount.- Для специфічних елементів керування Firecrawl, як-от
sources,categoriesабо видобування даних із результатів, використовуйтеfirecrawl_search. baseUrlза замовчуванням використовує розміщений у хмарі Firecrawl за адресоюhttps://api.firecrawl.dev. Перевизначення для самостійно розміщених екземплярів дозволені лише для приватних або внутрішніх кінцевих точок; HTTP приймається лише для таких приватних цілей.FIRECRAWL_BASE_URL— спільна резервна змінна середовища для базових URL-адрес пошуку й видобування даних Firecrawl.- Стандартний час очікування пошукових запитів Firecrawl становить 30 секунд; параметр
timeoutSecondsінструментаfirecrawl_searchперевизначає його для окремого виклику.
Налаштування резервного засобу Firecrawl для web_fetch
{ tools: { web: { fetch: { provider: "firecrawl", // explicit selection enables keyless fallback }, }, }, plugins: { entries: { firecrawl: { enabled: true, config: { webFetch: { baseUrl: "https://api.firecrawl.dev", onlyMainContent: true, maxAgeMs: 172800000, timeoutSeconds: 60, }, }, }, }, },}Примітки:
- Явно вибраний резервний засіб
web_fetchFirecrawl працює без ключа API. Якщо його налаштовано, OpenClaw надсилаєplugins.entries.firecrawl.config.webFetch.apiKeyабоFIRECRAWL_API_KEYдля отримання вищих лімітів. - Вибір Firecrawl під час початкового налаштування або
openclaw configure --section webвмикає плагін і вибирає Firecrawl дляweb_fetch, якщо інший провайдер отримання даних ще не налаштований. firecrawl_scrapeпотребує ключа API.maxAgeMsвизначає допустимий вік кешованих результатів (мс). Значення за замовчуванням — 172,800,000 мс (2 дні).onlyMainContentза замовчуванням має значенняtrue;timeoutSecondsза замовчуванням має значення 60.- Застарілу конфігурацію
tools.web.fetch.firecrawl.*іtools.web.search.firecrawl.*автоматично переноситьopenclaw doctor --fix. - Перевизначення URL-адрес видобування даних і базових URL-адрес Firecrawl дотримуються того самого правила щодо розміщених у хмарі та приватних ресурсів, що й пошук: публічний хмарний трафік використовує
https://api.firecrawl.dev; перевизначення для самостійно розміщених екземплярів мають відповідати приватним або внутрішнім кінцевим точкам. firecrawl_scrapeвідхиляє очевидно приватні, зворотні, метадані та цільові URL-адреси, що не використовують HTTP(S), перш ніж передавати їх Firecrawl, відповідно до контракту безпеки цілейweb_fetchдля явних викликів видобування даних Firecrawl.
firecrawl_scrape повторно використовує ті самі налаштування plugins.entries.firecrawl.config.webFetch.* і змінні середовища, зокрема обов’язковий ключ API.
Самостійно розміщений Firecrawl
Установіть plugins.entries.firecrawl.config.webSearch.baseUrl, plugins.entries.firecrawl.config.webFetch.baseUrl або FIRECRAWL_BASE_URL, якщо ви запускаєте Firecrawl самостійно. OpenClaw приймає http:// лише для цілей у зворотному інтерфейсі, приватній мережі, .local, .internal або .localhost. Загальнодоступні власні хости відхиляються, щоб ключі API Firecrawl випадково не надсилалися довільним кінцевим точкам.
Інструменти плагіна Firecrawl
firecrawl_search
Використовуйте цей інструмент, коли замість універсального web_search потрібні специфічні елементи керування пошуком Firecrawl. Потребує ключа API.
Параметри:
querycount(1-100)sourcescategoriesincludeDomains/excludeDomains(лише імена хостів; взаємовиключні)tbs(часовий фільтр, наприкладqdr:d,qdr:w,sbd:1)locationіcountry(географічне націлювання)scrapeResultstimeoutSeconds
firecrawl_scrape
Використовуйте цей інструмент для сторінок, які інтенсивно використовують JS або захищені від ботів, коли звичайний web_fetch працює ненадійно.
Параметри:
urlextractModemaxCharsonlyMainContentmaxAgeMsproxystoreInCachetimeoutSeconds
Прихований режим і обхід захисту від ботів
firecrawl_scrape і резервний засіб Firecrawl для web_fetch за замовчуванням використовують proxy: "auto" разом із storeInCache: true, якщо викликач не перевизначить ці параметри. firecrawl_search і провайдер Firecrawl для web_search не мають елементів керування proxy/storeInCache; прихований режим проксі застосовується лише до запитів видобування та отримання даних.
Режим proxy Firecrawl керує обходом захисту від ботів (basic, stealth або auto). auto повторює спробу з прихованими проксі, якщо базова спроба завершується невдало, що може витрачати більше кредитів, ніж видобування даних лише в базовому режимі.
Як web_fetch використовує Firecrawl
Порядок видобування даних web_fetch:
- Readability (локально)
- Налаштований провайдер отримання даних, як-от Firecrawl (якщо його вибрано або автоматично виявлено за налаштованими обліковими даними)
- Базове очищення HTML (останній резервний варіант)
Параметр вибору — tools.web.fetch.provider. Якщо його пропустити, OpenClaw автоматично виявляє першого готового провайдера отримання вебданих за доступними обліковими даними. Офіційний плагін Firecrawl надає цей резервний засіб.
Пов’язані матеріали
- Огляд вебпошуку -- усі провайдери й автоматичне виявлення
- Отримання вебданих -- інструмент web_fetch із резервним засобом Firecrawl
- Tavily -- інструменти пошуку й видобування даних