- làm nhà cung cấp
web_search - làm các công cụ plugin tường minh:
firecrawl_searchvàfirecrawl_scrape - làm trình trích xuất dự phòng cho
web_fetch
Cài đặt plugin
Cài đặt plugin chính thức, sau đó khởi động lại Gateway:Truy cập không cần khóa và khóa API
Firecrawl đăng ký hai nhà cung cấpweb_search:
- Firecrawl Search (
firecrawl) — sử dụng API/v2/searchđược lưu trữ cùng với khóa của bạn; được tự động phát hiện khi có khóa. - Firecrawl Search (Free) (
firecrawl-free) — sử dụng gói khởi đầu không cần khóa được lưu trữ, không yêu cầu khóa API. Gói này chỉ được bật khi chủ động chọn và không bao giờ được tự động chọn, vì việc chọn gói này sẽ gửi các truy vấn tìm kiếm của bạn đến gói miễn phí của Firecrawl.
web_fetch của Firecrawl được chọn tường minh cũng không cần khóa. Các
công cụ firecrawl_search và firecrawl_scrape tường minh yêu cầu khóa API. Thêm
FIRECRAWL_API_KEY vào môi trường gateway hoặc cấu hình khóa này để có giới hạn cao hơn.
Cấu hình tìm kiếm Firecrawl
- Việc chọn Firecrawl trong quy trình thiết lập ban đầu hoặc
openclaw configure --section websẽ tự động bật plugin Firecrawl đã cài đặt. - Chọn Firecrawl Search (Free) trong quy trình thiết lập ban đầu (hoặc đặt
provider: "firecrawl-free") để chạy không cần khóa API. Nhà cung cấp Firecrawl Search có khóa sẽ gửiplugins.entries.firecrawl.config.webSearch.apiKeyhoặcFIRECRAWL_API_KEY. web_searchvới Firecrawl hỗ trợqueryvàcount.- Để sử dụng các tùy chọn điều khiển dành riêng cho Firecrawl như
sources,categorieshoặc thu thập dữ liệu từ kết quả, hãy dùngfirecrawl_search. baseUrlmặc định sử dụng Firecrawl được lưu trữ tạihttps://api.firecrawl.dev. Chỉ được phép ghi đè bằng dịch vụ tự lưu trữ đối với các điểm cuối riêng tư/nội bộ; HTTP chỉ được chấp nhận cho các đích riêng tư đó.FIRECRAWL_BASE_URLlà biến môi trường dự phòng dùng chung cho URL cơ sở của thao tác tìm kiếm và thu thập dữ liệu Firecrawl.- Các yêu cầu tìm kiếm Firecrawl mặc định có thời gian chờ là 30 giây; tham số
timeoutSecondscủafirecrawl_searchsẽ ghi đè giá trị này cho từng lần gọi.
Cấu hình phương án dự phòng Firecrawl cho web_fetch
- Phương án dự phòng
web_fetchcủa Firecrawl được chọn tường minh hoạt động mà không cần khóa API. Khi được cấu hình, OpenClaw gửiplugins.entries.firecrawl.config.webFetch.apiKeyhoặcFIRECRAWL_API_KEYđể có giới hạn cao hơn. - Việc chọn Firecrawl trong quá trình thiết lập ban đầu hoặc
openclaw configure --section websẽ bật plugin và chọn Firecrawl choweb_fetch, trừ khi đã cấu hình một nhà cung cấp tìm nạp khác. firecrawl_scrapeyêu cầu khóa API.maxAgeMskiểm soát độ cũ tối đa của kết quả được lưu vào bộ nhớ đệm (ms). Giá trị mặc định là 172,800,000 ms (2 ngày).onlyMainContentmặc định làtrue;timeoutSecondsmặc định là 60.- Cấu hình
tools.web.fetch.firecrawl.*vàtools.web.search.firecrawl.*cũ đượcopenclaw doctor --fixtự động di chuyển. - Các giá trị ghi đè URL cơ sở/thu thập dữ liệu của Firecrawl tuân theo cùng quy tắc dịch vụ được lưu trữ/riêng tư như tìm kiếm: lưu lượng được lưu trữ công khai sử dụng
https://api.firecrawl.dev; các giá trị ghi đè tự lưu trữ phải phân giải thành điểm cuối riêng tư/nội bộ. firecrawl_scrapetừ chối các URL đích rõ ràng là riêng tư, loopback, siêu dữ liệu và không phải HTTP(S) trước khi chuyển tiếp chúng đến Firecrawl, phù hợp với hợp đồng an toàn đíchweb_fetchdành cho các lệnh gọi thu thập dữ liệu Firecrawl tường minh.
firecrawl_scrape tái sử dụng cùng các thiết lập plugins.entries.firecrawl.config.webFetch.* và biến môi trường, bao gồm khóa API bắt buộc của nó.
Firecrawl tự lưu trữ
Đặtplugins.entries.firecrawl.config.webSearch.baseUrl, plugins.entries.firecrawl.config.webFetch.baseUrl hoặc FIRECRAWL_BASE_URL khi bạn tự vận hành Firecrawl. OpenClaw chỉ chấp nhận http:// cho các đích loopback, mạng riêng, .local, .internal hoặc .localhost. Các máy chủ tùy chỉnh công khai bị từ chối để tránh vô tình gửi khóa API Firecrawl đến các điểm cuối tùy ý.
Công cụ plugin Firecrawl
firecrawl_search
Sử dụng công cụ này khi bạn muốn các tùy chọn điều khiển tìm kiếm dành riêng cho Firecrawl thay vì web_search chung. Yêu cầu khóa API.
Tham số:
querycount(1-100)sourcescategoriesincludeDomains/excludeDomains(chỉ tên máy chủ; loại trừ lẫn nhau)tbs(bộ lọc thời gian, ví dụqdr:d,qdr:w,sbd:1)locationvàcountry(nhắm mục tiêu theo địa lý)scrapeResultstimeoutSeconds
firecrawl_scrape
Sử dụng công cụ này cho các trang phụ thuộc nhiều vào JS hoặc được bảo vệ chống bot mà web_fetch thông thường xử lý không hiệu quả.
Tham số:
urlextractModemaxCharsonlyMainContentmaxAgeMsproxystoreInCachetimeoutSeconds
Chế độ ẩn mình / vượt qua cơ chế chống bot
firecrawl_scrape và phương án dự phòng Firecrawl web_fetch mặc định sử dụng proxy: "auto" cùng với storeInCache: true, trừ khi bên gọi ghi đè các tham số đó. firecrawl_search và nhà cung cấp Firecrawl web_search không có các tùy chọn điều khiển proxy/storeInCache; chế độ proxy ẩn mình chỉ áp dụng cho các yêu cầu thu thập/tìm nạp dữ liệu.
Chế độ proxy của Firecrawl kiểm soát việc vượt qua cơ chế chống bot (basic, stealth hoặc auto). auto thử lại bằng proxy ẩn mình nếu lần thử cơ bản thất bại, việc này có thể sử dụng nhiều tín dụng hơn so với chỉ thu thập dữ liệu cơ bản.
Cách web_fetch sử dụng Firecrawl
Thứ tự trích xuất của web_fetch:
- Readability (cục bộ)
- Nhà cung cấp tìm nạp đã cấu hình, chẳng hạn như Firecrawl (khi được chọn hoặc tự động phát hiện từ thông tin xác thực đã cấu hình)
- Dọn dẹp HTML cơ bản (phương án dự phòng cuối cùng)
tools.web.fetch.provider. Nếu bỏ qua tùy chọn này, OpenClaw sẽ tự động phát hiện nhà cung cấp tìm nạp web sẵn sàng đầu tiên từ thông tin xác thực hiện có. Plugin Firecrawl chính thức cung cấp phương án dự phòng đó.
Liên quan
- Tổng quan về Tìm kiếm web — tất cả nhà cung cấp và cơ chế tự động phát hiện
- Tìm nạp web — công cụ web_fetch với phương án dự phòng Firecrawl
- Tavily — công cụ tìm kiếm + trích xuất