Firecrawl
抓取或搜索网页
配置
抓取
操作
抓取
API 密钥*
••••••••
网站 URL*
输入网站 URL
仅主要内容
Disabled
抓取 (
firecrawl_scrape)从网页提取结构化内容,并提供全面的元数据支持。将内容转换为 Markdown 或 HTML,同时捕获 SEO 元数据、Open Graph 标签和页面信息。
输入
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
url | string | 是 | 要抓取内容的 URL |
apiKey | string | 是 | Firecrawl API 密钥 |
输出
| 参数 | 类型 | 说明 |
|---|---|---|
markdown | string | Markdown 格式的页面内容 |
html | string | 页面的原始 HTML 内容 |
metadata | object | 页面元数据,包括 SEO 和 Open Graph 信息 |
搜索
操作
搜索
API 密钥*
••••••••
搜索查询*
输入搜索查询
搜索 (
firecrawl_search)使用 Firecrawl 搜索网络信息
输入
| 参数 | 类型 | 是否必需 | 描述 |
|---|---|---|---|
query | string | 是 | 要使用的搜索查询 |
apiKey | string | 是 | Firecrawl API 密钥 |
输出
| 参数 | 类型 | 描述 |
|---|---|---|
data | array | 搜索结果数据 |
warning | string | 搜索操作中的警告消息 |
爬取
操作
爬取
API 密钥*
••••••••
网站 URL*
输入网站 URL
页面限制
100
爬取 (
firecrawl_crawl)爬取整个网站,并从所有可访问页面提取结构化内容
输入
| 参数 | 类型 | 是否必填 | 描述 |
|---|---|---|---|
url | string | 是 | 要爬取的网站 URL |
limit | number | 否 | 要爬取的最大页面数 (默认值:100) |
onlyMainContent | boolean | 否 | 仅从页面提取主要内容 |
apiKey | string | 是 | Firecrawl API 密钥 |
输出
| 参数 | 类型 | 描述 |
|---|---|---|
pages | array | 抓取页面的数组,包含其内容和元数据 |
total | number | 抓取期间发现的页面总数 |
creditsUsed | number | 抓取操作消耗的积分数量 |
使用说明
将 Firecrawl 集成到工作流中。可以搜索、抓取或爬取网站。
备注
- 类别:
tools - 类型:
firecrawl