Firecrawl

抓取或搜索网页

配置

抓取

操作
抓取
API 密钥*
••••••••
网站 URL*
输入网站 URL
仅主要内容
Disabled
抓取 (firecrawl_scrape)

从网页提取结构化内容,并提供全面的元数据支持。将内容转换为 Markdown 或 HTML,同时捕获 SEO 元数据、Open Graph 标签和页面信息。

输入
参数类型必填说明
urlstring是要抓取内容的 URL
apiKeystring是Firecrawl API 密钥
输出
参数类型说明
markdownstringMarkdown 格式的页面内容
htmlstring页面的原始 HTML 内容
metadataobject页面元数据,包括 SEO 和 Open Graph 信息

搜索

操作
搜索
API 密钥*
••••••••
搜索查询*
输入搜索查询
搜索 (firecrawl_search)

使用 Firecrawl 搜索网络信息

输入
参数类型是否必需描述
querystring是要使用的搜索查询
apiKeystring是Firecrawl API 密钥
输出
参数类型描述
dataarray搜索结果数据
warningstring搜索操作中的警告消息

爬取

操作
爬取
API 密钥*
••••••••
网站 URL*
输入网站 URL
页面限制
100
爬取 (firecrawl_crawl)

爬取整个网站,并从所有可访问页面提取结构化内容

输入
参数类型是否必填描述
urlstring是要爬取的网站 URL
limitnumber否要爬取的最大页面数 (默认值:100)
onlyMainContentboolean否仅从页面提取主要内容
apiKeystring是Firecrawl API 密钥
输出
参数类型描述
pagesarray抓取页面的数组,包含其内容和元数据
totalnumber抓取期间发现的页面总数
creditsUsednumber抓取操作消耗的积分数量

使用说明

将 Firecrawl 集成到工作流中。可以搜索、抓取或爬取网站。

备注

  • 类别:tools
  • 类型:firecrawl