Skip to main content
POST
抓取单个页面并以 markdown 返回其正文内容。
抓取一个 URL,返回它的正文 markdown。urlproxy 都必填 —— 计量档位下 proxy 必须是 basic —— formats 选择输出格式。返回 successdata,其中 markdown 是正文,metadata 是一大坨页面元信息(og: 与 twitter: 标签、statusCodesourceURLlanguage)。实测抓 1 个页面约 10 秒。⚠️ URL 必须是 HTTPS,且不能指向 PDF,两者都是直接拒绝而不是尽力而为。有 URL 又要正文时用它。多个 URL 一起处理用 post_firecrawl_batch_scrape(后台任务),少量且要立刻拿到用 post_tavily_extract(同步)。要先找出 URL,用 post_firecrawl_map

授权

Authorization
string
header
必填

Bearer authentication header of the form Bearer <token>, where <token> is your auth token.

请求体

application/json
url
string<uri>
必填

要抓取的 HTTPS URL。计量模式下不支持 PDF URL。

示例:

"https://docs.firecrawl.dev"

proxy
enum<string>
必填

代理层级。在计量模式下必须显式设为 "basic"。

可用选项:
basic
示例:

"basic"

formats
enum<string>[]

可选的输出格式。若提供,其值必须正好是 ["markdown"]。

可用选项:
markdown
示例:

响应

200 - application/json

抓取成功完成。

success
boolean

抓取成功时为 true。

data
object
creditsUsed
integer

该请求消耗的 Firecrawl credits(每页 1 个)。