抓取单个页面并以 markdown 返回其正文内容。
curl --request POST \
--url https://api.aisa.one/apis/v1/firecrawl/scrape \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"url": "https://docs.firecrawl.dev",
"proxy": "basic",
"formats": [
"markdown"
]
}
'import requests
url = "https://api.aisa.one/apis/v1/firecrawl/scrape"
payload = {
"url": "https://docs.firecrawl.dev",
"proxy": "basic",
"formats": ["markdown"]
}
headers = {
"Authorization": "Bearer <token>",
"Content-Type": "application/json"
}
response = requests.post(url, json=payload, headers=headers)
print(response.text)const options = {
method: 'POST',
headers: {Authorization: 'Bearer <token>', 'Content-Type': 'application/json'},
body: JSON.stringify({url: 'https://docs.firecrawl.dev', proxy: 'basic', formats: ['markdown']})
};
fetch('https://api.aisa.one/apis/v1/firecrawl/scrape', options)
.then(res => res.json())
.then(res => console.log(res))
.catch(err => console.error(err));<?php
$curl = curl_init();
curl_setopt_array($curl, [
CURLOPT_URL => "https://api.aisa.one/apis/v1/firecrawl/scrape",
CURLOPT_RETURNTRANSFER => true,
CURLOPT_ENCODING => "",
CURLOPT_MAXREDIRS => 10,
CURLOPT_TIMEOUT => 30,
CURLOPT_HTTP_VERSION => CURL_HTTP_VERSION_1_1,
CURLOPT_CUSTOMREQUEST => "POST",
CURLOPT_POSTFIELDS => json_encode([
'url' => 'https://docs.firecrawl.dev',
'proxy' => 'basic',
'formats' => [
'markdown'
]
]),
CURLOPT_HTTPHEADER => [
"Authorization: Bearer <token>",
"Content-Type: application/json"
],
]);
$response = curl_exec($curl);
$err = curl_error($curl);
curl_close($curl);
if ($err) {
echo "cURL Error #:" . $err;
} else {
echo $response;
}package main
import (
"fmt"
"strings"
"net/http"
"io"
)
func main() {
url := "https://api.aisa.one/apis/v1/firecrawl/scrape"
payload := strings.NewReader("{\n \"url\": \"https://docs.firecrawl.dev\",\n \"proxy\": \"basic\",\n \"formats\": [\n \"markdown\"\n ]\n}")
req, _ := http.NewRequest("POST", url, payload)
req.Header.Add("Authorization", "Bearer <token>")
req.Header.Add("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)
defer res.Body.Close()
body, _ := io.ReadAll(res.Body)
fmt.Println(string(body))
}HttpResponse<String> response = Unirest.post("https://api.aisa.one/apis/v1/firecrawl/scrape")
.header("Authorization", "Bearer <token>")
.header("Content-Type", "application/json")
.body("{\n \"url\": \"https://docs.firecrawl.dev\",\n \"proxy\": \"basic\",\n \"formats\": [\n \"markdown\"\n ]\n}")
.asString();require 'uri'
require 'net/http'
url = URI("https://api.aisa.one/apis/v1/firecrawl/scrape")
http = Net::HTTP.new(url.host, url.port)
http.use_ssl = true
request = Net::HTTP::Post.new(url)
request["Authorization"] = 'Bearer <token>'
request["Content-Type"] = 'application/json'
request.body = "{\n \"url\": \"https://docs.firecrawl.dev\",\n \"proxy\": \"basic\",\n \"formats\": [\n \"markdown\"\n ]\n}"
response = http.request(request)
puts response.read_body{
"success": true,
"data": {
"markdown": "<string>",
"metadata": {
"title": "<string>",
"description": "<string>",
"sourceURL": "<string>",
"statusCode": 123
}
},
"creditsUsed": 123
}搜索 API
Firecrawl 抓取
抓取单个网页并以干净的 markdown 返回其正文内容——无需你自己解析 HTML。
POST
https://api.aisa.one/apis/v1
/
firecrawl
/
scrape
抓取单个页面并以 markdown 返回其正文内容。
curl --request POST \
--url https://api.aisa.one/apis/v1/firecrawl/scrape \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"url": "https://docs.firecrawl.dev",
"proxy": "basic",
"formats": [
"markdown"
]
}
'import requests
url = "https://api.aisa.one/apis/v1/firecrawl/scrape"
payload = {
"url": "https://docs.firecrawl.dev",
"proxy": "basic",
"formats": ["markdown"]
}
headers = {
"Authorization": "Bearer <token>",
"Content-Type": "application/json"
}
response = requests.post(url, json=payload, headers=headers)
print(response.text)const options = {
method: 'POST',
headers: {Authorization: 'Bearer <token>', 'Content-Type': 'application/json'},
body: JSON.stringify({url: 'https://docs.firecrawl.dev', proxy: 'basic', formats: ['markdown']})
};
fetch('https://api.aisa.one/apis/v1/firecrawl/scrape', options)
.then(res => res.json())
.then(res => console.log(res))
.catch(err => console.error(err));<?php
$curl = curl_init();
curl_setopt_array($curl, [
CURLOPT_URL => "https://api.aisa.one/apis/v1/firecrawl/scrape",
CURLOPT_RETURNTRANSFER => true,
CURLOPT_ENCODING => "",
CURLOPT_MAXREDIRS => 10,
CURLOPT_TIMEOUT => 30,
CURLOPT_HTTP_VERSION => CURL_HTTP_VERSION_1_1,
CURLOPT_CUSTOMREQUEST => "POST",
CURLOPT_POSTFIELDS => json_encode([
'url' => 'https://docs.firecrawl.dev',
'proxy' => 'basic',
'formats' => [
'markdown'
]
]),
CURLOPT_HTTPHEADER => [
"Authorization: Bearer <token>",
"Content-Type: application/json"
],
]);
$response = curl_exec($curl);
$err = curl_error($curl);
curl_close($curl);
if ($err) {
echo "cURL Error #:" . $err;
} else {
echo $response;
}package main
import (
"fmt"
"strings"
"net/http"
"io"
)
func main() {
url := "https://api.aisa.one/apis/v1/firecrawl/scrape"
payload := strings.NewReader("{\n \"url\": \"https://docs.firecrawl.dev\",\n \"proxy\": \"basic\",\n \"formats\": [\n \"markdown\"\n ]\n}")
req, _ := http.NewRequest("POST", url, payload)
req.Header.Add("Authorization", "Bearer <token>")
req.Header.Add("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)
defer res.Body.Close()
body, _ := io.ReadAll(res.Body)
fmt.Println(string(body))
}HttpResponse<String> response = Unirest.post("https://api.aisa.one/apis/v1/firecrawl/scrape")
.header("Authorization", "Bearer <token>")
.header("Content-Type", "application/json")
.body("{\n \"url\": \"https://docs.firecrawl.dev\",\n \"proxy\": \"basic\",\n \"formats\": [\n \"markdown\"\n ]\n}")
.asString();require 'uri'
require 'net/http'
url = URI("https://api.aisa.one/apis/v1/firecrawl/scrape")
http = Net::HTTP.new(url.host, url.port)
http.use_ssl = true
request = Net::HTTP::Post.new(url)
request["Authorization"] = 'Bearer <token>'
request["Content-Type"] = 'application/json'
request.body = "{\n \"url\": \"https://docs.firecrawl.dev\",\n \"proxy\": \"basic\",\n \"formats\": [\n \"markdown\"\n ]\n}"
response = http.request(request)
puts response.read_body{
"success": true,
"data": {
"markdown": "<string>",
"metadata": {
"title": "<string>",
"description": "<string>",
"sourceURL": "<string>",
"statusCode": 123
}
},
"creditsUsed": 123
}抓取单个 URL,并以 markdown 返回清洗后的正文内容。当你已经知道确切要抓哪一页时,这是最快的单页入口。在 AIsa 计量模式下,该请求被刻意限制得比较窄:URL 必须是 HTTPS 且不能是 PDF,
proxy 必须设为 "basic",如果传 formats,其值必须正好是 ["markdown"]。Firecrawl 的高级选项(actions、headers、parsers、profile、lockdown、zeroDataRetention)不被接受。
计费按 Firecrawl credit 计量——Scrape 每页消耗 1 credit。如需先发现 URL,请使用 post_firecrawl-map;如需一次抓取多页,请使用 post_firecrawl-batch-scrape。授权
Bearer authentication header of the form Bearer <token>, where <token> is your auth token.
请求体
application/json
⌘I