Firecrawl (Firecrawl)

收录于 https://firecrawl.dev

综合排名 #42 ⭐ 可考虑
❌ 无中国大陆直连端点。Firecrawl 总部位于美国旧金山(YC W23),API base URL https://api.firecrawl.dev 单区域部署;docs.firecrawl.dev/billing.md 未列出任何亚太 / 中国路由层。中国大陆生产流量需代理或中转,跨太平洋首字节延迟通常 200-400 ms;Free 档 1000 credits 评估期可代理试用,但稳定流量建议自建代理或自部署 Firecrawl 自托管版(self-hosted Docker / Kubernetes)。 | 🌍 国际

💰 Token 价格

类型 价格 备注
输入 (Input) 纯 credit-based 按 endpoint 与特性消耗,每月按 plan 重置额度;额外 credit 按 $5 一档购买(每档 1k–5k credits 不等)。从 firecrawl.dev/pricing 与 docs.firecrawl.dev/billing.md 验证(2026-08-29):Free 1k/月 $0;Hobby 5k/月 $19(年付 $16);Standard 100k/月 $83(年付 $99);Growth 500k/月 $333(年付 $399);Scale 1M/月 $599;Enterprise Custom。Credit 单价:Scrape / Crawl / Map 1 cr/page、Search 2 cr/10 results、Monitor 1 cr/page/check、Interact 2–7 cr/browser-minute。Batch Scrape / Extract 按子操作同价。Agent 5 daily runs free,超量动态计费。 每百万 tokens
输出 (Output) 无独立 output 维度——Firecrawl 输出的是 scraped markdown / HTML / JSON 内容,计费仅按输入端的 credit 消耗与并发浏览器占用。出站数据本身不另收费;唯一例外是 Search 在 ZDR(zero-data-retention)企业档下按企业价另议。 每百万 tokens
缓存读取 无 token 级 cache。Firecrawl 自带页面层 maxAge 缓存(默认 2 天 = 172800000 ms,命中率高的页面秒级返回),仅对新鲜 scrape 调用扣 1 credit;`maxAge: 0` 强制刷新,`storeInCache: false` 不入库。 享折扣
💡 免费额度

Free 档永久免费:1,000 credits / 月,无需信用卡,支持 Scrape / Crawl / Map / Search / Batch Scrape / JSON mode 全部 endpoints;2 concurrent browsers;50,000 max queued jobs。适合评估与轻量使用,但 credit 重置周期每月初清零、当月用完不再补。Agent 5 daily runs free 适用于所有 plan(含 Free)。

🤖 支持模型(共 10 个)

Scrape (v2 /scrape) — convert any URL into clean markdown / HTML / structured JSON via the JSON-mode schema option; 1 credit per page Crawl (v2 /crawl) — recursively crawl a website and return content for every linked page; 1 credit per page scraped Map (v2 /map) — return every URL on a website without scraping content; 1 credit per call Search (v2 /search) — search the web and optionally scrape results; 2 credits per 10 results (rounded up) Batch Scrape (/v2/batch/scrape) — scrape an explicit list of URLs in one concurrent job (sync + async modes); 1 credit per URL Interact (/v2/interact) — interactive browser sandbox with Playwright code or natural-language prompts; 2 credits/minute (Playwright) or 7 credits/minute (prompt-driven); 1-minute minimum Monitor (/v2/monitor) — schedule recurring page / website / web-scale checks and notify by webhook, email, or Slack; 1 credit per page per check Agent (/v2/agent) — autonomous web research agent with optional JSON schema; 5 daily runs free, dynamic usage-based pricing beyond Extract (/v2/extract) — LLM-driven structured extraction across many URLs and URL patterns (batch sibling of JSON mode) JSON mode — embed `formats: [{type: "json", schema: {...}}]` directly in v2 /scrape to extract structured data with an OpenAI-compatible JSON schema

✨ 优势

  • v2 API 9 个 endpoint 一站式覆盖:Scrape / Crawl / Map / Search / Batch Scrape / Extract / Interact / Monitor / Agent,无需拼装多个工具
  • JSON mode (formats: [{type: "json", schema: {...}}]) 单次 scrape 直接产出 OpenAI 兼容 schema 结构化数据,免二次解析
  • maxAge 缓存默认 2 天:命中即毫秒级返回(实测 ~10× 加速);`maxAge: 0` 强制刷新,`storeInCache: false` 不入库
  • Interact 浏览器沙盒:Playwright code 或自然语言 prompt 双模式,2–7 credits/minute,1 分钟最低消费
  • Monitor 三类目标:Page(已知 URL diff)/ Website(定时整站)/ Web-scale(always-on 搜索新结果),webhook + email + Slack 通知
  • Agent 自主研究:5 daily runs free,超量按 token 用量动态计费;支持 JSON schema 输出,可与 Extract 联动
  • Self-hosted 开源(AGPL-3.0):官方 Docker / Kubernetes 镜像完整可用,企业可私有化部署避开大陆延迟与合规风险
  • MCP server 支持:firecrawl-mcp-server 提供 Scrape / Search / Parse 的 keyless 试用端点,官方 SKILL.md 一行接入 Claude Code / Cursor
  • Free 档永久免费、零信用卡:1k credits/月 + 5 daily Agent runs,是 web scraping 工具中评估门槛最低的一家

⚠️ 不足

  • × 无中国大陆端点:api.firecrawl.dev 单区域部署,跨太平洋延迟 200-400 ms;企业稳定流量建议自部署 self-hosted
  • × 无 token 级 cache:仅页面级 maxAge 缓存,对同 URL 频繁更新场景需自行管理 maxAge 与 storeInCache 标志
  • × Output 不限速但 Input 计 credit:Search 每次最多 10 results,11 results 算 4 credits(向上取整),高频搜索成本累积快
  • × Free 档每月 1k credits 用完即停:与评估期项目进度强耦合,月底 burst 流量可能被 429 拒绝
  • × Interact browser 最低 1 分钟计费:<1 分钟的快速 probe 也按整分钟计,调试期成本难压
  • × Monitor / Agent 计费动态:监控频次与 agent 任务量直接影响 credit 消耗,无固定封顶
  • × Self-hosted 版 AGPL-3.0:商业化 fork / 二次分发需开源;商业闭源场景需用 hosted 版或购买商业授权
  • × 无 affiliate 合作计划:apirank 暂未上线 Firecrawl 联盟链接,需走直接注册
  • × Vendor 暂无 Chat Completions / Responses API 形态:Firecrawl 是 scraping/crawling 平台而非通用 LLM API,与 OpenAI / Anthropic 不同赛道

🎯 适合场景

需要把整站 / 大批 URL 转成 clean markdown 的 RAG 工程师;构建 web-scale 监控(合规、价格、新闻、招聘、产品页变化)的 agent 团队;用自然语言 prompt 驱动浏览器做端到端 web 测试 / 表单填写 / 登录态交互的产品团队;要在 Claude Code / Cursor / Windsurf 里直接 scrape 当前页面的 agent 开发者(通过 firecrawl-mcp-server);受限于中国大陆延迟 / 合规的企业(自部署 Firecrawl Docker / Kubernetes 镜像);评估期 / 个人项目(Free 档零信用卡 1k credits/月 + 5 daily Agent runs)。

💰 价格与方案

方案每月 credits并发浏览器月付价年付价(每月)额外 credit 档
Free1,0002$0—(不售卖)
Hobby5,0005$19/月$16/月$5 / 1,000 credits
Standard100,00025$99/月(约 $83 实际)$83/月$5 / 2,000 credits
Growth500,00050$399/月(约 $333 实际)$333/月$5 / 2,500 credits
Scale1,000,000100$599/月$599/月$5 / 5,000 credits
EnterpriseCustom100+联系销售联系销售Custom + 批量折扣 + ZDR Search
Credit 单价 — Scrape / Crawl / Map1 credit / 页或调用全 plan 通用
Credit 单价 — Batch Scrape / Extract1 credit / URL全 plan 通用
Credit 单价 — Search2 credits / 10 results(向上取整)全 plan(Enterprise 可定制 ZDR)
Credit 单价 — Interact(Playwright code)2 credits / browser minute1 分钟最低消费
Credit 单价 — Interact(prompt 驱动)7 credits / browser minute1 分钟最低消费
Credit 单价 — Monitor1 credit / 页 / 检查全 plan 通用
Agent 每日免费运行5 次/天,超量动态计费所有 plan(含 Free)均适用
maxAge 页面缓存默认 2 天(172800000 ms)所有 plan 内置

🔧 API 与开发者体验

  • 接口风格: REST + SDK 封装;v2 端点位于 https://api.firecrawl.dev/v2(保留向后兼容的 /v1 表面)。官方 Python SDK `firecrawl`(PyPI)、Node SDK `firecrawl-js`(npm),以及托管 MCP server `firecrawl-mcp-server`,将 Scrape / Search / Parse 暴露给 Claude Code / Cursor / Windsurf。SDK 封装原生 HTTP 端点,多数调用方无需直接 curl。
  • 端点: POST /v2/scrape(单 URL,支持 formats 数组)、POST /v2/crawl(递归爬取整站,支持 page 限制、include/exclude 路径、maxDepth)、POST /v2/map(列出整站所有 URL)、POST /v2/search(网页搜索 + 可选 scrape)、POST /v2/batch/scrape(明确 URL 列表,sync + async 两种模式)、POST /v2/extract(基于 LLM 的多 URL / URL pattern 结构化抽取)、POST /v2/interact(浏览器沙盒,code 或 prompt 驱动)、POST /v2/monitor(定时检查)、POST /v2/agent(自主研究)、GET /v2/crawl/:id + /v2/batch/scrape/:id(状态 + 结果)、GET /v2/usage(credit 消耗)、GET /v2/queue/status(并发余量)。
  • 鉴权: Bearer token(`Authorization: Bearer fc-XXX` header),从 Firecrawl 控制台 firecrawl.dev/dashboard/api-keys 创建。团队作用域:同一团队内所有 key 共享同一并发浏览器上限与每月 credit 池。Enterprise 可叠加 IP 限制(CIDR 白名单)与单 key 端点 / 输出格式限制,两者均服务端强制。
  • JSON Mode(结构化抽取): v2 API 改动:v1 `jsonOptions` 参数已移除。直接将 schema 内嵌到 formats 数组:`formats: [{type: "json", schema: {type: "object", properties: {...}, required: [...]}}]`。OpenAI schema 原样使用,为 OpenAI tool call 生成的 schema 无需改写即用。返回 `{success: true, data: {...}}`,`data` 已符合 schema,无需二次 LLM 调用。
  • Batch Scrape 与异步: POST /v2/batch/scrape 接受 URL 列表并返回 `{id, urls, status}`。轮询 /v2/batch/scrape/:id 获取 `{status, completed, total, data: [...]}`。Async 模式任务完成后通过 webhook 流式推送;sync 模式阻塞至任务结束(受 timeout 参数约束,并发队列中最多等待 48h)。所有 scrape 选项(formats、JSON schema、headers、maxAge、onlyMainContent)透传到每个 URL。
  • Interact(浏览器沙盒): POST /v2/interact 接受 `{url, code: "playwright code..."}`(code 驱动会话,2 credits/minute)或 `{url, prompt: "click login, fill email, click submit"}`(prompt 驱动会话,7 credits/minute)。每次会话 1 分钟最低消费,按 browser-minute 计费。返回 `{success, code, execution_logs, interactive_screenshot, captures: [...]}`。适用登录墙抓取、JS 渲染 SPA、表单提交。
  • maxAge 页面缓存: 在任意 scrape 调用设置 `maxAge`(毫秒)控制缓存新鲜度。默认 172800000 ms(2 天);命中缓存毫秒级返回(实测 ~10x 加速)。`maxAge: 0` 强制刷新(绕过缓存,更慢)。`storeInCache: false` 返回页面但不写入缓存(适用一次性抓取、不影响其他调用)。
  • Monitor(定时检查): 三种目标类型:`/monitor` 已知 URL(单页 diff)、`/monitor` 整站(定时全量爬)、`/monitor` 全网(always-on 搜索)。配置 schedule(cron)、可选自然语言目标、通知渠道(webhook、email、Slack)。Credit 单价 1 credit / 页 / 检查。Bounty 计划(5,000 credits)奖励政府 / 法律 / 监管 / 公开记录源的反馈。
  • Agent: POST /v2/agent 接受 `{prompt, urls?, schema?}`,运行自主研究 agent 浏览 / 搜索 / 综合。每个 plan(含 Free)5 次/天免费运行;超量按用量计费。支持 JSON schema 输出,可与 Extract 联动做多 URL 结构化研究。适用「找符合 X 的所有产品并返回 price / SKU / stock」跨站工作流。
  • MCP Server: `npx -y firecrawl-mcp-server` 将 Scrape / Search / Parse 暴露为 Claude Code / Cursor / Windsurf 的原生 MCP 工具。托管 MCP keyless 端点 `https://api.firecrawl.dev/mcp/sse` 允许无 API key 调用 Scrape / Search / Parse(低 rate limits)。完整 MCP server 需要账号连接或 API key。SKILL.md 接入文档 firecrawl.dev/agent-onboarding/SKILL.md;WorkOS ID-JAG 鉴权路径支持能铸造 ID-JAG 的 agent 平台。
  • SDK 与自托管: 官方 Python(`pip install firecrawl`)、Node(`npm install firecrawl`)、Go(社区)、Rust(社区)。Self-hosted 版 AGPL-3.0 授权:官方 Docker 镜像 + Kubernetes manifests 位于 github.com/firecrawl/firecrawl,支持自带数据库(Postgres / Redis)与自带队列。Enterprise 商业授权用于闭源 fork;价格联系销售。
  • Rate Limit 与并发: 按团队的 rate limit(请求/分钟)限制请求量;并发浏览器上限(按 plan 2 / 5 / 25 / 50 / 100+)限制并行任务。任一超限返回 429。`GET /v2/queue/status` 返回当前可用度。最大队列任务数:Free / Hobby / Standard 50,000、Growth 100,000、Scale / Enterprise 200,000+。队列中任务最多等待 48h 后超时。

🕸️ 生产级 Web 抓取能力

Firecrawl 将自身定位为 agent 时代的抓取层。原生 HTML 抓取在 JS 渲染 SPA、登录墙、Bot 检测面前频繁失效;Firecrawl 将九个 v2 端点装入同一 credit 系统:Scrape 单页格式转换、Crawl 递归整站、Map URL 发现、Search 网页搜索 + scrape 融合、Batch Scrape 显式 URL 列表、Extract LLM 结构化抽取、Interact Playwright 代码或 prompt 驱动浏览器、Monitor 定时 diff、Agent 跨站点研究。v2 JSON Mode 将「scrape → LLM 抽取」两步压缩为一次调用。self-hosted AGPL-3.0 Docker / Kubernetes 构建给企业绕开中国大陆延迟与合规风险。Firecrawl 托管 MCP server 将 Scrape / Search / Parse 暴露为 Claude Code / Cursor / Windsurf 的原生工具。

🌐 区域可用性与延迟

Firecrawl 托管 API 运行于 https://api.firecrawl.dev 单一区域基础 URL(美国旧金山),无文档化的亚太或中国大陆路由层。北美与欧洲生产流量首字节延迟低至几十毫秒;中国大陆需代理或中转,托管端点跨太平洋首字节延迟通常 200-400 ms。对有中国大陆延迟或数据驻留要求的企业,自托管 AGPL-3.0 Docker / Kubernetes 构建完全运行在客户自己的基础设施上,免去跨太平洋往返。截至 2026 年 8 月没有 ICP 备案的中国大陆托管端点,但 api.firecrawl.dev/mcp/sse 的 MCP server 在全球范围提供 Scrape / Search / Parse keyless 端点。agent-friendly 接入 firecrawl.dev/agent-onboarding/SKILL.md 单文件覆盖 CLI / 浏览器鉴权、API key 设置、能力摘要。