Firecrawl (Firecrawl)
💰 Token 价格
| 类型 | 价格 | 备注 |
|---|---|---|
| 输入 (Input) | 纯 credit-based 按 endpoint 与特性消耗,每月按 plan 重置额度;额外 credit 按 $5 一档购买(每档 1k–5k credits 不等)。从 firecrawl.dev/pricing 与 docs.firecrawl.dev/billing.md 验证(2026-08-29):Free 1k/月 $0;Hobby 5k/月 $19(年付 $16);Standard 100k/月 $83(年付 $99);Growth 500k/月 $333(年付 $399);Scale 1M/月 $599;Enterprise Custom。Credit 单价:Scrape / Crawl / Map 1 cr/page、Search 2 cr/10 results、Monitor 1 cr/page/check、Interact 2–7 cr/browser-minute。Batch Scrape / Extract 按子操作同价。Agent 5 daily runs free,超量动态计费。 | 每百万 tokens |
| 输出 (Output) | 无独立 output 维度——Firecrawl 输出的是 scraped markdown / HTML / JSON 内容,计费仅按输入端的 credit 消耗与并发浏览器占用。出站数据本身不另收费;唯一例外是 Search 在 ZDR(zero-data-retention)企业档下按企业价另议。 | 每百万 tokens |
| 缓存读取 | 无 token 级 cache。Firecrawl 自带页面层 maxAge 缓存(默认 2 天 = 172800000 ms,命中率高的页面秒级返回),仅对新鲜 scrape 调用扣 1 credit;`maxAge: 0` 强制刷新,`storeInCache: false` 不入库。 | 享折扣 |
Free 档永久免费:1,000 credits / 月,无需信用卡,支持 Scrape / Crawl / Map / Search / Batch Scrape / JSON mode 全部 endpoints;2 concurrent browsers;50,000 max queued jobs。适合评估与轻量使用,但 credit 重置周期每月初清零、当月用完不再补。Agent 5 daily runs free 适用于所有 plan(含 Free)。
🤖 支持模型(共 10 个)
✨ 优势
- ✓ v2 API 9 个 endpoint 一站式覆盖:Scrape / Crawl / Map / Search / Batch Scrape / Extract / Interact / Monitor / Agent,无需拼装多个工具
- ✓ JSON mode (formats: [{type: "json", schema: {...}}]) 单次 scrape 直接产出 OpenAI 兼容 schema 结构化数据,免二次解析
- ✓ maxAge 缓存默认 2 天:命中即毫秒级返回(实测 ~10× 加速);`maxAge: 0` 强制刷新,`storeInCache: false` 不入库
- ✓ Interact 浏览器沙盒:Playwright code 或自然语言 prompt 双模式,2–7 credits/minute,1 分钟最低消费
- ✓ Monitor 三类目标:Page(已知 URL diff)/ Website(定时整站)/ Web-scale(always-on 搜索新结果),webhook + email + Slack 通知
- ✓ Agent 自主研究:5 daily runs free,超量按 token 用量动态计费;支持 JSON schema 输出,可与 Extract 联动
- ✓ Self-hosted 开源(AGPL-3.0):官方 Docker / Kubernetes 镜像完整可用,企业可私有化部署避开大陆延迟与合规风险
- ✓ MCP server 支持:firecrawl-mcp-server 提供 Scrape / Search / Parse 的 keyless 试用端点,官方 SKILL.md 一行接入 Claude Code / Cursor
- ✓ Free 档永久免费、零信用卡:1k credits/月 + 5 daily Agent runs,是 web scraping 工具中评估门槛最低的一家
⚠️ 不足
- × 无中国大陆端点:api.firecrawl.dev 单区域部署,跨太平洋延迟 200-400 ms;企业稳定流量建议自部署 self-hosted
- × 无 token 级 cache:仅页面级 maxAge 缓存,对同 URL 频繁更新场景需自行管理 maxAge 与 storeInCache 标志
- × Output 不限速但 Input 计 credit:Search 每次最多 10 results,11 results 算 4 credits(向上取整),高频搜索成本累积快
- × Free 档每月 1k credits 用完即停:与评估期项目进度强耦合,月底 burst 流量可能被 429 拒绝
- × Interact browser 最低 1 分钟计费:<1 分钟的快速 probe 也按整分钟计,调试期成本难压
- × Monitor / Agent 计费动态:监控频次与 agent 任务量直接影响 credit 消耗,无固定封顶
- × Self-hosted 版 AGPL-3.0:商业化 fork / 二次分发需开源;商业闭源场景需用 hosted 版或购买商业授权
- × 无 affiliate 合作计划:apirank 暂未上线 Firecrawl 联盟链接,需走直接注册
- × Vendor 暂无 Chat Completions / Responses API 形态:Firecrawl 是 scraping/crawling 平台而非通用 LLM API,与 OpenAI / Anthropic 不同赛道
🎯 适合场景
需要把整站 / 大批 URL 转成 clean markdown 的 RAG 工程师;构建 web-scale 监控(合规、价格、新闻、招聘、产品页变化)的 agent 团队;用自然语言 prompt 驱动浏览器做端到端 web 测试 / 表单填写 / 登录态交互的产品团队;要在 Claude Code / Cursor / Windsurf 里直接 scrape 当前页面的 agent 开发者(通过 firecrawl-mcp-server);受限于中国大陆延迟 / 合规的企业(自部署 Firecrawl Docker / Kubernetes 镜像);评估期 / 个人项目(Free 档零信用卡 1k credits/月 + 5 daily Agent runs)。
💰 价格与方案
| 方案 | 每月 credits | 并发浏览器 | 月付价 | 年付价(每月) | 额外 credit 档 |
|---|---|---|---|---|---|
| Free | 1,000 | 2 | $0 | — | —(不售卖) |
| Hobby | 5,000 | 5 | $19/月 | $16/月 | $5 / 1,000 credits |
| Standard | 100,000 | 25 | $99/月(约 $83 实际) | $83/月 | $5 / 2,000 credits |
| Growth | 500,000 | 50 | $399/月(约 $333 实际) | $333/月 | $5 / 2,500 credits |
| Scale | 1,000,000 | 100 | $599/月 | $599/月 | $5 / 5,000 credits |
| Enterprise | Custom | 100+ | 联系销售 | 联系销售 | Custom + 批量折扣 + ZDR Search |
| Credit 单价 — Scrape / Crawl / Map | 1 credit / 页或调用 | — | — | — | 全 plan 通用 |
| Credit 单价 — Batch Scrape / Extract | 1 credit / URL | — | — | — | 全 plan 通用 |
| Credit 单价 — Search | 2 credits / 10 results(向上取整) | — | — | — | 全 plan(Enterprise 可定制 ZDR) |
| Credit 单价 — Interact(Playwright code) | 2 credits / browser minute | — | — | — | 1 分钟最低消费 |
| Credit 单价 — Interact(prompt 驱动) | 7 credits / browser minute | — | — | — | 1 分钟最低消费 |
| Credit 单价 — Monitor | 1 credit / 页 / 检查 | — | — | — | 全 plan 通用 |
| Agent 每日免费运行 | 5 次/天,超量动态计费 | — | — | — | 所有 plan(含 Free)均适用 |
| maxAge 页面缓存 | 默认 2 天(172800000 ms) | — | — | — | 所有 plan 内置 |
🔧 API 与开发者体验
- •接口风格: REST + SDK 封装;v2 端点位于 https://api.firecrawl.dev/v2(保留向后兼容的 /v1 表面)。官方 Python SDK `firecrawl`(PyPI)、Node SDK `firecrawl-js`(npm),以及托管 MCP server `firecrawl-mcp-server`,将 Scrape / Search / Parse 暴露给 Claude Code / Cursor / Windsurf。SDK 封装原生 HTTP 端点,多数调用方无需直接 curl。
- •端点: POST /v2/scrape(单 URL,支持 formats 数组)、POST /v2/crawl(递归爬取整站,支持 page 限制、include/exclude 路径、maxDepth)、POST /v2/map(列出整站所有 URL)、POST /v2/search(网页搜索 + 可选 scrape)、POST /v2/batch/scrape(明确 URL 列表,sync + async 两种模式)、POST /v2/extract(基于 LLM 的多 URL / URL pattern 结构化抽取)、POST /v2/interact(浏览器沙盒,code 或 prompt 驱动)、POST /v2/monitor(定时检查)、POST /v2/agent(自主研究)、GET /v2/crawl/:id + /v2/batch/scrape/:id(状态 + 结果)、GET /v2/usage(credit 消耗)、GET /v2/queue/status(并发余量)。
- •鉴权: Bearer token(`Authorization: Bearer fc-XXX` header),从 Firecrawl 控制台 firecrawl.dev/dashboard/api-keys 创建。团队作用域:同一团队内所有 key 共享同一并发浏览器上限与每月 credit 池。Enterprise 可叠加 IP 限制(CIDR 白名单)与单 key 端点 / 输出格式限制,两者均服务端强制。
- •JSON Mode(结构化抽取): v2 API 改动:v1 `jsonOptions` 参数已移除。直接将 schema 内嵌到 formats 数组:`formats: [{type: "json", schema: {type: "object", properties: {...}, required: [...]}}]`。OpenAI schema 原样使用,为 OpenAI tool call 生成的 schema 无需改写即用。返回 `{success: true, data: {...}}`,`data` 已符合 schema,无需二次 LLM 调用。
- •Batch Scrape 与异步: POST /v2/batch/scrape 接受 URL 列表并返回 `{id, urls, status}`。轮询 /v2/batch/scrape/:id 获取 `{status, completed, total, data: [...]}`。Async 模式任务完成后通过 webhook 流式推送;sync 模式阻塞至任务结束(受 timeout 参数约束,并发队列中最多等待 48h)。所有 scrape 选项(formats、JSON schema、headers、maxAge、onlyMainContent)透传到每个 URL。
- •Interact(浏览器沙盒): POST /v2/interact 接受 `{url, code: "playwright code..."}`(code 驱动会话,2 credits/minute)或 `{url, prompt: "click login, fill email, click submit"}`(prompt 驱动会话,7 credits/minute)。每次会话 1 分钟最低消费,按 browser-minute 计费。返回 `{success, code, execution_logs, interactive_screenshot, captures: [...]}`。适用登录墙抓取、JS 渲染 SPA、表单提交。
- •maxAge 页面缓存: 在任意 scrape 调用设置 `maxAge`(毫秒)控制缓存新鲜度。默认 172800000 ms(2 天);命中缓存毫秒级返回(实测 ~10x 加速)。`maxAge: 0` 强制刷新(绕过缓存,更慢)。`storeInCache: false` 返回页面但不写入缓存(适用一次性抓取、不影响其他调用)。
- •Monitor(定时检查): 三种目标类型:`/monitor` 已知 URL(单页 diff)、`/monitor` 整站(定时全量爬)、`/monitor` 全网(always-on 搜索)。配置 schedule(cron)、可选自然语言目标、通知渠道(webhook、email、Slack)。Credit 单价 1 credit / 页 / 检查。Bounty 计划(5,000 credits)奖励政府 / 法律 / 监管 / 公开记录源的反馈。
- •Agent: POST /v2/agent 接受 `{prompt, urls?, schema?}`,运行自主研究 agent 浏览 / 搜索 / 综合。每个 plan(含 Free)5 次/天免费运行;超量按用量计费。支持 JSON schema 输出,可与 Extract 联动做多 URL 结构化研究。适用「找符合 X 的所有产品并返回 price / SKU / stock」跨站工作流。
- •MCP Server: `npx -y firecrawl-mcp-server` 将 Scrape / Search / Parse 暴露为 Claude Code / Cursor / Windsurf 的原生 MCP 工具。托管 MCP keyless 端点 `https://api.firecrawl.dev/mcp/sse` 允许无 API key 调用 Scrape / Search / Parse(低 rate limits)。完整 MCP server 需要账号连接或 API key。SKILL.md 接入文档 firecrawl.dev/agent-onboarding/SKILL.md;WorkOS ID-JAG 鉴权路径支持能铸造 ID-JAG 的 agent 平台。
- •SDK 与自托管: 官方 Python(`pip install firecrawl`)、Node(`npm install firecrawl`)、Go(社区)、Rust(社区)。Self-hosted 版 AGPL-3.0 授权:官方 Docker 镜像 + Kubernetes manifests 位于 github.com/firecrawl/firecrawl,支持自带数据库(Postgres / Redis)与自带队列。Enterprise 商业授权用于闭源 fork;价格联系销售。
- •Rate Limit 与并发: 按团队的 rate limit(请求/分钟)限制请求量;并发浏览器上限(按 plan 2 / 5 / 25 / 50 / 100+)限制并行任务。任一超限返回 429。`GET /v2/queue/status` 返回当前可用度。最大队列任务数:Free / Hobby / Standard 50,000、Growth 100,000、Scale / Enterprise 200,000+。队列中任务最多等待 48h 后超时。
🕸️ 生产级 Web 抓取能力
Firecrawl 将自身定位为 agent 时代的抓取层。原生 HTML 抓取在 JS 渲染 SPA、登录墙、Bot 检测面前频繁失效;Firecrawl 将九个 v2 端点装入同一 credit 系统:Scrape 单页格式转换、Crawl 递归整站、Map URL 发现、Search 网页搜索 + scrape 融合、Batch Scrape 显式 URL 列表、Extract LLM 结构化抽取、Interact Playwright 代码或 prompt 驱动浏览器、Monitor 定时 diff、Agent 跨站点研究。v2 JSON Mode 将「scrape → LLM 抽取」两步压缩为一次调用。self-hosted AGPL-3.0 Docker / Kubernetes 构建给企业绕开中国大陆延迟与合规风险。Firecrawl 托管 MCP server 将 Scrape / Search / Parse 暴露为 Claude Code / Cursor / Windsurf 的原生工具。
🌐 区域可用性与延迟
Firecrawl 托管 API 运行于 https://api.firecrawl.dev 单一区域基础 URL(美国旧金山),无文档化的亚太或中国大陆路由层。北美与欧洲生产流量首字节延迟低至几十毫秒;中国大陆需代理或中转,托管端点跨太平洋首字节延迟通常 200-400 ms。对有中国大陆延迟或数据驻留要求的企业,自托管 AGPL-3.0 Docker / Kubernetes 构建完全运行在客户自己的基础设施上,免去跨太平洋往返。截至 2026 年 8 月没有 ICP 备案的中国大陆托管端点,但 api.firecrawl.dev/mcp/sse 的 MCP server 在全球范围提供 Scrape / Search / Parse keyless 端点。agent-friendly 接入 firecrawl.dev/agent-onboarding/SKILL.md 单文件覆盖 CLI / 浏览器鉴权、API key 设置、能力摘要。