首页/Firecrawl
Firecrawl Web 上下文 API 图标

Firecrawl

Firecrawl 是开源 Web 上下文 API,让应用和 AI 智能体搜索、抓取、爬取、监控并操作实时网页,输出干净 Markdown、结构化 JSON、截图或元数据。

访问网站
Firecrawl API 将实时网站转化为智能体可用的结构化数据

产品介绍

Firecrawl 是什么?

Firecrawl 是面向 AI 系统的 Web 数据基础设施。其 API 可以搜索互联网、抓取单页、映射和爬取网站、监控新内容,并操作需要点击、填写表单、滚动或导航的页面。它将动态网站转化为智能体和语言模型应用可直接使用的干净上下文。

抓取结果可包含 Markdown、按照给定模式生成的结构化 JSON、HTML、截图和元数据。Firecrawl 处理 JavaScript 渲染、动态加载、文档、媒体解析和智能等待,并提供官方 SDK、REST API、命令行工具、智能体技能和 MCP 服务器,用于连接兼容的编码助手和智能体。

如何使用 Firecrawl

  1. 创建账户或部署开源项目,并取得所需凭证。
  2. 按任务选择 Search、Scrape、Crawl 或需要浏览器操作的 Interact。
  3. 配置输出格式、页面限制、路径过滤、请求头或 JSON 提取模式。
  4. 通过 SDK、REST、CLI、MCP 服务器或智能体技能调用。
  5. 将清洗结果交给研究智能体、RAG 管道、应用或数据工作流。

核心功能

  • Search: 查找相关网页,并可在同一次调用中返回完整页面内容。
  • Scrape: 将页面转换为干净 Markdown、JSON、HTML、截图或元数据。
  • Crawl 与 Map: 发现链接并提取整个网站或指定路径的内容。
  • Interact: 点击、输入、滚动、等待、按键并导航多步骤页面。
  • 动态页面处理: 自动渲染 JavaScript 并等待内容,无需额外浏览器配置。
  • 智能体集成: 通过 MCP、CLI、技能、REST 和官方 SDK 连接。

使用场景

  • 深度研究: 从论文、新闻、报告和专家来源收集当前信息。
  • RAG 摄取: 将网站转化为适合检索和知识库的干净文档。
  • 智能体 Web 工具: 让智能体搜索、阅读并操作实时页面。
  • 潜客丰富: 为公司和联系人记录补充当前 Web 信息。
  • 竞争与价格监控: 跟踪变化页面和新发布内容。
  • 产品引导: 根据用户现有网站预填项目内容。

价格

Firecrawl 每月提供 1,000 个免费 credits。官网还列出 Hobby、Standard、Growth、Scale 和 Enterprise 付费方案,提供更大额度和更高速率限制。项目本身开源,托管服务则增加托管基础设施和仅限托管版的能力。

常见问题

Firecrawl 支持大量 JavaScript 的网站吗?

支持。它会自动渲染 JavaScript 并处理动态加载内容。

可以返回结构化数据吗?

可以。调用方可提供 JSON 模式,并接收符合该结构的提取数据。

AI 智能体可以直接使用 Firecrawl 吗?

可以。Firecrawl 提供 MCP 服务器、命令行界面、智能体技能、REST API 和多种编程语言 SDK。

返回产品导航

相关产品

OpenAI Codex 是面向软件开发的 AI 编程产品,适合委派边界清晰的仓库任务并审阅其代码变更。

Claude Code 是 Anthropic 的 AI 编程产品,适合通过支持的开发界面在代码库中持续迭代。

Gemini CLI 是 Google 的开源 AI 终端产品,适合本地开发与命令行工作流。

邮件订阅

持续发现实用 AI 产品

定期接收精选产品、真实使用场景和开发者动态。