Skip to main content
Firecrawl MCP 提供用于查找、提取、交互和监控网页内容的工具。MCP 客户端连接后,会收到每个可用工具的完整输入 schema。

工具可用性

请先阅读 开始使用,然后选择面向代理面向用户。某些可选工具可通过环境配置或团队策略禁用。

选择工具

原有的 提取 MCP 工具已弃用,不属于当前工具集的一部分。对于已知页面,请使用 JSON 格式的 抓取;当 Firecrawl 必须发现来源时,请使用 代理。请参见选择数据提取器了解完整对比。
请使用 MCP 客户端针对当前参数显示的 schema。下方的功能指南介绍 Firecrawl 的底层行为,不会在此重复这些 schema。

重要行为

连接到自托管 Firecrawl API 的本地 MCP 服务器可直接读取 filePath。托管服务器无法读取您本机上的文件,因此需要通过两次调用完成交接:
  1. 使用 filePath 调用 firecrawl_parse,获取上传命令和 uploadRef
  2. 在可读取该文件的机器上运行上传命令。
  3. 使用返回的 uploadRef 再次调用 firecrawl_parse
上传命令使用短期有效的签名上传目标,不包含您的 Firecrawl API 密钥。对于公开文档 URL,请使用 firecrawl_scrape
firecrawl_crawl 通常会启动爬取,并在返回前轮询至终态。如果等待超时,请使用 firecrawl_check_crawl_status 和爬取 ID 恢复该任务。对于在当前 MCP 调用之外创建的爬取,也请使用相同的状态工具。firecrawl_agent 是异步的:它会返回任务标识符,firecrawl_agent_status 会检查该任务,直到其完成或失败。
使用 url 启动会话,或复用之前抓取调用中的 scrapeId。工作流完成后,使用 scrapeId 调用 firecrawl_interact_stop 以释放会话。
firecrawl_monitor_* 系列工具可创建、列出、更新、运行和检查定期监控。firecrawl_monitor_delete 会永久删除监控,只有在用户明确要求删除时才应调用。
设置 FIRECRAWL_NO_SEARCH_FEEDBACK=1 可阻止注册 firecrawl_search_feedback。设置 FIRECRAWL_NO_ENDPOINT_FEEDBACK=1 可阻止注册 firecrawl_feedback

功能指南

抓取

从单个 URL 提取内容或结构化字段。

搜索

查找相关的网页、新闻、图片和开发者资源。

研究索引

搜索论文、阅读段落并追踪引用。

开发者索引

根据 issue、PR、README 和文档回答编程问题。

爬取

遍历并提取整个网站或其中的某个部分。

解析

将文件转换为可供 LLM 使用的输出。

交互

在实时浏览器会话中操作动态页面。

代理

运行自主的多源研究。

监控

跟踪页面变更并接收通知。

故障排除

  • **某个工具缺失:**确认 开始使用 的连接模式,重新连接或重启客户端,并检查团队策略是否禁用了可选工具。
  • **客户端返回 401:**先检查配置的服务器 URL。
    • 如果配置的 URL 为 /v2/mcp-oauth,请通过客户端重新登录。
    • 如果为 /v2/mcp,请更换该服务器的 API 密钥,或将现有服务器 URL 更新为 /v2/mcp-oauth 并完成登录。
    • 完成任一更改后,启动新的客户端会话。
  • **客户端被限流:**查看当前限流规则,等待重试间隔,或从免密钥访问切换为已认证访问。