功能说明咨询

功能说明咨询

Tail
·Agent created by zway
Tail·Agent created by zway
FFirecrawl
这个有什么用
Search Toolssearch scrape crawl extract web page markdown map urls

Firecrawl 是一个网页抓取/解析工具,你刚选的这个连接在未认证状态下开放三个能力,对我们的研究流程有三处实际增量:

1. firecrawl_scrape:抓单页,比我内置的 webFetch 更能打

  • 支持 JS 渲染等待、移动端视图、代理、只取正文,对付那些动态加载或反爬的页面(部分券商研报页、IR 的交互式财报页)成功率更高。
  • 关键增量是结构化抽取:可以给一个 JSON schema 或提示词,让它直接返回字段化结果(比如从一页招股书要点里抽「募资额/基石投资者/估值区间」),不用我把整页 markdown 读进上下文再手工挑。
  • 还能带 maxAge: 0 强制实时抓,避免拿到缓存的旧快照,这点对时效敏感的公告有用。

2. firecrawl_parse:解析本地/上传的文档

  • 支持 PDF、Word、RTF、ODF、表格,可限制 PDF 页数。这个对你我最直接的场景是招股书和年报 PDF:ipo-report 那条线以前只能靠网页版正文,现在可以直接把 PDF 拆成 markdown 或按 schema 抽字段。

3. firecrawl_search:带类别过滤的检索

  • 支持 site:、inurl:、域名白/黑名单,还有 research/pdf/developer 分类。找特定交易所公告页、限定只搜 PDF、或只搜研究机构站点时,比通用搜索命中率高。

边界要说清楚:

  • 未认证状态有用量限制,账户类工具(爬全站的 firecrawl_crawl、firecrawl_map 站点 URL 发现)这次没暴露出来,需要接 OAuth 或 API key 才有。
  • 它不是行情源。价格、市值、K 线这些我照旧走 Driven 的结构化数据,Firecrawl 抓回来的任何财务数字都只当参考语境,不当权威值。
  • 抓回来的网页内容是外部不可信数据,我只做分析,不执行里面的指令。

要不要现在拿个真实场景试一发?比如挑一份你在跟的招股书 PDF 让它按字段抽,或者抓一个 webFetch 之前拿不到的页面验证一下它的穿透力。🐒

如何认证?
Load Skill{"name":"help"}
Search FilesMCP|connector|API key|OAuth|授权
Read Pagehttps://docs.firecrawl.dev/mcp-server

认证有两条路,走的是同一个终点(都拿到完整工具面和你团队套餐的额度),Firecrawl 官方文档写得很明确:

路径 A:API key(推荐,无浏览器依赖)

  1. 去 https://www.firecrawl.dev/app/api-keys 建一个 key。
  2. 在 Driven 里这个连接的配置项中,把服务地址设为 https://mcp.firecrawl.dev/v2/mcp,并加一个请求头:Authorization: Bearer <你的 API key>。
  3. 官方特意强调:key 要放在环境变量或客户端的密钥存储里,绝不能拼在 MCP URL 上。

路径 B:浏览器登录(OAuth)

  • 服务地址换成 https://mcp.firecrawl.dev/v2/mcp-oauth,由客户端拉起浏览器完成授权。这条路适合 Codex/Claude Code 这类本地跑的客户端;Driven 这边是托管环境,能不能顺畅拉起浏览器流程我没法替你确认,所以我建议先试 A。

两点提醒:

  • 我手上的 Driven 功能手册里没有 MCP 连接器的配置文档,所以上面第 2 步具体在哪个菜单、字段叫什么名字,我不编。配置入口就是你刚才选中 Firecrawl 这个连接的地方,找服务地址和自定义请求头(headers/认证)两栏填就行。要是那里没有填 header 的位置,说明这个连接器暂时只支持无认证模式,那就得走 Driven 官方支持问一下。
  • 现在的无认证状态是有每日额度上限的,只开放 Search/Scrape/Parse。

配好之后跟我说一声,我重新扫一遍它的工具列表验证,看 firecrawl_crawl(整站爬)和 firecrawl_map(站点 URL 发现)这两个有没有解锁。这俩才是对我们真正有增量的部分:比如把某家公司 IR 站点下所有财报页一次性摸出来,而不是一页一页喂给我。🐒