Firecrawl SEO 网站分析扩展
通过 Firecrawl MCP 抓取、发现和分析整个网站的页面、链接与结构。
技能要求用户安装并检查 Firecrawl MCP,说明了积分成本、错误处理和不可用时的替代方案;但未明确在大规模抓取或浏览器操作前取得用户确认,未充分披露抓取数据流、敏感内容处理、外部站点影响和可回滚机制,因此扣分。
命令、参数、依赖检查、常见错误和降级路径较清楚;但核心功能依赖外部 Firecrawl MCP,技能专属复现步骤、测试覆盖和异常输入诊断证据不足,且反爬处理等行为未被源文件验证,因此不超过静态上限并扣分。
触发词、crawl/map/scrape/search 场景及参数边界较明确;但非适用场景、站点规模限制、隐私约束和中文使用说明不足,核心服务依赖可能受中国大陆网络可达性影响的海外 Firecrawl 服务,因此扣分。
具备 front matter、MIT 许可证、版本号、安装说明、快速参考、参数表、用例、错误处理和跨技能集成说明;但缺少该技能自身的维护责任人、变更记录、更新路径、FAQ 和更完整的输出契约,因此未满分。
能够把站点发现、抓取、单页渲染和站内搜索组织成可直接调用的工作流,并给出 SEO 集成用途;但结果质量依赖外部服务、后续子技能和用户筛选,示例输出主要是描述性材料,未有该路径的可复现结果验证,因此按静态上限保守扣分。
技能提供参数、错误表和操作流程,仓库还声明存在 CI 与测试套件;但提供的测试并未覆盖该 Firecrawl 技能的 MCP 调用、输出正确性或成本控制,README 的效果和示例也不能替代独立复现,因此仅给有限分数。
- 大规模 crawl 可能消耗大量 Firecrawl 积分;技能要求事前告知估算,但没有强制用户确认或预算上限。
- 抓取任意用户提供的网站会产生外部网络请求;应在执行前确认目标、范围、隐私和 robots/访问许可。
- Firecrawl MCP 是核心依赖,且技能未说明中国大陆网络可达性、数据驻留或第三方服务的数据处理方式。
- 未提供该技能 MCP 调用和输出结果的专门测试,SEO 结论仍需人工复核。
这个 Skill 能做什么,适合哪些场景?
这是 claude-seo 仓库中的 Firecrawl 扩展技能,专注于全站抓取、URL 发现、单页深度抓取和站内搜索。它通过 Firecrawl MCP 处理 JavaScript 渲染页面,并可返回内容、元数据、链接、HTML 或截图。该技能适合需要站点级 SEO 数据采集的人,但必须先安装并连接 Firecrawl MCP。大规模抓取会消耗 Firecrawl 配额。
支持 /seo firecrawl crawl <url> 抓取网站页面内容、元数据和链接;支持 map 仅发现 URL;支持 scrape 对单页执行 JavaScript 渲染、提取主要内容并可获取截图;支持 search 在指定网站内搜索内容。抓取参数包括页面数量、链接深度、包含或排除路径、输出格式、等待条件、超时时间和浏览器操作。它还可用于内容清单、断链检查、URL 模式分析、孤立页面发现和站点结构分析。
- SEO 顾问需要审计大型网站时,先用 map 发现 URL,再对重点页面执行定向 crawl。
- 网站使用 React、Vue 或 Angular 等 JavaScript 渲染框架时,用 scrape 获取静态抓取可能遗漏的动态内容。
- 运营团队需要检查站内断链时,抓取链接输出并逐一核验目标状态。
- 内容团队想建立页面标题、元描述、H1 和正文清单时,使用全站 crawl 提取页面数据。
- 技术 SEO 人员需要分析 URL 结构、参数膨胀、重复路径或孤立页面时,先执行 map 再进行比较。
这个 Skill 有哪些优点和局限?
- 覆盖全站抓取、URL 映射、单页 JavaScript 渲染和站内搜索。
- 支持按路径包含或排除页面,适合分区审计。
- 可输出 markdown、HTML、链接和截图等格式。
- 对动态网站和单页应用比静态页面抓取更有针对性。
- 必须依赖 Firecrawl MCP,不能脱离该服务独立运行。
- 抓取和映射会消耗 Firecrawl credits;大规模任务可能受到额度、速率限制或付费计划影响。
- 遇到超时、403 或 robots.txt 限制时,结果可能不完整。
- 源材料没有提供该扩展自身的测试覆盖或跨平台验证信息。
如何安装这个 Skill?
在 claude-seo 仓库目录中运行:./extensions/firecrawl/install.sh。该技能要求 Firecrawl MCP 扩展已安装并连接;如果 firecrawl_scrape 或其他 Firecrawl 工具不可用,应先完成安装和配置。源材料未说明 Firecrawl API 密钥的完整配置步骤。
如何使用这个 Skill?
在支持该技能的 Claude Code 环境中使用:/seo firecrawl crawl https://example.com、/seo firecrawl map https://example.com、/seo firecrawl scrape https://example.com/page 或 /seo firecrawl search "keyword" https://example.com。大规模 crawl 前应先告知预计配额消耗;默认最多抓取 100 页、最大链接深度为 3,具体参数可按技能说明调整。
这个 Skill 与同类方案有什么区别?
相较于 fetch_page.py,Firecrawl scrape 更适合 JavaScript 渲染页面、干净 Markdown 提取和截图;fetch_page.py 更适合静态页面和需要响应头的场景。Firecrawl 不可用时,源材料还建议使用 WebFetch 获取基础 HTML,或使用 fetch_page.py 进行单页分析。