Skip to main content
了解如何使用 Firecrawl 的核心功能抓取 GitHub 仓库、issue和文档。
使用 Firecrawl 获取 GitHub 数据有两种方式。你可以抓取、映射或爬取特定的 github.com URL (本页其余内容将介绍此方法) ,也可以使用 研究索引 的 GitHub 搜索,无需知道确切 URL,即可通过语义搜索发现 GitHub 上相关的issue、拉取请求、讨论和 README。

设置

使用 JSON 模式抓取

通过 Zod schema 从仓库中提取结构化数据。
搜索 GitHub 上的仓库、issue 或文档。

使用研究索引搜索 GitHub

Firecrawl 的 研究索引包含 GitHub 索引,可对已索引的公开 GitHub Issue、拉取请求、讨论和仓库 README 进行语义搜索。当你不清楚具体的仓库或 URL 时,它可帮助你查找实现细节和既有工程实践。
您也可以通过通用的 /search 端点,将类别指定为 github,访问同一 GitHub 索引。
请参见 研究索引指南,了解如何使用 Python、cURL、CLI 和 MCP。

抓取

抓取单个 GitHub 页面 (仓库、issue 或文件) 。

映射

发现仓库或文档站点中所有可用的 URL。请注意:Map 仅返回 URL,不包含页面内容。

Crawl

从仓库或文档中抓取多个页面。

批量抓取

同时抓取多个 GitHub 链接。

使用 JSON 模式批量抓取

一次性从多个仓库中抽取结构化数据。