Skip to main content
Aprenda a usar os principais recursos do Firecrawl para fazer scraping de repositórios, issues e documentação do GitHub.
Há duas maneiras de obter dados do GitHub com o Firecrawl. Você pode fazer scraping, mapear ou fazer rastreamento uma URL específica do github.com (abordado no restante desta página) ou usar a busca do GitHub no Research Index para descobrir semanticamente issues, pull requests, discussões e READMEs relevantes em todo o GitHub sem conhecer a URL exata.

Configuração

Scraping com o modo JSON

Extraia dados estruturados de repositórios usando esquemas Zod.
Pesquise repositórios, issues ou documentação no GitHub.

Pesquise no GitHub com o Research Index

O Research Index do Firecrawl inclui um índice do GitHub que realiza buscas semânticas em issues, pull requests, discussões e READMEs de repositórios públicos indexados. Ele é útil para encontrar detalhes de implementação e soluções de engenharia já existentes quando você não sabe qual é o repositório ou a URL exata.
Você também pode acessar o mesmo índice do GitHub usando o endpoint geral /search com a categoria github.
Consulte o guia do Research Index para ver exemplos de uso com Python, cURL, CLI e MCP.

Scraping

Fazer scraping de uma única página do GitHub — repositório, issue ou arquivo.

Map

Descubra todas as URLs disponíveis em um repositório ou site de documentação. Nota: Map retorna somente URLs, sem conteúdo.

Crawl

Fazer crawling de várias páginas de um repositório ou documentação.

Extração em lote

Fazer scraping de várias URLs do GitHub simultaneamente.

Extração em lote com o modo JSON

Extraia dados estruturados de vários repositórios de uma só vez.