API do Crunchbase: preços, acesso e enriquecimento de dados empresariais

API Crunchbase: preços, acesso e enriquecimento de dados de empresas
Uma lista de empresas recentemente financiadas dá à sua equipe um ponto de partida. Para usá-la para geração de leads ou pesquisa de mercado, você precisa saber o que cada registro contém, como trazê-lo para seus sistemas e quais perguntas ainda precisam de uma visita ao site da empresa. O histórico de financiamento pode ajudá-lo a fazer uma pré-seleção de um negócio; sua página de carreiras ou anúncio de produto mais recente pode explicar por que isso importa para sua pesquisa hoje.
A API Crunchbase pode fornecer dados estruturados de empresas, mas planejar uma integração envolve mais do que obter uma chave de API. Você precisa confirmar o acesso aos campos necessários, estabelecer um orçamento e decidir como coletar e manter informações complementares.
Este guia aborda preços, acesso, documentação e implementação, e depois mostra como combinar registros de empresas com pesquisa de sites, incluindo onde a infraestrutura de proxy do CyberYozh App pode apoiar essa coleta adicional.
TL;DR
A API Crunchbase fornece acesso somente leitura a dados estruturados de empresas e financiamento, dependendo da sua licença.
O preço requer uma cotação de vendas. Confirme a elegibilidade atual da API Básica ou acesso de avaliação antes de presumir que existe uma opção gratuita.
Use Search para encontrar registros correspondentes e Entity Lookup para recuperar os detalhes de uma empresa conhecida.
Enriqueça registros com observações do site da empresa, retendo URLs de origem, timestamps e incertezas.
O CyberYozh App pode apoiar verificações complementares de sites que precisam de seleção geográfica ou sessões fixas. Proxies não são necessários para solicitações comuns à API Crunchbase e não expandem o acesso licenciado.
Visite as aplicações CyberYozh para acesso à API.
O Crunchbase tem uma API e para que você pode usá-la?
Sim, o Crunchbase oferece uma API REST somente leitura para recuperar dados estruturados sobre empresas, pessoas, rodadas de financiamento e aquisições, com registros e campos disponíveis dependendo do seu acesso licenciado. Somente leitura significa que você pode recuperar informações, mas não pode usar a API para criar ou editar perfis do Crunchbase.
Para pesquisa de empresas, duas operações são mais importantes. Search ajuda você a encontrar registros que correspondem a critérios especificados, como empresas em uma categoria específica ou rodadas de financiamento anunciadas dentro de um intervalo de datas. Entity Lookup recupera detalhes sobre uma empresa, pessoa ou rodada de financiamento conhecida usando seu identificador. A visão geral oficial da API do Crunchbase explica essas opções e os requisitos de acesso.
As equipes podem usar esses dados para construir listas de pesquisa, enriquecer registros de CRM ou analisar atividade de financiamento. O método de acesso correto depende da frequência com que você precisa das informações e onde planeja usá-las.
Método de acesso | O que suporta | O que verificar |
Site Crunchbase | Pesquisa manual através de perfis e ferramentas de busca | Recursos e limites de visualização da sua assinatura |
Exportações de assinatura | Transferir resultados disponíveis para planilhas ou outras ferramentas | Elegibilidade de exportação, limites de linhas e usos permitidos |
Acesso licenciado à API | Recuperação programática para pesquisas recorrentes e integrações | Datasets incluídos, campos, limites de requisições e termos de licenciamento |
Serviços de dados de terceiros | Acesso através de um provedor separado que anuncia dados relacionados ao Crunchbase | Identidade do provedor, proveniência dos dados, atualização e permissão para fornecer os dados |
Limitação de requisições ou limites de concorrência | Status da resposta e código de erro da API. A referência legada v4 do Crunchbase lista HTTP 429 para limites de concorrência e HTTP 409/LA409 para limitação de taxa. | Reduza a concorrência e a frequência de requisições, coloque requisições em fila e tente novamente com backoff, seguindo qualquer orientação de retry fornecida pelo servidor. |
Algumas questões de pesquisa exigem verificar o próprio site da empresa, como quais funções ela anuncia atualmente ou como sua oferta varia por mercado. Para essas verificações suplementares, os proxies residenciais rotativos do CyberYozh App fornecem geotargeting e sessões sticky quando a localização ou consistência de sessão é importante. Eles suportam a etapa de coleta de sites; requisições autenticadas comuns à API do Crunchbase não exigem proxies residenciais.
Quanto custa a API do Crunchbase?
O Crunchbase não publica um preço padrão de API em sua página oficial de produtos. Ele direciona clientes potenciais para entrar em contato com vendas para obter preços. Para estabelecer seu orçamento, solicite uma cotação que cubra os dados e o uso que seu projeto requer.
Antes de comparar ofertas ou se comprometer com um contrato, faça estas perguntas:
O que esclarecer | Perguntas a fazer |
Campos e datasets | A cotação inclui os dados de empresa, financiamento, investidor ou previsão que precisamos? Podemos inspecionar registros de amostra? |
Uso pretendido | A licença cobre pesquisa interna, recursos voltados ao cliente, ou ambos? |
Volume e atualização | O acesso proposto suporta nosso número esperado de registros e cronograma de atualização? |
Limites e entrega | Quais limites de requisição se aplicam? Quais opções de entrega estão incluídas? |
Permissões de dados | O que podemos armazenar, por quanto tempo podemos retê-lo e o que podemos exibir ou redistribuir? |
Suporte e contrato | Qual suporte está incluído? Quais são a duração do contrato, termos de renovação e condições de cancelamento? |
Estas são perguntas para avaliar uma proposta, não uma lista confirmada dos fatores de cobrança do Crunchbase. Ao analisar os preços da API do Crunchbase, compare o escopo e as permissões juntamente com o valor cotado.
O preço da API do Crunchbase também é apenas uma parte do orçamento de implementação. Reserve tempo de engenharia para construir a integração, armazenamento para registros permitidos e manutenção quando seus requisitos ou a API mudarem. Se sua pesquisa incluir a coleta de informações de sites de empresas, orce separadamente essa coleta, validação e qualquer infraestrutura de proxy que ela exigir.
Manter esses custos separados torna o total mais fácil de avaliar: a licença da API cobre o acesso aos dados acordado, enquanto seu orçamento de implementação cobre a transformação desses dados em algo que sua equipe possa usar.
A API do Crunchbase é gratuita?
O acesso completo à API do Crunchbase é uma oferta paga. Uma conta gratuita no site não estabelece, por si só, que você tenha acesso à API.
A documentação da API básica do Crunchbase descreve acesso limitado a dados de organizações, mas a existência dessa documentação não confirma que novos usuários possam atualmente obter uma chave básica gratuita. Antes de planejar uma integração em torno disso, pergunte ao Crunchbase se você se qualifica, quais campos estão disponíveis e quais restrições se aplicam.
Se você precisar avaliar a API completa, confirme se o acesso de avaliação está disponível e o que ele inclui. Não presuma que um teste de assinatura do site também forneça acesso à API.
Como obter uma chave de API e fazer sua primeira solicitação?
Depois que o Crunchbase confirmar seu acesso à API, recupere sua chave, armazene-a com segurança e comece com uma única consulta de organização. Isso fornece uma resposta gerenciável para inspecionar antes de construir pesquisas maiores.
Confirme o acesso que seu projeto requer
Verifique se sua licença inclui os endpoints e campos que você pretende usar. Ter uma chave de API não significa que todos os conjuntos de dados estejam disponíveis para sua conta.
Recupere sua chave de API
O Crunchbase direciona os clientes da API para as configurações de Integrações de sua conta. Para contas de equipe, o proprietário da equipe pode gerar e visualizar a chave associada ao plano de API. Siga as instruções da chave de API para a conta relevante.
Armazene a chave fora do seu código-fonte
Use um gerenciador de segredos ou uma variável de ambiente local como CRUNCHBASE_API_KEY. Mantenha o valor fora de repositórios, capturas de tela e logs de solicitação. Execute solicitações autenticadas a partir do seu backend em vez de expor a chave no código do navegador.
Solicite uma organização
O exemplo abaixo usa o permalink da organização crunchbase e passa a chave através do cabeçalho X-cb-user-key. Defina a variável de ambiente com segurança antes de executá-lo.
curl --request GET \
'https://api.crunchbase.com/v4/data/entities/organizations/crunchbase?field_ids=short_description' \
--header "X-cb-user-key: ${CRUNCHBASE_API_KEY}" \
--header 'Accept: application/json'
Este é um exemplo de solicitação, não um teste ao vivo verificado. Uma resposta simplificada pode ter a seguinte estrutura; a descrição abaixo é ilustrativa.
{
"properties": {
"identifier": {
"value": "Crunchbase",
"permalink": "crunchbase",
"entity_def_id": "organization"
},
"short_description": "Illustrative company description."
}
}Inspecione a resposta antes de salvá-la
Verifique o status HTTP, confirme se o identificador retornado corresponde à empresa pretendida e inspecione quais campos solicitados estão presentes. Sua aplicação deve lidar com valores ausentes ou nulos sem tratá-los como zero, falso ou evidência de que um evento nunca aconteceu. Se um campo esperado estiver ausente, verifique sua disponibilidade e suas permissões de acesso antes de alterar a solicitação.
Quais partes da documentação da API do Crunchbase você precisa?
Comece com a operação que sua aplicação precisa executar. A documentação da API do Crunchbase separa a localização de registros correspondentes da recuperação de detalhes sobre uma entidade conhecida, com instruções adicionais para selecionar campos e buscar mais resultados.
As solicitações de pesquisa usam POST com filtros e campos solicitados em um corpo JSON. A consulta de entidade usa GET para recuperar um registro conhecido. A API permanece somente leitura: usar POST para uma pesquisa não cria ou modifica dados da empresa.
Sua tarefa | Documentação a consultar | O que verificar |
Encontrar empresas que correspondam aos critérios | Search API | Filtros, operadores, ordenação e campos solicitados suportados |
Recuperar os detalhes de uma empresa | Entity Lookup API | O UUID ou permalink da organização e as propriedades disponíveis |
Solicitar propriedades e relacionamentos específicos | field_ids e card_ids | Campos e registros relacionados suportados pelo endpoint, sujeitos ao seu acesso |
Continuar através de um conjunto de resultados | Paginação | Como solicitar páginas de pesquisa subsequentes ou registros de relacionamento adicionais |
Compreender valores ausentes | Esquemas de resposta e requisitos de acesso | Quais valores são opcionais e quais exigem permissões diferentes |
Três detalhes merecem atenção antes de construir um processo de coleta maior.
Os filtros de pesquisa usam lógica AND
Filtros separados devem todos corresponder. Dentro de um campo que suporta includes, você pode fornecer múltiplos valores para corresponder a qualquer um deles, como os identificadores de localização para os Estados Unidos ou Canadá. Para condições OR em campos diferentes, faça solicitações separadas, combine todas as páginas de resultados e remova duplicatas por identificador.
A paginação precisa de tratamento explícito
Uma resposta bem-sucedida não contém necessariamente todos os registros correspondentes. A paginação de pesquisa usa after_id com o UUID da última entidade para solicitar a próxima página. Registros relacionados retornados através de cards têm instruções de paginação separadas, portanto não presuma que a mesma abordagem se aplica em todos os lugares.
Dados ausentes devem permanecer desconhecidos
Um valor de financiamento ausente não significa que uma empresa não levantou nada. Verifique o esquema de resposta, os campos solicitados e as permissões de acesso, depois preserve valores ausentes como desconhecidos em seu banco de dados. Isso evita que registros incompletos se tornem conclusões de pesquisa enganosas.
Como você pode enriquecer registros do Crunchbase com dados do site da empresa?
Use registros licenciados do Crunchbase para identificar empresas relevantes e, em seguida, colete observações específicas de seus sites oficiais. Mantenha cada observação vinculada à sua fonte e data para que sua equipe possa distinguir dados reportados da empresa do que um site mostra atualmente.
Suponha que você queira pesquisar empresas de software que recentemente levantaram financiamento e agora anunciam vagas de engenharia ou novos produtos. As informações de financiamento fornecem a seleção inicial; a evidência do site ajuda você a decidir quais empresas merecem uma análise mais detalhada.
1. Defina o que torna uma empresa relevante
Estabeleça os critérios antes de coletar registros. Para este exemplo, selecione empresas de software em seu mercado-alvo com um anúncio de financiamento nos últimos 90 dias. Especifique quais tipos de financiamento se qualificam e como você tratará registros com datas ou valores ausentes.
Defina as questões do site com a mesma precisão: a empresa anuncia vagas de engenharia e publicou um anúncio de produto datado dentro do mesmo período? Essas questões produzem observações que sua equipe pode verificar.
2. Recupere os registros licenciados de que você precisa
Solicite os identificadores, nomes de empresas, endereços de sites e informações de financiamento relevantes disponíveis sob sua licença. Mantenha a data do anúncio de financiamento separada da data em que você recuperou o registro.
Mantenha uma cópia de origem inalterada onde sua licença permitir armazenamento. Isso fornece uma referência quando pesquisas subsequentes revelarem um nome, domínio ou descrição diferente.
3. Corresponda cada empresa ao seu domínio oficial
Comece com o endereço do site associado ao registro e, em seguida, verifique se o destino representa a mesma organização. Compare o nome da empresa, a descrição do produto e os detalhes de identificação em sua página Sobre ou de contato.
Nomes diferentes podem se referir a uma organização após uma mudança de marca, enquanto nomes semelhantes podem pertencer a empresas não relacionadas. Registre aliases confirmados e redirecionamentos de domínio. Se a correspondência permanecer incerta, sinalize-a para revisão antes de anexar observações do site ao ID da empresa.
4. Selecione páginas que respondem à questão de pesquisa
Para este exemplo, concentre-se em páginas de carreiras, anúncios de vagas individuais, anúncios de produtos e notas de lançamento. Use métodos permitidos de coleta de dados e verifique as condições de acesso do site antes de automatizar solicitações.
Um conjunto pequeno e relevante de páginas torna os resultados mais fáceis de validar. Há pouca razão para coletar um site inteiro quando a questão diz respeito a vagas de engenharia anunciadas e lançamentos recentes de produtos.
5. Extraia observações com suas limitações intactas
Registre o cargo, localização anunciada, URL do anúncio e data de publicação quando disponíveis. Para notícias de produtos, capture o título do anúncio, data de publicação e a mudança específica descrita.
Mantenha a interpretação separada. Uma vaga ativa indica que um cargo está sendo anunciado; não prova que alguém foi contratado ou que o quadro total de funcionários está crescendo. Da mesma forma, um anúncio de produto pode descrever uma prévia ou lista de espera em vez de um lançamento disponível ao público geral.
6. Salve a evidência e o horário de coleta
Armazene a URL de origem e um timestamp de coleta junto com cada observação. Capture as datas de publicação separadamente quando a página as fornecer: uma página verificada hoje ainda pode conter um anúncio de vários anos atrás.
A tabela simplificada abaixo mostra como a saída poderia parecer. Todas as empresas, identificadores, detalhes de financiamento e observações são fictícios. Uma implementação deve reter timestamps completos em vez de apenas datas.
ID da Empresa | Domínio oficial | Informações de financiamento | Sinal observado no site | Fonte | Data de verificação |
demo-001 | northstar.example | Série A; $12M; anunciado em 10 de set. de 2026 | Duas vagas de engenharia anunciadas; datas de publicação ausentes | northstar.example/careers | 7 de out. de 2026 |
demo-002 | fieldnote.example | Seed; valor não divulgado; anunciado em 21 de ago. de 2026 | Beta do produto anunciado em 28 de set. de 2026 | fieldnote.example/news/product-beta | 7 de out. de 2026 |
7. Revise incertezas antes de atualizar o conjunto de dados
Envie correspondências de domínio ambíguas, datas conflitantes e anúncios pouco claros para uma fila de revisão. Uma página de carreiras ausente deve ser registrada como indisponível no momento da verificação, não como evidência de que a empresa parou de contratar ou operar.
Preserve os valores originais quando as fontes divergirem. Por exemplo, mantenha o nome da empresa fornecido pelo Crunchbase e adicione o nome comercial atual do site como uma observação separada até que a relação seja confirmada.
O conjunto de dados resultante deve permitir que um pesquisador rastreie cada conclusão de volta à evidência. "Recentemente financiada e anunciando duas vagas de engenharia" é uma descrição defensável. "Expandindo rapidamente após financiamento" requer suporte adicional.

Quando o CyberYozh App pode ajudar com pesquisa de sites de empresas?
O CyberYozh App pode apoiar pesquisas suplementares de sites quando seu coletor precisa de uma localização geográfica selecionada ou uma sessão de proxy consistente. Comece com acesso direto se atender aos seus requisitos. Adicione infraestrutura de proxy quando uma questão de pesquisa específica ou requisito de conexão justificar.
Para as empresas de software recentemente financiadas em nosso exemplo, três capacidades são relevantes:
Seleção geográfica
Verifique como uma empresa apresenta seus produtos, preços ou disponibilidade para visitantes conectando-se de um mercado relevante. Registre a localização selecionada com suas observações. Localização do IP é apenas uma influência na página: cookies, configurações de idioma e preferências de conta também podem afetar o que aparece.
Sessões fixas
Mantenha a sessão de proxy selecionada ao verificar páginas relacionadas, como um índice de vagas e suas listagens individuais de empregos. Isso ajuda a manter o contexto de rede consistente ao longo da sequência. Seu coletor ainda precisa gerenciar seus próprios cookies e estado do navegador; uma sessão de proxy fixa não os preserva automaticamente.
Configuração de proxy
Conecte seu coletor através de um protocolo suportado, como HTTP, HTTPS ou SOCKS5. Confirme o endpoint, porta, credenciais e suporte do cliente, depois teste um pequeno conjunto de páginas antes de expandir a coleta. Mantenha as credenciais do proxy separadas da sua chave de API do Crunchbase.
Para pesquisas recorrentes, o CyberYozh App também fornece acesso à API para gerenciamento de proxy, como Verificação de endereço IP, gerenciamento de proxy, ativação de SMS, cartões bancários virtuais e muito mais. Isso pode ajudar sua aplicação a gerenciar os recursos de proxy usados pelo seu coletor de sites. O Crunchbase fornece os registros licenciados de empresas, enquanto o CyberYozh App suporta a infraestrutura para verificações suplementares de sites.
Avalie a configuração em relação à tarefa de pesquisa: você está alcançando as páginas regionais pretendidas, mantendo a sessão necessária e extraindo observações precisas? O CyberYozh App fornece controle de conexão para essas verificações de sites. A API do Crunchbase permanece como a fonte dos registros licenciados, com sua própria autenticação e limites de acesso.
O que você deve verificar quando as solicitações falham ou os registros parecem incompletos?
Primeiro, identifique onde o problema ocorre: a solicitação da API do Crunchbase, a correspondência empresa-domínio ou a coleta suplementar de sites. Cada um requer uma correção diferente. Mantenha informações de diagnóstico suficientes para rastrear a falha, incluindo o status da resposta, mensagem de erro e horário da coleta, sem registrar credenciais.
Problema | O que verificar | Próxima ação |
Autenticação ou falha de acesso | Se a chave está carregada, se o cabeçalho de autenticação está correto e se sua licença cobre o endpoint solicitado. | Corrija a configuração da chave ou confirme o acesso com a Crunchbase antes de tentar novamente |
Limitação de requisições | Os detalhes de erro da resposta, os limites de requisição aplicáveis e o volume combinado de requisições entre workers | Reduza a concorrência, enfileire as requisições e tente novamente com backoff, seguindo qualquer orientação de retry fornecida pelo servidor |
Campos de API ausentes | Os field_ids ou card_ids solicitados, o schema do endpoint e suas permissões de acesso | Corrija requisições não suportadas; preserve valores genuinamente indisponíveis como desconhecidos |
Paginação incompleta | Se você processou as páginas de busca subsequentes e resultados de card adicionais | Retome usando o método de paginação documentado e remova duplicatas de registros por identificador |
Correspondência empresa-domínio incorreta | Redirecionamentos, rebrandings, nomes de empresas semelhantes e detalhes de identificação do site | Pause o enriquecimento para esse registro e verifique o domínio antes de anexar observações |
Falha na extração do site | A página retornada, estrutura HTML alterada, renderização de JavaScriptou uma página de erro de acesso | Inspecione a resposta e atualize o parser ou método de renderização; revise as restrições de acesso antes de prosseguir com a coleta |
Dica profissional: Prefira autenticação por header em vez de colocar a chave na URL, onde ela pode ser capturada em logs de requisição ou histórico do navegador se aberta em um navegador. Configure o logging para ocultar o header de autenticação também.
Trate um resultado vazio como algo a ser investigado. Ele pode refletir critérios de busca restritivos, um campo indisponível ou uma falha de coleta. Não significa automaticamente que uma empresa não tem financiamento, vagas ou anúncios recentes.
Após corrigir o problema, execute novamente uma pequena amostra afetada e inspecione a saída antes de reiniciar a coleta completa.
Como escolher a configuração certa para sua pesquisa?
Escolha a configuração com base na frequência com que você precisa dos dados e quais perguntas eles devem responder.
Para pesquisa manual ocasional
avalie o site da Crunchbase e as exportações disponíveis na assinatura relevante. Eles podem atender às suas necessidades sem uma integração para manter.
Para enriquecimento estruturado recorrente
avalie o acesso licenciado à API da Crunchbase. Confirme que os campos disponíveis, permissões e limites de requisição suportam seu cronograma de atualização pretendido.
Para registros estruturados mais observações de sites
combine a recuperação via API com um coletor separado. Mantenha os valores de origem e as descobertas do site distinguíveis, e configure a conexão de rede do coletor de acordo com quaisquer requisitos geográficos ou de sessão.
Antes de expandir a parte de pesquisa de sites, teste um conjunto pequeno e representativo de domínios de empresas. Verifique as observações extraídas em relação às páginas de origem, confirme o comportamento da sessão entre requisições relacionadas e meça o consumo de tráfego.
Se essas verificações exigirem infraestrutura de proxy, selecione uma conexão adequada do catálogo de proxies do CyberYozh App e use os resultados do piloto para dimensionar sua próxima coleta.
