Crunchbase API:定价、访问权限与企业数据丰富化

Crunchbase API:定价、访问和公司数据增强
一份最近获得融资的公司列表为您的团队提供了一个起点。要将其用于 潜在客户开发 或 市场研究,您需要了解每条记录包含什么内容、如何将其导入您的系统,以及哪些问题仍需访问公司网站。融资历史可以帮助您筛选企业;其招聘页面或最新产品公告可能会解释为什么它对您今天的研究很重要。
Crunchbase API 可以提供结构化的公司数据,但规划集成不仅仅是获取 API 密钥。您需要确认对所需字段的访问权限、制定预算,并决定如何收集和维护补充信息。
本指南涵盖定价、访问、文档和实施,然后展示如何将公司记录与网站研究相结合,包括 CyberYozh App 的代理基础设施可以在哪些方面支持该额外收集。
摘要
Crunchbase API 提供对结构化公司和融资数据的只读访问,具体取决于您的许可证。
定价需要销售报价。在假设存在免费选项之前,请确认当前 Basic API 资格或评估访问权限。
使用 Search 查找匹配记录,使用 Entity Lookup 检索已知公司的详细信息。
使用公司网站观察结果丰富记录,保留源 URL、时间戳和不确定性。
CyberYozh App 可以支持需要地理位置选择或 粘性会话的补充网站检查。普通 Crunchbase API 请求不需要代理,代理也不会扩展许可访问权限。
访问 CyberYozh 应用程序以获取 API 访问。
Crunchbase 有 API 吗?可以用它做什么?
是的,Crunchbase 提供只读 REST API,用于检索有关公司、人员、融资轮次和收购的结构化数据,可用记录和字段取决于您的许可访问权限。只读意味着您可以检索信息,但不能使用 API 创建或编辑 Crunchbase 档案。
对于公司研究,两个操作最为重要。 Search 帮助您查找符合指定条件的记录,例如特定类别中的公司或在日期范围内宣布的融资轮次。 Entity Lookup 使用标识符检索有关已知公司、人员或融资轮次的详细信息。Crunchbase 的官方 API 概述解释了这些选项和访问要求。
团队可以使用这些数据构建研究列表、丰富 CRM 记录或分析融资活动。正确的访问方法取决于您需要信息的频率以及计划在何处使用它。
访问方式 | 支持的功能 | 需要检查的内容 |
Crunchbase 网站 | 通过档案和搜索工具进行手动研究 | 订阅的功能和查看限制 |
订阅导出 | 将可用结果导入电子表格或其他工具 | 导出资格、行数限制和允许的用途 |
授权 API 访问 | 用于定期研究和集成的程序化检索 | 包含的数据集、字段、请求限制和许可条款 |
第三方数据服务 | 通过宣传提供 Crunchbase 相关数据的独立提供商进行访问 | 提供商身份、数据来源、新鲜度和提供数据的权限 |
请求限流或并发限制 | 响应状态和 API 错误代码。Crunchbase 的旧版 v4 参考文档列出了 HTTP 429 用于并发限制,HTTP 409/LA409 用于速率限制。 | 降低并发和请求频率,将请求排队,并采用退避重试,遵循服务器提供的任何重试指导。 |
某些研究问题需要检查公司自己的网站,例如它当前发布的职位或其产品在不同市场的差异。对于这些补充检查,CyberYozh App 的 轮换住宅代理 提供 地理定位 和粘性会话,适用于位置或会话一致性很重要的情况。它们支持网站采集步骤;普通的经过身份验证的 Crunchbase API 请求不需要住宅代理。
Crunchbase API 的费用是多少?
Crunchbase 不在其官方产品页面上公布标准 API 价格。它指引潜在客户联系销售部门获取定价。要确定预算,请索取涵盖项目所需数据和使用量的报价。
在比较报价或签订合同之前,请询问以下问题:
需要明确的内容 | 需要询问的问题 |
字段和数据集 | 报价是否包含我们需要的公司、融资、投资者或预测数据?我们能否查看样本记录? |
预期用途 | 许可证是否涵盖内部研究、面向客户的功能,还是两者都包括? |
数量和新鲜度 | 建议的访问权限是否支持我们预期的记录数量和刷新计划? |
限制和交付 | 适用哪些请求限制?包含哪些交付选项? |
数据权限 | 我们可以存储什么,可以保留多长时间,可以显示或重新分发什么? |
支持和合同 | 包含哪些支持?合同期限、续订条款和取消条件是什么? |
这些是评估提案时需要提出的问题,而非 Crunchbase 计费因素的确认清单。在审查 Crunchbase API 定价时,请将范围和权限与报价金额一并比较。
Crunchbase API 价格 也只是实施预算的一部分。需要为构建集成的工程时间、存储许可记录以及在需求或 API 变更时的维护预留资金。如果您的研究包括从公司网站收集信息,请单独为该收集、验证以及所需的任何代理基础设施编制预算。
将这些成本分开可以更容易评估总额:API 许可涵盖约定的数据访问,而您的实施预算涵盖将这些数据转化为团队可用内容的工作。
Crunchbase API 是否免费?
完整的 Crunchbase API 访问是付费服务。免费网站账户本身并不代表您拥有 API 访问权限。
Crunchbase 的 Basic API 文档描述了对组织数据的有限访问,但该文档的存在并不能确认新用户目前可以获得免费的 Basic 密钥。在围绕它规划集成之前,请询问 Crunchbase 您是否符合条件、哪些字段可用以及适用哪些限制。
如果您需要评估完整的 API,请确认是否提供评估访问权限以及包含哪些内容。不要假设网站订阅试用也提供 API 访问权限。
如何获取 API 密钥并发出首次请求?
一旦 Crunchbase 确认您的 API 访问权限,请获取您的密钥,安全存储它,并从单个组织查询开始。这将为您提供一个可管理的响应,以便在构建更大规模搜索之前进行检查。
确认您的项目所需的访问权限
检查您的许可是否包含您打算使用的端点和字段。拥有 API 密钥并不意味着每个数据集都对您的账户可用。
获取您的 API 密钥
Crunchbase 指引 API 客户前往其账户的 集成 设置。对于团队账户,团队所有者可以生成并查看与 API 计划关联的密钥。请按照相关账户的 API 密钥说明操作。
将密钥存储在源代码之外
使用密钥管理器或本地环境变量(如 CRUNCHBASE_API_KEY)。将该值排除在代码仓库、截图和请求日志之外。从后端运行经过身份验证的请求,而不是在浏览器代码中暴露密钥。
请求单个组织
下面的示例使用组织永久链接 crunchbase 并通过 X-cb-user-key 标头传递密钥。在运行之前安全地设置环境变量。
curl --request GET \
'https://api.crunchbase.com/v4/data/entities/organizations/crunchbase?field_ids=short_description' \
--header "X-cb-user-key: ${CRUNCHBASE_API_KEY}" \
--header 'Accept: application/json'
这是一个示例请求,而非经过验证的实时测试。简化的响应可能具有以下结构;下面的描述仅供说明。
{
"properties": {
"identifier": {
"value": "Crunchbase",
"permalink": "crunchbase",
"entity_def_id": "organization"
},
"short_description": "Illustrative company description."
}
}在保存响应之前检查它
检查 HTTP 状态,确认返回的标识符与目标公司匹配,并检查存在哪些请求的字段。您的应用程序应处理缺失或空值,而不将它们视为零、假或某个事件从未发生的证据。如果预期字段缺失,请在更改请求之前检查其可用性和您的访问权限。
您需要 Crunchbase API 文档的哪些部分?
从您的应用程序需要执行的操作开始。Crunchbase API 文档将查找匹配记录与检索已知实体的详细信息分开,并提供有关选择字段和获取更多结果的附加说明。
搜索请求使用 POST,在 JSON 正文中包含过滤器和请求的字段。实体查询使用 GET 检索已知记录。API 保持只读:对搜索使用 POST 不会创建或修改公司数据。
您的任务 | 需要查阅的文档 | 需要检查的内容 |
查找符合条件的公司 | Search API | 支持的过滤器、运算符、排序和请求字段 |
检索单个公司的详细信息 | Entity Lookup API | 组织的 UUID 或永久链接以及可用属性 |
请求特定属性和关系 | field_ids 和 card_ids | 端点支持的字段和相关记录,取决于您的访问权限 |
遍历结果集 | 分页 | 如何请求后续搜索页面或其他关系记录 |
理解缺失值 | 响应架构和访问要求 | 哪些值是可选的,哪些需要不同的权限 |
在构建更大规模的采集流程之前,有三个细节值得注意。
搜索过滤器使用 AND 逻辑
所有单独的过滤器必须全部匹配。在支持 includes 的字段中,您可以提供多个值来匹配其中任何一个,例如美国或加拿大的位置标识符。对于跨不同字段的 OR 条件,需要发出单独的请求,合并所有结果页面,并按标识符去除重复项。
分页需要显式处理
成功的响应不一定包含所有匹配记录。搜索分页使用 after_id 和最后一个实体的 UUID 来请求下一页。通过 cards 返回的相关记录有单独的分页说明,因此不要假设相同的方法适用于所有地方。
缺失数据应保持为未知
缺少融资值并不意味着公司没有筹集资金。检查响应架构、请求的字段和访问权限,然后在数据库中将缺失值保留为未知。这可以防止不完整的记录导致误导性的研究结论。
如何使用公司网站数据丰富 Crunchbase 记录?
使用获得许可的 Crunchbase 记录来识别相关公司,然后从其官方网站收集特定观察结果。将每个观察结果与其来源和日期关联,以便您的团队能够区分报告的公司数据和网站当前显示的内容。
假设您想研究最近获得融资并且正在招聘工程职位或发布新产品的软件公司。融资信息为您提供初步筛选;网站证据帮助您决定哪些公司值得更深入审查。
1. 定义公司的相关性标准
在收集记录之前设定标准。对于此示例,选择目标市场中在过去 90 天内有融资公告的软件公司。指定哪些融资类型符合条件,以及如何处理日期或金额缺失的记录。
同样精确地定义网站问题:公司是否发布工程职位空缺,是否在同一时期内发布了带日期的产品公告?这些问题产生您的团队可以检查的观察结果。
2. 检索所需的许可记录
请求您的许可证下可用的标识符、公司名称、网站地址和相关融资信息。将融资公告日期与您检索记录的日期分开保存。
在许可证允许存储的情况下,保留未更改的源副本。这样,当后续研究发现不同的名称、域名或描述时,您就有了参考。
3. 将每个公司与其官方域名匹配
从与记录关联的网站地址开始,然后检查目标是否代表同一组织。比较公司名称、产品描述以及其关于页面或联系页面上的识别详细信息。
不同的名称可能在品牌重塑后指向同一组织,而相似的名称可能属于不相关的企业。记录已确认的别名和 域名重定向。如果匹配仍不确定,请在将网站观察结果附加到公司 ID 之前标记以供审查。
4. 选择能够回答研究问题的页面
在此示例中,重点关注招聘页面、单个职位列表、产品公告和发布说明。使用允许的 数据采集 方法,并在自动化请求之前检查网站的访问条件。
一个小而相关的页面集合使结果更容易验证。当问题涉及广告招聘的工程职位和近期产品发布时,几乎没有理由采集整个网站。
5. 提取观察结果并保留其限制
记录职位名称、广告位置、列表 URL 和发布日期(如果可用)。对于产品新闻,捕获公告标题、发布日期和描述的具体变化。
保持解释的独立性。一个有效的职位空缺表明某个职位正在招聘;它并不能证明已有人被雇用或总员工人数正在增长。同样,产品公告可能描述的是预览版或候补名单,而不是正式发布的版本。
6. 保存证据和采集时间
在每个观察结果旁边存储源 URL 和采集时间戳。当页面提供发布日期时,单独捕获它们:今天检查的页面仍可能包含几年前的公告。
下面的简化表格显示了输出可能的样子。 所有公司、标识符、融资详情和观察结果均为虚构。 实现应保留完整的时间戳而不仅仅是日期。
公司 ID | 官方域名 | 融资信息 | 观察到的网站信号 | 来源 | 检查日期 |
demo-001 | northstar.example | A 轮;1200 万美元;2026 年 9 月 10 日公布 | 广告招聘两个工程职位;发布日期缺失 | northstar.example/careers | 2026 年 10 月 7 日 |
demo-002 | fieldnote.example | 种子轮;金额未披露;2026 年 8 月 21 日公布 | 2026 年 9 月 28 日公布产品测试版 | fieldnote.example/news/product-beta | 2026 年 10 月 7 日 |
7. 在更新数据集之前审查不确定性
将模糊的域名匹配、冲突的日期和不清楚的公告发送到审查队列。缺失的招聘页面应记录为检查时不可用,而不是作为公司停止招聘或运营的证据。
当来源不一致时,保留原始值。例如,保留 Crunchbase 提供的公司名称,并将网站当前的商业名称作为单独的观察结果添加,直到关系得到确认。
最终的数据集应该让研究人员能够将每个结论追溯到证据。"最近获得融资并广告招聘两个工程职位"是一个可靠的描述。"融资后快速扩张"需要进一步的支持。

CyberYozh App 何时可以帮助进行公司网站研究?
当您的采集器需要选定的地理位置或一致的代理会话时,CyberYozh App 可以支持补充性网站研究。如果直接访问满足您的要求,请从直接访问开始。当特定的研究问题或连接要求证明其合理性时,添加代理基础设施。
对于我们示例中最近获得融资的软件公司,三种功能是相关的:
地理位置选择
检查公司如何向从相关市场连接的访问者展示其产品、定价或可用性。在您的观察结果中记录选定的位置。 IP 位置 只是影响页面的因素之一:Cookie、语言设置和账户偏好也会影响显示的内容。
粘性会话
在检查相关页面时保持选定的代理会话,例如职位索引及其各个职位列表。这有助于在整个序列中保持网络上下文的一致性。您的采集器仍需要管理自己的 Cookie 和浏览器状态;粘性代理会话不会自动保留这些内容。
代理配置
通过支持的协议连接您的采集器,例如 HTTP、HTTPS 或 SOCKS5。确认端点、端口、凭据和客户端支持,然后在扩展采集之前测试一小组页面。将代理凭据与您的 Crunchbase API 密钥分开保存。
对于定期研究,CyberYozh App 还提供用于代理管理的 API 访问,例如 检查 IP 地址、代理管理、 短信激活、 虚拟银行卡 等。这可以帮助您的应用程序管理其网站采集器使用的代理资源。Crunchbase 提供授权的公司记录,而 CyberYozh App 支持补充网站检查的基础设施。
根据研究任务评估设置:您是否访问了预期的区域页面、保持了所需的会话并提取了准确的观察结果?CyberYozh App 为这些网站检查提供连接控制。Crunchbase API 仍然是授权记录的来源,具有自己的身份验证和访问限制。
当请求失败或记录看起来不完整时,您应该检查什么?
首先,确定问题发生的位置:Crunchbase API 请求、公司域名匹配还是补充网站采集。每种情况都需要不同的修复方法。保留足够的诊断信息以追踪故障,包括响应状态、错误消息和采集时间,但不要记录凭据。
问题 | 检查内容 | 下一步操作 |
身份验证 或访问失败 | 检查密钥是否已加载、身份验证标头是否正确以及您的许可证是否涵盖所请求的端点。 | 纠正密钥配置或在重试前向 Crunchbase 确认访问权限 |
请求限流 | 响应的错误详情、适用的请求限制以及所有工作进程的总请求量 | 降低并发数、将请求加入队列,并 使用退避策略重试,遵循服务器提供的任何重试指导 |
缺失 API 字段 | 请求的 field_ids 或 card_ids、端点架构以及您的访问权限 | 纠正不支持的请求;将真正不可用的值保留为未知 |
分页不完整 | 检查您是否处理了后续搜索页面和额外的卡片结果 | 使用文档中的分页方法继续,并按标识符去重记录 |
公司域名匹配错误 | 重定向、品牌更名、相似的公司名称以及网站识别详情 | 暂停该记录的数据丰富,在附加观察结果前验证域名 |
网站提取失败 | 返回的页面、变更的 HTML 结构、 JavaScript 渲染或访问错误页面 | 检查响应并更新 解析器 或渲染方法;在进一步采集前审查访问限制 |
专业提示: 优先使用请求头身份验证,而不是将密钥放在 URL 中,因为在浏览器中打开时可能被请求日志或浏览器历史记录捕获。同时配置日志以隐藏身份验证请求头。
将空结果视为需要调查的情况。它可能反映了限制性搜索条件、不可用的字段或采集失败。它并不自动意味着公司没有融资、职位空缺或近期公告。
纠正问题后,重新运行一小部分受影响的样本并检查输出,然后再重启完整采集。
如何为您的研究选择合适的配置?
围绕数据需求频率和必须回答的问题来选择配置。
对于偶尔的手动研究
评估相关订阅下可用的 Crunchbase 网站和导出功能。这些可能无需维护集成即可满足您的需求。
对于定期的结构化数据丰富
评估授权的 Crunchbase API 访问。确认可用字段、权限和请求限制支持您预期的刷新计划。
对于结构化记录加网站观察
将 API 检索与独立的采集器结合使用。保持源值和网站发现可区分,并根据任何地理或会话要求配置采集器的网络连接。
在扩展网站研究部分之前,测试一小组具有代表性的公司域名。对照源页面检查提取的观察结果,确认相关请求之间的会话行为,并测量流量消耗。
如果这些检查需要代理基础设施,请从 CyberYozh App 代理 目录 中选择合适的连接,并使用试点结果来规划下一次采集的规模。
