买数据补全最容易亏钱的一种方式,是先买“覆盖率”,再想这些数据到底允许改变什么。

供应商演示时可以给你看海量联系人、公司字段、技术栈、意向信号、职位、电话、邮箱和自动刷新。

这些都不能直接证明它会让CRM更好用。

真正有用的采购问题应该从另外四句话开始:

这个字段会影响什么决定?值从哪里来?和CRM冲突时怎么办?坏数据写进去以后怎么停、怎么撤?

这不是理论问题。

Apollo目前的CRM enrichment文档明确要求做字段映射,并把Auto-fill和Overwrite写入权限分开;HubSpot现在的enrichment/intelligence能力也直接服务于资格判断、分单、开发和触达。Forrester在2026年3月发布的B2B marketing and sales data provider评估中列出了11家重要供应商,也说明“销售数据供应商”已经是一个差异明显的正式品类,而不是随便换一家API都一样。

下面这18个问题,可以直接带进供应商Demo。

1. 你们到底会补哪些字段?

不要接受“公司数据+联系人数据”这种回答。

要按对象拿完整字段表:

  • 公司;
  • 联系人;
  • 线索;
  • 地理位置;
  • 技术栈;
  • Firmographic;
  • 就业信息;
  • Intent;
  • 关系数据;
  • 合规/抑制字段。

然后把字段再分三类:

决策关键字段:会直接影响分单、评分、区域、合规或选账户。

流程有用字段:能节省人工研究,但不会自动改变归属。

装饰字段:看起来完整,但不改变任何动作。

如果供应商连schema都解释不清楚,实施通常比Demo更麻烦。

2. 每个字段到底从哪里来?

“Proprietary data”不够。

你至少要知道来源模型:

  • 第一方;
  • 公开来源;
  • 授权数据;
  • 合作伙伴;
  • 模型推断;
  • 估算。

还要继续问:

  • 是公司级还是联系人级?
  • 单一来源还是多源合并?
  • 是观察事实还是概率推断?
  • 来源冲突时谁优先?

对高风险字段,来源透明度和覆盖率一样重要。

3. 每类字段的“新鲜度”到底怎么算?

职位变化速度和公司成立年份完全不是一回事。

不要接受一个“整个数据库每天更新”的统一口径。

按字段问:

字段 应该追问什么
职位 换岗多久能发现?
员工规模 多久重新估算?
邮箱/电话 最后一次验证是什么时候?
技术栈 是观察、推断还是自报?
地理位置 总部、账单地址、门店还是个人所在地?

一个号称每天刷新的数据库,里面不同字段仍然可能有完全不同的更新时间。

4. 你们说的“覆盖率”分母是什么?

Coverage可以有很多意思:

  • 找到这家公司;
  • 某字段有值;
  • 某字段最近更新;
  • 邮箱经过验证;
  • 记录属于目标国家;
  • 记录符合ICP;
  • 该字段可以合法进入你的业务流程。

这些不是一回事。

所有漂亮百分比,都要求供应商讲清楚分子和分母。

5. 购买前能不能用我们的真实样本测试?

这是最值钱的问题之一。

自己准备一个故意很难的样本:

  • 空记录;
  • 陈旧记录;
  • 最近人工核实过的记录;
  • 子公司;
  • 被收购公司;
  • 国际公司;
  • 刚换工作的人;
  • 域名不明确的公司。

不要让供应商只挑容易补的数据。

6. “补空白”和“覆盖原值”能不能分开控制?

Apollo目前文档对这一点写得很清楚:

Auto-fill只在CRM字段为空时补值;Overwrite则可以替换已有字段。

你的采购要求也应该一样清楚。

继续问权限能否按下面维度设置:

  • 单字段;
  • 单对象;
  • 单工作流;
  • 单来源;
  • 单客户分组;
  • 是否人工验证过。

能补数据、但不能治理写回,往往会把清洗成本转移给你的团队。

7. 人工核实过的值能不能保护?

销售昨天刚和客户确认了职位,今天凌晨第三方数据库不应该自动把它改回旧值。

可以直接问能不能设:

  • 人工确认职位90天内不覆盖;
  • 战略账户等级永不自动覆盖;
  • 法人名称不经过人工不覆盖;
  • 员工规模只填空白;
  • 冲突进入异常队列而不是强写。

8. 两个来源冲突时会发生什么?

不要只问“准确率”。

问冲突流程。

成熟一点的系统应该能:

  • 保留原值;
  • 显示建议值;
  • 标注来源;
  • 标记置信/审核状态;
  • 送进异常队列。

如果答案是“我们的数据更准,所以直接覆盖”,继续问。

9. CRM里能不能看到历史和来源?

HubSpot当前的intelligence/enrichment能力本身就把补全信息放到记录理解中。

无论你用谁,都应该能回答:

谁在什么时间,把哪个字段从什么改成什么,依据是什么?

看不到历史,排错只能靠猜。

10. 实时补全和定时补全分别怎么控制?

实时适合新进线索,定时适合老数据库。

这两个不是同一个需求。

要问:

  • 什么动作触发实时补全?
  • 定时任务多久能跑一次?
  • 两种方式积分怎么算?
  • 能不能按条件筛选?
  • 能不能马上暂停?
  • 供应商接口失败时怎么处理?
  • 半途中断会不会自动重试?

不要为了“real-time”三个字多付钱,买真正符合决策节奏的刷新方式。

11. 积分、限额、超额到底怎么算?

让供应商拿你的预计量做一份真实计算。

至少问:

  • 什么动作消耗credit?
  • 没查到也扣吗?
  • 同一条记录重复刷新还扣吗?
  • 联系人和公司是否不同价?
  • 查看、导出、解锁是否单独收费?
  • 实时自动任务会不会突然把积分烧完?

头部报价最便宜,不代表真实工作流最便宜。

12. 重复公司和实体识别怎么做?

数据补全最危险的情况之一,是系统分不清:

“ABC Holdings”“ABC US”“abc.com”到底是一家公司、母子公司还是完全不同实体。

要问供应商怎么处理:

  • 母公司/子公司;
  • 法人和品牌;
  • 多域名;
  • 并购;
  • 别名;
  • 重复联系人;
  • 重新分配的电话号码或邮箱。

只要数据会影响账户归属,这一项就非常重要。

13. 哪些国家和语言是真的强?

“全球覆盖”经常掩盖地区差异。

如果你要卖美国、加拿大、日本、德国、新加坡,就拿这五个市场分别测试。

还要问:

  • 职位标准化是否支持当地语言;
  • 地址格式是否正确;
  • 公司注册信息从哪里来;
  • 电话验证是不是各国都一样;
  • 本地公司域名是否容易识别。

14. 隐私、删除、抑制名单怎么处理?

这不是“有隐私政策就行”。

要问:

  • opt-out怎么保存;
  • 删除请求怎么传递;
  • do-not-contact是否能锁住;
  • 不同地区法规怎么映射到工作流;
  • 已删除字段会不会下一轮又被补回来;
  • 抑制决定有没有审计记录。

如果数据会进入自动开发,这些答案最好拿书面确认。

15. 哪些字段是推断,不是观察事实?

有些字段天生就是估算。

员工数、意向、收入区间、技术栈、购买阶段、资历,可能在不同供应商中有不同推断成分。

要求供应商明确标注。

否则销售会把“模型认为”当成“已经确认”。

16. 怎么证明补全真的有效?

不要只看“数据库完整率”。

试点可以看:

  • 合格空字段填充率;
  • 与人工可信样本一致率;
  • 有害冲突率;
  • 进入异常队列的比例;
  • 每个账户节省多少人工研究时间;
  • 分单修正量;
  • 无效联系方式下降多少;
  • 补全组与未补全组的会议/机会表现。

具体看哪个指标,要由字段最终影响什么业务决定决定。

17. 回滚方案是什么?

这个问题非常能看出成熟度。

继续追问:

  • 旧值能不能恢复?
  • 有没有字段级变更历史?
  • 错误批次能不能单独隔离?
  • 能不能立即暂停写入?
  • 断开集成会不会把历史一起丢掉?
  • 能不能只停某一个有问题的字段?

如果回滚只能靠数据库整体恢复,说明控制粒度不够。

18. 什么情况下你们会主动建议我们别买?

这是Demo最后最好用的问题。

可信的供应商应该能说出它不适合的情况,例如:

  • 你的目标市场正好是它的弱覆盖区;
  • CRM本身重复和脏数据太严重;
  • 你没有字段所有权规则;
  • 你的需求其实需要人工一手调查;
  • 使用量太小,经济性不成立;
  • 合规流程承接不了第三方数据。

如果答案是“所有公司都适合”,说明资格判断还没开始。

可以直接带进Demo的评分表

每家供应商按1–5分打分,再按你的业务权重计算:

维度 权重 供应商A 供应商B 供应商C
目标市场覆盖 20%
决策关键字段质量 20%
来源/历史可追溯 15%
写回控制 15%
实体识别 10%
隐私/抑制工作流 10%
真实用量成本 5%
回滚与支持 5%

不要因为“总字段数量最多”就让一家供应商赢。

权重应该落在真正会改变业务决定的字段和控制能力上。

签约前最后十步

  1. 只选5–10个最重要字段;
  2. 每个字段写清补空白还是允许覆盖;
  3. 准备一批故意难的数据;
  4. 提前确定验收指标;
  5. 把隐私和抑制流程写清楚;
  6. 模拟真实积分成本;
  7. 测试冲突处理;
  8. 测试回滚;
  9. 小范围试点;
  10. 达到字段级验收标准后再放大。

真正的采购原则只有一句:

数据补全不是购买“更多字段”,而是购买外部证据,以及把这些证据安全并入CRM的机制。

最值得买的供应商,不是Demo里填得最多的那一个,而是能把“不一致”明确暴露出来,并让你控制它怎么进入业务流程的那一个。

资料来源

相关阅读