AI 与网页数据 · 应用场景
用实时网络补全线索,而不是用人人都买过的名单
从公开来源获取公司数据、联系人和信号,反映它们今天的状态,按你的 schema 结构化,每个字段都有来源。
失败请求免费流量永不过期未使用套餐 24 小时内可退款
acme.itEnrich3 sources · 2.8 s
Company website0.9 sBusiness registry1.1 sProfessional profile0.8 s
ACME S.r.l.CRM record · 7 fields · 3 sources
CompanyACME S.r.l.registry
Domainacme.itwebsite
VATIT01234567890registry
Employees120profile
HQ
Milanregistry
IndustryIndustrial automationwebsite
Contacts3 foundwebsite
confidence 0.94duplicates merged: 2re-enrich: monthlyreturned via API
每家公司一条记录,每个字段都有来源。
要点
当公司页面和行业目录拦截自动化访问时,潜在客户信息补全就会停滞。Unlocker API 越过防护抓取每个页面,并以 JSON 返回你要求的字段,只在页面成功返回时计费。
为什么潜在客户信息补全难以规模化
购买的联系人名单一到手就已过时,而且和每个竞争对手买到的一模一样。另一种做法是从实时公开来源补全:公司官网、工商登记、职业社交网络、新闻。这些数据是最新的,也只属于你,但收集起来很难。
这些来源大多会拦截自动化访问。公司网站部署了反爬虫系统,职业社交网络严格限速,各国的工商登记返回的格式也各不相同。即使拿到了数据,匹配环节也最容易丢失准确性:同一家公司会以三种名称写法、两个域名和一家子公司出现,简单的流程会生成三条记录。
Datafuel 如何处理潜在客户信息补全
Unlocker API 能访问那些会拦截的来源,并以结构化 JSON 返回你要求的字段,而不是一张需要解析的页面。你来定义 schema,公司名称、域名、员工人数、所在地、联系人,每次请求都会返回填好的结果。
记录会跨来源进行实体解析,因此一家公司是一个实体,而不是三个,每个字段都附带其来源。当销售同事问某个数字从哪里来时,答案就附在记录上。
记录准确率,第 1–7 个月37% 对比 90%
购买的名单实时补全刷新
第 1 个月第 7 个月
适用于潜在客户信息补全的产品
所有应用场景价格相同。失败请求免费,已购流量永不过期。
工作原理
- 01发送一个域名或公司名称,以及你想填充的 schema。
- 02Datafuel 抓取相关公开来源,按你的 schema 提取并完成实体解析。
- 03通过 API 返回一条补全后的记录,每个字段都带有来源,可直接写入你的 CRM。
在你自己的目标上试试。失败请求免费。免费开始
注意事项
- 信息补全涉及个人数据。只收集你有合法依据的数据,并在存储任何内容之前确定保留期限。
- 先用强键匹配:域名、注册号,然后才是名称。只按名称匹配会产生重复记录。
- 记录会过时。安排定期重新补全;一次性抓取的数据一个季度内就会过时。
潜在客户信息补全:常见问题
你们可以从哪些来源补全信息?
任何公开来源:公司网站、工商登记、新闻、行业目录。需要登录的来源通过静态 ISP 会话处理。
我可以定义自己的字段吗?
可以。发送 JSON schema,或用自然语言描述字段。
你们如何处理重复记录?
记录按域名、注册号、电话和规范化名称进行匹配,并在合并时保留字段级来源。
这符合 GDPR 吗?
数据收集通过基于用户同意、符合 GDPR 的基础设施进行。存储哪些数据、保存多久由你决定;我们可以帮你确定范围。
我可以把结果直接推送到 HubSpot 或 Salesforce 吗?
目前需通过你自己的集成:调用 API 并将记录写入 CRM。原生集成已在规划中。
最后更新:。