arXiv研究提出B2B客户转化预测框架,准确率达 91%
该框架基于多键聚合联系人、聚类非标准公司名称,并采用CatBoost模型进行预测,论文已在KDD 2023相关研讨会上展示。
AI解读:B2B销售周期长,企业常因缺乏数据整合而难以判断哪些客户值得投入营销资源。这项研究针对单次销售场景,提出了一个将多个联系人聚合到客户层面的算法:对于公司名称这类不标准的信息,它能处理拼写错误和变体,从而将散乱的记录归并到正确客户下。随后,框架基于聚合数据生成特征,并用CatBoost梯度提升模型预测客户是否会表现出购买兴趣,即是否可能进入销售漏斗。作者称该框架在数据集上达到了 91% 的预测准确率。这意味着,市场营销团队可以更精准地筛选高潜力客户,并据此设计个性化活动,减少对低意向客户的无效触达。不过,91% 的准确率基于论文所用数据,且论文未披露数据集规模或覆盖面,因此这一数字不代表在所有行业或客户群中的普适效果。普通企业无需立即行动,但从事B2B营销数据分析的团队可借鉴其聚合逻辑,将类似的去重和预测思路整合到现有流程中。
据arXiv于 2026 年 9 月 3 日发布的一篇论文(编号arXiv:2609.03239),来自普渡大学等机构的研究团队提出一套B2B客户转化预测框架,在实验中实现了 91% 的预测准确率。该研究由Tianqi Wang、Sheikh Shams Azam、Wan Eih Huang、Anton Wiranata、Christopher G. Brinton、Jan P. Allebach共同撰写,相关成果已在KDD 2023的“端到端客户旅程优化”研讨会上展示。
面向单次销售场景,聚焦长周期客户筛选
论文针对一次性销售的B2B场景,指出此类业务的采购周期可能长达数月甚至数年。在此过程中,识别购买潜力高的客户并据此推荐个性化营销活动,有助于提升营销效率。研究关注的问题包括B2B客户数据的聚合、客户特征生成,以及预测客户是否会对购买表现出兴趣(即是否进入销售漏斗)。
聚合联系人并处理非标准公司名称
研究团队提出了一种算法,基于多个键将个别联系人聚合到B2B客户层面。对于公司名称等非标准化键,他们设计了一种新的架构,用于在包含拼写错误和拼写变体等不规则情况的域中进行聚类。在完成数据聚合后,框架定义并生成一组特征,然后应用CatBoost模型进行客户转化预测。
基于预测结果讨论个性化活动推荐
论文称该框架的预测准确率达 91%。基于预测结果和模型分析,作者进一步讨论了个性化活动推荐如何促进客户转化。论文共 10 页,包含 6 张图。