为每次字符串比较提供一致的数值相似度评分,以便随时间跟踪结果并在不同数据集之间进行比较。将评分与清晰、易于理解的理由相结合,解释两个字符串被视为匹配或不匹配的原因。
此功能添加了一个用于比较两个字符串的一致数值相似度度量,使您能够以可重复的方式量化两个值的接近程度。每次比较都会返回一个可存储、可分析趋势并用于为不同工作流程设置匹配阈值的评分。除了数值评分外,该功能还会生成解释,描述增加或减少相似度的主要因素,帮助用户理解匹配决策。这使得在审查、审计或利益相关者讨论期间更容易证明自动匹配结果的合理性。该评分可用于对结果进行分组(高置信度匹配、可能匹配和不匹配),并在需要时优先进行人工验证。它还支持通过跟踪平均评分、评分分布以及规则更新后的变化来监控随时间推移的质量。在实践中,这对于去重、实体解析、记录链接以及清理用户输入的文本(如姓名或地址)非常有用。解释组件通过显示令人惊讶的匹配发生的原因或预期匹配失败的原因来支持调试。总的来说,该功能提高了字符串匹配决策的透明度、一致性和操作控制。
外部资源
https://cross-service-solutions.com/