Решает Оценка сходства строк
Предоставляйте последовательный числовой показатель сходства для каждого сравнения строк, чтобы результаты можно было отслеживать с течением времени и сравнивать между наборами данных. Сопровождайте оценку четкими, понятными человеку причинами, объясняющими, почему две строки были признаны совпадающими или нет.
Эта функция добавляет последовательную числовую метрику сходства для сравнения двух строк, позволяя количественно оценить близость двух значений воспроизводимым способом. Каждое сравнение возвращает оценку, которую можно сохранять, анализировать в динамике и использовать для установки порогов совпадения для различных рабочих процессов. Наряду с числовой оценкой функция выдает пояснение, описывающее основные факторы, которые увеличили или уменьшили сходство, помогая пользователям понять решения о совпадении. Это облегчает обоснование результатов автоматического сопоставления во время проверок, аудитов или обсуждений с заинтересованными сторонами. Оценку можно использовать для группировки результатов (совпадения с высокой степенью уверенности, возможные совпадения и несовпадения) и приоритизации ручной проверки там, где это необходимо. Она также поддерживает мониторинг качества с течением времени путем отслеживания средних оценок, распределения оценок и изменений после обновлений правил. На практике это полезно для дедупликации, разрешения сущностей, связывания записей и очистки введенного пользователем текста, такого как имена или адреса. Компонент объяснения поддерживает отладку, показывая, почему произошло неожиданное совпадение или почему ожидаемое совпадение не удалось. В целом, функция повышает прозрачность, согласованность и операционный контроль над решениями по сопоставлению строк.
Внешний ресурс
https://cross-service-solutions.com/
Если вы знаете инструмент или подход, который мог бы помочь решить проблему, которую мы ещё не рассматривали, мы будем рады об этом услышать.