Solved by Оценка на сходство на низове
Тази функция ви помага да сравнявате две имена или текстови низове, които може да се различават по малки правописни вариации, и генерира резултат за сходство. Резултатът подпомага последователното и по-бързо вземане на решения при определяне дали вариациите вероятно се отнасят за един и същ обект.
Тази функция е предназначена за ситуации, в които малки правописни разлики затрудняват преценката дали две препратки сочат към един и същ обект. Тя генерира резултат за сходство, който количествено определя колко близки са два низа, помагайки ви да преминете от субективни предположения към повторяем процес на вземане на решения. Използвате я, като предоставяте двете стойности, които искате да сравните (например две имена на организации, имена на лица или имена на местоположения), и след това преглеждате резултата като индикатор за вероятната сила на съвпадението. Резултатът може да се използва за задаване на практически прагове за вашия работен процес, като например автоматично приемане при много висока степен на сходство, маркиране на гранични случаи за преглед и отхвърляне при ниска степен на сходство. Тя поддържа общи задачи за качество на данните, като дедупликация, свързване на записи и почистване на несъответстващи записи в различните системи. Тя е особено полезна, когато разликите произтичат от печатни грешки, алтернативни изписвания, липсваща пунктуация, съкращения или промени в интервалите. Чрез стандартизиране на сравненията с цифров резултат екипите могат да подобрят последователността между проверяващите и да намалят времето, прекарано в ръчна проверка. Функцията може да се използва и за приоритизиране на потенциалните съвпадения за преглед чрез сортиране на кандидатите по сходство. Като цяло тя ви помага да вземате по-ясни и подлежащи на одит решения относно това дали две леко различаващи се изписвания се отнасят за един и същ обект.
External Resource
https://cross-service-solutions.com/
If you know of a tool or approach that could help people solve a problem we haven't covered yet, we'd love to hear about it.