Solved by درجة تشابه السلاسل النصية
تساعدك هذه الميزة على مقارنة اسمين أو سلسلتين نصيتين قد تختلفان في بعض الاختلافات الإملائية البسيطة وتنتج درجة تشابه. تدعم هذه الدرجة اتخاذ قرارات متسقة وأسرع عند تحديد ما إذا كانت الاختلافات تشير على الأرجح إلى نفس الكيان.
تم تصميم هذه الميزة للمواقف التي تجعل فيها الاختلافات الإملائية البسيطة من الصعب الحكم على ما إذا كان مرجعان يشيران إلى نفس الكيان. فهي تولد درجة تشابه تحدد مدى قرب سلسلتين نصيتين، مما يساعدك على الانتقال من التخمين الذاتي إلى عملية اتخاذ قرار قابلة للتكرار. يمكنك استخدامها من خلال توفير القيمتين اللتين تريد مقارنتهما (على سبيل المثال، اسمي مؤسستين، أو اسمي شخصين، أو اسمي موقعين)، ثم مراجعة الدرجة كمؤشر على قوة التطابق المحتملة. يمكن استخدام الدرجة لتعيين عتبات عملية لسير عملك، مثل القبول التلقائي للتشابه العالي جداً، وتحديد الحالات الحدية للمراجعة، ورفض التشابه المنخفض. وهي تدعم مهام جودة البيانات الشائعة مثل إلغاء التكرار، وربط السجلات، وتنظيف الإدخالات غير المتسقة عبر الأنظمة. وهي مفيدة بشكل خاص عندما تنشأ الاختلافات عن الأخطاء المطبعية، أو التهجئات البديلة، أو علامات الترقيم المفقودة، أو الاختصارات، أو تغييرات المسافات. من خلال توحيد المقارنات بدرجة رقمية، يمكن للفرق تحسين الاتساق بين المراجعين وتقليل الوقت المستغرق في الفحص اليدوي. يمكن أيضاً استخدام الميزة لتحديد أولويات التطابقات المحتملة للمراجعة أولاً عن طريق فرز المرشحين حسب التشابه. وبشكل عام، فهي تساعدك على اتخاذ قرارات أوضح وقابلة للتدقيق حول ما إذا كانت تهجئتان مختلفتان قليلاً تشيران إلى نفس الكيان.
External Resource
https://cross-service-solutions.com/
If you know of a tool or approach that could help people solve a problem we haven't covered yet, we'd love to hear about it.