Resolvido por Pontuação de Similaridade de Strings
Este recurso permite definir um limite de similaridade claro (por exemplo, 0,85) que sinaliza automaticamente itens como possíveis duplicatas. Isso ajuda os revisores a concentrarem-se nas correspondências de maior confiança, reduzindo a verificação manual e melhorando a consistência na detecção de duplicatas.
Este recurso permite definir um limite numérico de similaridade que determina quando um par de itens deve ser sinalizado automaticamente como possível duplicata para revisão humana. Você escolhe o valor do limite (como 0,85) com base no quão rigorosa você deseja que seja a sinalização de duplicatas. Quando a similaridade atinge ou excede o limite, o sistema marca os itens para revisão em vez de exigir que os usuários pesquisem e comparem tudo manualmente. Isso cria uma regra consistente e repetível para o que conta como “possível duplicata”, o que pode reduzir divergências entre os revisores. Também ajuda as equipes a priorizar o esforço de revisão, exibindo apenas os candidatos mais relevantes. Um limite mais alto geralmente resulta em menos sinalizações com maior confiança, enquanto um limite mais baixo pode exibir mais duplicatas potenciais para uma revisão mais ampla. Isso é útil em fluxos de trabalho onde registros, envios, tickets ou entidades duplicadas podem criar ruído nos relatórios ou ineficiência operacional. Ele oferece suporte ao controle de qualidade, garantindo que possíveis duplicatas sejam identificadas precocemente e encaminhadas para uma etapa de revisão. O resultado é uma fila de revisão mais simplificada e uma melhor limpeza dos dados ao longo do tempo.
Recurso externo
https://cross-service-solutions.com/
Se conhece uma ferramenta ou abordagem que poderia ajudar as pessoas a resolver um problema que ainda não abordámos, gostaríamos de saber.