
Le bloc fonctionnel SIMILAR_TEXT calcule la similarité de deux chaînes de caractères.
Le calcul de la similarité de deux chaînes de caractères se fait selon la méthode décrite dans Programming Classics: Implementing the World's Best Algorithms par Oliver (ISBN 0-131-00413-1). Notez que cette implémentation n'utilise pas de pile comme dans le pseudo-code d'Oliver, mais utilise des appels récursifs qui peuvent améliorer les performances (mais pas nécessairement). Notez également que la complexité de cet algorithme est O(N³), où N est la longueur de la chaîne de caractères la plus longue.
L'entrée définit la première chaîne de caractères à comparer.
L'entrée définit la deuxième chaîne de caractères à comparer.
La sortie renvoie le nombre de caractères correspondants dans les deux chaînes de caractères.
Le nombre de caractères correspondants est calculé en recherchant la plus longue sous-chaîne commune initiale et en répétant cela récursivement pour les préfixes et suffixes. Les longueurs de toutes les sous-chaînes communes trouvées sont additionnées.
La sortie renvoie la similarité en pourcentage sous forme de nombre à virgule flottante. Pour ce faire, le résultat est divisé par la moyenne des longueurs des chaînes de caractères spécifiées et multiplié par 100.