
SOUNDEX İş Bloku, bir karakter dizisinin ses benzerliğini hesaplar.
Soundex değerleri, benzer şekilde telaffuz edilen kelimelerin aynı Soundex değeri ürettiği özelliğine sahiptir. Bu, veritabanlarında arama yaparken kelimenin doğru yazımını bilmeden de olsa telaffuzunu biliyorsanız kullanabilirsiniz. Soundex fonksiyonu, bir harfle başlayan dört karakterlik bir karakter dizisi döndürür.
Giriş, hesaplanacak karakter dizisini tanımlar.
Soundex kodu ile bir karakter dizisi döndürür.
Her Soundex kodu, örneğin Antcas için A532, bir harften sonra üç rakamdan oluşur. Kodlanacak kelimenin harf sayısı, daha fazla rakam üretebilecek kadar fazla ise, üçüncü rakamdan sonra kesilir. Kelimenin harf sayısı yetersizse, son rakamları sıfırla doldurulur. Örneğin Asya adı Lee, L000 olarak kodlanır.
| Rakam | Temsil Edilen Harfler |
|---|---|
| 1 | B, F, P, V |
| 2 | C, G, J, K, Q, S, X, Z |
| 3 | D, T |
| 4 | L |
| 5 | M, N |
| 6 | R |
Ünsüzler A, E, I, O ve U ve ünsüzler H, W ve Y ilk karakter dışında yok sayılmalıdır. Ayrıca Almanca diline göre tanımlanabilir: Ümlautlar Ä, Ö ve Ü yok sayılmalıdır, "şarap sütü" ß basit S olarak kodlanır.
Eğer orijinal karakter dizisindeki birbirini izleyen birkaç harf aynı Soundex kodu alırsa, sonuçta bu kod sadece bir kez görünür, örneğin abfx A120 olur (a kalır, çünkü ilk harf, b ve f aynı kodu 1 verir, x 2 verir, sonunda bir sıfır eklenir, dört karakter elde etmek için).
Soundex yönteminin uygulamasının praktik uygulamasında genellikle iki nokta eleştirilir: Öncelikle İngilizce diline çok yöneliktir ve ikinci olarak sadece çok genel bir analiz sunar.
Her ne kadar böyle olsa da, gösterilen algoritmanın fonetik aramada en sık kullanılan olduğunu belirtmek gerekir. Bu konuda Oracle veritabanı için PL/SQL standart komutu erken uygulanması da katkıda bulunmuştur.