> double | metaphone | advanced <
// Double Metaphone – zaawansowane kodowanie fonetyczne do dopasowywania wielojęzycznych nazw
Dwa kody
Generuje kod podstawowy i alternatywny, aby lepiej dopasowywać słowa.
Obsługa wielu języków
Dobrze radzi sobie z imionami pochodzącymi z różnych rodzin językowych.
Większa dokładność
Dokładniejszy niż oryginalny algorytm Metaphone.
>> informacje techniczne
Jak działa Double Metaphone
Double Metaphone, opublikowany przez Lawrence'a Philipsa w 2000 roku, to ulepszona wersja algorytmu Metaphone. Generuje dwa kody fonetyczne (podstawowy i alternatywny) dla każdego słowa, uwzględniając różne wymowy i pochodzenie językowe. Takie podwójne kodowanie znacząco poprawia dokładność dopasowywania nazw w języku angielskim, hiszpańskim, włoskim, francuskim, niemieckim oraz językach słowiańskich.
Dlaczego warto używać Double Metaphone
- Dopasowywanie międzynarodowych imion w bazach danych
- Badania genealogiczne ponad barierami językowymi
- Usuwanie duplikatów klientów w systemach CRM
- Sprawdzanie pisowni nazw własnych
- Wyszukiwanie w treściach wielojęzycznych i wielokulturowych
Przykłady Double Metaphone
Dwa kody dla lepszego dopasowania:
Schmidt:
Podstawowy: XMT
Alternatywny: SMT
Smith:
Podstawowy: SM0
Alternatywny: XMT
Campbell:
Podstawowy: KMPL
Alternatywny: KMPL
Raspberry:
Podstawowy: RSPR
Alternatywny: RSPR
Imiona obce:
García – [KRS|KRX]
Çelik – [SLK|SLK]
Nguyen – [NKN|NKN]
Dwa słowa uznajemy za pasujące,
jeśli jakakolwiek kombinacja ich kodów jest identyczna.
>> najczęściej zadawane pytania
Czym jest Double Metaphone?
Double Metaphone to zaawansowany algorytm fonetyczny, który generuje dwa kody dla każdego słowa – podstawowy i alternatywny. Dzięki temu uwzględnia różne wymowy i etymologie, co jest szczególnie przydatne przy dopasowywaniu imion z różnych języków i kultur.
Dlaczego jest lepszy niż klasyczny Metaphone?
Double Metaphone obejmuje znacznie więcej przypadków brzegowych i wzorców języków obcych. Rozpoznaje charakterystyczne schematy imion w języku hiszpańskim, włoskim, francuskim, językach germańskich i słowiańskich, a następnie generuje odpowiednie kody alternatywne. Dzięki temu dokładność dopasowań dla nazw międzynarodowych jest dużo wyższa.
Kiedy używać Double Metaphone?
Warto go stosować przy pracy z danymi wielokulturowymi, w międzynarodowych bazach klientów, badaniach genealogicznych oraz wszędzie tam, gdzie imiona mogą mieć różne zapisy lub pochodzenie językowe.
Jak działają dwa kody?
Kod podstawowy reprezentuje najbardziej prawdopodobną angielską wymowę, natomiast kod alternatywny odzwierciedla inne możliwe wymowy wynikające z pochodzenia językowego słowa. Dwa słowa uznaje się za dopasowane, jeśli jakakolwiek kombinacja ich kodów pokrywa się (podstawowy–podstawowy, podstawowy–alternatywny itd.).
// Porównanie
| Algorytm | Year | Author | Output |
|---|---|---|---|
| Metaphone | 1990 | Lawrence Philips | 1 code |
| Double Metaphone | 2000 | Lawrence Philips | primary + alternate |
| Metaphone 3 | 2009 | Lawrence Philips | commercial, higher accuracy |
// Krótka ściąga
word -> primary code, alternate code Smith -> SM0, XMT - if primary == alternate the word has one pronunciation - two words match if any of their codes are equal
>> Więcej pytań
P: Do czego służy drugi kod w Double Metaphone?
O: Wiele nazwisk, zwłaszcza nieangielskich, ma więcej niż jedną prawdopodobną wymowę. Drugi (alternatywny) kod obejmuje drugi odczyt; dwa słowa są podobne, jeśli choć jeden kod się zgadza.
P: Czy Double Metaphone jest lepszy od Metaphone?
O: Zwykle tak, zwłaszcza przy mieszanych listach nazwisk: uwzględnia więcej języków (słowiańskie, germańskie, romańskie) i podaje alternatywy. W zamian ma znacznie więcej reguł.
P: Gdzie stosuje się Double Metaphone?
O: Do wykrywania duplikatów w bazach klientów, wyszukiwania nazwisk w genealogii i archiwach oraz podpowiedzi „czy chodziło o…”. Jest dostępny w wielu bibliotekach i bazach danych.