データクレンジングとは?
■一言でいうと
名寄せをする際に、データクレンジングが先に行われ、旧漢字や住所の番地などを統一し、名寄せの精度をあげる機能です。
■どんなときに使うか
- 旧字や共同GW上で?で表記される漢字が使用されている時
- 屋号が使用されている時
- 住所に番地やハイフンが混合されている時
■何ができるか(メリット)
- 名寄せ前にデータクレンジングすることで名寄せの精度を上げます。
■もう少し詳しく
| 項目 | クレンジング内容 |
|---|---|
| 旧字・俗字 | 古く使われた文字や、本来は正しくないが常用されている文字を新字・正字に変換します。 (例)齋、濱、邊など、新字・正字に変換します。 |
| ?の修正 | 共同GWはシステムが古く、一部の漢字が反映せず?となっています フリガナから推測して正しい字に変換します。(例)髙 |
| 個人事業主 | 個人事業主の屋号は削除し、姓名で登録 |
| 団体 | 商店街、管理組合など理事長の個人名が併記されているが、個人名を削除し、団体名で登録 |
| 住所表記 | ・都道府県の表示がない場合、郵便番号から都道府県を設定 ・丁目やハイフンが混在しているので、ハイフンに統一 |
| 半角・全角 | 数字など半角・全角が混在していますので、統一 |
同じサイトウでも齋藤、齋藤、斉藤、齊藤など、旧字・俗字が混在した場合、新字・正字にデータクレンジグして、名寄せを行います。
顧客登録で、例えば「小守」を「子守」と漢字を間違えた場合、データクレンジグの対象とならないので、名前の漢字の間違いにはご注意ください。
■関連するページ
- 名寄せの条件
- 名寄せとは?
- 名寄せ一覧を確認する手順をみる

