データセットから個人識別子を削除または隠蔽し、個人の特定を困難にするプロセスであり、プライバシー保護に利用されます。
手法には、仮名化(識別子をキーに置き換えること)、k-匿名性(レコード間で属性値が共有されることを担保すること)、一般化(データの粒度を粗くすること)、および抑制(機微な項目を省略すること)が含まれます。効果的な非識別化は、プライバシーとデータ有用性の均衡を図るものであり、再識別技術の進展を踏まえた再識別リスク評価を必要とします。
ある都市では、ユーザーIDをランダムなトークンに置き換え、位置情報を1kmグリッド単位に集約することで、匿名化された交通ログを公開しています。定期的な再識別テストにより、特定の個人の移動履歴を追跡できないことを確認しており、利用者のプライバシーを損なうことなくオープンデータの活用を可能にしています。




