交通轨迹数据发布差分隐私保护算法研究
前面都是讲述的是一些基础知识
算法研究:
算法包含三个模块:初始化模块、噪声前缀树构建模块、轨迹数据集合成模块。
- 该论文提出的前缀树取消了每一子层的分类树,节省了隐私预算,减少了噪声的添加
- 算法的隐私预算分配机制考虑了父节点和 子节点计数值之间存在的规律,设计了逐层递增的隐私预算分配方式,提高了算法输出的净化后的轨迹序列数据集可用性
- 提出一种时空维度缩减方法,依据地点 之间的最短可达时间矩阵,在不消耗任何隐私预算的情况下,缩减了地点和时间组合 的维度,降低了维度爆炸的概率,改善了算法的运行时间
算法框架

轨迹前缀树的定义:

轨迹前缀树:

文章中的符号描述:

本文研究的轨迹中同时包含时间和地点信息,轨迹数据集具有维度大和稀疏的特点。
之前在设计噪声前缀树的时候,在树的每一子层建立分类树,消耗了大量的隐私预算,影响了输出净化的离散轨迹数据集的可用性。 分类树有助于过滤空节点,但是它会耗费不必要的隐私预算,导致前缀树节点实际获取的隐私预算很少,(隐私预算越少,添加的噪声就越大,相应的隐私保护程度也就越大)使得添加到节点技数中的噪声过大,影响算法输出结果。 – 作为改进, 本文中取消了分类树,隐私预算epsilon可以全部用于前缀树节点当中。
算法的框架流程:


隐私预算分配机制

并行机制:不同的数据集不同的查询函数。对于随机算法,整体满足max(ε) - 差分隐私
总隐私预算ε在前缀树中逐层节点进行分配,以构造满足差分隐私定义的噪声前缀树。由于每个子树中的轨迹是不相交(互不相交的数据集)的,满足了差分隐私定义的并行组合特性,所以树中同层的节点共享相同的隐私预算。



时空维度缩减方法



对比于之前的研究:为了满足ε - 差分隐私保护,在前缀树

本文研究了一种新的交通轨迹数据发布算法,通过改进前缀树结构、优化隐私预算分配和时空维度缩减,提高了算法效率和数据可用性。实验结果表明,新算法在大数据集和高隐私预算下表现出更好的性能。

1万+

被折叠的 条评论
为什么被折叠?



