跳到正文
10月9日周五
  1. arXiv 隐私论文41

    Nullify:面向 LLM 遗忘的免训练零空间激活引导方法

    Nullify 是一种免训练、非破坏性的激活引导方法,用于大语言模型遗忘:它在推理时用引导向量把隐私相关激活从记忆答案上引开,同时满足零空间约束,使保留查询的激活基本不受影响。在 TOFU 和 MUSE 上的评估显示,Nullify 的遗忘质量达到或超过已有基线,并近乎无损地保持模型效用。由于完全不做权重更新,它可作为即插即用的推理时干预框架。

  2. arXiv 隐私论文26

    面向持续机器遗忘的极小极大高斯机制

    研究提出用于牛顿更新在连续删除请求下的高斯机制,借助高斯差分隐私(GDP)及其自适应组合规则,证明整个已发布模型序列在统计上难以与匹配的精确重训练区分。基于计数界的随机游走噪声在删除上限 M 处渐近匹配单次发布的最坏情况方差,而独立噪声则多出约 M 量级的因子;基于集合的界可利用被删除记录的梯度与海森矩阵降低噪声方差。

10月8日周四
  1. arXiv 隐私论文42

    为何仅遗忘式机器遗忘需要记忆:arXiv 论文给出下界分析

    arXiv 论文研究仅接收已训练模型和待遗忘样本、无保留数据的“仅遗忘式”机器遗忘是否总是可行。作者证明这取决于学习方法:不同数据集可产生相同训练模型,却在删除同样样本后需要截然不同的输出,并据此推导出遗忘结果逼近重训练的精度下界。对简单阈值学习器,处理任意删除请求所需记忆的信息量可达整个数据集,而普通训练只保留一个边界点。

10月6日周二
  1. Future of Privacy Forum40

    前沿 AI 隐私如何度量:为 AI 开发与部署建立隐私基准的探索

    前沿 AI 系统在匿名化、数据最小化和数据共享等方面带来隐私挑战,但目前缺乏标准化的隐私风险评估方式。Future of Privacy Forum 指出,标准化隐私基准可为开发团队提供可追踪的量化目标,为第三方评估者提供统一工具,并帮助部署方比较供应商和开展风险评估。