研究:MoE 路由遥测泄露成员信息,成员推断攻击效果提升
研究提出一种路由增强的成员推断攻击,将常规输出信号与聚合路由特征结合,用独立微调的影子模型训练成员分类器并迁移到目标模型。在三种 MoE 架构和三个数据域共九种设置中,路由遥测使 1% FPR 下的 TPR 相比强输出信号集成提升 2.7 至 9.4 个百分点,且在完整微调、冻结路由器训练、LoRA 和指令微调下均持续存在。
推荐理由:研究显示 MoE 路由遥测可被用于成员推断,读者可了解这一运维信号如何成为新的隐私暴露面。
研究提出一种路由增强的成员推断攻击,将常规输出信号与聚合路由特征结合,用独立微调的影子模型训练成员分类器并迁移到目标模型。在三种 MoE 架构和三个数据域共九种设置中,路由遥测使 1% FPR 下的 TPR 相比强输出信号集成提升 2.7 至 9.4 个百分点,且在完整微调、冻结路由器训练、LoRA 和指令微调下均持续存在。
推荐理由:研究显示 MoE 路由遥测可被用于成员推断,读者可了解这一运维信号如何成为新的隐私暴露面。
114 名美国国会议员致信 Google 和 Spirit Airlines 的 CEO,要求叫停一项以 1000 万美元向 Google 提供 Spirit 内部数据用于训练 AI 模型的交易。
Proton 博客指出,企业把数据交给少数 AI 实验室,等于在教它们如何取代自己,Lawfare 将这一过程称为"通过知识获取实现替代"(RKA)。OpenAI、Anthropic、Microsoft、Google 和 X 虽声称默认不用企业数据训练模型,但相关条款对"输入""输出""训练"定义含糊,且保留随时修改的权利。
前沿 AI 系统在匿名化、数据最小化和数据共享等方面带来隐私挑战,但目前缺乏标准化的隐私风险评估方式。Future of Privacy Forum 指出,标准化隐私基准可为开发团队提供可追踪的量化目标,为第三方评估者提供统一工具,并帮助部署方比较供应商和开展风险评估。
Proton 梳理了 Amazon 旗下 Alexa、Twitch、Ring、Fire TV 及工作场所收集的数据如何用于 AI 训练,并给出各服务的关闭路径。
推荐理由:梳理 Amazon 各服务默认用于 AI 训练的数据范围与关闭路径,读者可据此逐项检查自己的设置。
儿童性虐待材料受害者在美国加州北区联邦地区法院对 xAI 提起集体诉讼,指控其用真实的儿童虐待图像和视频训练 Grok 的合成深度伪造脱衣能力。起诉书称原告是 FBI 儿童剥削通知计划追踪的已识别受害者,其材料带有已知哈希值,却出现在 Grok 生成并在 X 上传播的深度伪造内容中。
推荐理由:这起集体诉讼把 Grok 的训练数据来源与生成能力放进同一份指控,读者可了解儿童性虐待受害者对 AI 训练链条的追责路径。