研究:MoE 路由遥测泄露成员信息,成员推断攻击效果提升
研究提出一种路由增强的成员推断攻击,将常规输出信号与聚合路由特征结合,用独立微调的影子模型训练成员分类器并迁移到目标模型。在三种 MoE 架构和三个数据域共九种设置中,路由遥测使 1% FPR 下的 TPR 相比强输出信号集成提升 2.7 至 9.4 个百分点,且在完整微调、冻结路由器训练、LoRA 和指令微调下均持续存在。
推荐理由:研究显示 MoE 路由遥测可被用于成员推断,读者可了解这一运维信号如何成为新的隐私暴露面。
研究提出一种路由增强的成员推断攻击,将常规输出信号与聚合路由特征结合,用独立微调的影子模型训练成员分类器并迁移到目标模型。在三种 MoE 架构和三个数据域共九种设置中,路由遥测使 1% FPR 下的 TPR 相比强输出信号集成提升 2.7 至 9.4 个百分点,且在完整微调、冻结路由器训练、LoRA 和指令微调下均持续存在。
推荐理由:研究显示 MoE 路由遥测可被用于成员推断,读者可了解这一运维信号如何成为新的隐私暴露面。
针对差分隐私指数机制中数据集相关敏感度能否安全替代全局敏感度的问题,研究提出三类有效校准方法:对局部敏感度做私有高概率上界并推广至有限高阶敏感度层级;PTR 变体在有限公开网格上私有搜索温度参数;平滑敏感度支持多种设计,其中候选无关的平滑几何构造给出局部抑制框架下可接受的敏感度包络,对数变换则得到全局敏感度受控且保留原效用最大者的平滑得分函数。
研究者提出一种一次性构建差分隐私置信区间的框架,仅对最终重采样分位数加噪,而非对每次重采样的估计量分别加噪。在放回(m-out-of-n)采样下隐私成本仅与重采样次数 B 成对数关系,在无放回(子采样)下与 B 无关,避免了此前工作中的 √B 因子。该框架为子采样和 m-out-of-n 重采样提供非渐近高斯差分隐私(GDP)与效用保证,覆盖分位数和退化 U 统计量等估计量。
研究提出将人群规模不良事件监测作为手术数字孪生的独立信念层,并评估一种在形式化隐私保证下学习的联邦贝叶斯协议,各站点仅交换 Rényi 差分隐私自然参数更新。
FedSSMCoOp 是一个联邦少样本图像分类框架,用基于 SSM 的 Vision Mamba 与 Cross Mamba 模块,在联邦场景下只优化 soft-prompt 和 communication-prompt 更新,从而无需外部大语言模型做特征对齐。该框架在多个生物医学图像数据集上训练评估,性能相对基线稳定,平均轻量 1.96 倍。
针对 EmoNet-Face-HQ 细粒度情绪识别基准,研究者保留其图像、分类体系与评分,仅把答案读取方式从生成式作答改为按类别逐项读取 logits 的二分类查询。