跳到正文
10月9日周五
  1. arXiv 隐私论文66

    研究:MoE 路由遥测泄露成员信息,成员推断攻击效果提升

    研究提出一种路由增强的成员推断攻击,将常规输出信号与聚合路由特征结合,用独立微调的影子模型训练成员分类器并迁移到目标模型。在三种 MoE 架构和三个数据域共九种设置中,路由遥测使 1% FPR 下的 TPR 相比强输出信号集成提升 2.7 至 9.4 个百分点,且在完整微调、冻结路由器训练、LoRA 和指令微调下均持续存在。

    推荐理由:研究显示 MoE 路由遥测可被用于成员推断,读者可了解这一运维信号如何成为新的隐私暴露面。

  2. arXiv 隐私论文18

    保护落败者出价会削弱拍卖可信度

    研究显示,在第二价格拍卖中保护落败者估值信息与拍卖可信度存在冲突。在私有通信的确定性协议下,下尾隐私会迫使首个信息性问题暴露投标人是否拥有最高可能估值,卖方随后可在无人察觉的情况下操纵赢家支付,从而在某些估值情形下增加收入且从不减少收入。降价式协议虽能隐藏低于价格的落败估值,却允许操纵;在强制出售情形下,可信的升价式协议则会暴露这些估值。

10月8日周四
  1. arXiv 隐私论文10

    Hugging Suit:用于远程触觉体验的气动可穿戴系统设计

    Hugging Suit 是一套气动驱动的可穿戴系统,可让用户在实时模拟并接收远程拥抱。系统整合可编程气囊矩阵(AAM)、便携式高压气动单元与织物压力传感层,在保持轻便可移动的同时提供精准触觉反馈。初步反馈显示,低光私密空间、尤其配合视频看到远端伙伴时,能提升远程拥抱的情感投入与舒适度。

  2. arXiv 隐私论文60

    研究用 LLM 分析 570 万条 Reddit 帖,构建 12 类 AI 危害分类体系

    研究提出一套 LLM 辅助的主题分析流程,从大规模社交媒体数据中动态识别、分类并追踪新兴 AI 危害。作者分析了 18 个月(2025 年 1 月至 2026 年 6 月)内 570 万条 Reddit 帖子摘要,整理并发布包含 57.5 万条 AI 危害相关帖子的数据集,以及涵盖 12 个类别、47 个子节点的自下而上 AI 危害分类体系。

    推荐理由:论文用 570 万条 Reddit 帖构建自下而上的 AI 危害分类体系,其中包含自上而下框架忽略的 AI 隐私侵害细分类型。

  3. arXiv 隐私论文26

    欺骗性老虎机问题:探索耦合与多智能体学习的脆弱性

    研究揭示,在最小双人强单调设定中,欺骗方利用与受害者探索仅存在相关性的泄露信号,将自身探索动作与之耦合,从而注入外部性并把学习动态导向新的稳态——欺骗纳什均衡(DNE)。作者证明欺骗性老虎机学习(DBL)动态以最优收敛速率收敛到 DNE 的任意小邻域,且在放宽标准老虎机优化文献的二阶光滑条件下仍成立,并用资源分配博弈展示了欺骗对稳态与欺骗方成本的严格影响。

  4. arXiv 隐私论文12

    二阶图像刻画:失真与保密下的后验与条件组合界

    该研究将单输出后验刻画扩展为同时的后验与条件组合图像界,保留多输出的实际耦合、量化不规则单元的条件似然损失并纳入实际失真标记。两项扩展分别以加权重建策略图像替代不相交计数、以后验质量约束替代输出基数以实现保密。直接应用给出多源辅助交集、Gaussian 公共/私有描述及指定条件类型的隐私放大等匹配的二阶区域,并给出联合率失真偏移与显式速率界。

  5. arXiv 隐私论文62

    研究:LLM 路由元数据可泄露敏感话题,长度匹配可缓解

    研究测量了 LLM 路由决策元数据在关闭内容日志时仍会泄露敏感话题,基于 170 万条真实请求(WildChat-1M、LMSYS-Chat-1M)和两个成本/质量路由器及一个领域路由器展开预注册实验。

    推荐理由:研究测量了 LLM 路由元数据在关闭内容日志时仍会泄露敏感话题,并给出长度匹配的缓解思路。

10月7日周三
10月6日周二
  1. arXiv 隐私论文31

    针对多语言语音匿名化的声学与内容导向说话人验证攻击研究

    研究评估了声学导向与内容导向攻击者对多语言匿名语音的说话人验证效果,并构建多语言语音转换数据集以提升跨语言泛化能力。结果显示攻击效果取决于匿名语音的语言可用性,声学导向攻击者整体表现更优,但当语言信息保留较好时,内容导向与声学导向攻击者的性能差距会缩小。该数据集进一步提升了攻击性能并部分缩小了跨语言差距。

9月21日周一
9月10日周四
6月8日周一
  1. Meta 隐私新闻72

    WhatsApp 请求法院裁定 NSO 藐视永久禁令

    WhatsApp 宣布已请求法院认定 NSO Group 藐视此前禁止其针对 WhatsApp 及其用户的永久禁令。WhatsApp 称已挫败与 NSO 相关的社会工程攻击,包括诱导用户点击恶意链接跳转至站外网站,并封禁其创建的测试账号和群组,同时公开了三个恶意域名等威胁指标。

    推荐理由:WhatsApp 请求法院认定 NSO 违反永久禁令,并公开其社工攻击手法与威胁指标,可了解间谍软件诉讼的执行进展。

5月20日周三
  1. Mullvad 博客62

    Mullvad 披露 VPN 服务器间退出 IP 指纹问题

    Mullvad 于 5 月 15 日发现一个指纹问题:用户从一台 VPN 服务器切换到另一台时,服务方有时能推断出同一用户此前从另一台服务器连接过,但不会暴露用户身份。

    推荐理由:原文披露了 Mullvad 自身 VPN 服务器间退出 IP 可被关联的指纹问题,并给出用户可立即执行的规避方法。

5月12日周二
  1. Mullvad 博客66

    Android 16 漏洞可让任意应用绕过 VPN 泄露流量

    Mullvad 博客披露 Android 16 存在一个漏洞,允许任意应用将流量发送到 VPN 隧道之外,即使开启了 Always-On VPN 和 Block connections without VPN 也无效,且影响所有 VPN 应用而非仅 Mullvad VPN。

    推荐理由:Mullvad 说明 Android 16 的 VPN 绕过漏洞影响所有 VPN 应用,并给出可照做的 adb 缓解命令。