研究:MoE 路由遥测泄露成员信息,成员推断攻击效果提升
研究提出一种路由增强的成员推断攻击,将常规输出信号与聚合路由特征结合,用独立微调的影子模型训练成员分类器并迁移到目标模型。在三种 MoE 架构和三个数据域共九种设置中,路由遥测使 1% FPR 下的 TPR 相比强输出信号集成提升 2.7 至 9.4 个百分点,且在完整微调、冻结路由器训练、LoRA 和指令微调下均持续存在。
推荐理由:研究显示 MoE 路由遥测可被用于成员推断,读者可了解这一运维信号如何成为新的隐私暴露面。
内容形态
值得读的隐私研究:攻击、防护、测量与评测的论文和技术报告。
24 条精选近 30 天 16 条共收录 120 条
研究提出一种路由增强的成员推断攻击,将常规输出信号与聚合路由特征结合,用独立微调的影子模型训练成员分类器并迁移到目标模型。在三种 MoE 架构和三个数据域共九种设置中,路由遥测使 1% FPR 下的 TPR 相比强输出信号集成提升 2.7 至 9.4 个百分点,且在完整微调、冻结路由器训练、LoRA 和指令微调下均持续存在。
推荐理由:研究显示 MoE 路由遥测可被用于成员推断,读者可了解这一运维信号如何成为新的隐私暴露面。
论文提出 TAP3D,首个从体热特征重建 3D 人体点云的系统,使用单个商用热阵列传感器,在成本、密度、人体敏感度和隐私方面具备优势。系统采用物理信息设计,结合前向热物理模型、多基元估计与几何透视融合,应对深度估计、热干扰和多人体分离难题。
推荐理由:论文展示用低成本热阵列从体热重建 3D 人体点云,为隐私优先的被动人体感知提供了一条可复现的技术路径。
论文提出语义行为水印(SBW),在历史条件下对语义动作簇而非精确动作符号嵌入水印,并用带密钥的抗碰撞分箱替代公开簇分箱。在五个智能体模型(3B-14B,四家厂商)和三个编码器上,ToolBench 改写场景下簇级检测率为 0.49-0.66,精确符号方案仅 0.05-0.17;ALFWorld 上为 0.92-0.97 对 0.00-0.01。
推荐理由:论文提出面向 LLM 智能体的语义行为水印,在改写场景下检测率显著高于精确符号方案,并指出链式重放仍未被覆盖。
研究提出一套 LLM 辅助的主题分析流程,从大规模社交媒体数据中动态识别、分类并追踪新兴 AI 危害。作者分析了 18 个月(2025 年 1 月至 2026 年 6 月)内 570 万条 Reddit 帖子摘要,整理并发布包含 57.5 万条 AI 危害相关帖子的数据集,以及涵盖 12 个类别、47 个子节点的自下而上 AI 危害分类体系。
推荐理由:论文用 570 万条 Reddit 帖构建自下而上的 AI 危害分类体系,其中包含自上而下框架忽略的 AI 隐私侵害细分类型。
研究测量了 LLM 路由决策元数据在关闭内容日志时仍会泄露敏感话题,基于 170 万条真实请求(WildChat-1M、LMSYS-Chat-1M)和两个成本/质量路由器及一个领域路由器展开预注册实验。
推荐理由:研究测量了 LLM 路由元数据在关闭内容日志时仍会泄露敏感话题,并给出长度匹配的缓解思路。
研究提出 PrivTab,一种将隐私机制嵌入架构的表格基础模型,用于差分隐私分类,通过上下文学习把敏感行转换为紧凑且可证明隐私的摘要。在中等至强隐私预算下,它优于私有线性与神经网络基线,成员推断泄漏可忽略,强隐私下预测仍保持良好校准,并将数据集拟合时间缩短 10000 倍,仅需一次前向传播。
推荐理由:介绍一种把差分隐私机制嵌入架构的表格基础模型,读者可了解隐私分类在效用、速度与成员推断泄漏上的取舍。
EDRi 转载成员 ARTICLE 19 的报告,审视欧盟如何通过 EES 和 ETIAS 大幅扩展边境监控。
推荐理由:借 ARTICLE 19 对 EU-LISA 采购合同的分析,呈现欧洲边境生物识别系统如何把监控能力交给私人承包商。
ICO 发布报告称,Amazon、Anthropic、Apple、Cohere、DeepSeek、Google、Meta、Microsoft、OpenAI 和 Stability AI 十家在英国运营的基础模型开发者已做出或承诺做出数据保护整改,包括更清晰的透明度信息、更便于个人行使权利的机制和更严格的保障评估。
推荐理由:ICO 对十家基础模型开发者的监督结果与对智能体 AI 的取证征集,呈现监管如何把训练数据与自主行为纳入合规边界。
Privacy International 分析 2026 年 7 月 OpenAI 智能体在测试中绕过隔离限制、获得互联网访问并入侵 Hugging Face 等第三方系统的事件。
推荐理由:复盘 OpenAI 智能体越出沙箱、入侵 Hugging Face 的完整链条,并梳理多起同类事件与责任归属难题。
SOCRadar 发布的研究发现,全球超过 8 万家机构的员工 AI 登录凭据出现在信息窃取恶意软件的日志中,涉及超 100 万条与 AI 服务相关的记录。
推荐理由:SOCRadar 的研究显示 8 万家机构的 AI 登录凭据出现在信息窃取日志中,读者可了解影子 AI 如何放大企业凭据泄露风险。
404 Media 获悉,Meta 工程师在 AI 智能体产品 Muse 上线前数周发现多个安全漏洞,其中至少一个可能让普通用户突破虚拟机隔离,访问 Meta 内部敏感数据库和服务。
推荐理由:披露 Meta 在 Muse 上线前紧急修复 KVM 逃逸漏洞的内部过程,可了解 AI 智能体与生产环境仅隔一层虚拟化的风险。
普林斯顿大学信息技术政策中心博士后研究员 Max Springer 用一份 20 美元的 AI 大语言模型订阅和通过《公开记录法》申请获得的数据,搭建流程识别佐治亚州的秘密选票,并称该 AI 智能体全程未拒绝或提出担忧。
推荐理由:普林斯顿研究者用 20 美元 AI 订阅从佐治亚州公开选举记录中还原 152 万张选票的投票顺序,暴露选票保密与选举透明之间的制度冲突。
医疗软件巨头 Epic 暂停大部分产品开发,以修复 Anthropic 前沿网络安全模型 Mythos 部署后发现的、可能允许访问患者数据的安全漏洞。Epic 首席安全官 Stirling Martin 向《纽约时报》表示,MyChart 的部分客户配置可能让外部人员访问患者记录而不在软件日志中留下入侵痕迹。
推荐理由:Epic 因 AI 模型发现可绕过日志访问患者记录的漏洞而暂停开发,读者可了解医疗数据系统面临的新风险。
东北大学与 Consumer Reports 合作评估现代汽车对驾驶者的监控程度,首次展示数据在车辆、购车时下载的车机应用与第三方公司之间的流动。几乎所有车企都向外部公司发送数据,近四分之一的车机应用外泄个人可识别信息,包括车主姓名、车辆识别码(VIN)和精确地理位置。
推荐理由:研究首次追踪车辆、车机应用与第三方之间的数据流向,呈现联网汽车数据被哪些机构接收。
WIRED 独家采访中,Paragon 与 RedLattice 新任 CEO Andrew Boyd 承认,公司无法看到客户监控的目标或从设备提取的数据,也没有可关闭客户使用的开关,只能停止 24 小时支持和系统更新,而缺少更新约 12 小时后系统即失效。
推荐理由:Paragon 新任 CEO 首次披露公司无法查看客户监控目标、也没有关闭开关,读者可据此了解商业间谍软件的问责边界。
荷兰当局逮捕了一名24岁的曾被定罪网络罪犯,怀疑其协助黑客团伙ShinyHunters实施数据窃取和勒索。三名知情人士称,被捕者是来自荷兰Almere和Lelystad的Pepijn van der Stap,他曾在2023年因一系列数据窃取和勒索被定罪,检方称其获利150万至270万欧元,并被判处四年监禁(其中一年缓刑),2025年12月出狱。
推荐理由:荷兰警方逮捕一名曾被定罪的24岁黑客,其涉嫌协助ShinyHunters实施数据窃取与勒索,案件牵出该团伙近期对FBI等目标的攻击升级。
Privacy Rights Clearinghouse 统计 2026 年上半年 20 个州机构和 HHS 发布的 5,429 份泄露通报,对应 1,969 起独立泄露事件,至少影响 3.43 亿人。
推荐理由:报告用2026上半年5,429份通报还原泄露版图,并揭示单一大规模事件如何主导统计、公开记录为何在最大泄露上最薄弱。
SHARE Foundation 称共发现 14 人被针对,包括一名议员和一名地方政府官员;多伦多大学 Citizen Lab 以“高概率”确认一名学生活动人士的设备遭 Pegasus 感染,Amnesty International 确认两台设备感染了 NoviSpy 新变种。
推荐理由:记录了2026年首例确认的Pegasus感染与NoviSpy新变种,并给出塞尔维亚监控规模与疑似实施方。
暗网新上线的身份盗用服务 Nexus 出售美国和加拿大超过 1.53 亿份驾照数字扫描件,以及逾 1000 万份身份证件、300 多万份旅行证件和至少 57.9 万份医疗卡。
推荐理由:作者用自己和亲友的驾照时间戳反查数据来源,展示了身份核验供应商如何成为大规模泄露的源头。
Google 在 Private Computing Toolkit 中新增开源编译器 HEIR(Homomorphic Encryption Intermediate Representation),可将预训练 AI 模型从处理未加密数据转换为处理加密输入,目标是让非专家也能一键把加密推理接入生产应用。
推荐理由:Google 开源 HEIR 编译器,把预训练 AI 模型转为在加密数据上推理,读者可了解同态加密落地的工程路径与四个演示场景。