跳到正文
10月10日周六
10月9日周五
  1. Proton 博客62

    Proton 分析为何零数据留存未必能保护企业数据

    Proton 发文分析零数据留存(ZDR)为何未必能保护企业数据,指出 ZDR 通常只面向顶级客户,并附带滥用监控、标记对话、反馈按钮、文件与记忆等多重例外。

    推荐理由:梳理零数据留存条款中的滥用监控、标记对话与元数据例外,帮助读者理解企业 AI 采购中留存承诺的实际边界。

  2. arXiv 隐私论文66

    研究:MoE 路由遥测泄露成员信息,成员推断攻击效果提升

    研究提出一种路由增强的成员推断攻击,将常规输出信号与聚合路由特征结合,用独立微调的影子模型训练成员分类器并迁移到目标模型。在三种 MoE 架构和三个数据域共九种设置中,路由遥测使 1% FPR 下的 TPR 相比强输出信号集成提升 2.7 至 9.4 个百分点,且在完整微调、冻结路由器训练、LoRA 和指令微调下均持续存在。

    推荐理由:研究显示 MoE 路由遥测可被用于成员推断,读者可了解这一运维信号如何成为新的隐私暴露面。

  3. arXiv 隐私论文41

    Nullify:面向 LLM 遗忘的免训练零空间激活引导方法

    Nullify 是一种免训练、非破坏性的激活引导方法,用于大语言模型遗忘:它在推理时用引导向量把隐私相关激活从记忆答案上引开,同时满足零空间约束,使保留查询的激活基本不受影响。在 TOFU 和 MUSE 上的评估显示,Nullify 的遗忘质量达到或超过已有基线,并近乎无损地保持模型效用。由于完全不做权重更新,它可作为即插即用的推理时干预框架。

  4. arXiv 隐私论文22

    如何改进社交媒体以支持民主话语:一份跨学科设计机制清单

    一项跨学科研究提出一组可单独或组合实施的模块化机制,用于让社交媒体从以参与度和广告收入为目标转向支持民主话语与集体审议。这些机制包括用户可控的开放推荐系统、多元观点曝光工具、认知与认知论反馈、协作及 AI 辅助的事实核查、隐私与可见性控制、文明性与证据完整性机制,以及奖励高质量参与的声誉系统。研究称其既是设计选项清单,也是围绕民主价值而非参与度设计数字公共空间的跨学科讨论起点。

  5. arXiv 隐私论文31

    Gated Memory:面向对话式 AI 的准入控制记忆形成框架

    Gated Memory 在对话与存储之间加入两个决策检查点:准入闸门在抽取前结合完整话语上下文评估每条候选事实,条件化富化阶段则依据实体范围分类法与隐私约束对已准入事实进行落地。该方法在 LoCoMo-10 基准上相较检索与生成完全相同的强基线,LLM 评判准确率相对提升 2.6%,表明记忆形成质量是可测量的记忆性能约束。

10月8日周四
  1. Garante 意大利数据保护局62

    意大利数据保护局 10 月通讯:IQVIA 被罚 700 万欧元,奖学金名单与市镇监控同遭处罚

    意大利数据保护局在 10 月 8 日通讯中公布多项处罚:IQVIA Solutions Italy 因建立含 100 万名患者健康数据的数据库被罚 700 万欧元,监管机构认定这些数据并非匿名,患者代码可长期追踪并配合出生年份、性别、诊断、处方和位置数据实现重识别,数据库中还混入 3300 多名患者的身份信息。

    推荐理由:汇总意大利数据保护局近期多项处罚与指南,可对照了解奖学金名单公开、市镇监控和健康数据二次利用的合规边界。

  2. arXiv 隐私论文60

    SBW:面向 LLM 智能体的抗改写、抗伪造语义行为水印

    论文提出语义行为水印(SBW),在历史条件下对语义动作簇而非精确动作符号嵌入水印,并用带密钥的抗碰撞分箱替代公开簇分箱。在五个智能体模型(3B-14B,四家厂商)和三个编码器上,ToolBench 改写场景下簇级检测率为 0.49-0.66,精确符号方案仅 0.05-0.17;ALFWorld 上为 0.92-0.97 对 0.00-0.01。

    推荐理由:论文提出面向 LLM 智能体的语义行为水印,在改写场景下检测率显著高于精确符号方案,并指出链式重放仍未被覆盖。

  3. arXiv 隐私论文60

    研究用 LLM 分析 570 万条 Reddit 帖,构建 12 类 AI 危害分类体系

    研究提出一套 LLM 辅助的主题分析流程,从大规模社交媒体数据中动态识别、分类并追踪新兴 AI 危害。作者分析了 18 个月(2025 年 1 月至 2026 年 6 月)内 570 万条 Reddit 帖子摘要,整理并发布包含 57.5 万条 AI 危害相关帖子的数据集,以及涵盖 12 个类别、47 个子节点的自下而上 AI 危害分类体系。

    推荐理由:论文用 570 万条 Reddit 帖构建自下而上的 AI 危害分类体系,其中包含自上而下框架忽略的 AI 隐私侵害细分类型。

  4. arXiv 隐私论文26

    欺骗性老虎机问题:探索耦合与多智能体学习的脆弱性

    研究揭示,在最小双人强单调设定中,欺骗方利用与受害者探索仅存在相关性的泄露信号,将自身探索动作与之耦合,从而注入外部性并把学习动态导向新的稳态——欺骗纳什均衡(DNE)。作者证明欺骗性老虎机学习(DBL)动态以最优收敛速率收敛到 DNE 的任意小邻域,且在放宽标准老虎机优化文献的二阶光滑条件下仍成立,并用资源分配博弈展示了欺骗对稳态与欺骗方成本的严格影响。

  5. arXiv 隐私论文17

    面向物质使用障碍患者对话生成的多目标对齐小语言模型框架

    研究提出一个面向物质使用障碍(SUD)患者对话生成的多目标对齐小语言模型框架,分认知成分检测与认知成分对齐对话生成两阶段,结合知识蒸馏、人类标注偏好优化与注意力引导奖励塑形。在 BERTScore、ROUGE、METEOR、BLEU 及 LLM-as-judge 命中指标上,认知信息微调在认知实现与对齐上优于通用指令微调基线和心理健康领域专用小语言模型,开放式认知成分提升尤为明显。

  6. arXiv 隐私论文12

    CoMoE:在消费级 GPU 上实现通信高效的 MoE 推理

    CoMoE 是一个面向消费级 GPU 的通信高效 MoE 推理系统,通过以主机为中心的路由解决 PCIe 带宽受限且无 P2P 支持的通信瓶颈。它用主机支持的 token 多播消除出站冗余,并用主机暂存缓冲的细粒度 token 级聚合替代全局同步。在 RTX 5090 上吞吐最高提升 1.46 倍,接近支持 NVLink 的 A800,硬件成本仅为其 23.4%。

  7. arXiv 隐私论文20

    AURA:面向戒烟的先发式智能可穿戴设备设计研究

    研究团队提出 AURA——一个基于市售可穿戴设备的智能手表-手机生态系统,用于在复吸发生前主动检测并干预烟瘾。通过对 10 名多族裔亚洲吸烟者与戒烟者的半结构化共创设计访谈,研究识别出习惯、情绪与社会三个维度的烟瘾预测因素,以及社会问责、个性化支持、奖励和即时分心等用户偏好的干预策略。参与者还强调信任、隐私、个性化与非评判式交互的重要性。

  8. arXiv 隐私论文62

    研究:LLM 路由元数据可泄露敏感话题,长度匹配可缓解

    研究测量了 LLM 路由决策元数据在关闭内容日志时仍会泄露敏感话题,基于 170 万条真实请求(WildChat-1M、LMSYS-Chat-1M)和两个成本/质量路由器及一个领域路由器展开预注册实验。

    推荐理由:研究测量了 LLM 路由元数据在关闭内容日志时仍会泄露敏感话题,并给出长度匹配的缓解思路。

  9. AEPD 西班牙数据保护局22

    AEPD 发布《隐私、创新与技术》期刊第二期,纪念 GDPR 十周年

    西班牙数据保护局(AEPD)发布《隐私、创新与技术》(PIT)期刊第二期,专刊纪念 GDPR 十周年,聚焦其在技术演进下面临的挑战。专刊三篇文章分别讨论问责原则、自动化决策中的解释权,以及公共行政部门使用生成式 AI 时的隐私设计。期刊另设隐私研究栏目,收录九项研究,涵盖神经数据、匿名化、数据泄露、智慧城市、算法政治广告与合成身份等议题。

  10. EDRi 欧洲数字权利80

    奥地利拟修法允许 AI 在无人工复核下作出行政决定

    奥地利议会宪法事务委员会将于今年秋季审议《普通行政程序法》(AVG)修订草案,草案首次允许行政机关使用全自动系统作出具有法律约束力的决定,且无需人工复核具体结果。

    推荐理由:奥地利拟修法允许大语言模型在无人工复核下作出有约束力的行政决定,读者可了解全自动决策与基本权利之间的冲突。

  11. ICO 英国信息专员办公室75

    ICO 公布十家 AI 基础模型开发者整改结果,并就智能体 AI 启动证据征集

    ICO 发布报告称,Amazon、Anthropic、Apple、Cohere、DeepSeek、Google、Meta、Microsoft、OpenAI 和 Stability AI 十家在英国运营的基础模型开发者已做出或承诺做出数据保护整改,包括更清晰的透明度信息、更便于个人行使权利的机制和更严格的保障评估。

    推荐理由:ICO 对十家基础模型开发者的监督结果与对智能体 AI 的取证征集,呈现监管如何把训练数据与自主行为纳入合规边界。

  12. Proton 博客22

    阻止 AI 窃取企业数据只有一条路:Proton 称不能依赖监管承诺

    Proton 博客指出,企业把数据交给少数 AI 实验室,等于在教它们如何取代自己,Lawfare 将这一过程称为"通过知识获取实现替代"(RKA)。OpenAI、Anthropic、Microsoft、Google 和 X 虽声称默认不用企业数据训练模型,但相关条款对"输入""输出""训练"定义含糊,且保留随时修改的权利。

10月7日周三
  1. Google 安全博客68

    Google 为 Android 端侧 AI 推出 AISeal 隔离架构

    Google 宣布推出 Android on-device AI seal(AISeal),这是面向个性化端侧 AI 体验的隔离架构,基于 Android Virtualization Framework(AVF)和 pKVM hypervisor 构建,通过受保护虚拟机实现硬件隔离的安全保险库,即使主操作系统被完全攻破,个人数据仍保持加密隔离。

    推荐理由:原文说明了 Android 端侧 AI 隔离架构的技术基础与多租户设计,读者可了解个人上下文如何在硬件层与主系统隔离。

10月6日周二
  1. ANPD 巴西国家数据保护局12

    ANPD 公布第四届 Danilo Doneda 奖最终结果

    巴西国家数据保护局(ANPD)公布第四届 Danilo Doneda 奖最终结果,经申诉阶段后评审委员会确认获奖名单,并于本周二(06)在《联邦官方公报》上发布。前三名文章分别探讨“人工智能压力下的匿名化”“微型 SaaS 中的幽灵控制者——ANPD 面对平台自动化创建的挑战”以及“LGPD 下作为结构性义务的隐私设计(Privacy by Design)”。颁奖仪式日期与形式将另行公布。

  2. Privacy International26

    PI 就英国政府职场监控技术咨询提交回应意见

    Privacy International(PI)就英国政府关于职场监控技术的咨询提交回应,指出数据最小化与目的限制原则存在缺口,包括"范围蔓延"风险——为道路安全引入的面向驾驶员的摄像头可能被转用于纪律处分,并主张明确禁止在原目的之外出售或共享劳动者数据,包括公司破产或关闭后的情形。

  3. Proton 博客60

    SOCRadar 研究:8 万家机构的员工 AI 登录凭据出现在信息窃取日志中

    SOCRadar 发布的研究发现,全球超过 8 万家机构的员工 AI 登录凭据出现在信息窃取恶意软件的日志中,涉及超 100 万条与 AI 服务相关的记录。

    推荐理由:SOCRadar 的研究显示 8 万家机构的 AI 登录凭据出现在信息窃取日志中,读者可了解影子 AI 如何放大企业凭据泄露风险。

10月5日周一
  1. Garante 意大利数据保护局12

    Garante 10 月 20 日举办“数字生活与个人数据”消费者协会会议

    意大利数据保护局 Garante 将于 2026 年 10 月 20 日 9:30 至 13:00 在罗马 Confindustria 礼堂举办“数字生活与个人数据”会议,与消费者协会对话。会议与意大利企业与制造部及消费者协会合作,议题包括人工智能、非法电话营销、数字健康档案以及身后数字数据。报名方式将在 Garante 官网公布。

10月2日周五
  1. EFF71

    法院驳回政府撤诉动议,UAW 等三家工会诉国务院和国土安全部社交媒体监控案继续推进

    美国纽约南区联邦地区法院法官 Alvin K. Hellerstein 于 2026 年 10 月 1 日驳回了政府要求撤销诉讼的动议,允许 UAW、CWA 和 AFT 三家工会针对国务院和国土安全部社交媒体监控项目提起的诉讼继续推进。

    推荐理由:法院裁定工会针对政府社交媒体监控项目的诉讼可继续推进,读者可了解该项目被指以 AI 监控非公民言论的争议与司法进展。