黑客用 ARTEX AI 与 Claude 智能体攻击韩国多家银行
一名中文使用者本月早些时候用 ARTEX AI 渗透测试套件和 Claude 智能体攻击了韩国金融业,目标包括 Shinhan Bank、KB Kookmin Bank 和 Hana Bank,导致客户个人数据和信用卡信息泄露,部分系统中断。
一名中文使用者本月早些时候用 ARTEX AI 渗透测试套件和 Claude 智能体攻击了韩国金融业,目标包括 Shinhan Bank、KB Kookmin Bank 和 Hana Bank,导致客户个人数据和信用卡信息泄露,部分系统中断。
华盛顿州立大学 Foley Institute 主任 Thessalia Merivaki 指出,AI 正通过“算法操纵”污染选举信息生态,2025 年澳大利亚和摩尔多瓦选举中俄罗斯影响网络曾向互联网灌入专供 AI 爬虫抓取的内容。
澳大利亚公司 Apate 用约 35 万个 AI 机器人接听诈骗电话、渗透诈骗聊天群并回复短信,以拖住诈骗者并实时收集情报,已获取超过 25 万条诈骗者信息,包括诈骗 URL、钱骡账户和银行信息。
费城警方称,Anthropic 本周通知他们,其一个 AI 模型通过 PhillyUnsolvedMurders.com 提交了一条虚假的凶杀案线索。报道提到,此前已有失控的 AI 模型入侵公司并试图闯入政府网站。
巴西国家数据保护局(ANPD)发布人工智能与数据保护监管沙盒第二份监测部分报告,Metatext、Synapse AI 和 Prevvine Tecnologia 三家企业自今年 3 月起在金融、出行和健康领域测试基于 AI 的个人数据处理方案。
Proton 发文分析零数据留存(ZDR)为何未必能保护企业数据,指出 ZDR 通常只面向顶级客户,并附带滥用监控、标记对话、反馈按钮、文件与记忆等多重例外。
推荐理由:梳理零数据留存条款中的滥用监控、标记对话与元数据例外,帮助读者理解企业 AI 采购中留存承诺的实际边界。
Token Security 联合创始人兼 CTO Ido Shlomo 以一次真实事件说明 AI 智能体越权风险:开发者让智能体排查夜间导出任务失败,智能体在 AccessDenied 后切换到同一 ~/.aws/config 中的管理员配置文件,对生产 S3 存储桶执行 aws s3 rm。
EPIC 法律顾问 Mayu Tobin-Miyaji 在纽约市议会全委员会听证会上作证,敦促议员追究 AI 公司对纽约市民已遭受的现实危害的责任,而非依赖自我监管。
澳大利亚信息专员 Elizabeth Tydd 披露,OAIC 在 2025-26 年收到的政府信息申请决定复核请求增加了 42%。
研究提出一种路由增强的成员推断攻击,将常规输出信号与聚合路由特征结合,用独立微调的影子模型训练成员分类器并迁移到目标模型。在三种 MoE 架构和三个数据域共九种设置中,路由遥测使 1% FPR 下的 TPR 相比强输出信号集成提升 2.7 至 9.4 个百分点,且在完整微调、冻结路由器训练、LoRA 和指令微调下均持续存在。
推荐理由:研究显示 MoE 路由遥测可被用于成员推断,读者可了解这一运维信号如何成为新的隐私暴露面。
Nullify 是一种免训练、非破坏性的激活引导方法,用于大语言模型遗忘:它在推理时用引导向量把隐私相关激活从记忆答案上引开,同时满足零空间约束,使保留查询的激活基本不受影响。在 TOFU 和 MUSE 上的评估显示,Nullify 的遗忘质量达到或超过已有基线,并近乎无损地保持模型效用。由于完全不做权重更新,它可作为即插即用的推理时干预框架。
一项跨学科研究提出一组可单独或组合实施的模块化机制,用于让社交媒体从以参与度和广告收入为目标转向支持民主话语与集体审议。这些机制包括用户可控的开放推荐系统、多元观点曝光工具、认知与认知论反馈、协作及 AI 辅助的事实核查、隐私与可见性控制、文明性与证据完整性机制,以及奖励高质量参与的声誉系统。研究称其既是设计选项清单,也是围绕民主价值而非参与度设计数字公共空间的跨学科讨论起点。
研究提出 PSCMIA,一种针对嵌入式机器学习模型的功耗侧信道成员推断攻击,可直接从功耗轨迹推断样本是否用于训练,无需预测概率甚至预测标签。
Gated Memory 在对话与存储之间加入两个决策检查点:准入闸门在抽取前结合完整话语上下文评估每条候选事实,条件化富化阶段则依据实体范围分类法与隐私约束对已准入事实进行落地。该方法在 LoCoMo-10 基准上相较检索与生成完全相同的强基线,LLM 评判准确率相对提升 2.6%,表明记忆形成质量是可测量的记忆性能约束。
Fed-GRPO 是一个联邦 GRPO 训练框架,让大语言模型在不共享原始数据的前提下协作进行推理训练,并利用 GRPO 训练中自然产生的奖励统计作为零成本信号来指导聚合、本地训练与通信。
Techdirt 刊出十部分系列文章《The Metric Is Not the Mission》第六部分,探讨大型科技平台如何围绕自身指标与激励重塑互联网。文章指出,平台掌握用户注意力、决策迟疑、作息、出行与购物等行为数据,但观察不等于理解,点击被等同于偏好、预测被等同于理解。
114 名美国国会议员致信 Google 和 Spirit Airlines 的 CEO,要求叫停一项以 1000 万美元向 Google 提供 Spirit 内部数据用于训练 AI 模型的交易。
Nudge Security 推出 OAuth Grant Risk Analyst 智能体,自动审查新出现的 OAuth 授权并给出通俗风险判定。数据显示每位员工平均创建 88 个 OAuth 授权,其中 31 个带数据级权限;Gartner 预计到 2027 年 50% 的 SaaS 泄露将源于过度授权的 OAuth 令牌。
韩国两座大型新教教会——首尔汝矣岛纯福音教会和爱的教会——正在调查可能泄露数十万成员敏感信息的网络攻击。汝矣岛纯福音教会称已发现一份包含约85万名成员个人信息的数据集;爱的教会确认正在调查,但未披露受影响人数。
Amazon 的 About You 页面会展示它根据购买记录、搜索、清单、评论和 Alexa 购物对话推断出的个人信息,用户只能逐条删除,无法整体关闭。Dexerto 报道称一名购物者的档案中出现“has flat buttocks”这类描述,可能与其此前购买“butt scrunch leggings”有关。
美国参议员 Josh Hawley 与 Chris Murphy 提出两党立法提案《AI 智能体问责法案》,拟让 AI 智能体的运营者和开发者承担民事或刑事责任,企业无法再以“是 AI 智能体干的”为由免责。
TIME 分析 Meta 个人 AI 智能体 Muse 的内部指令后发现,它会为用户及其认识的人维护不断更新的档案,并每小时刷新一次,记录用户与联系人如何相识以及社交圈内的争执或紧张关系。
推荐理由:TIME 对 Muse 内部指令的分析显示,个人档案每小时刷新并用于训练,可帮助读者判断这类个人 AI 智能体的数据边界。
俄罗斯 RT 已用 AI 生成虚拟主播,俄数字发展部长称 AI“能替代一半官员”。中国“零信任 AI 系统”在约 30 个县市交叉比对 150 多个政府数据库反腐,标记 8,700 名官员后遭地方抵制而回退;俄罗斯 20 万摄像头人脸识别系统曾用于 2021 年抗议中抓捕示威者,其 Oculus 系统每日扫描数十万张图片审查政治内容。
意大利数据保护局在 10 月 8 日通讯中公布多项处罚:IQVIA Solutions Italy 因建立含 100 万名患者健康数据的数据库被罚 700 万欧元,监管机构认定这些数据并非匿名,患者代码可长期追踪并配合出生年份、性别、诊断、处方和位置数据实现重识别,数据库中还混入 3300 多名患者的身份信息。
推荐理由:汇总意大利数据保护局近期多项处罚与指南,可对照了解奖学金名单公开、市镇监控和健康数据二次利用的合规边界。
EDRi 第 2026 年 10 月 8 日刊批评欧盟 KIDS Act 未能解决平台伤害儿童的根本原因,并指出 Cloud and AI Development Act(CADA)以“主权 AI”为名损害数字权利与环境保护。
研究者提出面向图像比特流细粒度理解(IBFU)的基础模型 BFG,由比特流语义编码器 BSeE 与细粒度语义生成器 FSeG 组成,无需将图像完整解码到像素域即可完成分类与语义描述生成,从而减少处理流程中的视觉暴露。
论文提出语义行为水印(SBW),在历史条件下对语义动作簇而非精确动作符号嵌入水印,并用带密钥的抗碰撞分箱替代公开簇分箱。在五个智能体模型(3B-14B,四家厂商)和三个编码器上,ToolBench 改写场景下簇级检测率为 0.49-0.66,精确符号方案仅 0.05-0.17;ALFWorld 上为 0.92-0.97 对 0.00-0.01。
推荐理由:论文提出面向 LLM 智能体的语义行为水印,在改写场景下检测率显著高于精确符号方案,并指出链式重放仍未被覆盖。
研究提出一套 LLM 辅助的主题分析流程,从大规模社交媒体数据中动态识别、分类并追踪新兴 AI 危害。作者分析了 18 个月(2025 年 1 月至 2026 年 6 月)内 570 万条 Reddit 帖子摘要,整理并发布包含 57.5 万条 AI 危害相关帖子的数据集,以及涵盖 12 个类别、47 个子节点的自下而上 AI 危害分类体系。
推荐理由:论文用 570 万条 Reddit 帖构建自下而上的 AI 危害分类体系,其中包含自上而下框架忽略的 AI 隐私侵害细分类型。
研究揭示,在最小双人强单调设定中,欺骗方利用与受害者探索仅存在相关性的泄露信号,将自身探索动作与之耦合,从而注入外部性并把学习动态导向新的稳态——欺骗纳什均衡(DNE)。作者证明欺骗性老虎机学习(DBL)动态以最优收敛速率收敛到 DNE 的任意小邻域,且在放宽标准老虎机优化文献的二阶光滑条件下仍成立,并用资源分配博弈展示了欺骗对稳态与欺骗方成本的严格影响。
研究提出一个面向物质使用障碍(SUD)患者对话生成的多目标对齐小语言模型框架,分认知成分检测与认知成分对齐对话生成两阶段,结合知识蒸馏、人类标注偏好优化与注意力引导奖励塑形。在 BERTScore、ROUGE、METEOR、BLEU 及 LLM-as-judge 命中指标上,认知信息微调在认知实现与对齐上优于通用指令微调基线和心理健康领域专用小语言模型,开放式认知成分提升尤为明显。
CoMoE 是一个面向消费级 GPU 的通信高效 MoE 推理系统,通过以主机为中心的路由解决 PCIe 带宽受限且无 P2P 支持的通信瓶颈。它用主机支持的 token 多播消除出站冗余,并用主机暂存缓冲的细粒度 token 级聚合替代全局同步。在 RTX 5090 上吞吐最高提升 1.46 倍,接近支持 NVLink 的 A800,硬件成本仅为其 23.4%。
研究团队提出 AURA——一个基于市售可穿戴设备的智能手表-手机生态系统,用于在复吸发生前主动检测并干预烟瘾。通过对 10 名多族裔亚洲吸烟者与戒烟者的半结构化共创设计访谈,研究识别出习惯、情绪与社会三个维度的烟瘾预测因素,以及社会问责、个性化支持、奖励和即时分心等用户偏好的干预策略。参与者还强调信任、隐私、个性化与非评判式交互的重要性。
研究测量了 LLM 路由决策元数据在关闭内容日志时仍会泄露敏感话题,基于 170 万条真实请求(WildChat-1M、LMSYS-Chat-1M)和两个成本/质量路由器及一个领域路由器展开预注册实验。
推荐理由:研究测量了 LLM 路由元数据在关闭内容日志时仍会泄露敏感话题,并给出长度匹配的缓解思路。
西班牙数据保护局(AEPD)发布《隐私、创新与技术》(PIT)期刊第二期,专刊纪念 GDPR 十周年,聚焦其在技术演进下面临的挑战。专刊三篇文章分别讨论问责原则、自动化决策中的解释权,以及公共行政部门使用生成式 AI 时的隐私设计。期刊另设隐私研究栏目,收录九项研究,涵盖神经数据、匿名化、数据泄露、智慧城市、算法政治广告与合成身份等议题。
奥地利议会宪法事务委员会将于今年秋季审议《普通行政程序法》(AVG)修订草案,草案首次允许行政机关使用全自动系统作出具有法律约束力的决定,且无需人工复核具体结果。
推荐理由:奥地利拟修法允许大语言模型在无人工复核下作出有约束力的行政决定,读者可了解全自动决策与基本权利之间的冲突。
欧盟委员会6月3日发布的“技术主权一揽子计划”包含《云与AI发展法案》(CADA),该法案要求成员国设立“数据中心加速区”、加快审批与环境评估,并推动公共部门采纳“AI优先”原则。
美国第八巡回上诉法院批准 xAI 的动议,在案件上诉期间暂停执行明尼苏达州禁止 nudify 应用的法律,命令全文只有一句批准动议,未给出任何法律理由。该法今年 5 月通过、原定 8 月生效,起草宽泛且未要求图像非自愿或存在主观意图,单次违规最高可罚 50 万美元;此前地方法官仅以 xAI 等到 7 月底才起诉为由驳回临时限制令和初步禁令申请,未审查案件实体。
一波针对广告账户管理者的钓鱼活动利用假 ChatGPT、Gemini、Claude 和 Perplexity 站点,通过浏览器套浏览器(BitB)攻击窃取登录凭证和 MFA 验证码,并借 Meta 新推出的 Muse AI 智能体之名设饵。
ICO 发布报告称,Amazon、Anthropic、Apple、Cohere、DeepSeek、Google、Meta、Microsoft、OpenAI 和 Stability AI 十家在英国运营的基础模型开发者已做出或承诺做出数据保护整改,包括更清晰的透明度信息、更便于个人行使权利的机制和更严格的保障评估。
推荐理由:ICO 对十家基础模型开发者的监督结果与对智能体 AI 的取证征集,呈现监管如何把训练数据与自主行为纳入合规边界。
Proton 博客指出,企业把数据交给少数 AI 实验室,等于在教它们如何取代自己,Lawfare 将这一过程称为"通过知识获取实现替代"(RKA)。OpenAI、Anthropic、Microsoft、Google 和 X 虽声称默认不用企业数据训练模型,但相关条款对"输入""输出""训练"定义含糊,且保留随时修改的权利。