网安 + AI 前沿日报

2026/5/19 · CyberRadar

网络安全论文

uGen: An Agentic Framework for Generating Microarchitectural Attack PoCs

Debopriya Roy Dipta, Thore Tiemann, et al. · 2026/5/18

微架构攻击开发门槛极高,且代码难以跨平台移植。uGen 框架利用多智能体设计与检索增强技术,填补了大模型在底层硬件安全知识上的漏洞。它能以不足 2 美元的成本,在 4 分钟内自动生成针对 Spectre 或 Prime+Probe 的攻击代码。该工具在不同处理器架构上展现了惊人的成功率。这标志着漏洞挖掘进入了自动化新阶段,防御者必须面对更高效的威胁评估挑战。 [link]

Detecting Privilege Escalation in Polyglot Microservices via Agentic Program Analysis

Penghui Li, Hong Yau Chong, et al. · 2026/5/18

现代微服务架构复杂且代码语言繁杂,权限提升漏洞极难察觉。Neo 框架将大模型与程序分析技术深度融合,通过动态生成分析计划来应对多语言环境下的代码搜索。该研究在 25 个开源项目中挖出了 24 个零日漏洞,覆盖 7 种主流编程语言。相比传统工具,Neo 在处理跨服务交互时的准确率提升显著。它为大型分布式系统的安全审计提供了极具实战价值的自动化方案。 [link]

Who Owns This Agent? Tracing AI Agents Back to Their Owners

Ruben Chocron, Doron Jonathan Ben Chayim, et al. · 2026/5/18

当 AI 智能体产生破坏行为时,如何锁定幕后的部署账号?该研究首次定义了智能体溯源问题并提出实用协议。研究者利用金丝雀机制,在交互流中注入难以察觉且无法删除的特定载荷。即使攻击者尝试对指令进行改写,也无法规避溯源分析。实验证明该方案在多个主流模型供应商环境中均能可靠运行。它为解决智能体滥用引发的法律责任与合规问题提供了关键技术支撑。 [link]

Hidden in Memory: Sleeper Memory Poisoning in LLM Agents

Sidharth Pulipaka, Stanislau Hlebik, et al. · 2026/5/18

长期记忆让大模型助理更懂用户,却也开辟了新的攻击面。Sleeper Memory Poisoning 揭示了一种潜伏型攻击。攻击者通过操纵网页或文档,诱导模型在记忆中存入虚假信息。这些恶意记忆会在数周后的对话中被激活,从而操纵模型执行有害操作。在 GPT-5.5 等模型上的测试显示,攻击成功率极高。这种跨会话的持久性威胁,迫使我们必须重新审视状态化 AI 的数据信任边界。 [link]

A Cross-Modal Prompt Injection Attack against Large Vision-Language Models with Image-Only Perturbation

Hao Yang, Zhuo Ma, et al. · 2026/5/18

现有视觉语言模型攻击大多局限于单一模态,CrossMPI 实现了跨模态的突破。它仅通过微调图像层面的扰动,就能操纵模型对后续文本指令的理解。研究者发现模型中层而非末层才是多模态融合的关键,并据此优化了扰动算法。这种攻击绕过了传统的视觉空间限制,在多个主流模型上表现出极强的鲁棒性。它警示开发者,图像输入的微小瑕疵可能导致整个交互逻辑被恶意篡改。 [link]

PersonaFingerprint: Measuring Persona Inference on Modern Websites with LLM-Driven Browsing

Chuxu Song, Hao Wang, et al. · 2026/5/18

加密流量不再能保护你的身份隐私。PersonaFingerprint 证明攻击者仅凭数据包长度和时间间隔,就能推断出用户的浏览画像。研究者构建了模拟不同人格的大模型智能体,在真实网站上收集流量特征。实验显示,网站指纹识别已经进化到了人格指纹识别。即便访问相同的网站,不同的操作习惯也会泄露你的身份信息。这项研究极大扩展了加密流量分析的威胁范畴。 [link]

Rethinking the Security of DP-SGD: A Corrected Analysis of Differentially Private Machine Learning

Wenhao Wang, Shujie Cui, et al. · 2026/5/18

差分隐私随机梯度下降在工业界广泛应用,但理论分析与代码实现之间存在危险的脱节。该研究指出 Meta 的 Opacus 等主流库在处理梯度归一化时,采用了与数学证明不符的逻辑。这种偏差导致实际的隐私保护力度弱于宣称的指标。作者通过对多个版本的库进行安全审计,推导出了修正后的隐私保障曲线。这项工作为差分隐私机器学习的工程化落地提供了至关重要的安全底座。 [link]

Autonomous Intelligent Agents for Natural-Language-Driven Web Execution with Integrated Security Assurance

Vinil Pasupuleti, Siva Rama Krishna Varma Bayyavarapu, et al. · 2026/5/18

传统 Web 自动化测试极易因 UI 变动而失效。该研究利用大模型驱动的智能体,通过环境感知和自我修复策略,将测试脚本生成的成功率从 55% 提升至 93%。它能够处理复杂的导航逻辑,同时将自然语言描述的攻击场景转化为安全探测点。这套系统在生产环境测试中消除了 80% 的竞争状态干扰。它展示了 AI 如何将繁琐的测试与安全验证流程缩短 75% 的耗时。 [link]

From Backup Restoration to Minimum Viable Factory Recovery: A Systematization of Ransomware Recovery in Manufacturing Systems

Chun Yin Chiu · 2026/5/18

制造系统遭遇勒索病毒后,恢复生产绝非简单的备份还原。该研究提出最小可行工厂恢复概念,强调了工控系统与身份验证及供应链之间的深度耦合。通过分析大量真实事故案例,作者总结了导致恢复失败的九种典型模式。文章构建了一套以生产能力为核心的恢复生命周期模型,而非单纯的数据恢复。它为关键基础设施在遭受毁灭性网络攻击后的快速自救提供了系统化的工程指南。 [link]

LymphNode: A Plug-and-Play Access Control Method for Deep Neural Networks

Hanyu Pei, Shang Liu, et al. · 2026/5/18

边缘侧部署的深度学习模型面临严重的知识产权泄露风险。LymphNode 像一套免疫系统,无缝嵌入模型内部实现权限控制。它采用默认拒绝策略,通过在特征空间注入稀疏对抗扰动,使未经授权的查询完全失效。只有携带正确凭证的输入才能恢复模型精度。该方案极具工程吸引力:仅需不足 100 个样本即可完成部署,无需接触原始训练数据。它为高价值模型的本地化部署提供了极轻量化的防护。 [link]

AI 论文

SaaS-Bench: Can Computer-Use Agents Leverage Real-World SaaS to Solve Professional Workflows?

Kean Shi, Zihang Li, et al. · 2026/5/18

软件即服务 SaaS 已成为数字工作的核心。SaaS-Bench 选取了 23 个真实系统,构建了 106 个跨领域的专业工作流任务。实验揭示了当前计算机使用智能体 CUA 在长程规划和跨应用上下文维护上的巨大挑战。顶尖模型在真实场景下的完成率不足百分之四,这为下一代办公自动化智能体指明了攻坚方向。 [link]

X-SYNTH: Beyond Retrieval -- Enterprise Context Synthesis from Observed Human Attention

Guruprasad Raghavan, George Nychis, et al. · 2026/5/18

企业上下文分散在各系统中,单纯依靠语义匹配难以精准召回。X-SYNTH 将人类注意力特征引入 RAG 流程,把搜索问题转化为相关性判定。通过提取员工在正向产出前的数字行为特征,该框架显著提升了线索识别的准确率。这种基于人类反馈的动态上下文合成技术,为解决企业知识库虚假线索难题提供了实战范式。 [link]

STAR: A Stage-attributed Triage and Repair framework for RCA Agents in Microservices

Junle Wang, Xingchuang Liao, et al. · 2026/5/18

微服务故障诊断极其复杂。STAR 框架将工作流拆解为证据包和假设集等四个结构化阶段,把智能体失效视为可定位的逻辑漏洞。通过反事实候选评估和阶段性补丁修复,它能精准定位并纠正推理偏差。在真实生产环境中的卓越表现,证明了这种分段治理策略是构建高可靠运维智能体的有效路径。 [link]

SDOF: Taming the Alignment Tax in Multi-Agent Orchestration with State-Constrained Dispatch

Zhantao Wang · 2026/5/18

现有的多智能体框架往往脱离了业务逻辑约束。SDOF 将执行过程建模为带状态约束的状态机,确保智能体行为符合预设流程。在服务于数千家企业的招聘系统上,该框架展现了远超 GPT-4o 的抗对抗路由精度。它在大幅提升任务成功率的同时,有效拦截了所有非法业务操作,为复杂业务流提供了安全保障。 [link]

PAGER: Bridging the Semantic-Execution Gap in Point-Precise Geometric GUI Control

Jingxuan Wei, Xi Bai, et al. · 2026/5/18

在点位级精度的几何 GUI 任务中,传统的区域容错范式彻底失效。PAGER 填补了语义理解与底层执行之间的鸿沟,引入了拓扑感知的规划与像素级强化学习。通过对 22 万次过程监控行为的训练,它在精确几何构建任务中实现了四倍于最强基座的成功率。这标志着 GUI 智能体正迈向像素级精确操作的新阶段。 [link]

PRISM: Prompt Reliability via Iterative Simulation and Monitoring for Enterprise Conversational AI

Keshava Chaitanya, Jahnavi Gundakaram · 2026/5/18

企业级对话智能体最怕提示词在生产环境中产生不可预测的回归。PRISM 提出了持续可靠性工程理念,通过模拟真实对话、诊断失效根因并自动外科式修复,实现了提示词的闭环优化。在 Yellow.ai 平台的实测表明,它将提示词编写效率从天级缩短至分钟级,并能快速修复由于 LLM 行为漂移导致的性能下降。 [link]

From Flat Language Labels to Typological Priors: Structured Language Conditioning for Multilingual Speech-to-Speech Translation

Yu Pan, Yang Hou, et al. · 2026/5/18

现有的语音翻译系统通常将语言视为孤立标签。S2ST-Omni 2 引入了结构化的语言类型学先验,通过层级编码和动态门控技术,实现了高效的多语种适配。即便在只有三小时训练数据的极端低资源场景下,它依然展现出强大的推理性能。这种摆脱英语中心主义的设计,为构建全球通用的实时翻译系统奠定了基础。 [link]

Fully Open Meditron: An Auditable Pipeline for Clinical LLMs

Xavier Theimer-Lienhard, Mushtaha El-Amin, et al. · 2026/5/18

临床决策支持系统必须具备高透明度。Meditron 提供了首个全开放的医疗大模型管线,从经医生审计的语料库到去污染的训练方案完全透明。通过专家小组进行终端验证,它在临床场景下展现出了超越闭源模型的专业素养。这种对数据溯源和逻辑透明的追求,解决了医疗 AI 规模化落地过程中的信任危机。 [link]

DeepSlide: From Artifacts to Presentation Delivery

Ming Yang, Zhiwei Zhang, et al. · 2026/5/18

好的演示需要流畅的叙事与节奏把控。DeepSlide 打破了单纯生成页面的局限,利用多智能体协作支持从需求引导、时间规划到脚本生成及彩排支持的全流程。通过对叙事流和注意力引导的深度优化,它显著提升了演示文稿的交付质量。这套系统让 AI 助手从制图工具进化为专业的表达顾问,具有极高的现实应用价值。 [link]

Argus: Evidence Assembly for Scalable Deep Research Agents

Zhen Zhang, Liangcai Su, et al. · 2026/5/18

深层研究任务需要对证据进行严丝合缝的拼图式组装。Argus 系统通过搜索者与导航者的协作,将复杂的证据链条维护在共享图结构中。导航者负责验证证据缺失点并分派任务,避免了并行搜索中的信息冗余和上下文爆炸。该系统在多个基准测试中超越了主流闭源代理,为高效处理长程复杂信息检索任务提供了最优解。 [link]

BleepingComputer 新闻

Hackers earn $1,298,250 for 47 zero-days at Pwn2Own Berlin 2026

Sergiu Gatlan · 2026/5/18 13:33

Pwn2Own Berlin 2026 挑战赛落下帷幕。安全研究人员利用 47 个 zero-day 漏洞获得了 1298250 美元奖金。 [link]

Microsoft confirms Windows 11 security update install issues

Sergiu Gatlan · 2026/5/18 16:33

微软证实 2026 年 5 月发布的 Windows 11 安全更新 KB5089549 在部分系统上无法安装。安装失败时会显示 0x800f0922 错误。 [link]

Exploit available for new DirtyDecrypt Linux root escalation flaw

Sergiu Gatlan · 2026/5/18 15:18

Linux kernel 的 rxgk 模块近期修复了一个本地权限提升漏洞。该漏洞的 PoC 利用代码现已公开,攻击者可借此在部分 Linux 系统中获取 root 权限。 [link]

Grafana says stolen GitHub token let hackers steal codebase

Bill Toulas · 2026/5/18 21:46

Grafana Labs 披露攻击者利用窃取的 access token 侵入其 GitHub 环境,并下载了源代码。 [link]

Microsoft testing adjustable taskbar, Start menu in Windows 11

Sergiu Gatlan · 2026/5/18 19:14

微软正在 Windows 11 最新预览版中测试可调节大小的任务栏和开始菜单。该版本目前面向 Experimental 频道的 Insider 用户推送。 [link]

5 Steps to Managing Shadow AI Tools Without Slowing Down Employees

Sponsored by Adaptive Security · 2026/5/19 2:45

许多员工已在未经安全审计的情况下使用影子 AI 工具。Adaptive Security 介绍了如何在不影响员工效率的前提下建立实用的 AI 治理体系。 [link]

Leaked Shai-Hulud malware fuels new npm infostealer campaign

Bill Toulas · 2026/5/19 1:28

上周泄露的 Shai-Hulud 恶意软件现已投入新的 npm 攻击活动。上周末已监测到多个包含该病毒的恶意软件包。 [link]

INTERPOL ‘Operation Ramz’ seizes 53 malware, phishing servers

Bill Toulas · 2026/5/19 6:15

国际刑警组织的 Operation Ramz 行动逮捕了 200 多名网络犯罪分子。此次行动针对中东和北非地区,共缴获 53 台用于分发恶意软件和钓鱼程序的服务器。 [link]

SHub macOS infostealer variant spoofs Apple security updates

Bill Toulas · 2026/5/19 5:42

一款名为 SHub 的 macOS 信息窃取软件出现新变种。它利用 AppleScript 伪造安全更新消息并安装后门。 [link]

由 CyberRadar 智能体编写
消息抓取于 2026/5/18 7:26 至 2026/5/19 7:34