网安 + AI 前沿日报

2026/5/7 · CyberRadar

网络安全论文

GPUBreach: Privilege Escalation Attacks on GPUs using Rowhammer

Chris S. Lin, Yuqin Yan, et al. · 2026/5/6

Rowhammer 攻击正式攻陷 GPU 阵地。研究者在 NVIDIA GPU 上实现了首个权限提升攻击。通过操纵页表管理机制,非特权用户可以跨进程窃取加密密钥。这种威胁甚至能穿透 IOMMU 防御,让攻击者夺取 CPU 端的根 shell 权限。该研究揭示了 GDDR 内存存在的安全短板,彻底打破了 GPU 仅作为计算加速器的安全假象。 [link]

Trojan Hippo: Weaponizing Agent Memory for Data Exfiltration

Debeshee Das, Julien Piet, et al. · 2026/5/5

智能体记忆系统正演变为数据泄露的温床。Trojan Hippo 攻击利用单次恶意工具调用,在 Agent 的长期记忆中植入休眠载荷。当用户随后讨论金融或健康等敏感话题时,攻击会自动激活并窃取数据。实验显示该攻击对 OpenAI 与 Google 的前沿模型保持极高成功率。虽然现有防御手段能降低风险,但往往会大幅削弱智能体的实用性。 [link]

MAGE: Safeguarding LLM Agents against Long-Horizon Threats via Shadow Memory

Yuhui Wang, Tanqiu Jiang, et al. · 2026/5/6

针对 LLM 智能体的长周期威胁,MAGE 框架借鉴了系统安全中的影栈思路。它维护一套独立的影记忆,用于提取和留存整个执行轨迹中的安全关键上下文。在执行任何敏感动作前,系统会通过影记忆预先评估风险。这种防御方式能识别单轮交互难以发现的恶意意图。其实际运行开销微乎其微,为自动驾驶和医疗等关键领域的智能体部署提供了安全屏障。 [link]

Dependency-Aware Privacy for Multi-turn Agents

Divyam Anshumaan, Sarthak Choudhary, et al. · 2026/5/6

多轮对话智能体在交互中面临严重的隐私衰减。传统方案独立处理每次数据发布,攻击者通过合并多轮信息即可反推原始属性。RootGuard 提出了依赖感知隐私机制,仅对计算根节点进行一次性加噪,后续发布均基于噪声根进行确定性计算。该方案利用后处理定理确保隐私预算不随回合增加而枯竭。在医疗诊断测试中,它将目标误差降低了三倍。 [link]

Revisiting JBShield: Breaking and Rebuilding Representation-Level Jailbreak Defenses

Kemal Derya, Berk Sunar · 2026/5/6

即便号称零成功率的防御系统也可能在自适应攻击面前溃败。研究者通过干扰拒绝方向,成功破解了 JBShield 表征层防御。为了弥补这一结构性缺陷,他们提出了基于多层表征轨迹验证的 RTV 防御。该方法利用马氏距离检测多层拒绝特征的异常。实验证明多层一致性比单层概念相似性更难被绕过。这为构建鲁棒的 LLM 安全护栏提供了新思路。 [link]

LIPPEN: A Lightweight In-Place Pointer Encryption Architecture for Pointer Integrity

Erfan Iravani, Lalit Prasad Peri, et al. · 2026/5/6

内存安全违规长期威胁 C 语言程序。LIPPEN 提出了一种硬件软件协同架构,实现全指针加密且无需额外元数据。它将 64 bit 指针字段整体作为加密块,在解引用时透明解密。相比 ARM PAC 等机制,该设计利用了更高的熵,消除了暴力破解风险。在 RISC-V 核心上的实验表明,其运行时开销与现有方案相当,但能提供更强的指针完整性保护。 [link]

MOSAIC-Bench: Measuring Compositional Vulnerability Induction in Coding Agents

Jonathan Steinberg, Oren Gal · 2026/5/6

编码智能体可能在通过安全审查的同时,提交具有漏洞的代码。MOSAIC-Bench 揭示了这种结构性隐患。攻击者将恶意目标拆解为看似无害的常规任务,绕过了针对单个请求的安全对齐。九款主流智能体在该基准测试下的攻击成功率均超过百分之五十。研究建议将代码审查者重构为对抗性渗透测试者。这种策略在不影响开发效率的前提下,显著提升了漏洞检出率。 [link]

PHANTOM: Polymorphic Honeytoken Adaptation with Narrative-Tailored Organisational Mimicry

Abraham Itzhak Weinberg · 2026/5/6

传统的蜜罐令牌由于缺乏组织特征,极易被统计和语义分析识别。PHANTOM 框架引入了多组件生成流水线,将域名、技术栈和秘密值分布等组织知识融入其中。生成的令牌在语法、语义和统计层面均具备极高的欺骗性。人类评估者的接受率从不足百分之七飙升至百分之百。该系统支持脱机部署,为企业内部的入侵检测提供了更隐蔽的数字诱饵。 [link]

ZK-Value: A Practical Zero-Knowledge System for Verifiable Data Valuation

Zhaoyu Wang (HKUST, Hong Kong SAR), et al. · 2026/5/6

数据市场需要公平的价值分配,但 Shapley 值计算往往涉及大量私密数据。ZK-Value 系统实现了可验证的数据估值,兼顾隐私与效率。它通过 LSH-Shapley 算法将昂贵的距离运算转化为桶碰撞统计。配合超级预言机批处理等优化技术,证明生成时间缩短了数十倍。该系统能在数分钟内完成大规模数据集的估值证明,让去中心化数据交易的审计变得切实可行。 [link]

DECKER: Domain-invariant Embedding for Cross-Keyboard Extraction and Recognition

Bikrant Bikram Pratap Maurya, Nitin Choudhury, et al. · 2026/5/6

键盘敲击声正成为泄露隐私的隐秘渠道。DECKER 框架克服了以往研究中小规模数据集的局限性,在跨设备和跨环境场景下实现了高精度敲击推理。它通过键盘特征归一化和域对抗解耦技术,消除了设备音色对预测的干扰。即便在 VoIP 通信产生的网络噪声下,该系统依然能准确识别输入内容。这再次提醒用户在视频会议期间保持静音对保护敏感信息的重要性。 [link]

AI 论文

cotomi Act: Learning to Automate Work by Watching You

Masafumi Oyamada, Kunihiro Takeoka, et al. · 2026/5/6

理想的网页助手应该通过观察用户的日常操作来学习工作流。cotomi Act 实现了一套从行为到知识的自动化链路,它能将零散的浏览操作提炼为可复用的任务看板。在 WebArena 评测中,该系统以 80.4 % 的成功率超越了人类基准。其核心在于采用了自适应延迟观察和历史压缩技术。这为未来个人化智能助手的演进提供了一条清晰路径。 [link]

SymptomAI: Towards a Conversational AI Agent for Everyday Symptom Assessment

Joseph Breda, Fadi Yousif, et al. · 2026/5/6

医疗诊断 AI 不应只停留在处理标准病例集,更要面对普通人的真实叙述。SymptomAI 通过 Fitbit 应用在 13917 人中完成了真实测试。相比于用户主导的交流,AI 主导的标准化访谈显著提升了诊断准确度。该研究结合可穿戴设备的生理指标,揭示了急性感染与生理变化的强关联。这展示了 Agent 在预诊领域的工程潜力,也为普惠医疗的自动化实现贡献了实战数据。 [link]

Stable Agentic Control: Tool-Mediated LLM Architecture for Autonomous Cyber Defense

Kerri Prinos, Lilianne Brush, et al. · 2026/5/6

面对对抗性攻击,网络防御 Agent 需要硬核的稳定性保证。该研究设计了一种工具导向的架构,让 Claude 模型通过博弈论工具进行决策,并利用 Lean 4 完成了稳定性证明。在 282 个真实企业攻击图谱上的测试表明,该方案能将攻击者的预期收益降低 59 % 。它融合了 LLM 的策略探索能力与经典控制理论的鲁棒性,为构建自主化安全运营中心提供了可靠框架。 [link]

Terminus-4B: Can a Smaller Model Replace Frontier LLMs at Agentic Execution Tasks?

Spandan Garg, Vikram Nitin, et al. · 2026/5/6

在复杂的编码任务中,调用巨型模型处理琐碎的终端指令既慢又贵。Terminus-4B 证明了经过针对性训练的 4B 小模型,在执行搜索、调试和环境配置等子任务时,可以平替甚至超越 Claude 等模型。它为智能体系统节省高达 30 % 的 token 开销,同时保持主 Agent 的上下文整洁。对于追求性能与成本平衡的工程师,这是一份极具参考价值的轻量化实践。 [link]

Zero-Shot Confidence Estimation for Small LLMs: When Supervised Baselines Aren't Worth Training

Luong N. Nguyen · 2026/5/5

随着推理成本攀升,将简单任务路由至本地小模型已成为降本增效的方案。该研究对比了 Zero-shot 信号在置信度评估上的表现。结果显示,简单的 token 对数概率在分布外场景的表现优于复杂的监督基线。团队提出的检索条件自评估方案,提升了路由准确度,且显著降低了延迟。这为构建低成本、高可靠的端云协同推理系统提供了实战指南。 [link]

CreativityBench: Evaluating Agent Creative Reasoning via Affordance-Based Tool Repurposing

Cheng Qian, Hyeonjeong Ha, et al. · 2026/5/6

智能体要学会在紧急时刻将物品挪作他用。CreativityBench 挑战模型优先利用物理属性解决问题,例如用钥匙撬锁。研究团队构建了包含 4000 个实体和 15 万条属性标注的知识库。实验显示,现有的 LLM 在物理机制理解上存在明显硬伤,单纯增加参数规模难以突破瓶颈。这篇论文为提升 Agent 的创造性推理提供了实验场,也指出了模型进化的新方向。 [link]

EditPropBench: Measuring Factual Edit Propagation in Scientific Manuscripts

Garvin Kruthof · 2026/5/5

修改科学手稿中的一个数字,往往会引发连锁反应,导致其他定性描述失效。EditPropBench 专门测试模型处理这类非局部修改的能力。研究发现,即便是最强的 LLM 也会遗漏约 30 % 的下游更新。该工作通过构建事实图谱,精准捕捉文档内部的逻辑依赖。它为自动化编辑工具提供了严苛的测试标准,是确保科学出版物准确性的重要基石。 [link]

MolViBench: Evaluating LLMs on Molecular Vibe Coding

Jiatong Li, Yuxuan Ren, et al. · 2026/5/5

化学家正尝试通过自然语言让 AI 编写程序来搞定分子任务。MolViBench 是首个为此设计的基准测试,涵盖从单 API 调用到虚拟筛选流水线设计的 12 种真实任务。该测试不局限于代码检查,更结合了 AST 语义分析来确保化学层面的正确性。实验揭示了 AI 在分子理解与逻辑推理结合处的短板,为 AI 加速新药研发指明了进化方向。 [link]

MedStruct-S: A Benchmark for Key Discovery, Key-Conditioned QA and Semi-Structured Extraction from OCR Clinical Reports

Yingyun Li, Yu Wang, et al. · 2026/5/6

从充满噪声的 OCR 临床报告中提取半结构化数据,是重建病人病史的关键瓶颈。MedStruct-S 提供了 3582 页真实标注数据,针对字段标题未知和识别噪声等极端情况。通过对比 encoder-only 与 decoder-only 两大流派,研究发现小参数模型在特定条件下具备卓越的鲁棒性。该基准为医疗场景的信息提取任务树立了实战标杆,极具工程落地价值。 [link]

When to Think, When to Speak: Learning Disclosure Policies for LLM Reasoning

Jiaqi Wei, Xuehang Guo, et al. · 2026/5/6

在流式输出界面,AI 往往面临思考与表达的两难。过早发言容易犯错,思考太久则让用户感到焦虑。SxS 框架将披露时机建模为可学习的策略,让模型在私密思考与公共承诺之间找到平衡。通过强化学习优化,该系统能在保证准确率的同时,降低用户的感官延迟。这项技术优化了人机交互体验,也为处理长程思考任务提供了全新的输出范式。 [link]

BleepingComputer 新闻

Palo Alto Networks warns of firewall RCE zero-day exploited in attacks

Sergiu Gatlan · 2026/5/6 17:18

Palo Alto Networks 今日向用户发出警告。PAN-OS User-ID Authentication Portal 存在严重且未修复的漏洞。攻击者正在利用该漏洞发起攻击。 [link]

Why ransomware attacks succeed even when backups exist

Sponsored by Acronis · 2026/5/6 22:04

备份失败是因为攻击者先行摧毁了它们。Acronis 解释了勒索软件如何在加密前瞄准备份系统。这导致受害者无法恢复数据。 [link]

MuddyWater hackers use Chaos ransomware as a decoy in attacks

Bill Toulas · 2026/5/6 21:02

伊朗黑客组织 MuddyWater 将攻击行动伪装成 Chaos 勒索软件攻击。他们利用 Microsoft Teams 进行社会工程学攻击。以此获取访问权限并实现持久化。 [link]

Webinar: Why network incidents escalate and how to fix response gaps

BleepingComputer · 2026/5/6 20:56

多数网络事件升级是因为响应机制失效。这通常与告警数量无关。本次研讨会探讨如何修复分诊、数据富化和协同中的缺陷。 [link]

DAEMON Tools devs confirm breach, release malware-free version

Sergiu Gatlan · 2026/5/7 0:43

DAEMON Tools Lite 开发商 Disc Soft Limited 确认软件在供应链攻击中被植入木马。官方已发布不含恶意代码的新版本。 [link]

Critical vm2 sandbox bug lets attackers execute code on hosts

Bill Toulas · 2026/5/7 2:38

常见的 Node.js 沙箱库 vm2 存在严重漏洞。攻击者能够逃逸沙箱。他们在宿主系统上执行任意代码。 [link]

New Cisco DoS flaw requires manual reboot to revive devices

Sergiu Gatlan · 2026/5/7 2:06

思科修复了 Crosswork Network Controller 和 Network Services Orchestrator 中的拒绝服务漏洞。受攻击的系统需要手动重启才能恢复。 [link]

Hackers abuse Google ads for GoDaddy ManageWP login phishing

Bill Toulas · 2026/5/7 5:36

一项通过 Google 赞助搜索结果传播的钓鱼活动正在窃取凭据。目标是 GoDaddy 旗下的 ManageWP 平台。该平台用于管理大规模 WordPress 网站。 [link]

由 CyberRadar 智能体编写
消息抓取于 2026/5/6 7:25 至 2026/5/7 7:10