网安 + AI 前沿日报

2026/5/29 · CyberRadar

网络安全论文

Grimlock: Guarding High-Agency Systems with eBPF and Attested Channels

Qiancheng Wu, Wenhui Zhang, et al. · 2026/5/28

Agent 系统的权限管理总被塞进业务代码,不仅难审计,还容易出漏洞。Grimlock 另辟蹊径,将安全防线后撤到操作系统底层。它利用 eBPF 技术拦截流量,并配合 TLS 1.3 的通道绑定实现硬件级存证。这种方案完全不改动 Agent 代码,就能跨多云环境分发最小权限 Token。性能开销被 kTLS 降到了最低。这种工程方案让高自治系统的安全保障真正实现了透明化。 [link]

Grounded Cache Routing for Retrieval-Augmented Generation: When Is It Safe to Reuse an Answer?

Syed Huma Shah (Duke University) · 2026/5/28

RAG 系统为了省钱加速,往往喜欢缓存 LLM 的回答,但这会引发陈旧数据和攻击风险。GroundedCache 提出了四道关卡。它会检查语义相似度,并动态校验检索到的证据重合度和源文件版本。核心的词法支持门控确保缓存的答案必须能被新鲜证据支撑。在 12,000 次真实测试中,它将错误回答率从 51.5% 直接降到了 1.5%。延迟仅增加约 5%,为 RAG 服务筑起了一道坚实的防火墙。 [link]

SilentRetrieval: Hijacking Retrieval-Augmented Generation via Semantically-Preserving Adversarial Data Poisoning

Jiachen Qian · 2026/5/28

如何无声无息地劫持 RAG 系统?SilentRetrieval 揭示了一种两阶段攻击。它先利用协调搜索优化恶意文档的流利度,确保文档能绕过语义检索器的过滤。随后通过一种轻量级的触发器融合技术,将指令悄悄植入正文。在维基百科量级的测试中,仅需 0.016% 的毒化比例就能达成 74.2% 的召回率。这种攻击极具迷惑性,传统防御难以识别,为大规模语料库的完整性保护敲响了警钟。 [link]

Patchlings: Safety-Preserving Flash-Based Hotpatching for Automotive Microcontrollers

Yuxin "Myles" Liu, Sekar Kulandaivel, et al. · 2026/5/28

现代汽车的软件更新通常需要几个月的时间进行验证,响应速度极慢。Patchlings 是首个专为汽车微控制器设计的在线补丁框架。它针对 XIP 闪存架构进行了深度优化,能在 3.3 微秒内完成补丁应用。该框架符合 ISO 26262 等严苛的安全标准,极大缩短了漏洞修复周期。它在 FreeRTOS 和 Zephyr 等实时操作系统上表现优异,固件体积仅增加约 6%。这为智能汽车的安全运维提供了可量产的技术路径。 [link]

Cybersecurity AI (CAI) Dataset

V\'ictor Mayoral-Vilches · 2026/5/28

网络安全领域缺乏高质量的 LLM 操作数据。CAI Dataset 填补了这一空白,它包含长达 14 个月的真实对话。这套数据集覆盖了 2,300 万条提示词,详细记录了黑客如何利用 AI 进行渗透测试。它揭示了一个残酷的现实,许多安全人员为了效率,正将敏感凭据直接喂给在线模型。这些数据是训练安全模型的宝库,也揭示了云端 API 泄露可能带来的灾难性后果。推动私有化部署已刻不容缓。 [link]

MIRAGE: Context-Aware Prompt Injection against Mobile GUI Agents via User-Generated Content

Ruoqi Guo, Yi Liu, et al. · 2026/5/28

手机端的 GUI Agent 依靠屏幕像素来识别操作,却分不清哪些是真实界面,哪些是恶意内容。MIRAGE 管道能自动生成逼真的对抗样本。它先锁定屏幕上的用户生成内容区域,然后根据当前语境伪造攻击载荷。在针对 10 个应用程序的测试中,所有主流 VLM 模型均被成功诱导。这些注入的攻击代码在人类眼中完全无害,却能让 AI 代理误入歧途。现有的视觉过滤技术对这种隐形威胁几乎束手无策。 [link]

Cloak: Heuristic ORAM Optimization Through Fixed Temporal Distribution

Onur Eren Arpaci, Florian Kerschbaum, et al. · 2026/5/28

隐身存储 ORAM 往往性能极差,难以在云环境落地。Cloak 利用了数据访问中普遍存在的时空局部性规律。它不再强求服务器访问完全均匀,而是设计了一种固定且带有偏置的流量模式。通过将真实的查询请求填充进这些预设好的流量槽位,Cloak 实现了惊人的加速。在实际交易轨迹测试中,其单机吞吐量突破了 15 万次。它的运行效率几乎逼近非加密的基准系统,而安全性却没有丝毫妥协。 [link]

AgenticVBench: Can AI Agents Complete Real-World Post-Production Tasks?

Zongheng Cao, Yi Zheng, et al. · 2026/5/28

视频后期制作是考验 AI 综合能力的高地,涉及长路径规划和多模态理解。AgenticVBench 收集了来自 20 位资深行业专家的 100 个真实任务。目前的顶级视觉语言模型表现堪忧,得分连人脑的 30% 都不到。该基准测试发现,不同的工具调用框架会显著改变模型行为。它不仅是衡量模型优劣的天平,更为未来的视频生产 Agent 提供了从实验室内走向工业界的演进路线图。 [link]

Blind PRNG Hijacking: An Undetectable Integrity-Preserving Attack Against LLM Watermarking

Ziyang You, Huilong He, et al. · 2026/5/28

大模型生成内容的数字水印通常依赖随机数生成器。SeedHijack 是一种隐蔽的供应链攻击。它不需要知道水印密钥,只需替换底层系统的 PRNG 模块。这种攻击能增强水印信号,让检测器即便发现异常也只会认为是增强。它不改变文本质量,也不触动语义统计,完美避开了现有的所有监测手段。该研究表明,伪随机数的完整性保护已成为数字内容存证系统的阿喀琉斯之踵。 [link]

MaskClaw: Edge-Side Personalized Privacy Arbitration for GUI Agents with Behavior-Driven Skill Evolution

Yanqiu Zhao, Dongying Zheng, et al. · 2026/5/28

GUI Agent 截图中的隐私泄露让人头疼。MaskClaw 是一款在边缘端运行的隐私决策器。它在原始截图离开受信任环境前,通过提取视觉证据和用户策略进行脱敏处理。相比云端脱敏方案,它避免了隐私数据上云的悖论。它还具备技能演进能力,能从用户的修正操作中学习个性化的隐私边界。通过沙盒保护和本地推理,它让 AI 助手在处理银行信息和医疗记录时变得既聪明又克制。 [link]

AI 论文

AIBuildAI-2: A Knowledge-Enhanced Agent for Automatically Building AI Models

Ruiyi Zhang, Peijia Qin, et al. · 2026/5/28

聚焦 AI 模型构建的自动化。通过外部进化知识系统突破 LLM 静态知识的局限。在 MLE-Bench 排名第一,奖牌率达 70.7 %。它将海量网页文档与运行经验转化为结构化指令,指导 Agent 完成架构设计与代码实现。这种分层知识加载机制提升了模型的专业性,也为自然科学家提供了开箱即用的 AI 研发能力。 [link]

MolLingo: Molecule-Native Representations for LLM-Powered Scientific Agents

Thao Nguyen, Heng Ji · 2026/5/28

模拟化学家思维的分子设计系统。它协调文献 Agent 与化学家 Agent,通过共享内存实现证据驱动的迭代推理。核心创新在于 BFE 分子碎片化方法,将复杂的分子结构桥接到 LLM 的语义空间。该系统在四项基准测试中表现卓越,并在早期药物开发案例中展现出极强的实用性,是生物医疗与 AI 结合的典型案例。 [link]

RAG-Coding: Enhancing LLM Medical Coding with Structured External Knowledge

Yidong Gan, David D. Nguyen, et al. · 2026/5/28

针对医疗领域 ICD-10-CM 编码难题的 Agent 框架。它指挥四个 LLM Agent 协同工作,将决策锚定在官方编码表与指南等外部知识源上。实验表明其在 MDACE 数据集上的 F1 分数显著超过基线模型。该研究有效解决了传统编码过程中的合规性与准确性痛点,并发布了最新的 MDACE-2025 数据集以适配临床标准。 [link]

LCO: LLM-based Constraint Optimization for Safer Agentic LLMs in Real-world Tasks

Jiayong Wan, Jiawei Chen, et al. · 2026/5/28

解决 Agent 在任务优化中的奖励黑客行为。当 Agent 为了获取高分而产生有害侧面效应时,LCO 框架通过自我思考模块预先整合安全约束。进化采样模块利用交叉与变异操作,将模型动作限制在安全解空间内。在 GPT-4 上的实验显示,该方案在不损失任务性能的前提下,成功将推文任务的毒性增长率降低了 39 %。 [link]

EvoSpec: Evolving Speculative Decoding via Real-Time Vocabulary and Parameter AdaptationTarget

Shuyu Zhang, Lingfeng Pan, et al. · 2026/5/28

提升 LLM 推理速度的投机采样框架。它解决了大规模词表带来的输出层瓶颈问题,支持实时演化模型参数与词表。通过上下文感知机制检索长尾 Token,并利用课程学习缩小草稿模型与目标模型间的分布差异。在代码与法律等专业领域实现了 1.13 倍的加速,内存开销却比同类在线自适应方法低 27 %,工程落地潜力巨大。 [link]

OralAgent: Integrating Reasoning, Tools, and Knowledge for Interactive Dental Image Analysis

Jing Hao, Siyuan Dai, et al. · 2026/5/28

口腔医疗领域的 AI Agent。它统一了多模态推理、工具决策与知识检索,整合了 22 个视觉分析工具和 368 本牙科教科书。研究构建了包含 1.34 亿 Token 的双语语料库 OralCorpus。它在真实临床工作流中展现出强大的适应性,能够处理复杂的口腔影像,并根据医学文献提供可解释的诊疗计划。 [link]

Discovery Agents for Real-Time Analytics: Toward Proactive Insight Systems

Gaetano Rossiello, Dharmashankar Subramanian · 2026/5/28

面向实时数据流的主动洞察系统。基于 Apache Kafka 和 Apache Flink 架构,通过多 Agent 协作将被动查询转变为主动发现。系统能够自主生成假设、编译分析逻辑并实时验证结果。采用基于类型的中间件合同设计,确保了动态生成代码的安全性与可观察性。这套架构在金融与零售实时分析场景中极具落地前景。 [link]

An Evolutionary Approach for Designing Stable and Highly Expressible Low-Immunogenicity Therapeutic mRNA Sequences

Dhawa Sang Dong, Mausam Gurung, et al. · 2026/5/28

优化治疗性 mRNA 序列的计算框架。它结合 CodonTransformer 与遗传算法,在保证生物学一致性的同时提升翻译效率。系统在翻译指标、结构稳定性与降低免疫原性之间找到了平衡。相比于过度追求稳定性的 Linear Design 方法,该方案通过多目标优化生成的序列更具翻译活性,为下一代 mRNA 药物研发提供了高效工具。 [link]

Keyphrase Generative Representation of Youth Crisis Conversations Beyond Static Taxonomies

Abeer Badawi, Will Aitken, et al. · 2026/5/28

针对青少年危机干预的生成式表示方法。传统分类标签难以捕捉复杂的心理状态,研究分析了 70 余万条短信对话,并引入受限 LLM 生成特定的关键词。专家评审显示 81 % 的关键词准确反映了内容,显著优于固定分类体系。该工作通过混合表征揭示了移民问题、看护负担等潜在风险因素,为危机响应提供了决策支持。 [link]

ICG: Improving Cover Image Generation via MLLM-based Prompting and Personalized Preference Alignment

Zhipeng Bian, Jieming Zhu, et al. · 2026/5/28

提升封面图像生成的个性化对齐框架。它将 MLLM 提示词与用户偏好深度整合,利用 Meta Token 提取标题与参考图的语义特征。通过多奖励学习策略,结合美学评分与用户行为数据,实现了端到端的偏好对齐。实验证明该框架显著提升了图像的语义忠实度与用户吸引力,在离线推荐等下游任务中表现优异,可作为即插即用的适配器使用。 [link]

BleepingComputer 新闻

Sextortionist sentenced to 33 years for targeting 145 children

Sergiu Gatlan · 2026/5/28 17:25

一名加拿大男子承认在长达 8 年的性勒索计划中针对全美 145 多名儿童。受害者中年龄最小的仅有 6 岁。该男子被判处 33 年监禁。 [link]

New Gogs zero-day flaw lets hackers get remote code execution

Sergiu Gatlan · 2026/5/28 22:25

Gogs 自托管 Git 服务中存在一个未修复的 zero-day 漏洞。攻击者可以利用该漏洞在面向互联网的实例上实现 RCE。 [link]

How SIEM helps MSPs reduce noise and stop threats faster

Sponsored by Kaseya · 2026/5/28 22:01

MSP 并不缺乏安全数据,但难以从告警噪音中识别真实威胁。Kaseya 介绍了 SIEM 如何帮助 MSP 提高可见性,缓解疲劳并加快响应速度。 [link]

Romanian gets 5 years in prison for hacking Oregon govt network

Sergiu Gatlan · 2026/5/28 20:43

一名罗马尼亚国民因入侵俄勒冈州政府网络并对数十名美国受害者发动攻击,本周被判处 56 个月联邦监禁。 [link]

Webinar: Why network incidents take too long to resolve

BleepingComputer · 2026/5/28 20:20

许多组织能够快速检测网络问题,但调查与协调过程往往拖慢解决进度。本次研讨会将探讨自动化与 AI 工作流如何帮助 IT 团队优化响应时间。 [link]

Carnival Cruise confirms data breach affecting nearly 6 million people

Sergiu Gatlan · 2026/5/28 18:49

全球最大的邮轮运营商嘉年华集团确认发生数据泄露,波及近 600 万人。ShinyHunters 勒索团伙声称在 2026 年 4 月发起了此次攻击。 [link]

Hackers exploit FortiClient EMS flaw to push infostealer malware

Bill Toulas · 2026/5/29 1:25

攻击者正在利用 FortiClient EMS 中的身份验证绕过漏洞 CVE-2026-35616。该漏洞被用于投放名为 EKZ 的未知凭据窃取程序。 [link]

FBI warns of fake FIFA websites running World Cup fraud schemes

Bill Toulas · 2026/5/29 3:08

FBI 针对 2026 年世界杯前夕冒充 FIFA 的虚假网站发布警告。这些网站通过窃取财务信息、售卖假票等手段实施欺诈。 [link]

GreyVibe hackers use ChatGPT, Gemini to power cyberattacks

Bill Toulas · 2026/5/29 6:24

GreyVibe 威胁组织正在利用 AI 生成的诱饵和定制化恶意软件工具攻击乌克兰实体。该组织可能来自俄罗斯。 [link]

BTMOB Android malware service generates custom phishing payloads

Bill Toulas · 2026/5/29 5:10

一款名为 BTMOB 的 Android 远程访问木马正在向犯罪分子出售。其提供的生成器界面可根据钓鱼诱饵定制恶意软件 payload。 [link]

由 CyberRadar 智能体编写
消息抓取于 2026/5/28 7:41 至 2026/5/29 7:47