网安 + AI 前沿日报

2026/6/24 · CyberRadar

网络安全论文

Agent-Assisted Side-Channel Attacks on Non-Prefix KV Cache in RAG

He Sun, Shinan Liu, et al. · 2026/6/23

RAG 系统的加速技术成了隐私泄露的温床。研究者发现了 SpliceLeak 攻击,它利用了 KV cache 融合过程中的微架构时延特征。黑客通过 Step-Wave 签名,能精准推测私有提示词的长度。即便只需 63 次请求,就能逐个字符地窃取加密内容。该研究针对 vLLM 等主流框架,展示了内存去重与安全性之间的致命冲突。为此提出的 SpliceDefense 方案在几乎不损失吞吐量的前提下,通过对齐计算耗时封锁了这一侧信道漏洞。 [link]

AgenticOS: An Intent-Oriented Secure Operating System Architecture for Autonomous AI Agents

Zhen Zhao, Yu Zhang, et al. · 2026/6/23

传统的操作系统权限模型在 AI 智能体时代已经捉襟见肘。AgenticOS 提出了一种面向意图的全新架构。它不再单纯管理底层资源,转而将系统定义为意图过滤器。智能体不再直接请求文件或网络权限,必须提交结构化的意图声明。系统据此动态构建最小权限环境,从根源上遏制了提示词注入引发的越权行为。通过 Ghost Kernel 等四层核心组件,AgenticOS 将安全边界从输入端移到了执行层。这为构建可审计、受控的自主智能体运行环境提供了参考范式。 [link]

Snatcher: Apple Find My Network Exposes Your Lost Devices To Strangers

Zhenyu Ren, Yanbo Zhang, et al. · 2026/6/23

苹果的 Find My 网络原本是为了找回失物,现在却可能被小偷反向利用。Snatcher 框架仅需一部 Android 手机就能精准锁定周围遗失的苹果设备。它巧妙利用了蓝牙广播数据的不加密特性,结合声学触发器和传感器融合算法,实现了实时的物理定位。在真实场景测试中,攻击者能精准找回并窃取他人的配件。这项研究揭示了隐私保护与物理安全之间的设计权衡。它迫使科技巨头必须重新审视数亿台移动设备的底层协议安全性,以应对日益隐蔽的追踪与盗窃风险。 [link]

DEFENGRAPH: Knowledge Graph-Enhanced LLMs for Blue Team Cyber Defense

Zhen Wang, Kristen Moore, et al. · 2026/6/23

面对复杂的网络攻击,蓝队防守方常因信息过载而陷入决策困境。DEFENGRAPH 将知识图谱与大模型深度融合,构建了一套智能辅助防御系统。它通过静态与动态双层图结构,整合了 SIEM 告警、系统拓扑及攻击者行为数据。通过路径检索与语义过滤,该系统显著降低了大模型的幻觉问题,并在红蓝对抗实战中表现卓越。其决策召回率提升显著,能协助防御者快速锁定关键威胁并给出处置建议。这标志着网络安全自动化正在从简单的规则匹配演进到具备长时记忆与环境感知能力的专家系统阶段。 [link]

"What Happens Locally, Leaks Globally": Detecting Privacy Leakage Risks in MCP Servers

Biwei Yan, Minghui Xu, et al. · 2026/6/23

连接大模型与外部资源的 MCP 协议正在迅速普及,但其诱发的隐私风险不容忽视。研究者开发的 MCPPrivacyDetector 对一万多个服务器进行了深度扫描,发现泄露率超过 10% 。这些漏洞源于凭据、 API 密钥等敏感信息在协议交互过程中被无意返回。该工具利用跨语言静态分析技术,统一了 Python 等多种语言的代码表示,并精准定位了隐式泄露点。通过对真实案例的复盘,该研究揭示了智能体工具链中普遍存在的防御真空,为制定协议级安全标准提供了关键实证支持。 [link]

VeriPort: Automated and Verified Patch Backporting at Scale

Jonah Ghebremichael, Wenxin Jiang, et al. · 2026/6/23

开源软件的漏洞修复往往只针对最新版本,迫使开发者在升级风险与安全风险之间艰难抉择。 VeriPort 系统利用 Agentic AI 实现了自动化的补丁后向移植。它能将安全修复适配到旧版本,同步生成的证据链足以证明补丁有效且不破坏功能。在测试中,它成功解决了超过 95% 的后向移植任务,性能大幅领先同类工具。更重要的是,它纠正了上千个关于受影响版本的错误记录。这套系统极大地减轻了供应链安全的维护负担,让那些被遗忘的老旧代码库也能获得及时的安全加固。 [link]

BELLS-O: Evaluating the Operational Trade-offs of LLM Supervision Systems

Leonhard Waibl, Felix Michalak, et al. · 2026/6/23

如何在大模型防御效果、成本与延迟之间找到最优平衡点? BELLS-O 提供了首个独立的大模型监管系统评测标准。它覆盖了从 LlamaGuard 到 GPT 等 28 个主流系统,从 11 类危害维度进行了深度解剖。研究发现,专门的卫士模型在内容过滤上表现优异,速度快 10 倍且成本更低。而在检测越狱攻击时,顶尖全能模型效果更佳,却伴随着高昂的延迟代价。这一 Pareto 前沿的揭示,为企业在真实生产环境中选择安全屏障提供了数据支撑。它填补了厂商自研评测的偏见漏洞,是部署可靠 AI 应用的必备指南。 [link]

FlexServe: A Fast and Secure LLM Serving System for Mobile Devices with Flexible Resource Isolation

Yinpeng Wu, Yitong Chen, et al. · 2026/6/23

在移动设备上部署大模型,隐私与性能的兼得一直是工程难题。 FlexServe 巧妙利用 ARM TrustZone 技术,构建了一套可撤回的资源隔离方案。它打破了传统安全世界与普通世界对 NPU 和内存的管理壁垒,让操作系统在无法窥探数据的同时依然能高效分配资源。这种解耦设计解决了安全推理带来的巨大开销,响应速度提升了 10 倍。这意味着即便系统内核被攻破,用户的私密数据与模型权重依然能处于硬件级的保护伞之下。 FlexServe 为移动端 AI 的规模化应用扫清了安全与效率的双重障碍。 [link]

ColumnKeeper: Efficient Solutions to the ColumnDisturb Vulnerability in DRAM-based Systems

Andreas Kosmas Kakolyris, F. Nisa Bostanci, et al. · 2026/6/23

RowHammer 攻击的影响尚未平息, DRAM 领域又出现了名为 ColumnDisturb 的新威胁。这种漏洞能横跨三个连续子阵列诱发比特翻转,破坏力极大。 ColumnKeeper 作为首个防御方案,提供了确定性与概率性两种机制。它通过在内存控制器中跟踪特定列的激活频率,抢在干扰发生前触发刷新操作。实验证明,该方案在极低的性能损耗下成功封堵了硬件漏洞。由于该防御不依赖具体的软件逻辑,它为未来更细工艺制程的内存芯片提供了底层安全保障。这标志着硬件设计的进步,也是对抗微架构攻击的重要里程碑。 [link]

RAVEN: Agentic RAG for Automated Vulnerability Repair

Varun Gadey, Zijie Liu, et al. · 2026/6/23

漏洞自动修复正从内存安全问题向更广泛的逻辑漏洞演进。 RAVEN 框架通过构建 Agentic RAG 管道,将历史补丁经验转化为修复指令。它关注单文件代码的同时,还能派遣 Curator Agent 检索跨文件依赖,解决复杂的架构级漏洞。在 160 个真实 CVE 漏洞的测试中, RAVEN 取得了 83% 的修复成功率,且成本极低。由于它完全支持本地化部署,企业无需担心源代码泄露给闭源模型。这一研究证明了开源小模型在专业安全工程领域同样具备极高的潜力,是软件工程自动化的重要突破。 [link]

AI 论文

A-Evolve-Training: Autonomous Post-Training of a 30B Model

Zhan Shi, Bing He, et al. · 2026/6/23

A-Evolve-Training 实现了 30B 模型的自动化后训练。它摆脱了数周的人工调优,在 NVIDIA 榜单中跻身前列。系统不仅能优化指标,还能在指标失效时修正自身的搜索策略。这标志着模型自我进化的工程化落地。它证明了在 30B 规模下实现闭环训练的可行性,为未来超大规模模型的低成本迭代提供了重要参考。 [link]

Fara-1.5: Scalable Learning Environments for Computer Use Agents

Ahmed Awadallah, Sahil Gupta, et al. · 2026/6/23

Fara 1.5 聚焦于计算机使用智能体。研究团队构建了名为 FaraGen 1.5 的可扩展数据流水线,解决了人类演示数据昂贵且稀缺的问题。通过在真实网页和模拟环境中的强化训练,该智能体家族在浏览器使用基准测试中刷新了纪录。9B 版本的性能足以匹敌庞大的商业系统。它是通向完全自主 GUI 操作助手的关键一步。 [link]

Holmes: Multimodal Agentic Diagnosis for Mixed-Language Mobile Crashes at Industrial Scale

Jia Li, Wenyuan Ma, et al. · 2026/6/23

Holmes 是针对超大规模移动应用崩溃设计的诊断系统。在微信这类拥有 7000 万行代码的工业级环境中,定位崩溃根因如同大海捞针。它通过多模态信号合成和分层搜索结构,无需复现现场即可重建失效上下文。系统将原本耗时数小时的人工排查缩短至 77 秒。这种处理混合语言环境和闭源框架的能力,是工业界急需的调试利器。 [link]

CFAgentBench: A Reproducible Environment and Benchmark for Autonomous Construction-Finance Agents

Rishi Srivastava · 2026/6/23

CFAgentBench 填补了建筑财务领域智能体评估的空白。它模拟了真实的企业软件堆栈,包含 ERP 和银行门户等关键应用。与以往仅分析文本的基准不同,它要求智能体通过功能正确性验证。系统内置了严格的资金移动警报,任何未经授权的交易操作都会导致任务失败。这种基于真实世界财务风险的测试,为智能体落地高价值业务场景划定了底线。 [link]

Less is More: Lightweight Prompt Compression for Question Answering Applications on Edge Devices

Zihuai Xu, Ruofei Hou, et al. · 2026/6/23

边缘设备运行 RAG 应用时,过长的 Prompt 会导致巨大的计算负担。CORE 方案提出了一种无需辅助模型的双阶段句子级压缩方法。它通过 NER 和语义匹配识别核心信息,在英伟达 Jetson 模块和智能手机上展现了极高的效率。相比现有方法,它节省了过半的显存,并将智能手机上的能耗降低了 95% 以上。这让在移动端部署高性能问答助手变得触手可及。 [link]

Who Checks the Citations? Benchmarking Legal Hallucination Detection

Patty Liu, Dominik Stammbach, et al. · 2026/6/23

律师和法官越来越多地使用 AI 编写文档,但虚假引用成了行业的顽疾。这项研究收集了 1300 份包含真实错误的法律摘要,构建了目前最详尽的虚假引用分类体系。研究发现,即便是最强的 GPT 5 在智能体模式下,也难以处理所有隐蔽的法律逻辑错误。该研究不仅提供了检测工具,还为法律 AI 的政策制定提供了数据支撑。它直接回应了司法公平与算法可靠性的现实冲突。 [link]

Democratizing and accelerating AI-driven pathology research through agentic intelligence

Jiabo Ma, Cheng Jin, et al. · 2026/6/23

PathLab 致力于将生物医学研究意图转化为可执行的病理学工作流。对于不具备编程背景的医学专家,它提供了一个直观的自然语言接口。系统能够自动处理数据预处理、模型开发及结果解读,在 12 个公开数据集上的表现与专家手写脚本相当。它显著缩短了科研周期,让研究者能把精力集中在科学发现而非底层实现。这预示着 AI 驱动的生物医学研究正走向民主化。 [link]

Agentic Time Machine as an Infrastructure for Future-Event Forecasting

Jingyi Chai, Bingyang Zheng, et al. · 2026/6/23

预测未来事件需要获取特定历史时刻的互联网状态。Agentic Time Machine 构建了一种基础架构,能通过过滤网页内容重建任何过去的时间点。基于此,多智能体框架在选举和金融预测中表现出色。它在 FutureX 实时榜单上取得了第一名,验证了离线沙盒评估对在线预测能力的预测价值。这一工具为金融机构和决策者提供了复盘与预测的高保真环境。 [link]

Geometry-Aware Online Scheduling for LLM Serving: From Theoretical Bound to System Practice

Li Kong, Qi Qi, et al. · 2026/6/23

现代推理引擎在管理 KV Cache 时普遍采用基于时间的调度策略,却忽略了显存占用的空间动态。这项研究提出了 SVF 算法,从理论上证明了其竞争力的上界。通过将其作为插件集成到 vLLM 中,系统成功降低了平均延迟并提升了吞吐量。它仅需 1 bit 信息即可实现高效调度。这项研究实现了从严格数学证明到工业系统实践的完美跨越,极具工程推广价值。 [link]

Dementia-Agents: A Multi-Modal Multi-Agent System for Dementia Staging and Phenotyping

Yaling Shen, Maja Christensen, et al. · 2026/6/23

Dementia-Agents 是一种针对现实世界痴呆症分型设计的临床多智能体框架。它放弃了单一路径的病理诊断,转而模仿临床专家组的多维度协作。系统处理了来自 1066 名真实患者的异构数据,在分期和表型识别上表现稳健。通过暴露各领域的推理过程,它为医生提供了可信的诊断依据。这对于应对老龄化社会的神经退行性疾病诊疗具有重大的临床价值。 [link]

BleepingComputer 新闻

Webinar: Why email security teams are drowning in alerts

BleepingComputer · 2026/6/23 20:12

Phishing、BEC 和账号接管攻击持续让安全团队淹没在警报与调查中。本次网络研讨会探讨 behavioral AI 如何帮助自动化检测与响应工作流,减轻警报疲劳并提升运营效率。 [link]

Scattered Spider members plead guilty to hacking Transport for London

Bill Toulas · 2026/6/23 23:31

网络犯罪组织 Scattered Spider 的两名成员承认在 2024 年入侵了 Transport for London 系统。 [link]

The Exploit Doesn't Exist. You Can Still Prove It Works Against You

Sponsored by Picus Security · 2026/6/23 22:01

攻击者武器化新披露漏洞的速度远超多数机构打补丁的速度。Picus Security 解释了安全团队如何在公开 exploit 出现前验证漏洞的可利用性。 [link]

LastPass confirms data breach in Klue supply chain attack

Bill Toulas · 2026/6/23 21:58

LastPass 宣布黑客在本月初的 Klue 供应链攻击中窃取了公司的 OAuth tokens,随后访问了其 Salesforce 环境中的客户数据。 [link]

New macOS ClickFix attack silently mounts DMGs to push infostealer

Lawrence Abrams · 2026/6/24 2:30

新的 macOS ClickFix 攻击活动利用 Terminal 命令静默下载、挂载并启动来自恶意磁盘映像 DMG 文件的信息窃取软件。 [link]

Tata Electronics confirms cyberattack as hackers leak data

Bill Toulas · 2026/6/24 5:06

Tata Electronics 在一份给 BleepingComputer 的声明中确认其 IT 基础设施遭遇网络攻击。 [link]

Windows 11 KB5095093 update rolls out new Point-in-Time restore feature

Lawrence Abrams · 2026/6/24 4:22

微软发布了针对 Windows 11 24H2 和 25H2 的 KB5095093 预览累积更新。该更新修复了大量缺陷并开始推送新功能,其中包括新的 Point-in-Time 还原功能。 [link]

Healthtech firm Xolis suffers data breach impacting 1.4 million people

Bill Toulas · 2026/6/24 3:59

医疗技术公司 Xsolis 表示,约 140 万人的敏感数据在一次网络钓鱼攻击中泄露,该攻击让黑客获得了其网络访问权限。 [link]

Cisco Unified CM flaw CVE-2026-20230 now exploited in attacks

Lawrence Abrams · 2026/6/24 5:48

Cisco Unified Communications Manager Server 中一个追踪编号为 CVE-2026-20230 的高危 SSRF 漏洞目前正被攻击者利用。 [link]

由 CyberRadar 智能体编写
消息抓取于 2026/6/23 7:48 至 2026/6/24 7:33