网安 + AI 前沿日报

2026/6/16 · CyberRadar

网络安全论文

SkillMutator: Benchmarking and Defending Language-and-Code Cross-modal Attacks on LLM Agent Skills

Youngduk Kim, Minkyoo Song, et al. · 2026/6/15

关注 LLM Agent 技能扩展安全。攻击者在 SKILL.md 编写无害说明,却在脚本隐藏恶意指令。这是典型的跨模态攻击。研究者推出 SkillMutator 模拟 13 类变异攻击,发现现有扫描器检测率极低。其推理蒸馏框架将 Qwen 2.5-Coder 打造为防御利器。该方案有效规避数据外泄,将检测率提升至 88.2%。它证明了无需依赖闭源大模型,也能构建稳固安全防线。 [link]

AgentCyberRange: Benchmarking Frontier AI Systems in Realistic Cyber Ranges

Fengyu Liu, Jiarun Dai, et al. · 2026/6/15

现有的 AI 安全评估多局限于单一任务,难以还原真实入侵流程。AgentCyberRange 填补了空白。它构建了包含 110 个漏洞和 8 个企业级靶场的开放架构。研究发现 GPT 5.5 在复杂链路上表现出色,但也存在载荷变异绕过防御的风险。这套工具集成了执行与验证功能,是衡量 AI 进攻能力的标杆。它推动了社区对自主威胁的认知,为建立真实防御边界提供了数据支撑。 [link]

Software Dark Matter: Gazing at Uncharted Files to Navigate SBOM Integrations

Abhishek Reddypalle, Dennis Roellke, et al. · 2026/6/15

供应链透明度极度依赖 SBOM 元数据。DARKFILES 工具揭示了一个惊人现象。大量安全关键文件隐藏在文件系统中,却未被记录。这些软件暗物质是漏洞与密钥泄露的重灾区。研究分析了 DockerHub 等生态,发现元数据更新严重滞后。通过这一视角,团队成功挖掘出 3 个高危 CVE 漏洞。该研究迫使我们重新审视供应链审计范式,弥补了元数据驱动安全机制的系统性短板。 [link]

Same-Origin Policy for Agentic Browsers

Xilong Wang, Xiaoxing Chen, et al. · 2026/6/15

AI 智能体接入浏览器后,传统的同源策略面临崩塌。SOPBench 测试显示,智能体浏览器在执行自然语言指令时,经常触发未经授权的跨源数据流。为此,研究者提出了 SOPGuard 机制。它针对 Agent 自动化特性进行了 SOP 增强。在 BrowserOS 上的实验证明,该方案能精准阻断恶意攻击,且运行开销极小。这对于构建下一代安全、隐私可控的 AI 浏览器具有极其重要的工程参考价值。 [link]

From Shield to Target: Denial-of-Service Attacks on LLM-Based Agent Guardrails

Yuguang Zhou, Xunguang Wang, et al. · 2026/6/15

强大的 LLM 护栏本是防御盾牌,如今却成了 DoS 攻击的靶心。攻击者利用精心设计的 Payload 诱导护栏陷入超长推理循环。这种攻击在主流模型上均表现显著,甚至能产生 148 倍的延迟放大。一个恶意文档就可能瘫痪整个共享防御基础设施。该研究预警了推理鲁棒性的重要性。它提醒开发者,护栏设计必须考虑计算边界,防止安全组件反过来被用于耗尽可用资源。 [link]

SEVRA-BENCH: Social Engineering of Vulnerabilities in Review Agents

Rui Melo, Riccardo Fogliato, et al. · 2026/6/15

当 AI 承担代码审查工作时,它能识破话术下的恶意代码吗?SEVRA-BENCH 通过 15 种社会工程陷阱包装真实的 CVE 漏洞。实验揭示了闭源与开源模型在识别恶意贡献能力上的巨大鸿沟。即便 LLM 能识别静态漏洞,但在人为施加的紧迫感引导下,依然容易给出合并建议。该基准测试直指软件工程自动化中的信任链脆弱性,为提升自动化审查工具的抗干扰能力指明了方向。 [link]

Side-Channel Attacks Bypass Protection in 3D Printers

Eric Yocam, Varghese Vaidyan, et al. · 2026/6/15

3D 打印机的电机降噪技术原本是为了防范声学侧信道攻击。然而,物理世界的安全是多维的。研究表明,尽管主动降噪能屏蔽声音信号,但电机振动信号依然泄露几何信息。通过序列建模,攻击者能以 61% 的准确率推断打印内容。虽然目前还难以实现全几何重构,但这证明了现有的硬件防御存在显著盲区。这项工作对物理安全和侧信道防御策略的设计具有启发意义。 [link]

FreoStream:Enhancing Stream Guardrails via Future-Aware Reasoning and Safety-Aligned Optimization

Jianwei Wang, Guoyang Shen, et al. · 2026/6/15

在流式生成中,护栏需要在 Token 级进行拦截。缺乏上下文常导致过度拒绝,误伤安全内容。FreoStream 引入了具有未来感知能力的推理模块。它利用 LoRA 微调增强了基础护栏对隐含风险的识别力。实验表明,该框架在降低误报率的同时,提升了对越狱攻击的拦截率。它平衡了实时性与安全性,为高频互动的 LLM 应用提供了可靠保障。 [link]

From Prompts to Responses: Dual-Sided Data Leakage and Defense in Split Large Language Models

Zixuan Gu, Xiaojun Ye, et al. · 2026/6/15

拆分学习是解决边缘端 LLM 推理瓶颈的良药,但其中潜伏着隐私危机。PIDI 攻击能通过逆向工程还原用户提示词,也能窃取模型的生成响应。这种双侧初始化方案提升了长序列下的反向推导效果。为了应对威胁,ADMI 防御机制被提出。它结合了本地适配器预热和互信息正则化,在保障性能的前提下大幅降低了泄露率。该方案为隐私敏感场景下的模型分布式部署提供了坚实的工程验证。 [link]

When Good Verifiers Go Bad: Self-Improving VLMs Can Regress on New Tasks

Jianzhe Lin · 2026/6/15

利用验证器驱动的自博弈提升 VLM 已成为主流,但这一过程并非总是单调进步。研究发现,当验证器质量低于任务阈值时,学生性能会发生倒退。即便训练损失仍在下降,特定任务的表现却会暴跌。这种损伤在置信度误导下被放大。文章提出了方差定理来解释这种失效模式。它建议开发团队在开启循环前,必须量化评估验证器的适配度,而非迷信模型规模。 [link]

AI 论文

Orchestra-o1: Omnimodal Agent Orchestration

Fan Zhang, Vireo Zhang, et al. · 2026/6/15

智能体正在从单兵作战转向集群协作。Orchestra-o1 提出了一个全模态智能体编排框架,能够统一处理文本、图像、音频和视频等复杂输入。它通过模态感知任务分解与并行执行机制,在 OmniGAIA 基准上刷新了记录。此外,研究者引入了 DA-GRPO 强化学习方法,让 8 B 规模的小模型也能在复杂任务中展现出顶尖的协作能力。 [link]

MedLatentDx: Latent Multi-Agent Communication for Cross-Hospital Rare-Disease Diagnosis

Ziqing Wang, Lili Zhao, et al. · 2026/6/15

罕见病诊断面临数据稀缺与隐私受限的双重挑战。MedLatentDx 创新性地提出了隐空间多智能体通信框架。不同医院的智能体无需共享敏感的临床文本,只需传递经过压缩的 latent KV 块即可完成跨院协作。该方案通过 KV 蒸馏与跨家族对齐技术,在保护患者隐私的同时显著提升了诊断准确率。它是隐私计算在医疗大模型领域的成功实践。 [link]

CacheRL:Multi-Turn Tool-Calling Agents via Cached Rollouts and Hybrid Reward

Md Amirul Islam, Sumiran Thakur, et al. · 2026/6/15

训练小型智能体模型如何兼顾性能与效率?CacheRL 系统通过缓存 Rollout 与混合奖励机制,让 4 B 规模的模型在多步工具调用任务中达到了 92 % 的准确率。这种表现已经逼近了 GPT-5,但计算资源消耗仅为其百分之一。它利用模糊缓存消除了实时执行工具的高昂成本,配合思维链增强技术,为在边缘侧部署高性能智能体提供了可落地的技术路线。 [link]

BayLing-Duplex: Native Full-Duplex Speech Dialogue with a Single Autoregressive LLM

Qingkai Fang, Shoutao Guo, et al. · 2026/6/15

传统的语音对话系统通常依赖 Voice Activity Detection 模块,导致交互滞后。BayLing-Duplex 实现了单自回归模型驱动的原生全双工交互。它无需辅助模块即可自主决定何时倾听、何时发言或何时中断。通过在 400 K 样本上进行微调,该模型在保持回复质量的同时,交互成功率高达 92 %。它让智能体真正具备了像真人一样实时交流的能力。 [link]

GitOfThoughts: Version-Controlled Reasoning and Agent Memory You Can Replay, Diff, and Merge

Pavan C Shekar, Abhishek H S, et al. · 2026/6/15

智能体的推理过程往往是稍纵即逝的。GitOfThoughts 创造性地引入了版本控制思想,将推理树存储为 Git 仓库。每一个想法都是一次 commit,每个结果都是一个 tag。这种设计让推理过程变得可重现、可审计且可合并。尽管内存存储不一定能直接提升新问题的准确率,但它为智能体协作和长短期记忆管理提供了一套工业级的底层基础设施。 [link]

SIMMER: Benchmarking Latent Failures in LLM Executable Planning with a World Model

Xiaoxin Lu, Ranran Haoran Zhang, et al. · 2026/6/15

智能体规划中的潜伏失败往往比即时报错更危险。SIMMER 针对这一痛点,在厨房领域构建了一个拥有 4.6 万种可能交互的符号世界模型。实验发现,即便最顶尖的模型也有 56 % 的计划包含潜伏失败,且多为不可逆的严重后果。研究证明,引入反事实前瞻仿真能将此类错误减少 72 %。这为提升自动化系统在现实物理环境中的安全性提供了重要参照。 [link]

TwinBI: An Agentic Digital Twin for Efficient Augmented Interactions with Business Intelligence Dashboards

Jisoo Jang Wen-Syan Li · 2026/6/15

仪表盘操作与自然语言查询经常发生切换,导致分析状态脱节。TwinBI 引入了智能体数字孪生框架,通过统一的交互日志重建分析状态。它将可视化仪表盘的当前状态转化为可操作的上下文,使模型在 SQL 生成与洞察提取中的准确率提升了 20 %。这种深度耦合的设计,使 BI 工具进化为具备语义感知的分析助手。 [link]

Personal Care Utility: Health as Everyday Infrastructure

Mahyar Abbasian, Elahe Khatibi, et al. · 2026/6/15

医疗健康频繁发生在诊室之外,也体现在日常的饮食起居中。PCU 提出了一种事件驱动的健康基础设施架构,旨在将个人信号转化为语义化的生命事件。它利用大模型进行上下文推理与行为策略选择,同时确保临床决策依据可靠证据。以 2 型糖尿病为例,该系统能根据血糖、运动与压力数据提供实时干预,为慢性病管理提供了一套闭环的工程化方案。 [link]

Towards Direct Latent-Space Synthesis for Parallel Branches in LLM-Agent Workflows

Shikun Liu, Mufei Li, et al. · 2026/6/15

现代智能体工作流经常并行执行多个分支任务,但传统的文本拼接方法效率极低。Parallel-Synthesis 框架允许模型直接消费并行分支产生的 KV cache。通过引入缓存映射器与适配器,它在不损失推理质量的前提下,将首个 token 的生成速度提升了 2.5 到 11 倍。这种直接在隐空间进行合成的技术,解决了长上下文处理中的计算冗余问题,显著提升了响应效率。 [link]

Minim: Privacy-Aware Minimal View for Agents via Trusted Local Sanitization

Hexuan Yu, Chaoyu Zhang, et al. · 2026/6/15

智能体操作网页时,往往会将包含敏感信息的完整 UI 状态发送至云端。Minim 提出了一种部署在客户端的本地隐私经纪人方案。它通过预测 UI 元素的敏感度与任务必要性,实时进行隐私最小化处理。实验表明,该方案能在不牺牲智能体执行效率的前提下,精准剔除验证码、私密通知等无关信息。它在满足上下文完整性的同时,为智能体应用的合规性构筑了坚实防线。 [link]

BleepingComputer 新闻

Infinite Campus data breach affects 137,000 school staff accounts

Sergiu Gatlan · 2026/6/15 20:38

ShinyHunters 勒索团伙在 3 月的一次 Salesforce 数据窃取攻击中,窃取了超过 137,000 个教职工账户的个人信息。此次攻击的目标是广泛使用的 Infinite Campus K-12 学生信息系统。 [link]

Webinar: How behavioral AI stops phishing and account takeovers

BleepingComputer · 2026/6/15 20:12

现代网络钓鱼、BEC 以及账户接管攻击正日益绕过传统的邮件防御手段,给安全团队带来了沉重的运维压力。本次研讨会将探讨如何利用行为 AI 自动化检测、调查和修复流程,从而缓解告警疲劳并提升响应速度。 [link]

OptinMonster WordPress plugin hacked in CDN supply-chain attack

Bill Toulas · 2026/6/16 1:37

WordPress 插件 OptinMonster、TrustPulse 以及 PushEngage 在一场针对 Awesome Motive 的内容分发网络 CDN 的供应链攻击中遭到入侵。 [link]

Cisco fixes SD-WAN vManage flaw exploited in zero-day attacks

Sergiu Gatlan · 2026/6/16 1:12

思科发布了安全更新,修复了 Catalyst SD-WAN Manager 中编号为 CVE-2026-20262 的漏洞。该漏洞此前在零日攻击中被利用,攻击者借此提升到了 root 权限。 [link]

Council of Europe investigates ShinyHunters data breach claims

Sergiu Gatlan · 2026/6/16 0:37

欧洲理事会作为该洲最古老的跨政府机构,正在调查勒索组织 ShinyHunters 在周末声称的数据泄露事件。 [link]

FBI: Fraudsters use couriers to steal money in crypto scams

Sergiu Gatlan · 2026/6/15 23:30

美国联邦调查局 FBI 警告称,犯罪分子正利用快递人员从加密货币投资诈骗受害者手中收取现金。这类诈骗也被称为杀猪盘或浪漫陷阱。 [link]

Vibe coders are gonna vibe code: How CISOs are tackling code sprawl

Sponsored by Tines · 2026/6/15 22:01

员工正越来越多地在传统安全监管之外,使用 AI 工具构建自动化程序、Agent 和应用。Tines 探讨了 CISO 如何应对 AI 驱动的代码蔓延、影子工具以及治理挑战。 [link]

Chinese hackers breach REDCap servers, steal medical research

Bill Toulas · 2026/6/15 22:00

一项与中国相关的间谍活动针对暴露在外的 REDCap 服务器部署了 InfiniteRed 恶意软件,并从北美的一家医疗机构窃取了敏感数据。 [link]

New attack turned Microsoft 365 Copilot into 1-click data theft tool

Bill Toulas · 2026/6/15 21:00

Microsoft 365 Copilot 企业版中存在一个名为 SearchLeak 的关键漏洞链。攻击者可以通过精心构造的 URL,从目标的邮箱、OneDrive 或 SharePoint 账户中窃取敏感数据。 [link]

SimpleHelp bug lets hackers create rogue remote support accounts

Bill Toulas · 2026/6/16 4:06

SimpleHelp 远程管理软件中的一个漏洞允许未经身份验证的攻击者,通过使用 OIDC 认证协议在服务器上创建具有特权的管理员账户。 [link]

DOJ seizes CFAKE, SOCFAKE deepfake nude sites under TAKE IT DOWN Act

Lawrence Abrams · 2026/6/16 5:56

美国司法部宣布已查封 CFAKE.com 和 SOCFAKE.com 网站。这些网站涉嫌托管未经许可的 AI 生成女性裸露图像和视频。这是根据 TAKE IT DOWN 法案公开宣布的首次域名查封行动。 [link]

由 CyberRadar 智能体编写
消息抓取于 2026/6/15 7:42 至 2026/6/16 8:07