网安 + AI 前沿日报

2026/6/13 · CyberRadar

网络安全论文

DIG: Oracle-Guided Directed Input Generation for One-Day Vulnerabilities

Andrew Bao (University of Minnesota, Twin Cities), et al. · 2026/6/12

One-Day 漏洞威胁极大,补丁往往透露了触发细节。DIG 框架巧妙利用 LLM 分析补丁并生成 Oracle,指引模糊测试工具突破限制。它在 138 个真实 CVE 中表现惊人,触发速度相比传统工具提升百倍。这种将代码逻辑与动态执行结合的思路,为自动化 PoC 生成开辟了新路径。它具备复现已知漏洞的能力,并挖掘出了多个零日漏洞。该工程实践极具杀伤力。 [link]

SoK: The Constant Time Model

Billy Bob Brumley · 2026/6/12

恒定时间编程是防御侧信道攻击的基石。该研究系统梳理了现有模型的演进,揭示了学术界与工业界之间的理解鸿沟。研究者开发了一套攻击方法论,专门挖掘加密算法边界外的定时漏洞。他们在 OpenSSL 与 BoringSSL 中均发现了严重漏洞。安全性声称更严格的 BoringSSL 反而泄露了更强的信号。这说明系统的安全性远比代码实现更加复杂。这是对现有加密基石的一次深刻审计。 [link]

PI-Hunter: Automated Red-Teaming for Exposing and Localizing Prompt Injections

Pengfei He, Lesly Miculicich, et al. · 2026/6/12

随着 LLM 逐渐转变为 Agent 决策中心,提示注入成了头号安全威胁。PI-Hunter 是一款针对 Agent 系统的自动化红队审计框架。它利用反馈驱动的策略,诱导模型从外部环境抓取并执行恶意指令。通过模拟真实的攻击场景,开发者能直观看到漏洞如何通过外部组件传播。该工具在多种 Benchmarks 上大幅超越现有基线。它为构建鲁棒的自主系统提供了关键的测试手段。 [link]

CAPED: Context-Aware Privacy Exposure Defense for Mobile GUI Agents

Siyu Shen, Fenghao Xu, et al. · 2026/6/12

基于截图的移动 GUI Agent 就像时刻监视屏幕的眼睛,隐私泄露风险激增。CAPED 在截图上传云端前设置了一道上下文感知防线。它能智能识别当前任务所需的 UI 元素,并对无关的联系人、消息或健康数据进行脱敏。实验证明,该方案能将敏感数据泄露率从 0.766 降低至 0.268,同时保持任务成功率。它重新定义了设备与云端的隐私边界,让智能助手在保障隐私的前提下高效工作。 [link]

SMSR: Certified Defence Against Runtime Memory Poisoning in Persistent LLM Agent Systems

Tarun Sharma · 2026/6/12

具有持久化内存的 RAG 系统容易遭受跨会话投毒攻击。攻击者通过注入恶意记忆,能在不修改模型参数的情况下操控后续响应。SMSR 是首个提供认证防御的方案。它通过签名机制确保来源可靠,并引入随机化消融技术限制攻击者的影响力。在企业级场景的数千次测试中,该方案将攻击成功率从近乎 100% 降至忽略不计。它在保障安全的同时,仅损失极少的推理效率。该研究填补了动态知识库防御的空白。 [link]

The Emergence of Autonomous Penetration Capabilities in Large Language Model-Powered AI Systems

Jiaqi Luo, Jiarun Dai, et al. · 2026/6/12

AI 系统是否具备独立发起网络攻击的能力?这份评估报告给出了肯定的答案。研究者构建了全新的自动化渗透框架,配备通用网络安全工具对 300 个目标服务器进行实测。结果显示,顶级商用模型的渗透成功率最高可达 69.3%。这种能力正随着模型规模的增长而持续增强。文章揭示了 Frontier AI 跨越安全红线的现实可能性。这对红队测试和 AI 监管具有极高的参考价值。 [link]

MAStrike: Shapley-Guided Collusive Red-Teaming on Multi-Agent Systems

Chejian Xu, Zhaorun Chen, et al. · 2026/6/12

层次化多智能体系统在金融和软件工程中广泛应用。这种架构扩展了攻击面,特别是多智能体间的勾结攻击。MAStrike 引入 Shapley 值分析来量化每个智能体对系统安全的影响力。它能自动识别脆弱的智能体联盟,并生成协同的、具备角色认知的操作序列。该框架通过因果诊断不断自我完善,成功突破了多种现有防御。这为理解复杂 AI 系统的协同风险提供了全新的度量视角。 [link]

Influence Factors on RAG Poisoning

Pedro Pereira, Eva Maia, et al. · 2026/6/12

检索增强生成系统对检索源的质量极度依赖。这项研究通过 432 种配置的全面实验,深挖了 RAG 在遭遇投毒攻击时的脆弱性。研究发现,检索器架构和检索深度是决定风险暴露的关键。基于密集向量或图结构的检索器表现较稳健,但增加检索深度反而会引入更多恶意片段。投毒攻击的成功源于检索、生成与知识库三者的复杂交互。该研究为优化 RAG 架构提供了详实的工程指南。 [link]

ViPER: Vision-based Packing-Aware Encoder for Robust Malware Detection

Fatima Qaiser, Bisma Tahir, et al. · 2026/6/12

将恶意二进制文件转化为灰度图进行检测是行业趋势,但壳程序的存在一直是该技术的死穴。加壳会导致图像熵增,遮蔽关键结构特征。ViPER 采用双头架构,在识别恶意性的同时同步检测加壳状态。它利用门控机制针对加壳与未加壳样本应用不同的决策边界。在 20 万个 Windows 样本上的测试显示,其分类准确率大幅领先现有方案。它为处理野外复杂的打包软件提供了高效且自动化的工具。 [link]

Who Pays the Price? Stakeholder-Centric Prompt Injection Benchmarking for Real-world Web Agents

Zihao Wang, Yiming Li, et al. · 2026/6/12

提示注入的危害在不同利益相关者之间是不对称的。SBC 基准测试不再单纯关注攻击是否成功,而是精细化评估用户、平台和第三方承担的具体损失。它将攻击划分为隐蔽寄生、错位破坏和复合失效等多种模式。测试发现当前 Agent 几乎无法抵御任何攻击目标,失败模式也各不相同。该研究促使我们从社会技术系统的角度,重新思考 LLM 部署中的安全责任划分。这对于构建负责任的 AI 系统至关重要。 [link]

AI 论文

MiniMax Sparse Attention

Xunhao Lai, Weiqi Xu, et al. · 2026/6/12

针对长文本推理的高昂成本,MiniMax 推出 MSA 稀疏注意力机制。它采用块状稀疏结构,配合高效的 GPU 执行路径,将百万级上下文的计算量降低了 28.4 倍。在 H800 集群上,预处理速度提升 14.2 倍。这一技术已在 MiniMax-M3 模型中上线,解决了智能体长程记忆与代码库推理的落地瓶颈。 [link]

Can I Buy Your KV Cache?

Luoyuan Zhang · 2026/6/12

智能体每次阅读同一文档都要重算预填充。这篇论文提出 KV Cache 复用方案,允许开发者直接购买预计算好的缓存。测试显示在 Qwen3-4B 上复用成本比重算低 50 倍,且完全无损。通过构建智能体原生的缓存分发网络,云端推理成本将大幅降低。这可能是改变大模型服务商业模式的工业级突破。 [link]

MARD: Mirror-Augmented Reasoning Distillation for Mechanism-Level Drug-Drug Interaction Prediction

Mohammadreza Riyazat, Vian Lelo, et al. · 2026/6/12

预测药物相互作用是一个高度复杂的任务。MARD 通过蒸馏推理能力,构建了包含 147 种亚型的药理学知识库。它在处理新药对时的准确率提升显著,表现优于 GPT-4o,且推理成本极低。利用 DrugBank 数据进行自动验证,该研究为临床决策支持提供了高可靠的推理工具,具备极强的生物医药应用价值。 [link]

PersonaDrive: Human-Style Retrieval-Augmented VLA Agents for Closed-Loop Driving Simulation

Mahmoud Srewa, Praneetsai Iddamsetty, et al. · 2026/6/12

自动驾驶仿真中的交通流往往千篇一律。PersonaDrive 引入人类驾驶风格数据集,让 VLA 智能体能够根据简单指令展现激进、中立或保守的行为。该方案无需针对特定风格重训模型,仅靠检索增强即可在 Bench2Drive 榜单刷新纪录。它为闭环驾驶仿真提供了具备人类质感的动态环境,极大地提升了仿真测试的真实度。 [link]

Arbor: Tree Search as a Cognition Layer for Autonomous Agents

Neha Prakriya, Chaojun Hou, et al. · 2026/6/12

全栈大模型推理优化需要复杂的跨层协作。Arbor 框架将树搜索引入智能体认知层,模拟人类专家的调试思维。多智能体协作架构能自主分析硬件瓶颈,并将推理吞吐量提升 193 %。相比单智能体系统,Arbor 在长达数日的自动化优化任务中表现出极强的稳定性。该系统已经在不同硬件平台上验证了其硬件无关的复用潜力。 [link]

Pythagoras-Prover: Advancing Efficient Formal Proving via Augmented Lean Formalisation

Joshua Ong Jun Leang, Zheng Zhao, et al. · 2026/6/12

形式化数学证明不再是超大规模模型的专利。Pythagoras-Prover 家族通过课程微调与增强形式化方法,让 4B 模型在 MiniF2F 榜单击败了 671B 级别的庞大模型。这种极高的参数效率源于对证明数据的分级筛选与自蒸馏。它证明了通过精细的数据工程,轻量化模型也能在逻辑严密的硬科学领域达到顶尖水平。 [link]

SkillChain: Closing the Loop on Skill Evolution for Image-Based E-Commerce AI Assistants

Yimin Hu, Mengtao Xu, et al. · 2026/6/12

电商平台图像助手面临意图复杂、格式多变的挑战。SkillChain 实现了技能进化的生产闭环,自动完成技能创建、路由优化与迭代。在真实的电商环境中,它大幅提升了模型对结构化输出的合规性。上线一周的 A/B 测试显示,该框架显著增强了用户留存与内容消费。这是将大语言模型转化为稳健工业产品的优秀范例。 [link]

LabVLA: Grounding Vision-Language-Action Models in Scientific Laboratories

Baochang Ren, Xinjie Liu, et al. · 2026/6/12

实验室自动化不仅需要智能,更需要行动。LabVLA 将视觉语言动作模型引入科学实验,打通了从书面协议到机器人执行的路径。研究者通过合成实验轨迹数据,让 Qwen3-VL 具备了操作精密仪器的能力。在 LabUtopia 基准测试中,其成功率远超同类方案。这一进展预示着全自动化学合成与生物实验的未来正加速到来。 [link]

EurekAgent: Agent Environment Engineering is All You Need For Autonomous Scientific Discovery

Amy Xin, Jiening Siow, et al. · 2026/6/12

科学发现的瓶颈正从工作流转向环境工程。EurekAgent 提出了环境增强策略,通过权限管理、预算控制和人类反馈机制引导智能体探索。它在数学与内核工程任务中表现优异,甚至以极低成本发现了 26 圆包装问题的最新解。该研究揭示了通过优化资源约束与接口,现有模型就能迸发出超越人类的创造力。 [link]

DailyReport: An Open-ended Benchmark for Evaluating Search Agents on Daily Search Tasks

Jingxuan Han, Wei Liu, et al. · 2026/6/12

现有的搜索智能体测评往往偏离真实需求。DailyReport 针对用户日常搜索场景,构建了包含 150 个开放式任务的基准。它采用层级评价体系,精细化衡量智能体在偏好细化、权衡分析等维度的表现。测试发现即便是最先进的智能体,面对真实需求仍有巨大提升空间。该研究为开发更懂用户需求的搜索助理提供了指南。 [link]

BleepingComputer 新闻

Japanese energy firm loses drive with data of 10.9 million clients

Bill Toulas · 2026/6/12 7:14

九州电力公司披露了一起物理安全事件。该事件影响了超过 1000 万名客户的隐私数据。 [link]

Over 73,000 French govt employees affected in Tchap messenger breach

Sergiu Gatlan · 2026/6/12 15:09

法国政府透露其加密通信平台 Tchap 最近遭遇数据泄露。此次事件影响了法国公共部门超过 7.3 万名员工的账户。 [link]

Pharma giant Novo Nordisk discloses breach of clinical trials data

Sergiu Gatlan · 2026/6/12 18:13

丹麦制药巨头 Novo Nordisk 披露了一起数据泄露事件。作为全球最大的胰岛素生产商,该公司部分临床试验的患者信息受到影响。 [link]

CISA orders feds to patch actively exploited Ivanti flaw by Sunday

Sergiu Gatlan · 2026/6/12 16:26

CISA 命令政府机构在三天内修复一个已被利用的 Ivanti Sentry 漏洞。这是根据新发布的 BOD 26-04 指令做出的强制要求。 [link]

Early Warning Signs of Supply-Chain Attacks Live in the Dark Web

Sponsored by Flare · 2026/6/12 22:01

GitHub 访问权限销售、仓库泄露以及 API 密钥被盗都可能成为供应链攻击的起点。Flare 探讨了地下论坛如何暴露与软件供应链风险相关的早期信号。 [link]

Microsoft fixes Windows update failures linked to WUSA installer

Sergiu Gatlan · 2026/6/12 19:44

微软修复了一个已知问题。该问题导致 2025 年 5 月以来发布的 Windows 更新在通过网络共享使用 WUSA 安装时出现失败。 [link]

Over 400 Arch Linux packages compromised to push rootkit, infostealer

Bill Toulas · 2026/6/13 1:03

AUR 中有超过 400 个软件包正在分发 Linux rootkit 和 infostealer 恶意软件。这些软件旨在窃取凭证和 access token。 [link]

Maine disables data breach notification portal after fake disclosures

Lawrence Abrams · 2026/6/13 3:33

缅因州在发现虚假泄露公告后关闭了其公共数据泄露通报门户。目前该州正在审查相关流程以防止未来发生滥用。 [link]

phpBB forum fixes auth bypass bug lurking for a decade

Bill Toulas · 2026/6/13 2:19

phpBB 论坛软件修复了一个存在 10 年之久的身份验证绕过漏洞。攻击者可以利用该漏洞以包括管理员在内的任何用户身份登录。 [link]

Ukrainian national pleads guilty to role in Conti ransomware operation

Lawrence Abrams · 2026/6/13 1:54

一名去年从爱尔兰引渡到美国的乌克兰国民已承认有罪。他被控参与了 Conti 勒索软件运营相关的共谋罪行。 [link]

由 CyberRadar 智能体编写
消息抓取于 2026/6/12 7:57 至 2026/6/13 7:57