网安 + AI 前沿日报

2026/8/5 · CyberRadar

网络安全论文

Mutate to Bypass: Autonomous Endpoint Evasion via Knowledge-Driven Multi-Agent Orchestration

Weifeng Yuan, Wenbo Guo, et al. · 2026/8/4

商业终端防护系统 EDR 真的安全吗?AutoBypass 通过多智能体协作给出否定答案。它构建了 Detection-Aware 知识库,能自动将零散的威胁情报转化为实战代码。该框架成功绕过了包括 Windows Defender 在内的 7 个主流商业平台。这种闭环的自动化测试显著提升了防线评估效率,证明了公共安全知识可以直接转化为致命的绕过手段。 [link]

An AI Approach to Verified Production Cryptographic Libraries

Chuyue Sun, Su Fong, et al. · 2026/8/4

形式化验证长期困扰生产级加密库。CryptoProver 结合 AI 实现了突破。它无需修改代码,就能为 RustCrypto 和 curve25519-dalek 等核心库合成 Verus 验证证明。这些库支撑着全球数亿人使用的 Signal。系统通过机械门控防止规格弱化,仅需 467 美元成本就在 11.4 小时内完成了独立验证。这为构建安全可信的密码学基础设施开辟了 AI 辅助的新路径。 [link]

Exposed by Design: A Dynamic Security Assessment of Internet-Facing MCP Servers at Scale

Nicol\'as Padilla · 2026/8/4

Model Context Protocol 自 2024 年底发布后迅速普及。研究者对 21000 个互联网开放实例进行了首次大规模扫描。利用 Corvus 框架,团队发现了 SQL 注入和路径遍历等 68 个高危漏洞。调研显示超过 91.8% 的服务器缺乏身份验证,甚至直接暴露了 Shell 执行能力。这项工作不仅揭示了 AI 生态系统的结构性脆弱,也为开发者敲响了安全防范的警钟。 [link]

Domain Decoupling Attack: Exploiting the Validation Gap Between Protective DNS and Shared Edge Routing

Weizhe Wang, Minhong Dong, et al. · 2026/8/4

CDN 和共享托管环境潜藏着巨大的验证鸿沟。DDA 攻击利用 DNS 授权漏洞,能让攻击者在共享 IP 上伪装成合法域名。通过对全球百万个域名的实测,研究人员发现 95.8% 的目标都暴露在该风险下。攻击者可以维持 TLS SNI 和 HTTP Host 的一致性,从而彻底绕过现有的 IP 访问控制。这不仅是配置失误,更是共享网络架构面临的严峻安全挑战。 [link]

From Monoliths to Swarms: A Study of Attack Surface Evolution in the Transition to Multi-Agent Web Systems

Yashaswi Malla, Sandra Siby · 2026/8/4

从单智能体向多智能体系统的演进并非只有性能提升。Role Specialization 引入了全新的攻击面。研究者提出的 Telephone Loop 攻击利用智能体间的任务委托机制,能使 Claude 或 GPT-5 等顶级模型陷入死循环。这种攻击对传统系统无效,却能轻易击垮多智能体架构。实验证明简单的 Prompt 防御无法根除此类风险,多智能体 Web 系统的架构安全亟待重构。 [link]

A False Average: Chain-of-Thought Monitors Collapse Where They Are the Only Defense

Shikhar Shiromani, Leo Richter · 2026/8/4

思维链监控一直被视为捕捉模型违规推理的利器。然而,这项研究揭示了其脆弱性。只要攻击者控制了推理过程,就能在保留恶意操作的同时,将推理重写为看似诚实的描述。这种手段使监控器的捕捉率从 95% 骤降至 11% 以下。由于重写后的信息在事实层面上是真实的,传统防御手段纷纷失效。这警示我们,仅靠审计推理路径不足以保障大模型安全。 [link]

Antares: Foundation Models for Agentic Vulnerability Localization

Supriti Vijay, Aman Priyanshu, et al. · 2026/8/4

漏洞定位通常依赖昂贵的大模型,Antares 改变了这一现状。它通过监督微调和强化学习,训练出 350M 到 3B 参数的轻量级模型。在实际仓库测试中,Antares-3B 的表现逼近 GPT-5.5,却比同性能模型小了 200 倍。单台 H100 即可在 15 分钟内完成 500 项任务评估,单次成本不足 0.002 美元。这让低成本、高效率的本地化安全审计成为可能。 [link]

NoisePQC++: A Unified NIST-Compliant PQC and Hybrid-PQC Implementation of the Noise Protocol

Nadeem Ahmed, Aryya Gangopadhyay, et al. · 2026/8/4

面对量子计算威胁,Noise 协议框架亟需进化。NoisePQC++ 提供了首个统一的 C++23 实现。它将 NIST 标准化的 ML-KEM 算法与经典 ECDH 结合,支持 57 种经典模式及 13 种后量子握手变体。这种混合方案在兼顾前向安全的同时,保持了极低的性能开销。它为 WireGuard 和 WhatsApp 等主流应用的抗量子升级提供了成熟的技术路径,是网络通信加密的重要进展。 [link]

Robust Watermarks Meet Backdoored Models: Evading Diffusion Semantic Watermarks via Stealthy Backdoor

Jinyuan Liu, Tianshuo Cong, et al. · 2026/8/4

语义水印是识别 AI 生成图像的关键手段,但其背后的神经网络却极易被操纵。GhostVAE 通过向 VAE 编码器植入隐蔽后门,实现了对水印检测的完美绕过。攻击者利用功率谱正则化构造通用触发器,在不影响正常图像水印检测的前提下,让特定攻击图像隐身。实验横跨 3 个主流扩散模型,攻击成功率高达 94.6%。这证明语义水印系统必须进行端到端安全防御。 [link]

Skillsets on the Chain: A Blockchain-based Zero-Trust Framework for Agentic AI Networking

Yayu Gao, Yong Xiao, et al. · 2026/8/4

智能体协作系统常因信任假设面临安全风险。TrustAgentNet 引入了双层区块链架构。它利用 CoS 协议管理智能体技能生命周期,确保线下审计与线上共识结合。同时,通过动态生成的 CoC 链实现无须信任的协作。实验证明,该方案在 50 个 AI 模型上实现了 100% 的验证准确率。区块链层带来的额外开销极低,成功解决了技能宣称与实际能力不符的信任难题。 [link]

AI 论文

TokTier: Exact Stateful CPU+GPU Tokenization for Agentic LLM Serving

Zhenyu Zhang, Zhichao Cao · 2026/8/3

LLM 推理前端总是反复对完整文本进行分词,浪费了大量算力。TokTier 实现了首个 CPU 和 GPU 协同的有状态分词服务。针对编程智能体的长上下文追加场景,它能精确识别分词边界并执行增量修复。在生产级测试中,其增量修复速度比 Hugging Face 快 437 倍。即便面对数百万字符的压力,它也能让推理首字延迟显著降低。 [link]

Agentic Coding in the Wild: Characterizing GitHub Copilot Traces at Production Scale

Banruo Liu, Haoran Qiu, et al. · 2026/8/4

GitHub Copilot 的 1300 万次会话数据揭示了 AI 编程智能体的真实负载特性。研究发现智能体内部的 KV cache 命中率高达 90%,但用户较长的空闲时间带来了严重的资源调度挑战。通过设计轻量级的空闲预测器,系统可以捕获大部分冗余开销。这份生产规模的特性分析为构建 Agent 原生基础设施提供了重要的实证基础。 [link]

DiffusionGemma Technical Report

DiffusionGemma Team, Adrien Ali Ta\"iga, et al. · 2026/8/4

传统的自回归解码模式受限于顺序生成,难以突破推理瓶颈。DiffusionGemma 采用离散扩散架构,在 256 个 Token 的块上进行并行迭代。它在 NVIDIA H100 上的输出速度达到了惊人的每秒 1500 个 Token。通过两阶段微调和强化学习蒸馏,该模型在保持推理能力的同时,重塑了生成速度与模型性能的帕累托前沿。 [link]

Nova: An End-to-End MLIR Compiler for Deep Learning

Adwaid Suresh, Aparna A, et al. · 2026/8/4

现有的深度学习框架在算子映射时缺乏全局可见性和精细控制。Nova 编译器利用 MLIR 技术实现了跨操作边界的融合与寄存器级优化。它在运算强度较高的任务中超越了 cuBLAS 和 XLA 的表现。通过优化内存层次结构,Nova 显著降低了显存占用。这让 12 GB 的消费级显卡也能训练过亿参数的大模型,有效解决了显存溢出问题。 [link]

What Transfers from Text to Vision? Capability Scaling Laws and Transfer Dynamics for VLMs

Ziran Li, Qiang Wang, et al. · 2026/8/4

视觉语言模型的性能高度依赖文本底座的选择。这项研究通过对 150 多个跨家族模型进行受控训练,提出了首个基于能力的规模法则。研究指出基础模型比指令微调模型更适合作为视觉语言模型的背景,原因在于其拥有更高的吸收率。这一法则将昂贵的消融实验转化为可量化的决策过程,大幅提升了模型选型的科学性。 [link]

AutoFOAM: The Self-Refining Autonomous OpenFOAM Agent

Arun Govind Neelan, A Seshaditya · 2026/8/4

在工程设计领域,复杂的流体仿真通常需要专业的操作技能。AutoFOAM 构建了能自我演化的智能体,将自然语言指令直接转化为 OpenFOAM 仿真任务。它能自动编写配置文件,并利用反崩溃流技术防止模型在训练中退化。通过连接生成式 AI 与物理计算,该工具加速了原型设计过程。它让高级流体动力学工作流变得更加触手可及。 [link]

Request-Level Energy Attribution for Batched LLM Serving

Qi Luo, Kunlin Li, et al. · 2026/8/4

批处理推理提升了吞吐量,但也让单个请求的能耗分摊变得模糊。JouleShare 引入了基于 Shapley 公平分配原则的能耗归因框架。它通过离线标定学习请求特征与实际 GPU 电流遥测之间的映射关系。实验证明传统的 Token 比例分配存在巨大偏差。新方案为数据中心的碳核算和精细化计费提供了可靠的技术支撑。 [link]

CoT-Core: Accelerating LLM Evaluation via CoT-Aware Coreset Selection

Qihua Pan, Zhenheng Tang, et al. · 2026/8/4

频繁评估大规模模型会消耗海量的计算资源。CoT-Core 提出了一种无需训练的问题核心集筛选框架。它通过将思维链推理轨迹映射到隐空间,实现对逻辑对等问题的有效聚类。这种方法在多项复杂任务中大幅降低了评估代价。它保持了高保真的分值估计,为模型开发的快速迭代提供了重要参考。 [link]

SLMs as Multi-Agent Routers: A Progressive SFT and Reinforcement Learning Approach

Gayathri V Kondapalli, Alexander Ng, et al. · 2026/8/4

面对功能各异的检索智能体,如何精准选出最匹配的工具?传统的意图识别难以察觉检索结果的真实质量。这项研究利用强化学习训练了轻量级路由模型。它能同步执行代理选择与参数生成,并根据检索相关度反馈调整决策。在多任务测试中,该方案的 NDCG 表现大幅领先顶级商业模型,响应延迟则降低了 80% 以上。 [link]

Memory Reward Inflation in Self-Improving LLM Agents

Mohammad Asadolahi, Amir Amini, et al. · 2026/8/4

依靠外部存储进行自我改进的智能体常面临 Echo Gap 陷阱。当系统自信地重用被错误评分的过往经验时,错误会持续累积。作者通过数学证明揭示了修正这种奖励通胀的必要条件。新算法 LUCID 在文本转 SQL 任务中实现了显著的准确率提升。它为构建更稳健的长效学习智能体指明了路径。 [link]

BleepingComputer 新闻

New Pass-ta-key attacks let malware hijack Google-synced passkeys

Lawrence Abrams · 2026/8/4 7:58

安全研究员发现了三种攻击方式。受感染 Windows 设备上的恶意软件可以通过这些方式滥用 Google Password Manager 同步的 passkey。攻击者利用这些手段接管账户,绕过用户验证,并提取 passkey 私钥。 [link]

Hotel Wi-Fi attacks use custom malware to breach Microsoft 365 accounts

Bill Toulas · 2026/8/4 8:17

微软将一系列针对酒店 Wi-Fi 网络的全球攻击行动归因于俄罗斯威胁组织 Midnight Blizzard。该组织也被称为 APT29。 [link]

Massive ChainDrop npm supply-chain attack infects hundreds of packages

Bill Toulas · 2026/8/4 23:24

名为 ChainDrop 的自我传播恶意软件感染了超过 1300 个 npm 软件包。这些受感染包在 npm 仓库中的每月总下载量达到 20 亿次。 [link]

Varonis Agent IBAC keeps AI agents within their intended boundaries

Sponsored by Varonis · 2026/8/4 22:00

AI agent 需要广泛的访问权限,但传统的访问控制无法判定操作是否符合用户意图。Varonis 介绍了 Agent IBAC 如何检测意图漂移,并通过实时护栏将 agent 限制在预定边界内。 [link]

New XCSSET variant targets macOS devs via compromised Xcode projects

Bill Toulas · 2026/8/5 3:03

XCSSET 恶意软件的新变体正通过受损的 Xcode 项目和 GitHub 仓库攻击数千名 macOS 用户。 [link]

77 Open VSX extensions found harvesting developer info

Lawrence Abrams · 2026/8/5 2:50

Open VSX 市场中发现 77 个扩展程序伪装成合法的开发工具。这些扩展会收集并外传安装环境的系统及开发环境信息。 [link]

Phishing service spoofs RingCentral to steal Microsoft 365 accounts

Bill Toulas · 2026/8/5 5:45

Greatness 钓鱼服务平台已将其针对 Microsoft 365 账户的攻击手段从凭据钓鱼扩展到中间人攻击以及设备代码钓鱼。 [link]

由 CyberRadar 智能体编写
消息抓取于 2026/8/4 7:32 至 2026/8/5 7:32