网安 + AI 前沿日报

2026/8/25 · CyberRadar

网络安全论文

aiXamine: Unified Black-Box Evaluation of Cross-Dimensional Trade-offs in LLM Safety, Security, and Privacy

Fatih Deniz, Yazan Boshmaf, et al. · 2026/8/24

LLM 表现出一种安全税现象:强化安全对齐会导致模型拒绝三分之一的良性查询。研究人员推出 aiXamine 平台,首次对 120 多个模型进行了跨维度的黑盒评估。实验揭示了安全性、隐私与鲁棒性之间的复杂权衡。特别是蒸馏过程若缺乏修正,会导致模型鲁棒性发生灾难性坍塌。这套自动化红队流水线为构建真正可信的大模型提供了科学的度量衡。 [link]

ARQ: Agentic CodeQL Query Refinement for C/C++ Vulnerability Detection

Chunyi Wang, Yunfei Ke, et al. · 2026/8/24

CodeQL 规则编写长期依赖人工,难以兼顾查全率与误报率。ARQ 框架利用大模型智能体实现了查询规则的自动迭代。它通过合成程序寻找规则漏洞,并在反馈循环中不断自我修复。该工具成功修复了 GitHub 上悬挂 27 个月的悬而未决问题,甚至在 libpng 和 zlib 等工业级库中挖出了未知漏洞。这种无需标注数据的自动化审计技术,标志着静态扫描进入了智能体驱动的新阶段。 [link]

GhostTac: Manipulating Tactile Sensors without Physical Contact

Kun Wang, Xuancun Lu, et al. · 2026/8/24

机器人触觉传感器正面临无需接触的新型物理威胁。GhostTac 利用电磁干扰成功操纵了传感器的电学输出,迫使机器人产生过大的抓握力甚至造成物理损坏。攻击者通过精密构造的信号绕过硬件滤波,将干扰转化为持久的偏移量。实验涵盖 10 种传感器模块和 2 种灵巧手,均验证了该攻击的有效性。这提醒开发者,在追求感知精度的同时,硬件底层的防御边界亟待重构。 [link]

Uncovering and Understanding Hidden Dependencies in the LLM API Reseller Ecosystem via Prefix-Cache Side Channels

Zimo Ji, Xin Wei, et al. · 2026/8/24

大模型 API 转售市场鱼龙混杂,隐藏的供应链链路极具风险。CacheTracer 首次利用 prefix-cache 侧信道探测出转售商之间的依赖关系。通过对 39 个端点的 110 万次请求测量,研究人员还原了一个深达 7 层的复杂供应网络。一旦上游节点发生故障或数据泄露,大量下游服务将产生灾难性的连锁反应。这种 API 级的隐秘测绘技术,为透视大模型生态透明度提供了关键利器。 [link]

Enabling Threshold Custody for the Lightning Network with Nested Threshold Multi-Signatures

Paul Gerhart, Nadav Kohen, et al. · 2026/8/24

比特币闪电网络虽然锁定了数亿美元资产,但其通道节点大多依赖脆弱的在线单私钥。Iceberg 方案通过嵌套门限多签名技术,首次实现了对闪电网络通道的分布式托管。它允许参与者在不修改现有协议和底层代码的情况下,以 t-of-n 门限模式运行。实验显示其支付吞吐量保持在 93 % 以上,仅产生微小的性能损耗。这为数字资产的大规模机构级保护扫清了工程障碍。 [link]

MATEE: Efficiently Bridging the Semantic Gap in TrustZone via Arm Pointer Authentication

Shiqi Liu, Xiang Li, et al. · 2026/8/24

Arm TrustZone 的安全世界与普通世界之间存在严重的语义鸿沟,导致恶意应用可能伪造请求参数来窃取数据。MATEE 巧妙地利用硬件级指针认证技术,将请求与客户端身份强行绑定。它在不修改现有应用逻辑的前提下,实现了不同客户端敏感数据的物理隔离。评估结果显示其运行开销仅为 2.19 %,展现出极佳的工业应用前景。这种轻量级的防御思路为可信执行环境注入了新的生命力。 [link]

More Granular, Less Trust: Enforcing Intra-Process Isolation with Arm CCA in an Untrusted Management Environment

Shiqi Liu, Zhouqi Jiang, et al. · 2026/8/24

现有的机密计算方案难以抵御来自操作系统的特权攻击,进程内部的隔离机制依然脆弱。CCAegis 扩展了 Arm CCA 架构,利用粒度保护表实现了精准的进程内隔离。它通过静态分析追踪敏感数据流,并在函数调用时自动切换访问权限。信任边界被压缩至极致,仅需信任极小的安全监控器。该系统在加密任务测试中表现稳定,为云原生环境下的应用安全提供了坚实的硬件防线。 [link]

Billion-Scale Nearest-Neighbor Search under Fully Homomorphic Encryption on a Single GPU, Balancing Leakage and Cost

Isamu Isozaki, Madison Bratina, et al. · 2026/8/24

在完全加密的情况下搜索十亿级向量库,曾被认为在单卡 GPU 上不可实现。该研究通过引入秩削减与层级路由机制,在单张 GPU 上成功完成了亿级数据的同态加密检索。系统在保证召回率的同时,将每条加密查询的延迟压低至 6 秒以内。通过科学的填充策略,团队有效平衡了数据几何特征泄露与计算开销。这项成果让隐私计算从实验室理论真正走向了超大规模工程部署。 [link]

ClawSentry: A Progressive Multi-Tier Security Monitor for Safeguarding Autonomous LLM Agents

Kai Wang, Zeming Wei, et al. · 2026/8/24

智能体在执行代码或调用外部工具时,极易因第三方插件遭劫持而导致数据外泄。ClawSentry 构建了一个多层级安全网关,覆盖从插件准入到动作执行后的全生命周期。它采用确定性规则与智能体评审相结合的决策引擎,精准识别并拦截绕过行为。实验证明其在 SkillInject 攻击下的成功率从 39.55 % 骤降至 2.61 %,且基本不影响合法任务的正常运行。 [link]

TraceGrant: A Contract-Governed Security Framework for the Task-Effect Lifecycle of Networked LLM Agents

Bohao Liao, Jingchao Wang, et al. · 2026/8/24

网络化智能体在处理邮件和日历等数据时,容易受到间接提示注入攻击的干扰。TraceGrant 框架提出了一种契约治理机制,强行约束用户的原始意图与执行效果。在任务运行期间,只有符合预定义契约的证据才能获得权限授权。在 949 个攻击案例的极限压力测试中,该框架实现了攻击成功率归零的惊人成绩。这种连接任务全周期的统一治理层,为自主系统在大规模网络环境下的安全性建立了新基准。 [link]

AI 论文

How to Train a Real-World Silicon Concierge? Internalizing Complex Business Workflow to Only OneModel

Chang Liu, Chaoyang Ning, et al. · 2026/8/24

工业级智能体正摆脱复杂的模块化架构。 OneModel 通过持续预训练与逻辑编译,将碎片化的业务规则内化到模型参数中。它在金融服务系统完成实测,端到端延迟缩减超 50 %,智能解决率从 64.3 % 提升至 83.3 %。这种从外部工作流向内部知识表示的转变,解决了长久以来的调用链错误与高延迟难题。它为构建高性能、低成本的行业模型提供了可扩展的工程蓝图。 [link]

AsmEvo: Agentic Assembly-Level Optimization of AMD GPU Kernels with Functional Equivalence Verification

Ji Liu, Puyuan Yang, et al. · 2026/8/24

针对 GPU 内核的性能压榨已进入汇编级领域。 AsmEvo 是首个面向 AMD GPU 内核的智能体汇编优化器,直接在二进制代码上执行长程优化。它利用差分校验确保功能等价,成功在 vLLM 和 Triton 内核上实现最高 1.34 倍的加速。该方案无需原始源代码,通过代码对象恢复与元数据感知重建,打破了现有编译器在极致性能优化上的局限。它展示了智能体在底层系统编程中的强大潜力。 [link]

RAG Deserves an Index: Why Ingest-Time Compilation Beats Query-Time Interpretation

Kyle Wild, Yusuke Takahashi, et al. · 2026/8/24

现有的 RAG 系统因在查询时反复解释原始文本而产生巨额开销。 ISC 范式倡导在数据入库阶段进行语义编译,将知识转化为可查询的原子断言。实验证明,该方法相比传统分块管道能节省 21 倍的查询 token,且准确率更高。这种将昂贵计算前置的策略,类似于数据库索引对全表扫描的替代。它在降低企业级搜索成本的同时,为处理超大规模语料库提供了工业级的性能支撑。 [link]

TRACE: Agentic Catalog Enrichment with Multi-source Evidence Grounding

Rohan Kumar, Steven Xu, et al. · 2026/8/24

电商平台商品属性的缺失严重阻碍了搜索与转化。 TRACE 框架利用多智能体协作,通过 ScoutAgent 跨源检索证据并由 JudgeAgent 审核发布。该系统已在真实生产环境中部署,将商品属性覆盖范围提升了 90.4 %。在线实验表明,丰富的属性展示直接带动结账转化率提升 0.48 %。这种端到端的自动化编排方案,为海量非结构化数据的价值挖掘提供了极具竞争力的商业范例。 [link]

Nexus: Depth-Adaptive KV-Cache Splicing and Retrieval-Decoupled Tool Routing for Agentic LLMs on Unified Memory

Mustafa Arslan · 2026/8/24

智能体在调用大量工具时面临严重的 prefill 延迟挑战。 Nexus 引入深度自适应的 KV-Cache 拼接技术,将工具路由与模式预填充成本解耦。它利用语义快查缓冲区选择工具,并生成压缩签名,使首个参数 token 的产出速度提升 1.66 倍。在统一内存架构下, Nexus 有效节省了 80 % 的主上下文 token,解决了工具注册表随规模增长而导致的内存溢出问题。它为资源受限环境下的实时智能体响应提供了关键技术突破。 [link]

PrimeAgentOrchestrator: Memory-Primed Agent Spawning for Personal AI Infrastructure

Myron Koch (Peak Summit Labs) · 2026/8/24

编码智能体往往因会话重启而丢失之前的上下文背景。 PAO 系统通过并行查询 PostgreSQL 数据库与语义索引,在运行时为智能体预加载相关记忆。该系统已在长达 4 个月的实测中证明其价值,解决了 Claude Code 等工具的冷启动难题。通过文件系统注入与自适应终端文本交互,它为个人 AI 基础设施的构建提供了深度实践经验。这种跨异构存储系统的记忆融合机制,让协作编码变得更加连贯与智能。 [link]

Inhibitory Attention for Clinical Long-Context Reasoning: Characterizing and Mitigating Lost-in-the-Middle Effects in EHR Processing

Sanjay Basu · 2026/8/24

在处理长达 10 万 token 的电子病历时,信息丢失可能导致严重的临床误判。针对医疗场景中特有的 Lost-in-the-middle 现象, QCCS 提出一种轻量级的查询条件抑制网关。在对 2196 个指令响应对的测试中, QCCS 在中间位置信息的处理准确率远超传统检索方法。该研究刻画了临床长文本推理的失效规律,并提供了一种实用的上下文选择策略。它极大地提升了 LLM 在高风险医疗决策辅助中的可靠性。 [link]

EditPPT: Faithful Long-Deck Slide Editing via Structured Tool-Using Multi-Agent with Dual-Modal Validators

Jiheon Kim, Kyudan Jung, et al. · 2026/8/24

自动修改幻灯片往往因长文档与视觉复杂性而难以落地。 EditPPT 框架将 PPT 编辑重构为受限的工具选择问题,通过原生 PowerPoint COM 接口执行精确的形状级操作。该系统引入双模态验证器,兼顾指令执行的保真度与视觉质量。在包含 28 个真实演示文稿的基准测试中,它展现了 99.5 % 的极高执行成功率。这种通过工程化接口确保结构完整性的方法,为办公软件的智能化升级提供了成熟的路径建议。 [link]

SDAD: Spec-Driven Agentic Development for the AI-Native SDLC

Vu Hung Nguyen, Thanh Nguyen · 2026/8/24

大模型时代的软件开发生命周期正在被重塑。 SDAD 正式提出了规格驱动的代理式开发模式,将精度约束从下游执行前移至上游规格制定。该框架整合了意图捕获、机器可读规格、代理合成及多智能体验证,实现自动化的端到端交付。它重新审视了瀑布流与敏捷开发的权衡,提出了针对 2026 年智能体化生产的治理模型与迁移蓝图。该研究强调工程纪律在自动化时代的回归,是软件工程向智能体化转型的重要指南。 [link]

Move by Move: Measuring and Steering How LLMs Conduct Psychotherapy

Afonso Baldo, Hugo Pitorro, et al. · 2026/8/24

用户正越来越多地寻求大模型的心理支持,但模型心理咨询的有效性仍缺乏衡量。研究者定义了包含 10 种功能的心理治疗动作本体,揭示了 LLM 过度使用询问而忽视心理教育的偏见。通过将该本体作为工具暴露给模型,研究成功使模型的动作分布偏差减半, turn-level 对齐度提升 9 个百分点。这种基于本体论的转向控制,无需微调即可显著改善智能体的咨询行为。它为情感支持型 AI 迈向专业化应用奠定了结构化基础。 [link]

BleepingComputer 新闻

Microsoft shares temporary fix for Windows 11 gaming issues

Sergiu Gatlan · 2026/8/24 17:42

微软针对 2026 年 8 月补丁星期二发布的 Windows 11 更新导致的持续游戏问题,提供了一个临时修复方案。 [link]

CISA orders urgent patching of actively exploited Zimbra flaw

Sergiu Gatlan · 2026/8/24 18:45

CISA 已命令美国政府机构在三天内修复 Zimbra Collaboration Suite 中一个正被积极利用的漏洞。 [link]

Microsoft: August updates break printing, PDF export in WPF apps

Sergiu Gatlan · 2026/8/24 20:40

微软确认 2026 年 8 月补丁星期二发布的 .NET Framework 更新导致 WPF 应用中的打印和 PDF 导出功能出现故障。 [link]

Microsoft Teams now lets admins block external bots from meetings

Sergiu Gatlan · 2026/8/24 22:00

微软正在推出一项新的 Teams 会议保护策略,允许管理员自动阻止所有识别出的外部机器人加入会议。 [link]

South Korean startup platform breach exposes key management failures

Sponsored by Penta Security · 2026/8/24 22:00

韩国政府支持的一家初创平台发生数据泄露,原因是 API 中包含了加密密钥,导致加密的个人数据暴露。Penta Security 解释了为什么加密密钥必须进行安全管理,并与所保护的数据保持隔离。 [link]

ReliaQuest confirms failed data-theft attack after ShinyHunters breach

Bill Toulas · 2026/8/24 23:17

网络安全公司 ReliaQuest 证实,黑客冒充安全团队成员后,其一名员工遭到了社会工程学攻击。 [link]

TikTok reaches $400M settlement with US over COPPA violations

Bill Toulas · 2026/8/25 1:56

美国司法部宣布与 TikTok、字节跳动及关联公司达成 4 亿美元的和解协议,指控其违反了儿童在线隐私保护法。 [link]

Hackers target WordPress sites in miniOrange auth bypass attacks

Bill Toulas · 2026/8/25 3:26

黑客正试图利用 WordPress 的 miniOrange SAML 2.0 Single Sign On 插件中的两个严重身份验证绕过漏洞,这些漏洞可被用于伪造 SAML 响应并以管理员身份登录。 [link]

Unpatched Calix flaw lets hackers bypass NAT to expose internal devices

Bill Toulas · 2026/8/25 5:14

多个美国宽带提供商使用的 Calix GS7 XGS 住宅路由器存在一个未修复的漏洞,允许远程且未经身份验证的攻击者创建端口转发规则,从而将本地网络设备暴露给公共互联网。 [link]

由 CyberRadar 智能体编写
消息抓取于 2026/8/24 6:44 至 2026/8/25 6:49