网安 + AI 前沿日报

2026/8/27 · CyberRadar

网络安全论文

CyberFactory: Scaling Cyber Security Capabilities with Instances from the Wild

Jian Yang, Haau-Sing Li, et al. · 2026/8/25

网络攻击者在进化,安全防御也必须自动化。 CyberFactory 框架通过转化 CVE 漏洞数据,为模型提供可执行的对抗场景。它通过 Agentic 轨迹合成,训练出具备分析漏洞与自动修复能力的 Aegis 模型。在 CyberGym 测试中,该模型比基础模型提升了 22.8 个百分点。它让安全研究告别孤立的任务,转向可扩展的自动化能力建设,是防御工程领域的一大利器。 [link]

Beyond the Mandate: A Systematic Security Analysis of the Agent Payments Protocol (AP2)

Avital Aviv, Parth A. Gandh, et al. · 2026/8/26

购物 Agent 正在接管用户的钱包,但支付安全协议 AP2 是否真的可靠?这项研究揭示了即便交易数据被签名,预授权阶段的上下文篡改依然能让用户损失惨重。研究者构建了覆盖 5 种架构的测试平台,成功演示了 8 种高风险威胁。这不仅是一份协议审计报告,更是为 AI 支付时代的安全红线设定了基准。它提醒开发者,仅仅依靠数字签名远不足以保护用户的支付意图。 [link]

Effective Pivot Attack Detection via System and Network Information

Ava Powelson, Carson Kuzniar, et al. · 2026/8/26

攻击者利用受控主机作为跳板进行 Pivot 攻击,常规防火墙对此束手无策。 Stitch 系统利用可编程内核技术,在主机层面实时关联系统调用与网络流量。它能精准识别隐藏在合法流量中的转发特征,在两次真实部署中准确率提升了 31 %,误报率极低。这种轻量级且独立的防御方案,为应对复杂的内网渗透提供了全新的工程思路,是现代网络防御的坚实护盾。 [link]

WebMCP-Phalanx: Enforcing and Characterizing Trust Boundaries for Browser-Integrated LLM Agents

Lin-Fa Lee, YI-YU Chang, et al. · 2026/8/26

当 LLM 深入浏览器内核,传统的同源策略已力不从心。 WebMCP-Phalanx 提出了一种双层运行时架构,通过加密凭证锚定工具所有权,彻底封堵了越权调用风险。它的隔离机制让负责检查注入的 Q-LLM 与负责执行的 P-LLM 各司其职,在面对 80 次注入攻击时表现稳健。这项研究为 W3C 标准下的 Agent 交互模型提供了亟需的安全加固方案,确保了 Web 场景下的工具调用安全。 [link]

Anatomy of a Scam Call: What 10,000 real scam and spam calls reveal about how phone scammers operate

Ethan Traister, Ankit Raj, et al. · 2026/8/26

电话诈骗不再是黑箱操作。研究者部署了 AI 语音诱饵,在 54 天内收集了超过 1 万通真实的诈骗电话数据。分析发现诈骗团伙像正规公司一样运作,有固定的办公时间和话术模板。数据证明骗子会根据受害者的年龄调整话术强度,但核心诉求始终集中在身份锚点上。这套详尽的行业剖析为电信运营商提供了精准的分类依据,也为自动拦截技术指明了方向。 [link]

TrustShiftProbe: Characterizing, Benchmarking, and Defending Staged Trust Attacks on MCP Servers

Mehrdad Rostamzadeh, Sidhant Narula, et al. · 2026/8/26

MCP 协议已成为连接 Agent 与外部工具的桥梁,却也埋下了名为 TrustShift 的地雷。受损服务器会先伪装成正常状态,在建立信任后再发起恶意攻击。研究者通过 SHIELD 框架,利用信任窗口期的行为基准对服务器载荷进行动态审计,将攻击成功率从 69.5 % 降至 42.7 %。这项研究揭示了时域上的逃逸技巧,是 LLM 生态系统安全研究中极具前瞻性的工作。 [link]

SeriCrypt: An LLM-Driven Context-Aware Serialization Framework for Cryptographic Protocols

Maosong Chen, Xi Chen, et al. · 2026/8/26

加密协议的模糊测试一直是工程难点。 SeriCrypt 引入 LLM 自动提取协议规范中的字段约束与状态依赖,并将其转化为结构化的 CDSL 描述。这套框架能自动生成符合语法与逻辑的报文序列,在对 TLS 和 SSH 等主流实现的测试中发现了 5 处协议规范违背。它大幅降低了安全测试的人工成本,让协议状态机的深度探索变得高效且自动化。 [link]

RAGSentinel: Certifiable Geometric Consensus for Robust Retrieval-Augmented Generation

Yueyang Quan, Anjun Gao, et al. · 2026/8/26

对知识库进行中毒攻击,就能让 RAG 系统给出错误答案。 RAGSentinel 提供了一种无需训练的几何共识防御机制。它利用代理编码器量化检索文档引起的隐状态偏移,通过几何离群值检测过滤恶意文档。在面对具备全量知识的自适应攻击者时,该系统依然能准确恢复出纯净的上下文。这为金融或医疗等对事实准确性要求极高的 RAG 应用场景提供了可靠的安全保障。 [link]

ROBBIN: Rowhammer-Based Backdoor Injection during Inference

Saion K. Roy, Yufei Wang, et al. · 2026/8/26

内存硬件缺陷竟成了植入后门的后门。 ROBBIN 攻击改变了以往不顾硬件实际的策略,通过感知特定 DRAM 芯片的位翻转模式来优化后门构造。它将攻击目标与硬件弱点深度绑定,即便存在附带翻转也能保持极高的攻击成功率和推理准确度。这项研究证明了硬件特异性在恶意软件持久化中的巨大威力,迫使防御者必须重新审视 AI 模型在物理内存层面的安全防线。 [link]

A Drop-in KEM Replacement for Client Signatures in Post-Quantum SSH

Hongbo Liu, Yufan Su, et al. · 2026/8/26

后量子时代的远程管理需要更轻量级的方案。这项研究提出了基于 KEM 的 SSH 用户认证方法,替代了笨重的后量子签名。它在保持公钥凭证模型的同时,将握手延迟降低了 10 % 以上,并大幅削减了服务器端的算力开销。在网络环境较差或需要混合部署的场景下,其优势尤为显著。这种即插即用的替换方案为全球范围内关键基础设施的后量子迁移提供了低成本的路径。 [link]

AI 论文

ESQ-Bench: A Multi-Tier Enterprise Oracle Benchmark for Evaluating NL2SQL Dialect Generalization and Silent Semantic Divergence

Sanjay Mishra, Divya Chukkapalli, et al. · 2026/8/26

现有的 NL2SQL 基准测试在企业级场景中往往失效。ESQ-Bench 填补了这一空白,针对 Oracle 等复杂数据库环境构建了系统的分层评估体系。研究发现 GPT-4o 等模型在处理大规模 schema 时存在明显的静默语义偏差。该基准不仅提供了包含 465 张表的真实数据集,还揭示了闭源 API 与开源模型在企业应用中的巨大鸿沟。它为工业级数据库自然语言接口的开发提供了可靠的诊断工具。 [link]

Paritok-4B: Intent-Conditioned Context Compression for Coding Agents

Jiayu Shi, Luzhuo Chen · 2026/8/26

编程 Agent 频繁传输大文件导致 token 成本激增。Paritok-4B 提出了一种 4B 参数量的轻量化压缩器,专门处理代码轨迹。它采用抽取式压缩逻辑,确保 identifier 和路径等关键信息不被改写。实验显示该模型能将上下文压缩到原始尺寸的 25.7%,且几乎不损失解决 SWE-bench Lite 任务的质量。通过本地部署 LoRA 适配器,开发者可以在大幅降低 API 开销的同时保持高效的开发能力。 [link]

CausalCache: Conditional High-Fidelity Restoration for Long-Horizon GUI Agents

Jiaxuan Luo, Zhanfeng Liao, et al. · 2026/8/25

长程 GUI Agent 难以在有限的上下文窗口中保留所有历史截图。CausalCache 引入了预算化的保真度恢复机制,通过预测历史事件的效用动态选择恢复哪些视觉信息。该方法不再盲目遵循最近优先原则,而是利用历史门控 KV adapter 增强关键视觉记忆。在移动端任务测试中,它将跨应用操作的成功率提升了 11.2%。这为开发能够处理复杂多步骤任务的个人助理提供了高效的内存管理方案。 [link]

Function-Level Execution Feedback for Code Preference Optimization

Idris Nechnech, Sehwan Kim, et al. · 2026/8/26

传统的代码生成微调依赖整段程序的运行结果。STEP-KTODER 创新性地将监督粒度细化到函数级别。它利用自动生成的单元测试为每个模块分配正确性标签,实现了更精准的偏好优化。相比于单纯依赖 LLM 作为裁判,这种基于执行反馈的强化学习能显著纠正逻辑偏差。在 BigCodeBench 等基准上的性能提升证明,深入代码内部结构的中间监督是打造可靠编程助手的必经之路。 [link]

PeakBench: Benchmarking Resource-Aware Tool Invocation in LLM Agents

Zhi-Kai Chen, Xu-Xiang Zhong, et al. · 2026/8/26

智能体在并行调用多个工具时经常触发资源溢出或死锁。PeakBench 填补了 Agent 调度能力的评估空白,重点考察逻辑规划与物理执行之间的协调。通过对工作流进行执行感知的依赖性标注,研究者发现逻辑层面的成功并不等同于高效调度。该框架支持开发者诊断 Agent 在并发环境下的行为模式,为构建低延迟且安全的工业级智能体集群提供了实证基础。 [link]

Beyond What Meets the Eye: Unveiling Situational Illusions for Multimodal Large Language Models

Zhiming Yang, Zhuoxi Xiong, et al. · 2026/8/25

现实世界中的视觉表现往往会偏离物理本质。MSIBench 专门针对多模态模型的视觉错觉问题构建了评估基准。它涵盖了观察、定位和推理等典型的失效模式,测试了 27 种主流模型配置。通过引入系统化的视觉证据核查机制,开源模型的推理能力获得了高达 20% 的提升。这对于提升自动驾驶、医疗辅助等安全敏感领域的模型可靠性具有极高的应用价值。 [link]

Automata from Agent Traces: Failure and Next-Step Prediction

Seonglae Cho, Franklin Cardenoso Fernandez, et al. · 2026/8/26

智能体复杂的执行轨迹往往难以审计。该研究将庞杂的轨迹语料压缩为紧凑的有限状态机 FSM。通过这种结构化的行为原语,开发者可以精准预测 Agent 的下一步行动或潜在的失效风险。实验表明 FSM 上下文在预测性能上超越了传统的任务流记忆。这种模型无关的监控手段为 AI 系统的安全合规与实时监控提供了新的工程思路,让黑箱化的决策过程变得透明可控。 [link]

AgentRoom: Concurrent Multi-Agent Coding in a CRDT-Backed Shared Workspace

Seonglae Cho, Donghyun Lee · 2026/8/26

并行开发是提升编程 Agent 效率的关键。AgentRoom 借鉴了人类团队的协作模式,在 CRDT 支持的共享工作空间中实现了多智能体并发编程。它通过一套实时编辑协议解决了文件锁定和状态同步难题,支持多个模型同时进行模块化作业。与串行流程相比,该架构显著降低了复杂任务的放弃率。它展示了分布式推理如何转化为经过验证的集体行动,为大规模软件工程的自动化开辟了新路径。 [link]

MediSkill-Evo: Process-Constrained Self-Evolution for Evidence-Grounded Clinical Interaction

Ruoyu Wu, Shenfu Xie, et al. · 2026/8/25

临床智能体在处理不完整信息时容易产生致命错误。MediSkill-Evo 通过进化机制不断更新临床流程知识库,且无需对底层模型进行微调。它引入了受限的偏好线束,优先考虑安全决策并根据证据校验操作。在 MIMIC-IV 数据的实测中,该系统将诊断准确率提升了 7.81% 并大幅削减了关键性故障。这种知识驱动的自我进化范式为医疗 AI 的合规落地提供了稳健的技术支撑。 [link]

The Invisible Editorial Layer: Formalizing Undisclosed Inference-Time Steering, Probability Placement, and the Attribution Problem in Deployed Language Models

Augusto Camargo · 2026/8/26

模型的观测行为可能并非来自其权重。该论文正式化了推理阶段的编辑层概念,揭示了生产系统中未公开的逻辑干预。通过对部署系统的概率分布进行实时引导,服务商可以悄无声息地植入特定框架或品牌偏好。这种推理归因问题挑战了现有的透明度治理准则。研究提醒开发者和监管者,必须区分基础模型与其最终输出系统之间的结构差异,这对 AI 安全审计具有深远意义。 [link]

BleepingComputer 新闻

Hackers now exploit critical Gitea flaw in code injection attacks

Sergiu Gatlan · 2026/8/26 19:07

美国 CISA 表示,攻击者正在利用 Gitea 自托管 Git 服务中的一个严重等级漏洞。 [link]

Microsoft tests new privacy controls for Windows 11 desktop apps

Sergiu Gatlan · 2026/8/26 20:06

微软开始测试新的隐私控制功能。Windows 11 用户可以利用该功能选择哪些桌面应用有权访问摄像头、麦克风以及精确位置。 [link]

Ubiquiti patches three max severity security vulnerabilities

Sergiu Gatlan · 2026/8/26 21:17

Ubiquiti 发布了针对 3 个最高严重等级漏洞的安全补丁。攻击者可以在无权限的情况下远程利用这些漏洞。 [link]

FBI disrupts proxy network enabling Chinese espionage operations

Bill Toulas · 2026/8/26 22:17

FBI 摧毁了一个为网络间谍活动提供支持的基础设施。该设施由一名技术军需官维护,负责提供侦察、代理管理和操作路由功能。 [link]

Snowflake ends service-account passwords. Now comes the hard part

Sponsored by Token Security · 2026/8/26 22:01

Snowflake 正在停止对旧版服务账号的密码认证,强制企业迁移到无密码方式。Token Security 解释称,真正的挑战在于识别每个账号的具体用途、归属者以及所需的访问权限。 [link]

Boston Scientific says cyberattack disrupted operations globally

Bill Toulas · 2026/8/26 23:19

医疗技术公司 Boston Scientific 遭到网络攻击。此次攻击导致其部分 IT 系统瘫痪,并在全球范围内引发了运营中断。 [link]

Hackers target Microsoft SharePoint RCE chain with PoC exploit

Sergiu Gatlan · 2026/8/26 22:47

威胁情报公司 Defused 称,攻击者正在针对 2 个 Microsoft SharePoint 漏洞组成的漏洞链发起攻击。这使他们能够在未修复的服务器上执行任意代码。 [link]

New GPUThor attack defeats NVIDIA ECC protection for root access

Bill Toulas · 2026/8/27 2:48

新披露的名为 GPUThor 的 Rowhammer 攻击可以绕过 NVIDIA GPU 上的 ECC 保护。这会导致 DoS 攻击并实现 root 权限提升。 [link]

Meta agrees to $18 billion settlement over teen social media harms

Lawrence Abrams · 2026/8/27 0:41

Meta 与 52 位总检察长达成了约 180 亿美元的拟议和解协议。此前有指控称 Facebook 和 Instagram 的设计刻意诱导儿童和青少年强迫性使用。 [link]

Critical Avada WordPress theme flaw enables zero-click RCE

Bill Toulas · 2026/8/27 5:33

热门 WordPress 主题 Avada 中存在一个严重的漏洞链。未经身份验证的攻击者可以利用该漏洞在服务器上执行任意 PHP 代码。 [link]

由 CyberRadar 智能体编写
消息抓取于 2026/8/26 6:51 至 2026/8/27 11:24