网络安全论文
MazeRunner: Nonlinear Task and Clue Orchestration for LLM-driven Black-Box Automated Penetration Testing
Zhenyuan Li, Yi Jiang, et al. · 2026/8/17
渗透测试是资源密集型工作。 MazeRunner 引入三智能体编排框架,实现了非线性任务管理与线索关联。它能处理环境反馈,并在失败时自动审计攻击路径。在 Hack The Box 真实靶场测试中,该系统在 Claude Sonnet 4.5 驱动下展现出远超 PentestGPT 等基座模型的能力,成功拿下了多个 root 权限。它是自动化红队评估领域的一大突破。 [link]
Weird Machines in Transport Layer Security
Michael Collins, Jada Cumberland, et al. · 2026/8/17
TLS 握手协议竟然可以变成图灵完备的计算系统。研究者发现 OpenSSL 和 BoringSSL 的原始原语可以组合成所谓的奇怪机器。这种机器的计算逻辑与身份验证决策深度耦合,形成一种 trust actuation 机制。通过在 Docker 中运行的实例,作者展示了如何在不触发内存损坏的情况下,仅通过重新协商逻辑就绕过密码强度检查。这为协议实现层面的安全性研究开辟了全新视角。 [link]
Characterizing the Variance Envelope: A Multi-Dimensional Analysis of Spectre Telemetry Across Architectures and Workloads
Jaya Keshava Chandra Kotha, Jean-Luc Gaudiot · 2026/8/17
Spectre 等硬件攻击在 HPC 指标中留下的足迹极易被系统噪声淹没。该研究横跨 Intel 、 ARM 和 AMD 三大架构,深入刻画了攻击特征的方差包络。实验揭示了 Prime+Probe 攻击在 AMD Jaguar 上的微架构瓶颈。研究结论指出,静态检测模型在复杂的现实负载下必然失效,未来的运行时监测系统必须具备架构感知能力并能够动态适应环境变化。 [link]
TLF: Rapid Characterization of RF Transceiver Parameters in Embedded Systems via Bus-Level Interception
Larry Hernandez, Sergey Bratus · 2026/8/17
如何从硬件总线流量中直接提取无线电收发器的配置? TLF 框架通过截获微控制器与收发器芯片间的总线数据,实现了协议状态机的自动重建。它能秒级还原频率跳变序列、调制参数甚至硬件加密密钥。在针对 SX1276 等主流 LoRa 芯片的实测中,该工具无需固件源码即可生成完整的逆向报告,为嵌入式系统的物理层对抗提供了强大支撑。 [link]
CoSA: Context-Aware Severity Assessment via Context Analysis with Large Language Models
Jinfeng Jiang, Yikun Li, et al. · 2026/8/17
传统的漏洞评分高度依赖人工,且现有工具缺乏对代码库全局上下文的理解。 CoSA 结合代码属性图与两阶段剪枝策略,利用 LLM 从海量代码噪声中精准提取与 CVSS 相关的证据。通过这种语义感知的方法,它能生成紧凑的指标摘要并驱动轻量级分类器。实验证明, CoSA 在真实漏洞数据集上的 F1 分数大幅领先于函数级模型,有效解决了软件漏洞治理中的优先级评估难题。 [link]
Vaulted Passkeys: A Device-Bound Proposal for Authenticated Credential Export and Import
Pol Henarejos · 2026/8/17
设备绑定凭证在提供高安全性的同时,也带来了灾难恢复和迁移的难题。 Vaulted Passkeys 提出了一种全新的架构,允许在不暴露私钥明文的前提下,通过 HKDF 密钥分离和 AEAD 配置实现凭证的安全导出与恢复。该方案在保持设备隔离特性的基础上,解决了 Fido2 备份这一工程痛点。它为下一代身份认证标准提供了可落地的参考实现,有助于消除 Passkeys 普及的最后技术障碍。 [link]
Trust Without Boundaries: An Architectural Analysis of Satellite Flight Software
Jack Vanlyssel, Gruia-Catalin Roman, et al. · 2026/8/17
随着航天器软件化程度加深,星载飞控软件的边界安全变得至关重要。研究人员对 NASA 的 cFS 架构进行了系统性扫描,揭示了组件间缺乏隔离与访问控制的深层缺陷。通过在 NOS3 模拟器上运行恶意组件,作者验证了仅利用合法架构权限即可操纵卫星行为的攻击路径。该研究打破了航天软件内部信任无边界的传统假设,为未来高等级航天任务的内生安全设计提供了关键建议。 [link]
P2Skill: Privacy Preserving Skill Distillation for Cloud-Local LLM Inference Systems
Myunghoon Ryu, Geunpyo Park, et al. · 2026/8/17
在云端大模型与本地小模型混合推理的趋势下,用户隐私保护面临严峻挑战。 P2Skill 采用基于 Prompt 的技能蒸馏方法,让本地模型自主完成 PII 路由、重写与重构。它不需要针对特定隐私任务进行微调,而是通过云端模型的失败反馈不断优化本地技能。测试显示,该方法在四个领域基准测试中表现优异,推理质量显著优于现有的实体脱敏方案,实现了隐私与效能的平衡。 [link]
STINER: Automated Extraction of Strategic Cyber Threat Intelligence from X
Yasir Ech-Chammakhy, Oussama Azrara, et al. · 2026/8/17
X 平台已成为网络威胁情报的首发地,往往比官方报告早数天。 STINER 构建了一个包含 2100 条社交媒体告警的专家标注语料库,专注于提取勒索软件组织、目标行业等战略级实体。通过对 DarkBERT 等领域编码器的微调,该系统在非正式语言环境下达到了 89.33% 的 F1 分数。实测表明,它能比厂商安全报告更早地捕捉到 SafePay 勒索运动的苗头,是主动威胁狩猎的有力工具。 [link]
CipherSight: Robust Website Fingerprinting via Record-Resource Semantic Supervision under Distribution Shifts
Runhan Song, Qiqi Liu, et al. · 2026/8/17
加密流量指纹识别常受到时间和地域带来的分布偏移困扰。 CipherSight 抛弃了敏感的 TCP 包序列特征,转而采用基于 TLS 记录的层次化框架。它通过掩码记录建模捕获流量上下文语义,并利用细粒度的记录资源标注进行监督。实验验证了它在两千类网站识别中的准确率超过 95.41% ,且在跨地域漂移的情况下依然保持高性能,为防御各种侧道分析攻击提供了高鲁棒性的检测基准。 [link]
AI 论文
ScienceFlow: A long-horizon agent for ML research, scientific discovery and beyond
Mingming Zhao, Jiqian Dong, et al. · 2026/8/17
ScienceFlow 框架挑战了 LLM 代理在长程科研任务中的稳定性难题。它将科研过程建模为可恢复的执行状态,引入 ESTRA 机制在动态路径中灵活切换锚点。系统还配备了资源感知控制器,根据预算自动优化计算作业。在 MLE-bench 榜单上,该方案取得了 70.22% 的 Any-Medal 高分。它证明了高效的状态管理和资源分配是实现全自动机器学习研究的关键。 [link]
Does a Language Server Save Tokens for Coding Agents? A Measurement Methodology and Preliminary Study
Pengcheng Xu · 2026/8/17
开发者普遍认为语义检索比全文搜索更省 token ,但事实往往相反。这篇论文对 coding agent 进行了深度评测,发现在符号定位任务中,使用 LSP 协议反而会增加 6% 到 118% 的 token 开销。研究指出模型在定位时更倾向于使用 grep 。这项研究提醒工程人员,盲目接入复杂的协议工具未必能提升效率,构建适配任务的路由机制才是最优解。 [link]
Not All Tokens Are Equal: Inflation-Aware Routing for Agentic LLM Systems
Heming Fu, Shan Lin, et al. · 2026/8/17
当代理任务失败并重试时,实际消耗的 token 远超单次调用。这种 token 通胀现象被大多数路由算法忽略了。InflationAgent 提出了一种四阶段路由方案,利用 CoT 分支熵预判任务难度。它通过计算语义汇率来优化模型选择,在固定预算下将 GSM8K 的准确率提升至 94.7% 。该研究为构建高性价比的商业代理系统提供了数据支撑,显著降低了长尾任务的成本。 [link]
Never the Number: Structural Abstention for AI Systems Whose Answers Are Consumed as Fact
Zhelun (Allen), Wu · 2026/8/17
企业级部署对 LLM 生成 SQL 的容错率极低。一旦出现幻觉字段,后果不堪设想。论文提出了结构化弃权模式,将生成式外壳与确定性内核分离。内核仅执行符合预设形状的查询,无法处理的请求会被直接拒绝。这种设计保证了系统永远不会返回捏造的数值。通过在生产环境 2 年的实战演练,该架构证明了可靠性优于准确率,是决定 AI 应用落地生死的关键。 [link]
AgentRewind: Recoverable Execution for Long-Horizon LLM Agents
Yu Zhuang, Kefei Chen, et al. · 2026/8/17
长程任务中一个小错误会导致全局崩盘。AgentRewind 为 LLM 代理引入了类似游戏的存档读档机制。它记录代理上下文与受控环境的对齐快照,允许代理在出错时回溯到特定状态并重新尝试。在工程任务基准 MettleBench 上,该框架显著提升了任务完成率。这种容错机制让开发者敢于让代理处理复杂的软件工程任务,而不必担心单步失误造成不可逆的环境损坏。 [link]
Agentao: A Governed Local-First Runtime for Tool-Using LLM Agents
Bo Jin, Qiang Jiao, et al. · 2026/8/17
代理在本地环境调用工具时存在安全隐患。Agentao 提供了一套受控的本地优先运行时环境,实现了动作提案与授权执行的物理分离。它构建了权限介导的工具系统和可审计的执行踪迹,让每一次操作都透明可控。该系统为构建可治理、可检查的工业级代理提供了务实的参考架构,是解决 prompt 注入与工具毒化问题的有力工程尝试。 [link]
Mandato: Protocol-Level Enforcement of Digitally Signed Mandates on AI Agent Actions with Cryptographically Chained Audit Trails
Giovanni Racioppi · 2026/8/17
如何让 AI 代理的每一次操作都具备法律效力?Mandato 实现了协议层的数字签名授权。它将民法中的授权委托概念引入 MCP 协议,代理的每个工具调用都必须经过加密签名的指令校验。系统会自动生成抗篡改的哈希链审计日志,满足欧盟 AI 法案的合规要求。这套方案让技术人员与法律审计人员拥有了共同的对话语言,为 AI 进入高监管行业铺平了道路。 [link]
Ontology-Grounded Project Memory for Coding Agents
James Adam · 2026/8/17
现代软件开发中代码变更极快,coding agent 往往记不住修改的原因。MOOSEDev 利用本体论构建了结构化的项目记忆,将架构决策和约束记录在知识图中。通过 MCP 接口,代理可以查询决策背后的逻辑。在包含 835 条记录的语料库测试中,该系统对复杂逻辑查询的回采率接近 100% ,远超基于向量的 RAG 方案。这套神经符号系统让大型项目的维护变得更有条理。 [link]
Intern-S2-Mobius: Foundation Model with Decoupled Knowledge and Reasoning
Kai Chen, Jifeng Ding, et al. · 2026/8/17
传统 Transformer 结构将知识存储与逻辑推理混在一起。Mobius 架构通过解耦两者实现了效率飞跃。它使用全局共享的存储模块保存知识向量,多个推理模块迭代进行逻辑运算。这种设计让 7B 模型在推理速度上提升了近 4 倍,且仅需 62.6% 的训练数据就能达到基准水平。该成果为在移动端等受限场景下部署高性能基础模型开辟了新路径,大幅降低了推理成本。 [link]
Simulation-Aware In-Context Policy Improvement for LLM-Aided Analog Layout Refinement
Bingyang Liu, Ziming Wei, et al. · 2026/8/17
模拟集成电路的版图设计至今仍高度依赖人工迭代。虽然生成器可以处理初始布局,但性能微调需要昂贵的仿真。论文提出了一种仿真感知的 ICPI 框架,利用多代理系统在 act-observe-reflect 循环中优化参数。在真实电路测试中,仅需数十次仿真即可超越传统贝叶斯优化。它将 LLM 的推理能力直接转化为芯片设计效率,是 AI 赋能 EDA 行业的典型范例。 [link]
BleepingComputer 新闻
Anthropic confirms Claude is down in major outage affecting multiple services
Mayank Parmar · 2026/8/17 6:28
Claude 正在遭遇严重的停机故障。用户反映多个 Anthropic 服务出现登录困难和性能下降的问题。 [link]
SafePal data breach impacts 39,798 customers, stolen info for sale
Lawrence Abrams · 2026/8/17 7:47
加密货币硬件钱包供应商 SafePal 警告称 39 798 名客户受到数据泄露的影响。攻击者利用漏洞窃取了订单信息,并声称正在出售这些被盗数据。 [link]
Microsoft working on Defender patch for ShieldBreak zero-day
Sergiu Gatlan · 2026/8/17 17:05
微软正在为 ShieldBreak 零日漏洞开发安全补丁。该漏洞由安全研究员 Nightmare Eclipse 上周披露,目前编号为 CVE-2026-69414。 [link]
French tax authority data breach affects 678,000 individuals
Sergiu Gatlan · 2026/8/17 18:09
法国经济财政部披露了一起数据泄露事件。攻击者通过访问公共财政总局系统的权限,窃取了 678 000 名个人的数据。 [link]
Philips and GE investigating Clop ransomware data theft claims
Sergiu Gatlan · 2026/8/17 19:25
科技巨头 GE 和 Philips 证实正在调查 Clop 勒索软件组织入侵其系统并窃取数据的指控。 [link]
Windows Server 2022 reaches end of mainstream support in 60 days
Sergiu Gatlan · 2026/8/17 20:33
微软提醒 IT 管理员 Windows Server 2022 即将结束主流支持。该系统将在 2026 年 10 月转入扩展支持阶段。 [link]
Certighost and the Privilege Hiding in Your Certificate Authority
Sponsored by BeyondTrust · 2026/8/17 22:00
CVE-2026-54121 允许普通域用户将企业 CA 提升为 Domain Controller。修复补丁并非难事。重点在于理解常驻权限和隐式信任,并将 PKI 视为 Tier 0 身份基础设施。 [link]
Microsoft confirms GitHub is down worldwide
Mayank Parmar · 2026/8/17 22:47
GitHub 对部分用户不可用。此次大规模故障导致网站、API、Actions 和 Pull Requests 等多项服务出现错误。 [link]
Pokémon Center data breach exposes customer info, cancels some orders
Lawrence Abrams · 2026/8/18 3:12
Pokémon Center 正在通知英国和德国的客户。第三方物流供应商 CEVA Logistics 遭遇黑客攻击,导致客户个人信息和订单数据泄露。 [link]
Hacker claims 3.6 million Azure account records stolen from major companies
Ionut Ilascu · 2026/8/18 3:35
一名威胁行为者正在出售员工数据库。据称这些数据通过被盗凭据从多家财富 500 强公司的 Azure 基础设施中获取。 [link]