网络安全论文
FRESCO: Complete and Scalable Temporal Safety for CHERI Application Processors
Merve G\"ulmez, Nils Jordan, et al. · 2026/8/28
芯片安全迈入新阶段。 FRESCO 针对 CHERI 架构解决了栈内存的 Use-after-return 难题。它通过 provenance 标识为栈指针着色,确保能力不会超出作用域。这种硬件与软件的协同设计在 SPEC CPU 等负载下表现卓越,仅有 4 % 的开销。它实现了完整的内存安全,为工业级处理器防御此类内存漏洞提供了高扩展性的工程范本。 [link]
SILK: Closing the Time-of-Check-to-Time-of-Use Gap in RoT-Protected AI Systems
Ruichen Qi, Xinting Jiang, et al. · 2026/8/28
AI 系统的根信任在数据流转中存在严重漏洞。权重在进入计算引擎前可能在 DRAM 或总线中被篡改,形成 TOCTOU 威胁。 SILK 创新性地利用量化权重的最低有效位作为完整性校验位。这种在预计算边界进行的流式验证无需额外标签,在 FPGA 上展现了极高的吞吐量。它为大模型推理安全筑起了一道轻量且坚固的防线。 [link]
Beyond Vector Hiding: Breaking and Mitigating Shared-Direction Weight Obfuscation in TEE-Offloaded Large Language Models
Menghui Zhang, Aoying Zheng, et al. · 2026/8/28
在设备端利用 TEE 加速大模型推理已成趋势,但传统的权重混淆方案已被攻破。 SpectralLeak 和 LatticeLeak 两种新攻击揭示了共享秩一关系的泄露风险。 ButterflyCloak 提出了基于蝴蝶掩码的改进方案,在保持快速校正的同时实现了最大秩保护。该研究拆解了现有方案的脆弱性,并为隐私保护下的分布式推理提供了更强的数学保障。 [link]
PLCBench: Can Autonomous LLM Agents Turn PLC Access into Sustained Physical Impact?
Yitian Zhou, Jingyu Zheng, et al. · 2026/8/28
攻击者能否利用大模型智能体瘫痪工厂设施? PLCBench 构建了首个真实的硬件在环框架来回答这个问题。它连接了商业 PLC 硬件与闭环过程模拟,不仅关注软件利用,更关注持续的物理影响。研究发现虽然智能体能执行工艺写入,但维持物理目标仍具挑战。这为工业控制系统的防御评估提供了极具现实意义的实验基准。 [link]
Unsaid, Unsafe? Implicit Security Obligations in LLM-Based RTL Code Generation
Guang Yang, Xing Hu, et al. · 2026/8/28
大模型生成的硬件代码若存在安全后门,流片后将无法修复。 RTL-Obliger 针对功能说明书中缺失的安全义务,构建了神经符号框架。它能从文档中提取语义图,并与 CWE 模式本体匹配,自动推断隐式安全需求。通过两阶段生成机制,它显著提升了 Verilog 等硬件描述语言代码的安全性。这对于自动化芯片设计流程的质量管控至关重要。 [link]
ADeptS-Bench: Measuring the Trustworthiness of Computer Use Agents Across Devices
Joy Chen, Alejandro Castillejo Munoz, et al. · 2026/8/28
计算机使用智能体正逐渐接管我们的手机和桌面应用,但它们的安全性评估却长期空白。 ADeptS-Bench 填补了这一短板,专门测试智能体在处理歧义指令和视觉界面威胁时的表现。实验揭示了当前顶尖模型的致命弱点,它们会毫不犹豫地点击恶意扣费按钮。该基准测试为开发更安全、更懂得寻求澄清的智能助手指明了工程方向。 [link]
SysComb: Fine-Grained Transparent System Call Filtering for Attack Surface Reduction
Matthew Rossi, Marco Abbadini, et al. · 2026/8/28
限制系统调用是减少内核攻击面的有效手段,但现有的 seccomp 方案往往需要修改内核或应用代码。 SysComb 利用 eBPF 技术实现了透明的状态感知过滤。它能根据应用程序的运行状态动态切换最严格的过滤规则,且无需改动任何源码。其实测性能与内核原生方案相当,是容器化时代实现最小权限原则的利器。 [link]
SPA: Securing Persistent LLM Agents Across Queries with Plan-First Information-Flow Control
Dylan Girrens, Guangjing Wang · 2026/8/28
长期运行的 LLM 智能体面临着来自网页和文档的持续注入威胁。 SPA 提出了一种计划优先的架构,通过声明式语言生成执行计划。它利用双格信息流控制技术追踪跨查询的数据流向,防止恶意负载修改控制流或污染状态。这种将数据与逻辑隔离的设计在保证智能体持久性的同时,成功将攻击成功率降至接近零。 [link]
How Do LLM Agents Actually Get the Flag? Trace-Level Provenance for Agentic Offensive Security Evaluation
Kimberly Milner, Minghao Shao, et al. · 2026/8/28
夺旗赛得分真的代表大模型的网安能力吗? CTF-ABACUS 通过追踪级别溯源揭开了真相。它将智能体的行为分解为渗透测试阶段,识别其是真正完成了利用,还是仅仅靠猜测或记忆获取了 Flag。研究发现大量成功记录其实属于浅层轨迹。这套框架为评估自主安全智能体提供了更客观的标尺,助力设计更具区分度的实战靶场。 [link]
KubeCap: A Framework for Capability Minimization in Kubernetes via Static Analysis and LLM-Assisted Rule Inference
Yuhao Liu, Yingnan Zhou, et al. · 2026/8/28
开发者在配置 Kubernetes 时常因依赖默认设置而违反最小权限原则。 KubeCap 框架通过静态分析与大模型辅助的规则推理,自动识别容器运行所需的最小 Linux 能力集。它能从内核代码中导出系统调用与权限的映射关系,并自动修复不安全的清单文件。在多个 Go 项目中,它实现了超过 50 % 的权限缩减,极大地收窄了云原生应用的受攻击面。 [link]
AI 论文
Accelerating Scientific Research with Gemini in the Real-World
Samuel Schmidgall, Xiaokai Zhu, et al. · 2026/8/28
谷歌发布 Co-Scientist 框架,将 Gemini 转化为执行导向的科研伙伴。它打破了单纯生成假设的局限,深度参与 MXenes 材料合成、半导体生长及生物表型预测。该系统在计算机科学任务中发现的架构显著提升了医疗基准测试表现。通过双盲研究证实,其生成论文的可靠性模块有效降低了虚假信息与剽窃风险。这标志着闭环多智能体科研系统向现实世界科学发现迈出了关键一步。 [link]
AgentFold: Closed-Loop Agentic Search for Protein Folding Model Design
Mingquan Liu, Jiangyu Chen, et al. · 2026/8/28
蛋白质折叠模型设计迎来自动化新时代。AgentFold 将模型开发建模为代码变体的闭环搜索,在 ESMFold 基础上自主实施代码修改与调试。它采用 MCTS 策略在 2 000 多行代码的工程级项目中分配算力。实验结果显示,该框架在 5 000 GPU 小时的运行中将 lDDT 提升了 7.5 %。其产生的干预痕迹揭示了可学习先验优于几何扰动的设计模式。这一研究为复杂科学机器学习系统的自主进化提供了标准范式。 [link]
From Sound to Symptom: Real-Time Respiratory Signal Understanding for Conversational Healthcare Agents
Tanmay Laud, Herprit Mahal, et al. · 2026/8/28
现有对话系统往往将咳嗽等声音视为噪声,HealthCUES 填补了这一空白。它通过流式处理管道实时监测呼吸信号,使对话智能体具备临床理解能力。系统不仅能识别咳嗽,还能区分干咳、湿咳及哮鸣音,并评估持续时间。基于 Qwen3Omni 驱动的多任务预测机制,HealthCUES 在嘈杂的会议场景中依然保持高召回率。医务工作者证实该系统在远程医疗工作流中具有极高的应用价值。 [link]
TelecomGPT-R1: A Unified Open-Source Reasoner for the Telecom Stack
Bohao Wang, Chenwei Wu, et al. · 2026/8/28
电信工程涉及复杂的协议规范与网络计算,TelecomGPT-R1 为该堆栈提供了统一推理能力。研究者构建了涵盖协议、知识、建模和故障四个维度的 SFT 语料库。通过两阶段后训练工艺,模型成功将电信专业知识与多步推理能力融合。在 GRPO 算法的稳定优化下,它在多个电信基准测试中位居开源模型榜首。该成果证明了领域特定推理器在处理高杠杆工业任务时的卓越潜力。 [link]
CIFQA: A Deterministic Tool-Grounded Multi-Agent LLM Framework for Financial Query Answering
Kunjesh Parekh, Anil Kumar Tiwari, et al. · 2026/8/28
金融问答中的多步计算往往让大模型产生合乎逻辑的数字错误。CIFQA 框架通过解耦语言理解与数值执行攻克了这一难题。它指派专门的 Agent 进行查询解析、参数提取与计算规划,并由确定的 Python 工具执行核心运算。即便在处理复杂的定存查询时,该系统也达到了 90.87 % 的总准确率。研究发现,合理的架构设计对提升数值可靠性的作用远超模型规模。这一确定性工具驱动的思路为金融数字化转型提供了稳健参考。 [link]
PICasso: An AI-Enabled Design Framework for Autonomous Optimization of Silicon Photonic Devices
Deepak Vungarala, Deniz Najafi, et al. · 2026/8/28
硅光子集成电路的设计正变得更加智能。PICasso 框架实现了从自然语言规范到可制造布局的自主优化。它整合了从 NL 到 YAML 再到 GDS 的生成管道,并注入 PDK 知识以确保物理合规。通过模拟引导的优化机制,该系统将电路插入损耗平均降低了 1.74 dB。实验证明 PICasso 能将复杂的参数化任务转化为高性能的物理设计。这标志着 AI 驱动的光子芯片设计已从简单的网格生成进化为实用的自动化工程工具。 [link]
TutorTrace: A Dataset and Taxonomy for Classifying Learner Behavioral States during AI-Assisted Programming Education
David Barron, Xiaohang Tang, et al. · 2026/8/28
AI 编程导师如果缺乏行为语境,很难真正帮助初学者。TutorTrace 从 IDE 遥测数据中提取低级别行为特征,将其转化为可计算的语境抽象。通过对 480 名学生的实地部署,系统识别了寻求帮助前后的不同阶段。采用行为感知提示词后,学生无独立工作的提问频率显著下降。该研究展示了如何利用实时行为建模来预测学习需求。这种以数据驱动的行为洞察为规模化自适应教育提供了新途径。 [link]
The Artificial Experimentalist: Discovery and Control of Self-Organizing Phenomena with Autotelic Reinforcement Learning
Marko Cvjetko, Benedikt Hartl, et al. · 2026/8/28
控制复杂系统中的自组织现象一直是科学难题。CARL 框架引入闭环自博弈强化学习,使 Agent 能通过微小的局部干预引导整体模式。在连续元胞自动机 Lenia 的实验中,CARL 发现稳定孤子的效率远超启发式方法。它不仅能创建模式,还能实时指挥孤子穿过迷宫。这种零样本泛化能力意味着 Agent 掌握了底层的物理逻辑。该路径为自动发现并控制复杂系统中的涌现现象开辟了新方向。 [link]
TreeGraft: Adaptive Multi-Drafter Grafting for Tree-Based Speculative Decoding
Jiaming Fan, Daming Cao, et al. · 2026/8/28
为了加速 LLM 推理,TreeGraft 提出了一种自适应多草稿树状解码框架。它解决了小模型质量低与大模型延迟高的矛盾,允许不同成本的草稿模型共同构建共享树。通过轻量级调度器,系统能智能决定调用强力草稿模型的时机,以重新评分并回收被遗漏的路径。在 10 对模型组合的测试中,TreeGraft 平均实现了 15.1 % 的性能提升。这一工程优化方案显著提高了投机采样在长序列生成中的效率。 [link]
Thomson: Continual Learning of Frontier Models for SovereignAI
Shengzhuang Chen, Jerrod Parker, et al. · 2026/8/28
Thomson 的出现证明了机构完全有能力自主构建前沿水平的主权 AI。该项目放弃了代价高昂的从零训练,转向在开源权重模型上进行持续学习。通过引入保护塑性与稳定性的干预手段,模型在法律、税务及复杂研究任务中表现优异。它在消除灾难性遗忘的同时,实现了跨代际的性能飞跃。这套方案大幅降低了算力与人员预算门槛。对于追求数据隐私与垂直领域深度的企业而言,Thomson 提供了一条可落地的技术路线。 [link]
BleepingComputer 新闻
PaperCut releases second emergency patch for exploited flaws
Lawrence Abrams · 2026/8/29 3:08
PaperCut 发布了针对 PaperCut NG 和 MF 打印管理软件中两个活跃利用漏洞的第二次紧急安全更新。此前研究人员发现了多种绕过初始修复方案的方法。 [link]
GiveWP WordPress donation plugin flaw lets hackers execute server commands
Bill Toulas · 2026/8/29 2:18
WordPress 的 GiveWP 插件存在一个最高严重级别漏洞。未授权攻击者可以利用该漏洞在托管服务器上执行任意命令。 [link]
68-year-old imprisoned after making $1.3 million by pirating IPTV services
Bill Toulas · 2026/8/29 0:36
一名 68 岁男子在英国被判处超过 6 年监禁。他因运营非法 IPTV 服务在 3 年内获利 980,812 英镑,约合 130 万美元。 [link]
AI Is Accelerating Vulnerability Discovery. Can Defenders Keep Up?
Sponsored by Action1 · 2026/8/28 22:00
AI 正在加速漏洞发现进程。这给节奏较慢的漏洞富化、优先级排序和修复系统带来了压力。Action1 解释了防御者为何需要关联多个情报源,并将漏洞数据转化为更快的修复行动。 [link]
Over 8,300 Gitea servers vulnerable to code execution attacks
Sergiu Gatlan · 2026/8/28 20:58
网络安全机构 Shadowserver 表示,超过 8,300 个暴露在互联网上的 Gitea 实例仍未修复严重漏洞。这些实例正面临持续的远程代码执行攻击。 [link]
Toy-making giant Hasbro disclose data breach affecting employees
Sergiu Gatlan · 2026/8/28 19:46
全球大型玩具与游戏公司 Hasbro 披露,攻击者获取了数量不明的员工个人和财务信息。 [link]
ServiceNow warns of three max severity security vulnerabilities
Sergiu Gatlan · 2026/8/28 18:29
ServiceNow 发布了针对 AI Platform 中三个新最高严重级别漏洞的安全补丁。这些漏洞可被用于代码注入、SQL 注入以及权限提升攻击。 [link]
Windows 11 KB5120998 update released with 35 changes and fixes
Sergiu Gatlan · 2026/8/28 17:10
微软发布了适用于 Windows 11 版本 25H2 和 24H2 的 KB5120998 预览累积更新。该更新包含 35 项更改,改进了开始菜单、任务栏和 Windows 搜索。 [link]
McKesson discloses breach after ShinyHunters claims patient data theft
Lawrence Abrams · 2026/8/29 6:40
医疗保健和药品分销巨头 McKesson 披露了一起涉及第三方应用和数据窃取的安全事件。勒索组织 ShinyHunters 声称窃取了 2.84 亿条患者数据记录。 [link]