网络安全论文
Stealing Reasoning Traces from Proprietary LLM APIs
Alexander Panfilov, David Schmotz, et al. · 2026/8/11
顶级模型厂商隐藏了推理过程,却将加密的 Chain-of-Thought 数据块传回客户端。这项研究揭露了一个严重的架构漏洞。攻击者能将一个模型的加密推理块注入给防御较弱的模型,强迫后者解密并输出明文。研究者成功从 OpenAI 和 Google 等平台的公共代码库中提取出 182 个凭证信息。跨模型兼容性让所谓的数据保护形同虚设。它提醒我们,客户端存储敏感数据的逻辑依然存在巨大的安全套利空间。 [link]
Governing the KV Cache: Preventing Timing Side-Channel Leakage in Multi-Tenant LLM Inference
Tejasvi C. Addagada · 2026/8/11
在多租户推理场景中,KV Cache 共享能显著提升吞吐量,但也引入了精确的定时侧信道。攻击者通过探测缓存命中的延迟差异,可以还原其他用户的私有 Prompt 提示词内容。KVGov 方案提供了一个轻量级的治理层。它通过为每个租户引入独立的 HMAC 盐值,使缓存键在密码学层面完全隔离。实验证明,该方案在保证 93% 缓存效率的同时,彻底阻断了针对 vLLM 等流行框架的泄露攻击。它让云端大模型服务在追求高性能的同时,守住了多租户隐私的红线。 [link]
SLAC: Access-Driven CPU-to-GPU Side-channel Attacks via System-Level Cache on Apple Silicon
Tianhong Xu, Saion K. Roy, et al. · 2026/8/11
Apple Silicon 的高性能源于异构 SoC 架构中 CPU 与 GPU 共享系统级缓存。这种共享开启了新的攻击面。SLAC 技术揭示了 GPU 访存行为会在共享缓存中留下可观测的足迹。通过 Prime+Probe 探测,攻击者即便没有高权限,也能以极高精度重建图形神经网络的拓扑结构,甚至窃取 LLM 的输入关键词。这种跨域侧信道攻击在 M1 芯片上得到了实证验证。研究结果呼吁硬件厂商重新评估共享缓存的隔离机制,防止敏感数据跨越计算单元边界发生泄露。 [link]
Adversarial Attacks on Deep OCR Systems
Wenbo Sun, Hongzong LI, et al. · 2026/8/11
视觉模态在 DeepSeek-OCR 中被视为光学压缩媒介,显著提升了长文本处理能力。这项研究实现了针对生成式 OCR 视觉语言模型的首个纯黑盒对抗攻击。攻击者无需获取梯度或概率,仅凭输出字符串的相似度即可完成干扰。实验揭露了模型在解码时的严重失效,包括内容重复、截断以及 Prompt 泄露。这种不可感知的图像扰动,让文档识别系统的可靠性面临严峻挑战。它提醒开发者在追求高吞吐量的同时,必须加固底层视觉编码的安全防线。 [link]
HaloMark: A Spectral Threshold for Embedding-Vector Watermarking under C2PA
Tarun Sharma · 2026/8/11
嵌入向量已成为大模型时代的核心资产,但传统水印技术在向量量化和微调面前极易失效。HaloMark 方案将向量水印与 C2PA 标准深度耦合。它利用块对角正向旋转和局部敏感哈希技术,为每个向量签署独一无二的身份证明。即使面对去噪自编码器等强力攻击,检测准确率依然保持在 0.98 以上。它为内容来源验证和知识产权保护提供了坚实的密码学底座。该方案单次验证仅需 284 微秒,完全满足工业级的大规模部署需求。 [link]
Privacy-Preserving Data Drift Detection and Recovery for Large-Scale LLM Applications via Proxy Representations
Michael Levit, Josh Ledgard, et al. · 2026/8/11
在拥有数亿用户的生产环境中,如何在不触碰隐私数据的前提下监测 LLM 应用的性能漂移?ProxyDrift 框架弃用了原始交互数据,转而使用脱敏的代理表示来量化特征分布。它通过多维特征描述符评估生产流量与评估集之间的对齐度,并自动生成高质量的合成数据来刷新测试基准。该系统在保持 RA 0.9 高度对齐的同时,完美避开了 PII 泄露风险。它为大规模 LLM 应用的自动化运维提供了一套既安全又精准的漂移监控闭环。 [link]
EvoTrustRAG: Evolution-Aware Conflict Attribution and Evidence Handling for Reliable Retrieval-Augmented Generation
Xi Nie, Hongwei Li, et al. · 2026/8/11
RAG 系统在面对相互矛盾的检索信息时,难以区分信息属于知识演化还是恶意篡改。EvoTrustRAG 框架将这一难题转化为冲突归因问题。它通过构建事实证据图,分析时间关系与支持结构,判断冲突源自正常的知识更新、恶意干预还是未解的确定性。实验显示,该方案在强协同攻击下的错误率从 31.2% 显著降至 16.0%。它让大模型在动态多变的信息环境中,具备了分辨真伪与处理证据的一致性推理能力。 [link]
Can AI Write Compliant Code, and to What Extent? Evaluating SOC 2 Compliance of Claude Fable 5, Claude Opus 4.8, and Claude Opus 5 Across Four Use Cases
Iccha Sethi, Herman Errico · 2026/8/11
当我们让 Claude 编写涉及敏感数据的代码时,它会主动遵守安全合规标准吗?研究团队针对 4 个真实用例,对 Claude Fable 5 等前沿模型进行了 SOC 2 合规性审计。结果显示,模型在默认状态下经常遗漏 S3 加固、日志记录和多因子认证等关键控制点。但在 Prompt 中加入一句合规性要求后,合规得分瞬间飙升至 86% 以上。这项研究量化了 LLM 生成生产级代码时的合规性缺口,提醒开发者必须通过显式的安全指令来补齐防护短板。 [link]
Targeted Counterfactual Fingerprinting for Black-Box LLM Ownership Verification
Yutong Wu, Xiaofan Bai, et al. · 2026/8/11
如何验证一个黑盒 API 背后的大模型是否盗用了你的知识产权?TCF 框架抛弃了脆弱的全文匹配,转向受控的目标反事实转移验证。它通过优化 Prompt 扰动,使被保护模型在特定的输入下给出预设的反事实响应。验证过程仅需检查嫌疑模型的最终输出是否与该目标匹配。在 4 个主流模型家族上的测试显示,该方法 AUC 达到 0.9861。它在保持鲁棒性的同时,显著降低了所有权验证的判定模糊度,是保护大模型资产的强效工具。 [link]
SSHafe: A Real-Time SSH Brute Force Attack Detection and Novel Credential Rotation Standard
Aditya Mitra, Amar Kumar Mandal, et al. · 2026/8/11
传统的 SSH 防御工具 Fail2Ban 难以捕捉分布式的慢速暴力破解攻击。SSHafe 系统通过深度挖掘身份验证日志的时间序列特征,利用 LightGBM 分类器实现了 99.96% 的实时检测精度。一旦识别出攻击模式,系统会自动阻断风险账户并引导合法用户通过 Passkey 进行凭证更新。这种方案将身份验证与密码重置流程进行了密码学绑定,彻底消除了 OTP 或邮件验证中的劫持风险。它为远程系统管理提供了一种兼具高响应速度与高安全性的防御范式。 [link]
AI 论文
Training Variable Long Sequences with Data-Centric Parallel
Geng Zhang, Xuanlei Zhao, et al. · 2026/8/11
训练长序列时常常受困于计算负载不均。Data-Centric Parallel 框架让数据本身驱动运行时。它能根据 Batch 的序列长度动态调整并行规模和梯度累积策略。在 32 块 H200 显卡上,该方法实现了高达 2.88 倍的加速。集成过程极其简单,仅需 10 行代码即可适配主流模型。它打破了效率与易用性之间的权衡,为处理可变长度长序列提供了工业级的强力基准。 [link]
Scaling Inherently Interpretable Language Models
Guide Labs Team, Andreas Madsen, et al. · 2026/8/11
可解释性不该是牺牲性能的重税。Steerling-8B 将解释约束直接融入训练目标。随着算力规模提升,模型表示反而变得更加清晰且对人类友好。它支持闭环干预,通过归因诊断发现问题后,无需重新训练即可进行概念引导。更惊人的是,其性能足以抗衡训练算力高出数倍的开源模型。这项研究挑战了传统范式,证明了可解释性可以与模型能力同步扩展。 [link]
DocAtlas: Long-Document Understanding as Mutable-State Interaction
Hongchen Wei, Yuanzhe Wang, et al. · 2026/8/11
理解长文档不应只是静态检索。DocAtlas 把超长文档理解建模为可变状态的信息寻觅过程。系统通过分层树结构维护活动工作记忆,赋予模型搜索、阅读和做笔记的工具能力。配合 GPT-5.4 使用时,它在 MMLongBench-Doc 上的表现甚至超过了人类专家。即便使用 4B 规模的小模型,在强化学习加持下也能大幅提升长文本任务的胜率。这是构建轻量级长文档助手的创新路径。 [link]
Aero Realtime: Fully Aligned Input-Output Streams for Low-Latency Streaming Multimodal Generation
Kaichen Zhang, Wei Huang, et al. · 2026/8/11
实时交互需要告别先预填后解码的传统模式。Aero Realtime 采用了全双工架构,将音视频观测与文本输出对齐在统一的时间网格上。每 80 毫秒的音频槽都能独立预测词元。这种设计允许输入和输出流同步推进,消除了交互中的延迟感。在单台工作站上,它能保持极低的处理滞后。它标志着多模态交互从微回合轮询迈向真正的连续自然对话。 [link]
Reason Wide, Not Deep: Amortizing the Reasoning Premium into Distilled Skills
Agamdeep Singh, Srishti Gautam, et al. · 2026/8/11
推理模型虽然强大,但高昂的 Token 成本让企业望而却步。Reason Wide 提出了一种摊销推理成本的新思路。它通过分析现有的推理轨迹,将复杂的逻辑步骤蒸馏为紧凑的 Skill 注入系统提示词。在测试任务中,这种方法帮助 GPT-5.4-mini 抹平了与大型推理模型的差距,同时节省了数倍的 Token 支出。它证明了群体层面的广度搜索可以有效替代单次推理的深度消耗。 [link]
Search-G1: Grounded Search Agents via Representation-Based Intrinsic Rewards
Cheng Ruoxi, Ma Haoxuan, et al. · 2026/8/11
搜索增强代理常面临过度搜索或幻觉的困扰。Search-G1 引入了一种基于表示的内在奖励框架。它通过预测闭书知识是否充足来判断检索的必要性,并利用敏感度评估答案对证据的依赖程度。这种机制让强化学习在优化过程中能够平衡检索精度与搜索成本。实验表明,校准后的代理生成的回答更具地面性,轨迹更短且准确率不减。它是构建高效可靠搜索代理的关键进展。 [link]
ZhuLong: Execution-Grounded LLM Agent for EDA Scripting with Offline API Self-Exploration
Yang Liu, Shiwei Hou, et al. · 2026/8/11
芯片设计中的 EDA 脚本编写门槛极高且文档稀缺。ZhuLong 代理通过执行落地和离线 API 自动探索解决了这一难题。它不仅能进行代码检索和沙箱执行,还能通过反证实验推断未公开 API 的行为。在真实环境测试中,该系统将 Pass@1 成功率从基准的 23.6% 提升到了 78.5%。对于处理垂直领域长尾技术文档和非标准接口具有极高的工程参考价值。 [link]
An Agentic AI Framework Overcomes Fundamental Limitations of Large Language Models for Glaucoma Detection from Fundus Photography
Jalil Jalili, Hossein Taghizad, et al. · 2026/8/11
医疗 AI 绝不能容忍随机性和幻觉。这项研究为青光眼检测打造了一套多代理框架。系统先由大模型初步评估,再通过函数调用激活专门的深度学习工具进行图像质量分析和分割,最后由模型进行反思整合。相比单一模型,该流程将诊断准确率提升了 16 到 47 个百分点。即使背后的模型更换,其鲁棒性也依然稳定。它展示了如何通过工具编排让通用模型满足严苛的临床要求。 [link]
From Single Chatbots to Governed Agent Ecosystems: An Agentic AI Pattern Catalogue and Orchestration Framework for Mission-Critical Hospital Information Management Systems
Manideep Dhar, Ritwik Singh, et al. · 2026/8/11
医院信息系统正面临从聊天机器人向受控代理生态的跨越。本文提出了一套符合合规要求的代理编排框架。它针对分诊和记录等工作流建立了正式的风险分层模型,并支持在 Epic 和 Cerner 等主流平台部署。技术上结合了机密计算与策略代码化,确保符合 HIPAA 等法律。该框架为减少医疗行政负担和提高 AI 试点转化率提供了可执行的蓝图。 [link]
Full-bandwidth transformer
Xi Wang, Ziyang Cai, et al. · 2026/8/11
自回归模型在生成时往往会丢弃顶层隐藏状态。Full-bandwidth transformer 通过潜反馈机制拓宽了垂直反馈通道。每一轮生成的顶层状态都会与新词元融合并重新进入计算栈,赋予模型二次思考的深度预算。这种设计保留了标准 KV cache 和训练目标,却能以更短的推理轨迹实现更高的准确率。它让算力开销不再单纯随长度激增,为高效推理提供了全新的架构支撑。 [link]
BleepingComputer 新闻
Hackers breached a small Polish energy plant via private APN last year
Bill Toulas · 2026/8/11 7:07
去年黑客利用私有 APN 接入 OT 网络,入侵了波兰一家为约 50000 名居民供暖的热电厂。 [link]
US and South Korea warn of Gunra ransomware targeting govt agencies
Sergiu Gatlan · 2026/8/11 17:47
美国联邦机构与韩国警察厅向全球政府及关键基础设施组织发出警告,要求其加强系统防护以应对 Gunra 勒索软件攻击。 [link]
Cisco warns of high-severity ClamAV flaws with public exploits
Sergiu Gatlan · 2026/8/11 19:03
思科警告 Secure Endpoint Connector 存在两个高危漏洞。攻击者可以利用这些漏洞发起 DoS 攻击,导致 ClamAV 扫描进程崩溃。 [link]
CISA: Microsoft SharePoint flaw now exploited in ransomware attacks
Sergiu Gatlan · 2026/8/11 20:12
CISA 今日证实勒索软件团伙已开始利用一个 Microsoft SharePoint 高危远程代码执行漏洞。该漏洞自 7 月初以来一直处于被活跃利用状态。 [link]
Mozilla updates GPG signing key for Firefox releases after exposure
Sergiu Gatlan · 2026/8/11 21:20
Mozilla 今日宣布已更新用于签署 Firefox 和 Thunderbird 版本的 GPG 密钥。此前该密钥在 GitHub 上被意外泄露。 [link]
Vague Task, Total Access: When AI Delegation Becomes a Security Risk
Sponsored by Token Security · 2026/8/11 21:15
当 AI 代理获得企业系统和数据的广泛访问权限时,其行为可能会超出预定的任务范围。Token Security 解释了组织为何需要明确代理意图,并持续强化权限控制。 [link]
DDoS attacks over 1 Tbps surged fivefold in the second quarter
Bill Toulas · 2026/8/11 21:00
Cloudflare 表示其在今年第二季度成功缓解了 800 多次流量超过 1 Tbps 的网络层 DDoS 攻击。 [link]
Wesco confirms security incident after ExfilSquad claims data theft
Bill Toulas · 2026/8/11 23:59
全球供应链和分销巨头 Wesco 在给 BleepingComputer 的声明中确认,公司正在调查一起网络安全事件。 [link]
Windows 11 KB5121003 & KB5120240 cumulative updates released
Mayank Parmar · 2026/8/12 1:38
微软发布了适用于 Windows 11 25H2、24H2 和 23H2 版本的 KB5121003 与 KB5120240 累积更新。这些更新修复了安全漏洞和错误,并增加了新功能。 [link]
Delta probes Wi-Fi deauth attack on flight carrying DEF CON attendees
Ionut Ilascu · 2026/8/12 2:34
达美航空正在调查一个未经授权的 Wi-Fi 网络。该网络出现在一架从拉斯维加斯飞往亚特兰大的航班上,机上乘客包括参加 DEF CON 黑客大会的人员。 [link]
Windows 10 KB5120249 cumulative update released with fixes
Mayank Parmar · 2026/8/12 2:26
微软发布了适用于 Windows 10 22H2 和 21H2 版本的 KB5120249 扩展安全更新,旨在修复安全漏洞和软件错误。 [link]
Microsoft August 2026 Patch Tuesday fixes 400 flaws, 3 zero-days
Lawrence Abrams · 2026/8/12 2:08
适逢微软 2026 年 8 月补丁星期二。此次发布的更新修复了多达 400 个漏洞,其中包括一个已被活跃利用和两个已公开披露的零日漏洞。 [link]
Cisco warns of ASA and FTD VPN flaw exploited to crash devices
Lawrence Abrams · 2026/8/12 3:45
思科发出警告。Secure Firewall ASA 和 FTD 软件中的一个高危 DoS 漏洞正被黑客利用,攻击者可以通过该漏洞远程导致受影响的设备崩溃。 [link]
Sandworm hackers target IT pros with trojanized WireGuard VPN client
Bill Toulas · 2026/8/12 5:07
与俄罗斯威胁组织 Sandworm 相关的黑客从 5 月起就开始针对系统管理员和 IT 专业人员。他们通过虚假工作邀约分发带有木马的 WireGuard VPN 客户端。 [link]
DeadLock ransomware uses blockchain to resist infrastructure takedown
Bill Toulas · 2026/8/12 6:15
DeadLock 勒索软件行动正在使用去中心化基础设施。该设施依赖区块链服务来保护与受害者的通信以及数据泄露活动,从而对抗基础设施拆除。 [link]