网络安全论文
Retrieval Pivot Attacks in Hybrid RAG: Measuring and Mitigating Amplified Leakage from Vector Seeds to Graph Expansion
Scott Thornton · 2026/2/10
RAG 系统正在从向量检索演进为混合图检索,但也引入了新的安全缺口。本文揭开 Retrieval Pivot Attacks 这种新型攻击。攻击者利用知识图谱中的实体关联,从不敏感的种子数据横向跳转到受保护的租户数据。实验表明混合 RAG 的风险评分高达 0.95。研究者提出在图扩展边界强制执行授权检查。这一改进能消除大部分泄露,为企业级多租户安全提供了坚实的工程参考。 [link]
SPECA: Specification-to-Checklist Agentic Auditing for Multi-Implementation Systems -- A Case Study on Ethereum Clients
Masato Kamba, Akiyoshi Sannai · 2026/2/10
以太坊客户端的多实现机制旨在提高网络容错,但当所有客户端都误解了模糊规范时,差分测试也会失效。SPECA 框架将自然语言规范转化为审计清单,并实现了跨实现的审计重用。在以太坊 Fusaka 升级的真实审计中,该智能体发现了 17 项有效漏洞。其表现超越了 49 名人类参赛者。它平均仅需 40 分钟就能完成专家级的验证与提交。这证明了智能体在复杂分布式系统审计中具备极高的工业价值。 [link]
PICASSO: Scaling CHERI Use-After-Free Protection to Millions of Allocations using Colored Capabilities
Merve G\"ulmez, Ruben Sturm, et al. · 2026/2/11
CHERI 架构虽然提供了强大的空间内存安全性,但堆内存的时间安全始终是性能瓶颈。PICASSO 方案通过引入彩色能力标签,为 CHERI 增加了硬件级的时间安全支持。它在 FPGA 软核上成功实现,并集成了 CheriBSD 和编译器工具链。相比以往频繁扫描内存的撤销机制,该方案将性能损耗降至 5% 左右。它为百万量级的内存分配提供了高效保护,让 Use-After-Free 漏洞在现代高性能硬件中无处遁形。 [link]
QRS: A Rule-Synthesizing Neuro-Symbolic Triad for Autonomous Vulnerability Discovery
George Tsigkourakos, Constantinos Patsakis · 2026/2/11
现有的静态扫描工具高度依赖专家预设规则,容易遗漏未知模式。QRS 框架颠覆了传统范式。它利用神经符号技术自主合成 CodeQL 查询脚本,并配合智能体进行结果验证和漏洞利用模拟。在对 PyPI 热门软件包的实测中,它成功发现了 39 个中高危漏洞。其中 5 个漏洞已获得新分配的 CVE 编号。该工具极大降低了漏洞挖掘的门槛,展示了 LLM 驱动的自动发现技术在真实软件供应链安全中的巨大潜力。 [link]
MUZZLE: Adaptive Agentic Red-Teaming of Web Agents Against Indirect Prompt Injection Attacks
Georgios Syros, Evan Rose, et al. · 2026/2/11
Web 智能体在自动化操作网页时,极易受到间接提示注入攻击。MUZZLE 框架模拟了极具威胁的自适应攻击场景。它能根据智能体的执行轨迹,动态识别高价值攻击面并生成恶意指令。研究人员在多个真实应用中发现了 37 种新型攻击,涵盖了隐私泄露和业务中断等多种危害。这种红队自动化测试方法无需人工干预。它能帮助开发者在智能体上线前识别复杂的注入漏洞,是保障生成式 AI 应用安全的关键防御工具。 [link]
CyberExplorer: Benchmarking LLM Offensive Security Capabilities in a Real-World Attacking Simulation Environment
Nanda Rani, Kimberly Milner, et al. · 2026/2/10
CyberExplorer 首次将 LLM 智能体置于拥有 40 个真实漏洞服务的虚拟机中。智能体需要像黑客一样自主进行侦察、目标选择和渗透测试。这种开放环境的模拟记录了模型获取 flag 的过程,并分析了多智能体协作与决策修正模式。它为评估 AI 在网络空间作战中的真实水平提供了基准。它是研究自主防御技术的重要实验场。这套基准测试集填补了攻击智能体在真实环境下评估能力的空白。 [link]
Timing and Memory Telemetry on GPUs for AI Governance
Saleh K. Monfared, Fatemeh Ganji, et al. · 2026/2/11
在 AI 治理中,如何确保计算资源不被滥用是一个工程难题。当宿主机和设备都不可信时,传统的监控手段往往会失效。本文提出一套基于 GPU 架构特性的遥测框架。它利用验证延迟函数和 GEMM 张量核测量等手段,生成反映计算强度的统计指标。即便没有厂商提供的可信计数器,防御方也能感知 GPU 的真实负载和内存占用情况。这套机制为大规模算力设施的合规监管提供了新思路。它展示了纯计算层面的信号也能实现可信治理。 [link]
Atlas: Enabling Cross-Vendor Authentication for IoT
Sanket Goutam, Omar Chowdhury, et al. · 2026/2/11
IoT 设备的跨厂商认证一直面临碎片化和云端依赖问题。Atlas 框架巧妙地将 Web PKI 扩展到物联网领域。它利用 ACME 客户端和厂商控制的 DNS 命名空间,为每个设备签发全球可验证的 X.509 证书。设备之间通过 mTLS 建立直接通信隧道,无需硬件改动即可实现去中心化的身份验证。在 ESP32 平台上的测试显示,其性能开销极小。这为智能家居和智能城市中的设备互联互通扫清了安全与兼容性障碍。 [link]
A Behavioral Fingerprint for Large Language Models: Provenance Tracking via Refusal Vectors
Zhenyu Xu, Victor S. Sheng · 2026/2/11
保护 LLM 的知识产权已成为行业焦点。本文发现模型的安全对齐过程会留下独特的行为指纹。通过提取模型在处理有害提示时的拒绝向量,研究者构建了一套稳健的溯源追踪系统。这种指纹对微调、合并和量化等常见修改具有极强的抵抗力。实验证明它能以 100% 的准确率识别出基础模型家族。结合零知识证明技术,该方案可以在不泄露模型参数的前提下进行所有权验证。它为防范非法模型衍生提供了新武器。 [link]
One RNG to Rule Them All: How Randomness Becomes an Attack Vector in Machine Learning
Kotekar Annapoorna Prabhu, Andrew Gan, et al. · 2026/2/11
随机数生成器是机器学习流程中被长期忽视的安全死角。不同框架和硬件底座在伪随机数实现上的差异,正成为一种隐蔽的攻击向量。RNGGuard 工具通过静态分析识别代码中的不安全随机函数,并在运行时动态拦截和替换为安全实现。该方案能防止数据采样过程被操纵,也能抵御针对权重初始化和优化器的恶意攻击。其低成本、即插即用的特性,使其成为工业界加固机器学习流水线安全的实用利器。它填补了随机源安全校验的空白。 [link]
AI 论文
DLLM Agent: See Farther, Run Faster
Huiling Zhen, Weizhe Lin, et al. · 2026/2/10
扩散语言模型在智能体领域大放异彩。通过将 Diffusion 引入推理流程,研究者实现了比自回归架构快 30% 以上的端到端效率,极端场景提速甚至超过 8 倍。该方法减少了工具调用次数,并提升了全局规划的准确率。这种效率与性能的双重突破,为部署高性能低延迟的自动化助手铺平了道路,展现出极强的工程落地潜力。 [link]
Free(): Learning to Forget in Malloc-Only Reasoning Models
Yilun Zheng, Dongyang Ma, et al. · 2026/2/10
推理模型过度思考会导致性能下降。该研究指出当前 LLM 存在 malloc-only 的架构缺陷,导致冗余步骤堆积。通过引入 Free-Module 插件,模型学会了动态清理无用上下文。在长程推理任务中,它成功解决了 Qwen3 等大型模型的性能崩塌问题。这种让 AI 学会忘记的机制,提升了推理质量,也让推理计算变得更加可持续且高效。 [link]
Improving Data and Reward Design for Scientific Reasoning in Large Language Models
Zijie Chen, Zhenghao Lin, et al. · 2026/2/10
解决开放式科学问题一直是 LLM 的软肋。研究团队构建了包含 100 万个 STEM 问题的 Dr. SCI 数据集,并设计了一套全新的强化学习流水线。它利用细粒度准则引导模型进行探索性推理,在 GPQA 等榜单上超越了 GPT-4o 等顶尖闭源模型。这套系统化的数据工程方案,为提升机器在硬核领域的科研推理能力提供了坚实支撑。 [link]
P1-VL: Bridging Visual Perception and Scientific Reasoning in Physics Olympiads
Yun Luo, Futing Wang, et al. · 2026/2/11
物理竞赛是检验机器理解物理世界客观规律的最佳考场。P1-VL 家族模型通过强化学习与智能体增强技术,首次让开源视觉语言模型在国际物理奥林匹克中斩获 12 枚金牌。它能精准识别电路图中的隐含约束,将抽象逻辑与现实感知深度绑定。这标志着 AI 在科学推理上的跨越,也为实现通用的物理智能迈出了关键一步。 [link]
Bridging Efficiency and Transparency: Explainable CoT Compression in Multimodal Large Reasoning Models
Yizhi Wang, Linan Yue, et al. · 2026/2/11
长链条推理虽然强大,但巨大的 Token 消耗让成本居高不下。XMCC 提出了一种可解释的多模态推理压缩方法。它将压缩过程建模为强化学习优化下的顺序决策过程,在缩短推理轨迹的同时,还能生成自然语言解释。该方案保证了视觉与文本对齐的完整性,显著提升了推理效率。这种兼顾性能与透明度的创新,在实际业务部署中极具吸引力。 [link]
SpotAgent: Grounding Visual Geo-localization in Large Vision-Language Models through Agentic Reasoning
Furong Jia, Ling Dai, et al. · 2026/2/11
视觉定位任务在特征稀疏的现实场景中极易受挫。SpotAgent 将地理定位转化为一种智能体推理过程。它不再单纯依赖模型的参数化知识,通过外部工具进行多轮验证。这种协同推理机制在标准榜单上刷新了记录,并有效降低了地理位置幻觉。这种通过工具辅助实现可验证预测的设计思路,为地理信息系统等领域提供了可靠的技术方案。 [link]
CoMMa: Contribution-Aware Medical Multi-Agents From A Game-Theoretic Perspective
Yichen Wu, Yujin Oh, et al. · 2026/2/11
在肿瘤多学科会诊中,决策的稳定性至关重要。CoMMa 采用博弈论目标优化去中心化的多智能体协作流程。它摒弃了传统的叙事推理,转而通过确定性的嵌入投影来量化每个专家的贡献。在真实医疗数据集上的表现证明,这种方法比传统架构更精准且稳定。这种基于数学底座的决策路径,为复杂医疗场景下的 AI 协作提供了更具可解释性的参考标准。 [link]
AgentSkiller: Scaling Generalist Agent Intelligence through Semantically Integrated Cross-Domain Data Synthesis
Zexu Sun, Bokai Ji, et al. · 2026/2/11
缺乏高质量长程交互数据正限制着通用智能体的进化。AgentSkiller 通过语义关联的跨域数据合成技术,全自动生成了上万条可靠的交互样本。该框架利用实体图谱和模拟器,模拟出逻辑闭环的工具调用场景。实验显示,在此数据上训练的模型在函数调用能力上提升显著。这种低成本、可扩展的数据生产方式,是推动智能体能力触达工业级水平的加速器。 [link]
Decoupled Reasoning with Implicit Fact Tokens (DRIFT): A Dual-Model Framework for Efficient Long-Context Inference
Wenxuan Xie, Yujia Wang, et al. · 2026/2/11
事实信息与推理模式的交织,常导致长文本推理陷入泥潭。DRIFT 框架创新地将知识提取与推理逻辑解耦。它利用轻量化模型将海量文档块压缩为隐式事实 Token,投射到推理模型的向量空间中。这种做法规避了检索器噪声,也突破了原生上下文窗口的限制。测试表明,它在长程任务中性能卓越,为实现海量知识的高效推理提供了崭新范式。 [link]
Anagent For Enhancing Scientific Table & Figure Analysis
Xuehang Guo, Zhiyong Lu, et al. · 2026/2/11
科研论文中的图表包含极高密度的信息。Anagent 框架通过规划、专家、求解和评估四个专业智能体的协作,攻克了科学图表分析中的多模态理解难题。研究团队同步发布了包含 6 万多个实例的 AnaBench 榜单。该系统在无需微调的情况下即可提升 13% 以上的准确率。这套能够整合多源证据的分析系统,极大缩短了科研人员解读实验数据的时间。 [link]
BleepingComputer 新闻
New Linux botnet SSHStalker uses old-school IRC for C2 comms
Bill Toulas · 2026/2/11 7:09
一个名为 SSHStalker 的新 Linux 僵尸网络正在利用 IRC 协议进行 C2 操作。 [link]
Microsoft releases Windows 11 26H1 for select and upcoming CPUs
Mayank Parmar · 2026/2/11 10:06
微软发布了 Windows 11 26H1。该版本不适用于现有的 PC,它将预装在搭载 Snapdragon X2 处理器或其他 ARM 芯片的设备上。 [link]
Proactive strategies for cyber resilience with Wazuh
Sponsored by Wazuh · 2026/2/12 1:40
网络韧性意味着预测威胁、及时检测并在事故发生后快速恢复。Wazuh 展示了其开源 SIEM 和 XDR 如何通过统一可见性、检测与自动化响应来加强主动防御。 [link]
LummaStealer infections surge after CastleLoader malware campaigns
Bill Toulas · 2026/2/12 1:02
LummaStealer 感染量近期激增。攻击者利用 ClickFix 技术开展社会工程学活动,以此分发 CastleLoader 恶意软件。 [link]
Crazy ransomware gang abuses employee monitoring tool in attacks
Lawrence Abrams · 2026/2/12 3:29
Crazy 勒索软件组织成员正在滥用合法的员工监控软件和 SimpleHelp 远程支持工具。他们利用这些工具在企业网络中维持持久化、规避检测并准备部署勒索软件。 [link]
Police arrest seller of JokerOTP MFA passcode capturing tool
Bill Toulas · 2026/2/12 3:14
荷兰警方逮捕了一名来自多德雷赫特的 21 岁男子。他涉嫌销售 JokerOTP 自动化钓鱼工具,该工具可以拦截 OTP 验证码来劫持账户。 [link]
Microsoft Store Outlook add-in hijacked to steal 4,000 Microsoft accounts
Bill Toulas · 2026/2/12 5:53
Outlook 的 AgreeTo 插件遭到劫持并被改造为钓鱼工具包。该工具已经窃取了超过 4000 个微软账户凭据。 [link]