网络安全论文
Thinking More, Harnessing Better: State Machine Guided Harness Automatic Generation with Project Digestion and Workflow Decomposition
Xing Zhang, Zikang Huang, et al. · 2026/7/9
编写高质量 Fuzz 测试脚本极其耗时。SynapseFlow 利用状态机指导 LLM 自动生成测试 Harness。它通过数据流分析聚合函数,采用分阶段的回滚算法确保脚本正确性。在 25 个开源项目中,它比现有工具提升了 3 倍的分支覆盖率。该工具成功发现了 7 个真实漏洞并获得了 5 个 CVE 编号。它让模糊测试的自动化从理论走向了大规模工业实践。 [link]
When Agents Remember Too Much: Memory Poisoning Attacks on Large Language Model Agents
George Torres, Sharad Shrestha, et al. · 2026/7/9
个人 AI 助手正成为黑客的新目标。GhostWriter 揭示了针对 LLM Agent 长期存储系统的内存中毒攻击。攻击者通过注入隐藏的恶意载荷,在 Agent 检索记忆时激活错误指令。实验显示,这种攻击在主流 Agent 框架中达到了 98% 的注入成功率。为了抵御威胁,研究者提出了 AM-Sentry 防御机制,通过内存保存策略和检索筛选大幅降低了风险。 [link]
Beware of Agentic Botnets: Scalable Untargeted Promptware Attacks via Universal and Transferable Adversarial HalluSquatting
Aya Spira, Stav Cohen, et al. · 2026/7/9
LLM 的幻觉居然能被用来构建僵尸网络。HalluSquatting 攻击利用了模型对资源标识符的预测性幻觉。攻击者预先注册这些不存在的包名或技能名,诱导 Agent 在自动执行任务时下载恶意代码。这种攻击具有极强的可迁移性。研究者在多个生产环境应用中实现了远程代码执行。这警示开发者必须重新评估 AI 代理在开放互联网环境下的执行权限。 [link]
Deanonymizing Monero Transactions in Tor Network
Ruisheng Shi, Shihan Zhang, et al. · 2026/7/9
门罗币一直以强匿名性著称。ProxyMark 框架证明了门罗币与 Tor 网络集成时存在严重缺陷。攻击者可以通过占据特定节点的出口连接,精准捕获该节点发出的原始交易。实验表明,这种方法能有效识别交易源 IP 并实现地理位置定位。该研究直接击碎了门罗币在 Tor 环境下的隐私神话,迫使隐私货币社区必须修复底层的连接协议漏洞。 [link]
Auditable Machine Unlearning for Privacy-Compliant Ransomware Detection Using Multi-Shard SISA and Deep Reinforcement Learning
Jannatul Ferdous, Rafiqul Islam, et al. · 2026/7/9
勒索软件检测模型在 GDPR 时代面临新难题。如果用户要求删除训练数据,重新训练整个模型成本巨大。该研究结合深度强化学习与 SISA 分片重训技术。它实现了可审计的样本删除,重训时间从数百秒缩短至 30 秒以内。该框架在 Windows 11 行为数据集上保持了 0.99 以上的检测精度。它证明了安全防御与数据隐私合规可以在工程实践中完美共存。 [link]
LibFHE: A Numba-Based CUDA-Python Library for Non-RNS CKKS-BGV Fully Homomorphic Encryption on GPUs
John Chiang · 2026/7/8
全同态加密 FHE 的计算开销一直是其商用瓶颈。LibFHE 框架基于 Numba 和 CUDA-Python 构建,在 GPU 上实现了高性能的非 RNS 变体加密。它通过 Python 绑定提供了极高的可编程性,同时具备接近裸机 C++ 性能的执行效率。该库打破了学术代码难以维护的僵局,让开发者能像写普通 Python 代码一样调用复杂的同态运算。它是推动隐私计算迈向工程落地的有力工具。 [link]
Mitigating Taint-Style Vulnerabilities in MCP Servers via Security-Aware Tool Descriptions
Yang Shi, Jiaheng Fu, et al. · 2026/7/9
MCP 协议让 LLM 能够轻松调用外部工具。SPELLSMITH 分析了 MCP 服务端面临的污染类漏洞风险。由于社区修复代码漏洞的速度较慢,该工具提出了一种基于文本增强的主动防御策略。它在工具描述中嵌入行为规范,利用 LLM 的自我反思能力识别恶意输入参数。实验证明这种方案无需修改业务代码,就能有效阻断通用的越权利用。它是 Agent 生态防御的一条新路径。 [link]
When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems
Haowen Xu, Xue Tan, et al. · 2026/7/9
多智能体系统 MAS 的协作过程极易受到隐蔽攻击。AcMAS 放弃了传统的图模型分析,转而监控 Agent 局部的激活空间状态。它能精准识别异步执行过程中的恶意异常,并引导被攻陷的智能体恢复正常功能。相比于暴力隔离节点,该方案极大地保留了系统的业务连续性。在面对隐蔽攻击时,它的检测 F1 分数比基准方法提升了 0.55 以上。这为大规模 AI 协作系统的实时监控提供了工程参考。 [link]
PRoVeFL: Private Robust and Verifiable Aggregation in Federated Learning
Harsh Kasyap, Anil Kumar Pradhan, et al. · 2026/7/9
联邦学习中的参数泄露和恶意投毒威胁依然严峻。PRoVeFL 框架利用多密钥全同态加密实现了隐私且可验证的聚合。它巧妙地将密文操作卸载到明文域处理,在保证严格隐私的前提下大幅提升了统计聚合效率。其运行速度比 Prio 等主流方案快 10 到 100 倍。该系统支持多种抗投毒算法,为大规模分布式机器学习提供了一个高性能且鲁棒的底层架构。 [link]
ORAN-DEFEND: Subspace Detection and Sanitization of Backdoor DRL xApps in Open RAN
Md Raihan Uddin, Fatemeh Lotfi, et al. · 2026/7/9
开放无线接入网 O-RAN 越来越依赖 DRL 技术。ORAN-DEFEND 针对第三方供应商提供的后门插件设计了防护方案。它利用 SVD 分解将监控指标投影到安全子空间,在不重新训练模型的前提下清洗掉异常触发信号。在 Colosseum 数据集上的测试表明,该方案对多种主流攻击的防御成功率超过 99.5%。它为电信级基础设施引入第三方 AI 模块提供了关键的安全评估基准。 [link]
AI 论文
ArtisanCAD: An Industrial-Level CAD Agent with Expert-Grounded Knowledge Distillation
Yunhan Xu, Qifeng Wu, et al. · 2026/7/8
工业组件设计依赖长路径建模和精确的 B-Rep 执行。ArtisanCAD 引入 CAD-IR 这种可执行的中间表示,将专家的操作流程蒸馏为可复用的参数化技能。它通过 CATIA 后端实现自动化执行,配合多视角视觉反馈进行迭代优化。实验表明该系统在处理模糊的文字设计意图时表现出色,显著降低了 Chamfer Distance 指标。这套方案为工业级 CAD 设计向智能化转型提供了落地的技术支撑。 [link]
The Harness Effect: How Orchestration Design Sets the Token Economics of Enterprise Agentic AI
Muayad Sayed Ali, Aliaksandra Novik, et al. · 2026/7/9
在企业级智能体开发中,盲目堆砌 Token 往往导致成本激增。这项研究指出,编排层才是控制 Token 经济学的核心杠杆。通过更换 Writer Agent Harness,研究者在模型能力持平的情况下,将单任务成本降低了 41 %,速度提升了 44 %。它揭示了缓存策略、失败治理等六类机制对效率的乘数效应。对于追求降本增效的企业,优化编排层比更换底层模型具有更高的投入产出比。 [link]
Accurate, Interdisciplinary and Transparent Structure-property Understanding with Deep Native Structural Reasoning
Chen Tang, Yizhou Wang, et al. · 2026/7/9
解释蛋白质或晶体结构的属性需要深刻理解物理约束。SciReasoner 是一款多模态科学基础模型,它将坐标、拓扑和周期性连接离散化为统一的结构令牌。这让模型在推理过程中能像处理文字证据一样引用结构单元。它在 86 项科学基准测试中表现卓越,特别是在低同源性蛋白质的功能标注和逆合成预测方面。专家评估认为其推理轨迹的科学性极高,是科研自动化领域的重要进展。 [link]
AgentLens: Production-Assessed Trajectory Reviews for Coding Agent Evaluation
Andrey Podivilov, Vadim Lomshakov, et al. · 2026/7/9
评价代码智能体不应只看任务是否最终通过,过程轨迹同样重要。AgentLens 建立了一套针对生产环境的评测标准,重点评估智能体在执行任务过程中的指令遵循、工具调用和错误修复能力。它利用 LLM 生成的轨迹评论和侧边对比,为每次运行提供直观的解释,避开了单一的成功率数字。这让开发者能够精准诊断模型行为,并在产品管线中捕捉细微的退化风险,是智能体工程化的实用工具。 [link]
Large Behavior Model: A Promptable Digital Twin of the Retail Customer
Wachiravit Modecrua, Krittin Pachtrachai, et al. · 2026/7/9
传统的推荐系统往往缺乏决策解释能力,而大行为模型 LBM 直接从海量零售交易中学习顾客的决策过程。它采用个人与环境的统一建模框架,通过检索增强生成引入产品上下文,并结合强化学习进行证据驱动的校准。该模型在购买预测、优惠券兑换等任务中表现优异,展现了强大的零样本跨领域迁移能力。它为零售行业打造可模拟、可解释的顾客数字孪生提供了成熟范式。 [link]
Cost-Effective Agent Harnesses for Abstract Reasoning and Generalization on ARC-AGI-1
Kabir Moghe, Peter Chin · 2026/7/9
在预算严格限制下,如何在不进行微调的前提下提升大模型的抽象推理能力?研究者开发了 Explorer-Definer 流水线,将模式发现与程序合成明确解耦。其核心在于 Reflective Orchestrator 模块,它能在假设失败时自主探索新的变换逻辑。在 ARC-AGI-1 公开评测集上,该架构将基准成功率提升了 52 个百分点。这证明了通过巧妙的智能体编排,小规模开源模型也能在复杂逻辑任务中挑战巅峰性能。 [link]
From Atomic Actions to Standard Operating Procedures: Iterative Tool Optimization for Self-Evolving LLM Agents
Haipeng Ding, Yuexiang Xie, et al. · 2026/7/9
现有的智能体大多依赖孤立的文件读写等原子操作,导致重复劳动且易出错。EvoSOP 提出了自进化框架,允许智能体从执行轨迹中提取并合成高级的标准作业程序。这些 SOP 作为可调用的高阶工具,封装了多步骤逻辑,能显著减少交互轮数并提升成功率。研究展示了工具集从构建、合并到剪枝的完整生命周期管理。这为开发能够通过经验积累不断变强的自进化系统指明了方向。 [link]
Behavior Leverage Imbalance in Multi-Teacher On-Policy Distillation
Jiabin Shen, Guang Chen, et al. · 2026/7/9
智能体在工具调用时,容易出现过度调用的倾向。研究发现,这种行为漂移源于 Token 级别的杠杆失衡,即特定的结构化标签或函数名对全局生成模式具有不成比例的控制力。Soft Clamp 方法被提出用于动态压缩极端差异信号,在保留有效梯度的同时校准偏离行为。实验显示它有效减少了重复调用和无效循环。这为多老师在线策略蒸馏中的稳定性问题提供了精巧的工程解法。 [link]
LLMs Silently Correct African American English: Auditing and Mitigating Dialect Bias via Activation Steering
Huan Wu, Ali Emami, et al. · 2026/7/9
语言模型在理解方言时常伴随隐性偏见,表现为强制将非裔美国英语重写为标准英语。研究者引入了 cDGI 框架来量化这种偏见,并利用激活转向技术在不增加推理开销的情况下进行缓解。相比提示词工程,该方法在保持流畅度的同时,将偏见程度降低了 5 到 20 倍。团队还发布了迄今最大的高质量平行语料库 REAL-AAE 。这项工作对于构建兼具包容性的全球化 AI 应用至关重要。 [link]
Gradient-Based Speech-to-Text Alignment for Any ASR Model: From CTC to Speech LLMs
Albert Zeyer, Ralf Schl\"uter, et al. · 2026/7/9
确定音频中每个词的时间边界是语音处理的基础需求。传统的对齐方法往往受限于编码器网格的粗粒度。该研究提出一种通用的基于梯度的对齐方案,适用于任何可微的 ASR 模型。它通过计算 Token 对输入的梯度显著性,利用动态规划提取精确边界,无需模型修改或额外训练。这种方法在 Speech LLM 等新型模型上表现稳健,在需要高精度语音编辑的场景中具有极高的工程价值。 [link]
BleepingComputer 新闻
Microsoft patches RoguePlanet Defender zero-day vulnerability
Sergiu Gatlan · 2026/7/9 13:42
微软发布安全补丁以修复名为 RoguePlanet 的 Defender 零日漏洞。该漏洞在 2026 年 6 月的补丁星期二之后披露。 [link]
Police arrests 5,800 suspects in global anti-fraud crackdown
Sergiu Gatlan · 2026/7/9 17:47
执法机构在跨越 97 个国家的全球反诈骗行动中逮捕了 5811 名嫌疑人。本次行动扣押了 2.93 亿美元的非法资产。 [link]
AssuranceAmerica data breach exposes records of 6.9 million drivers
Sergiu Gatlan · 2026/7/9 15:47
美国保险公司 AssuranceAmerica 披露一起数据泄露事件。攻击者在今年早些时候入侵其系统,导致近 700 万名驾驶员的记录受影响。 [link]
Microsoft to retire the OWA Light client in Exchange Server
Sergiu Gatlan · 2026/7/9 19:00
微软宣布计划在未来的 Exchange Server 更新中停用 OWA Light。它是 Outlook Web App 邮件客户端的轻量级版本。 [link]
New Forg365 phishing platform uses AI to target Microsoft 365 accounts
Bill Toulas · 2026/7/9 22:39
名为 Forg365 的新型 PhaaS 平台专注于窃取 Microsoft 365 账户。该平台结合 AiTM 与设备代码方案,并利用 AI 辅助生成诱饵。 [link]
The Hidden Security Risks of Reduced Summer IT Coverage
Sponsored by Kaseya · 2026/7/9 22:02
IT 团队休假时安全运维并未停止,但人员配置通常会减少。Kaseya 解释了 AI 驱动的自动化如何帮助企业保持全年的安全运营,降低对人工流程的依赖。 [link]
New Helix vishing group emerges in SharePoint data theft attacks
Bill Toulas · 2026/7/10 1:08
名为 Helix 的新型数据勒索组织正在使用身份识别战术。他们通过 vishing、设备代码钓鱼和滥用 MFA 从 SharePoint 环境窃取数据。 [link]
Microsoft expects more Windows security updates from AI-discovered flaws
Lawrence Abrams · 2026/7/10 1:00
微软表示 Windows 用户将看到更多安全更新。公司正增加对 AI 的依赖,以发现其代码库中的漏洞。 [link]
Injective SDK on npm infected with cryptocurrency wallet stealer
Bill Toulas · 2026/7/10 4:10
黑客入侵 Injective Labs SDK 项目的 GitHub 仓库。他们在 npm 上发布恶意包,以窃取加密货币钱包私钥和助记词。 [link]