网络安全论文
Jailbreak Foundry: From Papers to Runnable Attacks for Reproducible Benchmarking
Zhicheng Fang, Jingjie Zheng, et al. · 2026/3/2
大模型越狱技术更迭极快,传统测评基准容易过时。Jailbreak Foundry 建立了一套多智能体工作流,能将最新的攻击论文自动转化为可执行代码。它通过标准化组件 JBF-LIB 和 JBF-EVAL,实现了 30 种攻击在 10 个模型上的高保真复现。这套方案显著降低了安全测试的开发成本,为构建与攻击演进同步的动态基准提供了工业级支撑。 [link]
Learning to Generate Secure Code via Token-Level Rewards
Jiazheng Quan, Xiaodong Li, et al. · 2026/3/2
大模型辅助编程虽然高效,却常带入安全隐患。Vul2Safe 框架利用模型自我反思能力,从现实漏洞中构建高质量修复对,并生成多样化的隐式提示词。核心创新在于 SRCode 训练框架,它首次在强化学习中引入 token 级别奖励。这种细粒度的信号能引导模型在代码生成时精准识别并强化安全模式,在多项基准测试中显著降低了生成代码的漏洞率。 [link]
Anansi: Scalable Characterization of Message-Based Job Scams
Abisheka Pitumpe, Amir Rahmati · 2026/3/2
虚假招聘类电信诈骗正呈指数级增长,传统监测手段难以规模化对抗。Anansi 打造了首个闭环自动化测量管线,结合 LLM 和自动化浏览器代理,与 1900 多名诈骗者进行深度博弈。该系统不仅提取了诈骗者的行为特征,还揭秘了其资金流向和基础设施复用规律。这项研究展示了利用自动化技术渗透诈骗生态的巨大潜力,为治理网络欺诈提供了全新的工程方法。 [link]
Lifecycle-Integrated Security for AI-Cloud Convergence in Cyber-Physical Infrastructure
S M Zia Ur Rashid, Deepa Gurung, et al. · 2026/3/2
当 AI 推理与云基础设施深度融合,安全边界变得模糊。该研究提出了覆盖全生命周期的威胁分类模型,并构建了统一参考架构。它集成数据工厂安全、模型供应链加固及运行态治理,成功在 Grid-Guard 案例中验证了有效性。无需人工干预即可化解协同攻击,同时满足多项工业监管标准,直接对齐 NIST AI RMF 等权威框架,极具落地价值。 [link]
Enhancing Continual Learning for Software Vulnerability Prediction: Addressing Catastrophic Forgetting via Hybrid-Confidence-Aware Selective Replay for Temporal LLM Fine-Tuning
Xuhui Dou, Hayretdin Bahsi, et al. · 2026/3/2
在演进的代码库中,静态识别模型很快会失效。研究者针对 LoRA 微调的 phi-2 模型,探索了时间分布偏移下的持续学习策略。提出的 Hybrid-CASR 方案通过置信度感知的重放机制,平衡了漏洞样本比例。该方案在保持高 F1 分数的同时,训练时间缩短了 17% 。它是软件安全预测领域的实战利器,证明了选择性重放在应对大模型灾难性遗忘方面的优越性。 [link]
I've Seen This IP: A Practical Intersection Attack Against Tor Introduction Circuits and Hidden Services
Nicolas Constantinides · 2026/3/2
Tor 匿名服务的引入电路存在结构性弱点。研究者揭示了一种实用的交集攻击,仅需观测特定阶段的单个中继即可追踪路径。通过在毫秒级的时间窗内对目标 IP 进行多轮交叉比对,攻击者能识别通往洋葱服务的所有跳点。实验在真实网络中验证了收敛速度,并探讨了全球中继地理集中化带来的风险。这为加固匿名通信协议的路由确定性提供了重要实证。 [link]
PDF: PUF-based DNN Fingerprinting for Knowledge Distillation Traceability
Ning Lyu, Yuntao Liu, et al. · 2026/3/2
知识蒸馏虽然能压缩模型,也让模型窃取变得容易。PDF 框架将设备唯一的物理不可克隆函数 PUF 特征,在蒸馏阶段叠加到教师模型的输出概率中。这种指纹技术无需改动架构即可实现追溯,且对推理精度的影响微乎其微。利用神经网络双重解码,它能对抗逆向工程攻击。该方案为轻量化模型保护开辟了新思路,是模型版权存证的可靠技术方案。 [link]
PLA for Drone RID Frames via Motion Estimation and Consistency Verification
Jie Li, Jing Li, et al. · 2026/3/2
无人机远程识别 RID 缺乏加密保护,面临虚假身份威胁。该研究提出一种物理层认证算法,通过感知 AoA 、多普勒漂移等无线参数进行一致性校验。它利用 CA-EKF 滤波与 LSTM 运动估计器融合,实时判定无人机上报的位置与其物理轨迹是否吻合。这种多源融合策略在复杂飞行动作下表现稳健,有效填补了低空监管的技术空白,显著提升了非法机侦测的可靠性。 [link]
SAILOR: A Scalable and Energy-Efficient Ultra-Lightweight RISC-V for IoT Security
Christian Ewert, Tim Hardow, et al. · 2026/3/2
物联网设备在安全与能效之间取舍艰难。SAILOR 系列 RISC-V 内核通过模块化设计,支持 1 到 32 位的序列化执行路径。它在极小的面积成本下集成了密码学扩展,将能效提升了 13 倍,面积减少了 59% 。这种灵活的硬件设计允许开发者根据场景定制安全能力。它证明了在资源极度受限的设备上,也能高效实现高强度加固,打破了性能与安全的博弈困局。 [link]
Privacy-Preserving Local Energy Trading Considering Network Fees
Eman Alqahtani, Mustafa A. Mustafa · 2026/3/2
本地能源市场虽然能平衡能源,却容易泄露用电隐私。研究者提出一种基于安全多方计算 MPC 的隐私保护协议,在保护敏感数据的同时引入网络费机制。该方案采用双重拍卖模式,并通过 Schnorr 身份认证确保参与者合法。实验表明协议可支持 5000 名参与者在 4.17 分钟内完成清算。这为解决能源互联网中物理约束与数据安全之间的矛盾提供了工程可行方案。 [link]
AI 论文
ODAR: Principled Adaptive Routing for LLM Reasoning via Active Inference
Siyuan Ma, Bo Gao, et al. · 2026/3/2
LLM 推理正从参数规模转向推理时计算。ODAR 框架通过主动推理评估问题难度。它将查询动态路由至 Fast Agent 或 Slow Agent。该方法在 MATH 等基准上取得 98.2 % 的高精度。相比盲目增加采样次数,这种自适应资源分配显著提升效率。它在完全开源的 Llama 4 和 DeepSeek 栈上表现优异。这种基于自由能的决策机制为大模型高效推理提供了工程范式。 [link]
DARE-bench: Evaluating Modeling and Instruction Fidelity of LLMs in Data Science
Fan Shu, Yite Wang, et al. · 2026/3/2
现有数据科学基准缺乏标准化的过程评估。DARE - bench 引入 6300 个源自 Kaggle 的任务。所有任务均具备可验证的客观事实。即使是顶尖模型在应对多步数据科学建模时也显现出吃力感。研究表明利用该数据集进行微调可大幅提升性能。Qwen 3 模型的准确率在强化学习加持下提升超过 8 倍。这为开发具备实战能力的数据科学智能体提供了关键基石。 [link]
IDP Accelerator: Agentic Document Intelligence from Extraction to Compliance Validation
Md Mofijul Islam, Md Sirajus Salekin, et al. · 2026/3/2
企业级文档处理常受困于多文档包和复杂合规要求。IDP Accelerator 框架实现了端到端的智能文档处理。它包含多模态分类器 DocSplit 和基于代码执行的分析模块。该方案支持 MCP 协议并具备安全的沙箱环境。在医疗行业的生产部署中,该系统实现了 98 % 的分类准确率。处理延迟缩减 80 % 且运营成本大幅下降。这是 agentic AI 在工业界落地的典范。 [link]
Truncated Step-Level Sampling with Process Rewards for Retrieval-Augmented Reasoning
Chris Samarinas, Haw-Shiuan Chang, et al. · 2026/3/2
强化学习训练大模型使用搜索引擎面临奖励分配难题。SLATE 框架通过截断式步骤采样和密集奖励解决此问题。它生成的轨迹在共享前缀后仅在下一步产生差异。这种设计在理论上显著降低了优势估计的方差。配合 LLM as judge 提供的深度监督,模型在多跳问答任务上表现强劲。这种方法让推理过程中的搜索决策变得可归因。它助力小型模型在复杂任务中实现性能跃迁。 [link]
SleepLM: Natural-Language Intelligence for Human Sleep
Zongzhe Xu, Zitao Shuai, et al. · 2026/3/2
现有的睡眠分析系统多局限于封闭的标签分类。SleepLM 家族模型首次将自然语言与多模态多导睡眠监测结合。研究团队构建了包含 10 万 小时数据的首个大规模睡眠文本数据集。该模型除了生成睡眠报告,还具备语言引导的事件定位能力。它在零样本学习和跨模态检索任务中刷新了纪录。这种将生理信号与语言智能对齐的尝试,为精准医疗和睡眠健康干预开辟了全新路径。 [link]
PseudoAct: Leveraging Pseudocode Synthesis for Flexible Planning and Action Control in Large Language Model Agents
Yihan (Logon), Wen, et al. · 2026/3/2
传统的 ReAct 模式在处理长逻辑任务时容易产生冗余或陷入死循环。PseudoAct 引入伪代码合成技术。它让智能体将复杂任务分解为具备循环和分支逻辑的结构化计划。这种设计使决策逻辑具备了时序连贯性。在 FEVER 任务上,该方法将成功率提升了 20.93 %。它有效减少了 token 消耗并提高了推理稳定性。这标志着智能体从反应式决策向主动规划的进阶。 [link]
ProductResearch: Training E-Commerce Deep Research Agents via Multi-Agent Synthetic Trajectory Distillation
Jiangyuan Wang, Kejun Xiao, et al. · 2026/3/2
深度搜索范式在向电商领域迁移时存在严重的领域鸿沟。ProductResearch 通过多智能体协作生成高质量的工具调用轨迹。User Agent 负责推断细粒度的购物意图。Supervisor Agent 统筹生成详尽的研究报告。通过反思内化过程,多智能体互动被精炼为单角色训练样本。这种方法显著提升了 MoE 模型在复杂购物咨询中的深度。它是利用合成数据提升电商智能体专业性的成功实践。 [link]
Toward General Semantic Chunking: A Discriminative Framework for Ultra-Long Documents
Kaifeng Wu, Junyan Wu, et al. · 2026/3/2
超长文档的课题分割是信息检索的痛点。传统方法受限于固定窗口,大模型推理则成本昂贵。该研究基于 Qwen 3 0.6 B 构建判别式分割模型。它通过跨窗口上下文融合层和重叠滑动窗口策略,支持单次 13 k token 输入。该模型在 WIKI 727 K 上的 F1 分数优于 Jina 系列。其推理速度实现两个数量级的飞跃。这种高效的语义分块技术为超长文档处理提供了实用化方案。 [link]
CLFEC: A New Task for Unified Linguistic and Factual Error Correction in paragraph-level Chinese Professional Writing
Jian Kai, Zidong Zhang, et al. · 2026/3/2
专业的中文写作中语法错误与事实性错误常交织出现。CLFEC 任务专注于段落级的统一纠错。数据集涵盖时政、金融、法律及医学等多个专业领域。研究对比了从 Prompt 到 RAG 再到 Agent 的多种纠错范式。实验发现将语言与事实错误放在同一上下文中处理效果最佳。该研究为工业界构建全自动校对系统提供了详实的实证指南。它解决了大模型在专业写作中过度纠错的难题。 [link]
CiteAudit: You Cited It, But Did You Read It? A Benchmark for Verifying Scientific References in the LLM Era
Zhengqing Yuan, Kaiwen Shi, et al. · 2026/3/2
大模型生成的科学引文常伴随幻觉风险。虚假参考文献甚至已渗透进顶级学术会议论文。CiteAudit 是首个针对科学写作中引文幻觉的基准和检测框架。它采用多智能体流水线完成声明提取和证据检索。该系统通过校准判断来评估引用源是否真实支持论点。实验显示该框架在准确性和可解释性上均优于前人方法。这为维护 AI 时代学术诚信提供了重要的自动化工具。 [link]
BleepingComputer 新闻
Anthropic confirms Claude is down in a worldwide outage
Mayank Parmar · 2026/3/2 20:23
Claude 目前似乎正经历重大故障。所有平台均报告错误率上升。 [link]
How Deepfakes and Injection Attacks Are Breaking Identity Verification
Sponsored by Incode · 2026/3/2 23:01
Deepfakes 和注入攻击正针对身份验证环节。攻击涵盖从入职到账户恢复的全过程。Incode 解释了企业必须验证完整会话的原因。这包括媒体、设备完整性和行为。目的是实时阻止合成与注入攻击。 [link]
UK warns of Iranian cyberattack risks amid Middle-East conflict
Sergiu Gatlan · 2026/3/2 23:54
英国国家网络安全中心 NCSC 提醒英国机构注意。受中东冲突影响,伊朗网络攻击的风险正在升高。 [link]
Florida woman imprisoned for massive Microsoft license fraud scheme
Sergiu Gatlan · 2026/3/3 1:30
一名佛罗里达州女性被判处 22 个月监禁。她运行了一个持续多年的大型计划。该计划非法买卖数千张被盗的 Microsoft 真品证书 COA 标签。 [link]
Alabama man pleads guilty to hacking, extorting hundreds of women
Sergiu Gatlan · 2026/3/3 2:54
一名 22 岁的亚拉巴马州男子承认了勒索、网络骚扰和计算机欺诈罪名。他劫持了数百名年轻女性的社交媒体账号。受害者中包含未成年人。 [link]
Fake Google Security site uses PWA app to steal credentials, MFA codes
Ionut Ilascu · 2026/3/3 4:23
一项钓鱼活动利用伪造的 Google 账号安全页面。该页面分发一个基于 Web 的应用。此应用能窃取一次性密码并收集加密货币钱包地址。它还能通过受害者的浏览器代理攻击者的流量。 [link]