网络安全论文
CSF: Black-box Fingerprinting via Compositional Semantics for Text-to-Image Models
Junhoo Lee, Mijin Koo, et al. · 2026/4/21
商业 AI 图像模型版权保护面临挑战。现有水印技术通常需要提前部署。CSF 提出一种黑盒指纹识别方法。它利用组合语义提示词探测模型。这种方法不需要访问模型内部权重。研究覆盖了 FLUX 和 SD 系列模型。它能有效识别经过微调的衍生模型。这为创作者维权提供了强有力的技术支撑。它的防御不对称优势让攻击者难以预测指纹空间。 [link]
Safety, Security, and Cognitive Risks in State-Space Models: A Systematic Threat Analysis with Spectral, Stateful, and Capacity Attacks
Manoj Parmar · 2026/4/21
Mamba 等状态空间模型在处理长文本方面表现优异。然而其安全性尚未得到系统研究。本文首次揭示了 SSM 的安全威胁。攻击者可以通过频谱敏感性漏洞发起攻击。延迟触发的后门能躲避常规检测。实验表明基因分析和网络安全领域面临严重风险。研究提出了针对性的治理建议。这一研究填补了新型架构在安全评估领域的空白。 [link]
Refunded but Rewarded: The Double Dip Attack on Cashback Reward Engines
S M Zia Ur Rashid, Suman Rath · 2026/4/21
现金返还奖励系统通常不被视为安全核心。本文研究了奖励逻辑中的严重缺陷。通过对 6 家银行账户进行实测,研究者发现了双重提取漏洞。由于退款同步存在时间差,用户可以反复套现。部分系统甚至在订单取消后仍保留奖励。研究提出了基于状态机的防御算法。这直接关乎金融支付平台的资金安全。这是对业务逻辑漏洞的一次深刻审视。 [link]
Surgical Repair of Insecure Code Generation in LLMs
Gustavo Sandoval, Brendan Dolan-Gavitt, et al. · 2026/4/21
大模型在写代码时经常引入已知漏洞。这并非模型缺乏知识。研究发现安全表征在最后一层受到格式约束的干扰。模型能够识别漏洞却依然生成不安全代码。本文提出一种外科手术式的修复方法。通过针对性的转向向量,安全风险降低了 74 %。这种方案不需要昂贵的微调。它在多种架构模型上表现稳健。它是解释性研究转化为工程实践的范例。 [link]
Benign Fine-Tuning Breaks Safety Alignment in Audio LLMs
Jaechul Roh, Amir Houmansadr · 2026/4/21
音频大模型正快速普及。研究发现即便是良性数据的微调也会破坏安全对齐。音频输入特有的声学特征成为了新的攻击向量。哪怕文字内容无害,特定音色也能诱导模型拒绝防御。实验显示 Jailbreak 成功率最高可达 87.12 %。本文提出的语义过滤防御手段极为有效。它揭示了多模态安全中被忽视的一角。开发者必须重新审视音频编码器带来的风险。 [link]
SafeDream: Safety World Model for Proactive Early Jailbreak Detection
Bo Yan, Weikai Lin, et al. · 2026/4/21
多轮对话攻击正成为主流。攻击者通过潜移默化的引导使模型失守。SafeDream 引入了安全世界模型概念。它能根据隐藏状态预测对话的发展趋势。该框架通过 CUSUM 算法积累风险信号。它在有害内容生成之前就能发出警报。相比传统后置防御,它争取到了关键的检测提前量。其检测及时性在多个基准测试中排名第一。该方案无需修改模型权重。 [link]
CapSeal: Capability-Sealed Secret Mediation for Secure Agent Execution
Shutong Jin, Ruiyi Guo, et al. · 2026/4/21
智能体在执行任务时往往需要调用 API 密钥。将凭证直接暴露给模型进程极其危险。CapSeal 提出了一种能力封印架构。它将直接访问替换为受限的受托代理调用。该系统集成了防重放绑定与篡改审计。模型只能使用密钥发起特定动作,无法提取原始数据。这为智能体安全执行复杂任务筑起了防火墙。这种思路将秘密管理从密钥管理转向了动作能力授权。 [link]
Glitch in the Sky: Exploiting Voltage Fault Injection in UAV Flight Controllers
Yun-Ping Hsiao, Yanda Li, et al. · 2026/4/21
无人机自动驾驶逻辑的弹性至关重要。硬件层面的电压干扰会改变软件执行路径。研究者利用硬件干扰平台对控制器发起攻击。实验证明电压抖动可以禁用紧急避障等安全机制。这可能导致飞行器被劫持或坠毁。本文揭示了网络物理系统中硬件漏洞的隐蔽性。开发者必须在设计初期就考虑硬件容错防御。这对于自动驾驶等高风险领域具有重要参考价值。 [link]
SafeLM: Unified Privacy-Aware Optimization for Trustworthy Federated Large Language Models
Noor Islam S. Mohammad, Ulu\u{g} Bayaz{\i}t · 2026/4/21
在高风险领域部署大模型需要兼顾隐私与安全。SafeLM 建立了一个统一的联邦学习框架。它利用全同态加密保护训练梯度。系统集成了针对中毒攻击和推理攻击的防御。通过校准解码技术,模型幻觉得到了有效抑制。实验数据显示有害内容检测率高达 98.0 %。它在保证实用性的同时实现了极佳的隐私效能比。这种综合性的优化方案非常适合企业级私有化部署。 [link]
CAMP: Cumulative Agentic Masking and Pruning for Privacy Protection in Multi-Turn LLM Conversations
Aman Panjwani · 2026/4/21
现有的隐私脱敏工具通常只关注单轮对话。当用户分多次透露个人信息时,静态脱敏会失效。CAMP 提出了一种跨轮次的累积隐私保护机制。它建立了一个会话级的 PII 注册表。通过评估实体共现的组合风险得分,系统会自动追溯并屏蔽历史记录。这种方法在医疗和金融场景中表现优异。它在不破坏对话连贯性的前提下防止了身份重识别。这解决了智能体长期记忆中的隐私隐患。 [link]
AI 论文
Brain-CLIPLM: Decoding Compressed Semantic Representations in EEG for Language Reconstruction
Xiaoli Yang, Huiyuan Tian, et al. · 2026/4/21
脑机接口面临信号噪声大与带宽受限的瓶颈。研究者提出语义压缩假设,认为 EEG 信号编码的是语义锚点而非完整句式。Brain-CLIPLM 框架通过对比学习提取语义锚点,并结合具备 CoT 推理能力的检索增强 LLM 进行句子重建。实验表明该方法在句子检索准确率上显著优于直接解码。它为非侵入性脑机接口提供了生物学上更合理的路径,让思维直接转化为文字的愿景向现实迈进了一步。 [link]
AdaExplore: Failure-Driven Adaptation and Diversity-Preserving Search for Efficient Kernel Generation
Weihua Du, Jingming Zhuo, et al. · 2026/4/21
针对 Triton 这类低资源领域特定语言的算子生成难题,AdaExplore 框架实现了基于执行反馈的自进化。它通过失败驱动适配将重复性错误转化为验证规则存入内存,并利用多样性保持搜索在优化空间中寻找全局最优解。该系统无需外部知识或额外微调,在 KernelBench 基准测试中实现了最高 3.12 倍的运行加速。这种闭环优化机制极大地提升了高性能计算代码生成的可靠性。 [link]
COSEARCH: Joint Training of Reasoning and Document Ranking via Reinforcement Learning for Agentic Search
Hansi Zeng, Liam Collins, et al. · 2026/4/21
搜索智能体通常将检索器视为固定工具,仅优化推理逻辑,导致性能受阻。CoSearch 框架通过 GRPO 算法实现了推理智能体与生成式排序模型的联合训练。它设计了语义分组策略以支持排序器的高效优化,并结合轨迹反馈奖励信号提升长期搜索质量。在多步 QA 任务中,该方法显著超越了现有基线。这种全局协同优化思路揭示了智能搜索的演进方向,让 AI 能够像专家一样精准调取并综合海量信息。 [link]
Step-GRPO: Internalizing Dynamic Early Exit for Efficient Reasoning
Benteng Chen, Weida Wang, et al. · 2026/4/21
长链思维模型虽然推理强大,但常在冗余检查上浪费算力。Step-GRPO 通过后训练框架将动态退出能力内化至模型内部。它将优化目标从 token 转向语义步骤,并利用动态截断机制让模型学习在获得高置信度结果后及时终止。在 Qwen3-8B 上的实验显示,该方法在不损失准确率的前提下减少了 32% 的算力消耗。这种对过度思考的抑制技术,是提升高性能大模型推理能效比的必由之路。 [link]
Knows: Agent-Native Structured Research Representations
Guangsheng Yu, Xu Wang · 2026/4/21
PDF 这种面向人类阅读的格式正成为 AI 研究智能体的沉浸式负担。Knows 协议引入了一种轻量级 YAML 侧边栏规范,将结构化声明、证据溯源与验证关系直接绑定至现有论文。实验显示即便 0.8B 参数的小模型在阅读侧边栏时,其理解准确率也能提升至 67% 以上,同时减少最高 86% 的 token 消耗。这种 Agent-Native 的文档表示方式降低了自动化文献分析的门槛,有望彻底重塑科研效率。 [link]
Semantic Consensus: Process-Aware Conflict Detection and Resolution for Enterprise Multi-Agent LLM Systems
Vivek Acharya · 2026/4/21
企业级多智能体系统在生产环境中的失败率极高,核心诱因在于智能体间存在语义意图分歧。SCF 框架作为一种进程感知中间件,通过语义意图图谱和冲突检测引擎实时识别矛盾的动作组合。该框架在 AutoGen 和 LangGraph 等主流平台上表现优异,实现了 100% 的工作流完成率。它为构建鲁棒、可协作的自动化 AI 员工队伍提供了关键治理层,让大规模复杂业务流程的自动执行变得真正可用。 [link]
Abstain-R1: Calibrated Abstention and Post-Refusal Clarification via Verifiable RL
Skylar Zhai, Jingcheng Liang, et al. · 2026/4/21
强化学习常误导模型对无法回答的问题进行瞎猜。Abstain-R1 引入了澄清感知奖励函数,使模型在无法确定的情况下主动解释缺失信息。通过在 unanswerable queries 上进行验证强化学习,这款 3B 规模的模型在拒答与澄清任务中展现出媲美 DeepSeek-R1 的能力。它证明可靠性不完全依赖模型规模,通过精准设计的奖励机制,小型模型也能具备极高的认知成熟度和严谨态度。 [link]
GenericAgent: A Token-Efficient Self-Evolving LLM Agent via Contextual Information Density Maximization (V1.0)
Jiaqing Liang, Jinyi Han, et al. · 2026/4/21
长时程任务的瓶颈并非上下文长度,决策信息密度才是关键。GenericAgent 以信息密度最大化为核心,通过最小原子工具集、按需分层内存和经验转化为代码的自进化机制实现高效运行。该系统在显著减少 token 使用量的同时,持续提升任务完成率。这种极致的效率导向设计解决了 AI 智能体在复杂环境下的成本与稳定性矛盾,为构建永续运行的自主系统提供了样板。 [link]
Waking Up Blind: Cold-Start Optimization of Supervision-Free Agentic Trajectories for Grounded Visual Perception
Ashutosh Bajpai, Tamal Majumder, et al. · 2026/4/21
小型视觉语言模型在工具编排中常表现出视觉脆性,SPECTRA 框架通过自监督感知和级联工具演练解决了这一难题。它利用冷启动强化学习引导智能体发现鲁棒行为,并强制要求先通过工具获取证据再进行逻辑合成。引入的工具效用指标精准量化了工具性能。在 MMMU-Pro 等挑战性测试中,该方法提升了 5% 的任务准确率。它为轻量化多模态智能体在边缘设备上的可靠部署扫清了障碍。 [link]
The Provenance Gap in Clinical AI: Evidence-Traceable Temporal Knowledge Graphs for Rare Disease Reasoning
Md Shamim Ahmed, Maja Dusanic, et al. · 2026/4/21
顶级 LLM 在处理罕见病临床推理时常出现引文伪造问题。HEG-TKG 系统构建了包含千万级关系和疾病轨迹里程碑的证据驱动时间知识图谱。它将临床评估与 PubMed 记录深度绑定,确保所有医学主张均具备 100% 的可验证性。临床专家评估证实该系统在安全性和完整性上表现卓越。它成功弥合了生成式 AI 与严肃医疗需求之间的信任鸿沟,为精准医疗辅助决策树立了数据主权典范。 [link]
BleepingComputer 新闻
NGate Android malware uses HandyPay NFC app to steal card data
Bill Toulas · 2026/4/21 17:00
NGate malware 的一个新变体正在针对 Android 用户。它通过隐藏在木马化的 HandyPay 应用中窃取 NFC 支付数据。HandyPay 本身是一个合法的移动支付处理工具。 [link]
Actively exploited Apache ActiveMQ flaw impacts 6,400 servers
Sergiu Gatlan · 2026/4/21 19:17
非营利安全组织 Shadowserver 发现 6,400 多台暴露在互联网上的 Apache ActiveMQ 服务器存在漏洞。这些服务器正面临利用高危代码注入漏洞的持续攻击。 [link]
Former ransomware negotiator pleads guilty to BlackCat attacks
Sergiu Gatlan · 2026/4/21 18:12
41 岁的前网络安全事件响应公司员工 Angelo Martino 已经认罪。他承认在 2023 年参与了针对美国公司的 BlackCat ransomware 攻击。 [link]
CISA flags new SD-WAN flaw as actively exploited in attacks
Sergiu Gatlan · 2026/4/21 20:30
CISA 要求美国政府机构在四天内加固系统。监管机构发现 Catalyst SD-WAN Manager 的一个新漏洞正被积极利用。 [link]
Stopping Fraud at Each Stage of the Customer Journey Without Adding Friction
Sponsored by IPQS · 2026/4/21 22:02
欺诈预防和用户体验不需要在两者之间做抉择。IPQS 展示了如何结合身份、设备以及网络信号。这种方案可以在不增加阻力的情况下阻止欺诈。 [link]
UK probes Telegram, teen chat sites over CSAM sharing concerns
Sergiu Gatlan · 2026/4/21 21:49
英国独立通信监管机构 Ofcom 启动了对 Telegram 的调查。现有证据表明该平台被用于分享儿童性虐待材料。 [link]
New Lotus data wiper used against Venezuelan energy, utility firms
Bill Toulas · 2026/4/22 2:38
去年出现了一种此前未见记录的数据擦除 malware。这种被命名为 Lotus 的工具被用于针对委内瑞拉能源和公用事业机构的定向攻击。 [link]
French govt agency confirms breach as hacker offers to sell data
Bill Toulas · 2026/4/22 5:46
法国政府机构 France Titres 证实发生数据泄露。此前有威胁行为者声称入侵了系统并正在出售窃取的公民数据。 [link]