网络安全论文
zk-X509: Privacy-Preserving On-Chain Identity from Legacy PKI via Zero-Knowledge Proofs
Yeongju Bak (Tokamak Network, Seoul, et al. · 2026/3/27
如何在不暴露隐私的前提下,让区块链识别你的真实身份?zk-X509 利用现有的 40 亿张 X.509 证书,通过 RISC-V 零知识虚拟机实现了这一跨越。用户无需迁移现有证书体系,即可在链上证明自己的身份属性。该方案巧妙地结合了 OS keychain 签名委派,确保私钥不出本地安全隔离区。这种桥接传统 PKI 与去中心化账本的技术方案,为监管合规与用户隐私的平衡开辟了新路径。它具备极高的工程实用价值。 [link]
Bridging Code Property Graphs and Language Models for Program Analysis
Ahmed Lekssays · 2026/3/27
既然大模型受限于 token 长度且难以理解复杂代码逻辑,何不让它学会使用静态分析工具?codebadger 作为一个 MCP 服务,将 Joern 图引擎与 LLM 深度绑定。它不再强求模型生成复杂的查询语句,提供高层级的切片和污点分析工具。研究人员利用它在 libtiff 中成功挖掘出此前未公开的缓冲区溢出漏洞,并一次性修复了 libxml2 的整数溢出问题。这标志着语义级全库代码审计进入了智能协同时代。 [link]
The System Prompt Is the Attack Surface: How LLM Agent Configuration Shapes Security and Creates Exploitable Vulnerabilities
Ron Litvak · 2026/3/27
系统提示词配置不仅是指令,更是决定安全的攻击面。PhishNChips 研究揭示了一个惊人事实:即便使用相同的模型,仅仅微调提示词策略,钓鱼邮件的绕过率就可能从 1 % 飙升至 97 %。过度依赖单一特征的精准提示词虽然能提升短期检测率,却也容易被攻击者针对性诱导。当攻击者镜像了合法域名的信号,模型会盲从错误的指令逻辑。这项研究提醒开发者,构建稳健的邮件安全代理需要引入外部真实数据。 [link]
Shape and Substance: Dual-Layer Side-Channel Attacks on Local Vision-Language Models
Eyal Hadad, Mordechai Guri · 2026/3/27
动态高分辨率预处理技术为本地 VLM 带来了性能提升,却也无意中开启了侧信道大门。AnyRes 架构会根据图像长宽比将其切分为数量不等的补丁,这种工作负载差异直接反映在执行时间上。攻击者通过监测简单的系统指标就能指纹化输入图像的几何轮廓。更进一步,利用最后级缓存竞争,攻击者甚至能分辨出图像的具体语义内容。这项研究对边缘侧 AI 部署提出了严峻的隐私挑战,证明了硬件层面的信息泄露防不胜防。 [link]
AIP: Agent Identity Protocol for Verifiable Delegation Across MCP and A2A
Sunil Prakash · 2026/3/27
智能体之间频繁的协作和工具调用正处于裸奔状态,MCP 协议甚至完全缺失身份验证机制。AIP 协议引入了调用绑定能力令牌,将身份标识、权限衰减和溯源记录熔炼进一个追加链中。它支持 JWT 和基于 Datalog 策略的逻辑验证,能有效应对多跳委托中的权限滥用。在实际部署中,该协议仅带来极微小的延迟波动,却能拦截 100 % 的恶意攻击尝试。它为快速扩张的 AI Agent 生态系统补齐了至关重要的信任基石。 [link]
PIDP-Attack: Combining Prompt Injection with Database Poisoning Attacks on Retrieval-Augmented Generation Systems
Haozhen Wang, Haoyue Liu, et al. · 2026/3/27
RAG 系统虽然能缓解大模型的幻觉问题,却也引入了新的投毒风险。PIDP-Attack 将提示词注入与数据库投毒相结合,无需预知用户查询内容即可实现精准操控。攻击者通过在推理时附加恶意字符,并向检索库注入少量污染文档,显著提升了攻击成功率。在多个基准数据集上的实验证明,这种复合攻击模式比传统的 PoisonedRAG 更具威胁。它揭示了 RAG 架构在防御未知查询攻击时的脆弱本质,迫使安全社区重新审视检索链条的可靠性。 [link]
SolRugDetector: Investigating Rug Pulls on Solana
Jiaxin Chen, Ziwei Li, et al. · 2026/3/27
Solana 平台因极低的发币门槛沦为 Rug Pull 骗局的温床。不同于以太坊上的合约漏洞,这些诈骗行为多隐藏在正常的链上交易操作中。SolRugDetector 是首个针对此类风险的检测系统,它完全基于交易状态数据对代币进行画像。研究人员分析了 2025 年上半年发行的 100,063 个新币,识别出 76,469 个诈骗项目。这些骗局生命周期极短且组织化程度极高。该研究不仅发布了宝贵的真实数据集,也为链上防御机制提供了实战指南。 [link]
Multi-target Coverage-based Greybox Fuzzing
Masami Ichikawa · 2026/3/27
现代系统软件架构依赖操作系统与固件的深度协作,传统的单目标模糊测试已力不从心。MTCFuzz 提出了一种跨越软件边界的协同测试方法,将 QEMU 虚拟化环境作为统一观测点。通过同时获取操作系统与底层固件的代码覆盖率反馈,它能触达更深层的系统逻辑。这种多目标覆盖策略在处理 OpenSBI 或 OP-TEE 等复杂接口时表现卓越。该技术为 RISC-V 和 ARM 架构下的全栈安全审计提供了强有力的工具支持,填补了跨层级测试的空白。 [link]
ALPS: Automated Least-Privilege Enforcement for Securing Serverless Functions
Changhee Shin, Bom Kim, et al. · 2026/3/27
Serverless 架构由于自动扩缩容特性极具吸引力,但细粒度的权限管理却成了安全隐患。ALPS 框架利用定制的静态分析技术从函数代码中精准提取权限需求。它配合微调的 LLM,能自动生成符合特定云厂商规范的安全策略,并实现实时访问阻断。在对 8,322 个真实函数的评估中,该系统实现了极高的权限提取覆盖率且性能损耗微乎其微。这套厂商无关的自动化方案,为云原生应用的最小特权原则落地铺平了道路,极大降低了配置错误风险。 [link]
Unveiling the Resilience of LLM-Enhanced Search Engines against Black-Hat SEO Manipulation
Pei Chen, Geng Hong, et al. · 2026/3/27
集成了大模型的搜索引擎正在改变我们获取信息的方式,但它们能否抵御黑产 SEO 的侵蚀?这项研究构建了包含 1,000 个恶意网站的测试集,对 ChatGPT 和 Gemini 等主流产品进行了深度体检。虽然检索阶段能过滤掉绝大多数传统攻击,但针对 LLM 特性的重写策略仍能诱导模型总结错误信息。攻击者利用分段文本等手段,可将操纵成功率翻倍。作为该领域的首份系统性安全报告,它为构建更具韧性的 AI 搜索生态提供了关键见解。 [link]
AI 论文
Design Once, Deploy at Scale: Template-Driven ML Development for Large Model Ecosystems
Jiang Liu, John Martabano Landy, et al. · 2026/3/27
推荐系统模型爆炸式增长,Meta 工程师们通过 SMT 框架打破了这一僵局。该方案将模型构建模块化,在提升跨熵表现的同时,将每个模型的迭代耗时削减了百分之九十二。它让新技术的推广复杂度从指数级降至线性。这种在大规模生产环境下的工程实践,为广告平台和大规模模型生态系统的开发效率提供了教科书般的演进思路。 [link]
On the Foundations of Trustworthy Artificial Intelligence
TJ Dunham · 2026/3/27
为什么同样的模型在 ARM 和 x86 上输出不同?本项目揭示了浮点数运算对 AI 信任根基的破坏,并用 99,000 行 Rust 代码构建了一个纯整数推理引擎。它实现了跨地域、跨架构的位一致性输出,并成功在三大洲分布式部署。该研究将 AI 安全从宽泛的伦理讨论拉回到严谨的算术领域,为去中心化验证和高可靠性 AI 应用奠定了坚实的确定性基础。 [link]
SliderQuant: Accurate Post-Training Quantization for LLMs
Shigeng Wang, Chao Li, et al. · 2026/3/27
面对 DeepSeek-R1 和 Llama 3 这种巨无霸模型,如何实现无损且极速的量化?SliderQuant 框架通过观察神经网络不同层对量化的敏感度差异,引入了创新的滑动窗口设计。该方法仅需极少量可学习参数,就能显著降低浅层和深层的量化误差。无论是纯权重还是权重激活量化,它在数学、代码等高难度任务上均展现出顶尖的精度保持能力。 [link]
Separate Before You Compress: The WWHO Tokenization Architecture
Kusal Darshana · 2026/3/27
现有的 BPE 分词器让非拉丁语系用户承受着高昂的 Token 税。WWHO 架构通过将语言规则与统计压缩分离,彻底解决了印地语、僧伽罗语等语素文字在分词时的结构破碎问题。该方案在确保音节零破碎的前提下,将 Token 使用量降低了百分之六十以上,变相将上下文窗口扩大了 4.38 倍。这为实现全球范围内更公平、更高效的语言模型推理提供了创新方案。 [link]
Prompt Attack Detection with LLM-as-a-Judge and Mixture-of-Models
Hieu Xuan Le, Benjamin Goh, et al. · 2026/3/27
针对提示词注入和越狱攻击,新加坡政府在其公共服务聊天机器人中部署了一套实时防御屏障。该系统利用 gemini-2.0-flash-lite-001 等轻量级模型作为安全裁判,通过意图分解和自我反思,在极低延迟下实现了高精度的防御。它证明了无需笨重的模型,也能在生产环境中构建起动态演进的安全防线,是生成式 AI 安全治理在现实场景中落地的标杆案例。 [link]
AutoSAM: an Agentic Framework for Automating Input File Generation for the SAM Code with Multi-Modal Retrieval-Augmented Generation
Zaid Abulawi (Department of Nuclear Engineering, Texas A&M University, et al. · 2026/3/27
编写核反应堆模拟程序的输入文件既枯燥又易错。AutoSAM 框架利用智能体驱动的多模态 RAG 技术,能够自动从设计图纸、PDF 报告和电子表格中提取关键参数并生成求解器代码。它在复杂的熔盐堆实验案例中展现了百分之百的几何信息提取准确率。这项工作展示了 AI 如何深入精密制造的核心,将工程师从繁重的文档校对中解放出来。 [link]
Trace2Skill: Distill Trajectory-Local Lessons into Transferable Agent Skills
Jingwei Ni, Yihao Liu, et al. · 2026/3/27
智能体如何从失败中学习?Trace2Skill 模仿人类专家,通过分析大量的执行轨迹,将零散的教训提炼成可复用的声明式技能库。这些技能无需参数更新即可在不同规模的模型间无缝迁移,甚至能让 35B 参数的小模型在表格问答任务中表现大幅飞跃。该框架解决了自动化技能生成的脆弱性问题,为构建能够自主进化且具备领域专业能力的智能体开启了新途径。 [link]
EcoThink: A Green Adaptive Inference Framework for Sustainable and Accessible Agents
Linxiao Li, Zhixiang Lu · 2026/3/27
为了减少 AI 对环境的影响,EcoThink 框架引入了一套节能型自适应推理机制。它利用轻量级蒸馏路由器实时判断查询复杂度,对简单事实检索跳过繁重的思维链计算,仅在逻辑复杂时动用核心算力。在九项基准测试中,它平均降低了约百分之四十的推理能耗。该方案兼顾了智能表现与环境责任,为构建可持续且普惠的生成式 AI 智能体提供了切实可行的路线图。 [link]
How Far Are Vision-Language Models from Constructing the Real World? A Benchmark for Physical Generative Reasoning
Luyu Yang, Yutong Dai, et al. · 2026/3/27
仅仅生成漂亮的 3D 模型还远远不够。DreamHouse 基准测试将目光投向了真实的木结构住宅建筑,要求模型在满足视觉真实的基础上,符合几何、结构及建筑规范的严苛约束。通过模拟真实的建造步骤和物理依赖,它揭示了现有大模型在物理生成推理能力上的巨大鸿沟。该研究将多模态智能推向了设计施工全流程自动化的新阶段。 [link]
A Decade-Scale Benchmark Evaluating LLMs' Clinical Practice Guidelines Detection and Adherence in Multi-turn Conversations
Andong Tan, Shuyu Dai, et al. · 2026/3/27
医疗场景对准确性的要求不容有失。研究人员通过收集过去十年跨越 24 个专科、9 个国家的临床实践指南,构建了 CPGBench 框架。测试发现,尽管领先模型能识别大部分指南内容,但在多轮对话中遵循这些建议并给出准确引用的能力仍显不足。这项针对 32,155 条建议的系统化评估,为 LLM 在临床实践中的安全部署划定了基准,是医疗 AI 迈向合规化的关键一步。 [link]
BleepingComputer 新闻
Dutch Police discloses security breach after phishing attack
Sergiu Gatlan · 2026/3/27 16:20
荷兰国家警察局披露了一起由钓鱼攻击引发的安全漏洞。此次事件影响范围有限,并未影响公民数据。 [link]
Windows 11 KB5079391 update rolls out Smart App Control improvements
Sergiu Gatlan · 2026/3/27 17:20
微软发布了针对 Windows 11 24H2 和 25H2 的 KB5079391 预览累积更新。该更新包含 29 项变更,涵盖 Smart App Control 和显示改进。 [link]
Anti-piracy coalition takes down AnimePlay app with 5 million users
Sergiu Gatlan · 2026/3/27 18:40
创意与娱乐联盟宣布关停 AnimePlay。该平台是拥有 500 多万用户的大型动漫流媒体应用。 [link]
European Commission investigating breach after Amazon cloud hack
Sergiu Gatlan · 2026/3/27 20:22
欧盟委员会作为欧盟的主要执行机构,正在调查一起安全漏洞。此前有威胁参与者获取了其 Amazon 云基础设施的访问权限。 [link]
Agentic GRC: Teams Get the Tech. The Mindset Shift Is What's Missing.
Sponsored by Anecdotes · 2026/3/27 22:02
Agentic GRC 实现了工作流自动化。这促使团队重新审视运维之外的角色。Anecdotes 解释了当前核心挑战在于如何从执行层转向风险领导力。 [link]
European Commission investigating breach after Amazon cloud account hack
Sergiu Gatlan · 2026/3/27 20:22
欧盟委员会作为欧盟的主要执行机构,正在调查一起安全漏洞。此前有威胁参与者获取了其 Amazon 云基础设施的访问权限。 [link]
Fake VS Code alerts on GitHub spread malware to developers
Bill Toulas · 2026/3/28 0:51
GitHub 开发者正面临大规模攻击。攻击者在项目讨论区发布虚假 VS Code 安全警报,诱导用户下载恶意软件。 [link]
Backdoored Telnyx PyPI package pushes malware hidden in WAV audio
Bill Toulas · 2026/3/28 5:13
TeamPCP 黑客破坏了 PyPI 上的 Telnyx 软件包。恶意版本利用 WAV 音频文件隐藏并分发凭据窃取软件。 [link]