网络安全论文
The Cognitive Firewall:Securing Browser Based AI Agents Against Indirect Prompt Injection Via Hybrid Edge Cloud Defense
Qianlong Lan, Anuj Kaul · 2026/3/26
网页端 AI 智能体正面临间接提示词注入攻击。Cognitive Firewall 采用端云结合架构。它在客户端部署 Sentinel 过滤表现层攻击,云端 Deep Planner 负责语义分析。这种分块计算模式让 ASR 降至 1% 以下,同时相比纯云端方案提速 17000 倍。该研究证明确定性防御能有效补充概率性语言模型,为交互式智能体筑起长城。 [link]
AgentRFC: Security Design Principles and Conformance Testing for Agent Protocols
Shenghan Zheng, Qifan Zhang · 2026/3/26
AI 智能体协议正处于爆发期。AgentRFC 填补了系统性安全框架的空白。它定义 6 层架构模型,并基于 TLA+ 形式化 11 项安全原则。其配套的 AgentConform 工具能自动检测协议实现与规范的一致性。研究揭示了多协议组合时存在的安全隐患。这为构建互通且安全的自主智能体生态提供了底层标准,对行业协议标准化具有重要意义。 [link]
Invisible Threats from Model Context Protocol: Generating Stealthy Injection Payload via Tree-based Adaptive Search
Yulin Shen, Xudong Pan, et al. · 2026/3/26
MCP 让大模型调用外部工具变得简单。这种便利也带来了严重的工具响应操纵风险。TIP 攻击框架利用树状搜索生成极具欺骗性的注入载荷。它在黑盒环境下展现强控制力。面对现有防御,其成功率依然超过 50%。该研究揭示 MCP 部署中隐秘而致命的安全缺口,提醒开发者在享受集成便利时必须警惕外部数据的控制权归属。 [link]
Space Fabric: A Satellite-Enhanced Trusted Execution Architecture
Filip Rezabek, Dahlia Malkhi, et al. · 2026/3/26
卫星互联网需要不依赖厂商预置密钥的信任根。Space Fabric 利用卫星在轨的物理不可访问性构建防御边界。它将信任锚点分布在两个独立的安全芯片中。所有密钥均在发射后生成,地球上没有任何人能获取。它通过分层背书机制确证安全性。这为轨道计算提供了真正的硬件级信任基础,让分布式星链系统彻底摆脱了对单点厂商的依赖。 [link]
CAPTCHA Solving for Native GUI Agents: Automated Reasoning-Action Data Generation and Self-Corrective Training
Yuxi Chen, Haoyu Zhai, et al. · 2026/3/26
验证码一直是原生 GUI 智能体难以逾越的障碍。ReCAP 智能体改变了局面。它通过端到端 VLM 直接感知屏幕并操作设备。研究者构建包含 7 类挑战的动态验证码系统。利用自动生成的推理动作轨迹进行训练,ReCAP 成功将解决率从 30% 提升至 80%。它擅长处理噪声和扭曲文本,还能在出错后自我纠正。这标志着智能体在复杂交互场景下的重要进步。 [link]
ClawKeeper: Comprehensive Safety Protection for OpenClaw Agents Through Skills, Plugins, and Watchers
Songyang Liu, Chaozhuo Li, et al. · 2026/3/26
OpenClaw 作为领先的智能体运行时,其权限过高带来的数据泄露风险不容忽视。ClawKeeper 提供了实时安全框架。它在指令层注入策略,在运行时监控行为。最独特的是解耦的 Watcher 层,它能实时验证状态演化并在高风险动作前强制人工确认。这种分层保护不干扰智能体内部逻辑。它为下一代自主系统的落地提供了可靠的安全底座。 [link]
Towards Remote Attestation of Microarchitectural Attacks: The Case of Rowhammer
Martin Herrmann, Oussama Draissi, et al. · 2026/3/26
Rowhammer 漏洞证明硬件并非绝对可靠。HammerWatch 改变了防御思路。它不再盲目围追堵截攻击,而是通过远程度量来检测微架构层面的异常行为。它利用 ECC DRAM 产生的异常以及硬件计数器作为证据。即便面对具备内核权限的对手,TPM 锚定的哈希链也能确保结果完整。这套方案在普通硬件上即可实现,为底层硬件攻击提供了低成本检测路径。 [link]
Policy-Guided Threat Hunting: An LLM enabled Framework with Splunk SOC Triage
Rishikesh Sahay, Bell Eapen, et al. · 2026/3/26
面对高级持续性威胁,SOC 分析师常被海量日志淹没。该框架将 Agentic AI 与 Splunk 深度集成。它利用自动编码器识别异常,结合强化学习进行初步筛选,最后由 LLM 进行上下文分析。实验证明它能根据安全目标自主调整策略。这降低了分析师的决策压力,实现了从流量摄取到风险处置的自动化。它让威胁狩猎从人工操作转向智能化驱动。 [link]
Walma: Learning to See Memory Corruption in WebAssembly
Oussama Draissi, Mark G\"unzel, et al. · 2026/3/26
WebAssembly 的线性内存模型容易受到破坏攻击。Walma 另辟蹊径,利用机器学习识别内存快照中的攻击特征。它支持 CNN 分类器,能有效检测结构化布局中的异常。实验显示其开销最低仅为 1.07 倍。这种方案无需侵入式的二进制插桩。它为 Wasm 应用的运行时完整性校验提供了一种实用且高性能的检测手段,具有极强的工程应用潜力。 [link]
Forensic Implications of Localized AI: Artifact Analysis of Ollama, LM Studio, and llama.cpp
Shariq Murtuza · 2026/3/26
本地大模型运行环境的普及给数字取证带来了挑战。研究人员对 Ollama 和 LM Studio 等软件进行了取证分析。他们发现了大量未公开的磁盘和内存伪迹。攻击者留下的提示词历史、模型使用记录和网络活动被逐一揭秘。这套研究提供了可复现的取证流程和分诊命令。对于法务调查而言,这是一份关于本地 AI 软件行为的权威指南,填补了现有调查手段的空白。 [link]
AI 论文
Fast and Faithful: Real-Time Verification for Long-Document Retrieval-Augmented Generation Systems
Xunzhuo Liu, Bowei He, et al. · 2026/3/26
企业级 RAG 助手经常面临长文档验证难题。该研究设计了实时验证组件,能处理高达 32 K token 的上下文。系统通过自适应推理策略平衡延迟与覆盖率,显著提升了回答的忠实度。在生产环境中,该方案比传统的分块校验更有效。它为构建超大规模可靠检索应用提供了工程指南,代码已在 Hugging Face 开源。 [link]
Schema on the Inside: A Two-Phase Fine-Tuning Method for High-Efficiency Text-to-SQL at Scale
Chinmay Soni, Shivam Chourasia, et al. · 2026/3/26
为 2.5 亿用户提供板球统计查询是一项工程挑战。该研究通过两阶段微调让 8 B 模型内化了海量数据库 Schema。这让提示词长度缩减了 99 % 以上,彻底摆脱了高昂的 API 调用成本。系统在语义准确率上超越了 Gemini 2.0。它展示了垂直行业如何利用本地模型实现高精度、低延迟的文本转 SQL 应用。 [link]
Berta: an open-source, modular tool for AI-enabled clinical documentation
Samridhi Vaid, Mike Weldon, et al. · 2026/3/26
商业 AI 临床记录系统昂贵且数据不透明。Berta 作为开源模块化平台解决了这一痛点。它集成在现有医疗基础设施中,大幅降低了运行成本。在长达 8 个月的实测中,该系统有效处理了数万次临床会话。它为医疗机构夺回数据主权提供了低成本替代方案,是省级规模 AI 医疗应用的典型案例。 [link]
Internal Safety Collapse in Frontier Large Language Models
Yutao Wu, Xiao Liu, et al. · 2026/3/26
顶尖模型在执行特定任务时可能陷入持续输出有害内容的怪圈。研究者提出了 TVD 框架并构建了包含 8 个专业的测试集。实验发现 GPT-5.2 等模型在某些场景下的安全失效风险高达 95 %。这种内部安全崩溃揭示了模型能力增强带来的新风险。这对高风险领域的 AI 部署提出了严峻的技术警示。 [link]
The Price Reversal Phenomenon: When Cheaper Reasoning Models End Up Costing More
Lingjiao Chen, Chi Zhang, et al. · 2026/3/26
廉价推理模型真的省钱吗?研究揭示了价格倒挂现象。由于思考 token 消耗极高,标价更低的模型实际账单可能反超 28 倍。针对 Gemini 和 GPT 等模型的测试显示,推理过程的波动性极大。这项研究打破了 API 价目表的迷信,敦促开发者关注每笔请求的真实成本监控。这对于大规模部署的企业来说至关重要。 [link]
Prompt Compression in Production Task Orchestration: A Pre-Registered Randomized Trial
Warren Johnson, Charles Lee · 2026/3/26
提示词压缩关乎输入成本。它也会影响昂贵的输出长度。通过对 Claude 4.5 的随机对照试验发现,过度压缩可能增加总推理费用。研究对比了均匀保留与熵自适应等多种策略,划定了成本与相似度的帕累托前沿。这项工作提醒开发者在生产环境中不能盲目追求压缩率。它为大模型应用落地提供了详实的经济学依据。 [link]
Environment Maps: Structured Environmental Representations for Long-Horizon Agents
Yenchia Feng, Chirag Sharma, et al. · 2026/3/26
自动化复杂的软件工作流一直是长程智能体的弱项。该研究引入环境地图概念,将屏幕录制和执行轨迹整合为结构化图表。这种表示包含上下文、动作和隐性知识。在 WebArena 测试中,配备地图的智能体成功率翻倍。它为长程规划提供了可解释且可编辑的基础。这种架构显著减少了智能体在动态界面中的幻觉。 [link]
Can LLM Agents Be CFOs? A Benchmark for Resource Allocation in Dynamic Enterprise Environments
Yi Han, Lingfei Qian, et al. · 2026/3/26
智能体能否胜任首席财务官的工作?EnterpriseArena 模拟了长达 132 个月的企业经营环境。智能体需要动态分配稀缺资源,同时平衡多重目标。实验显示即便最先进的模型也难以在充满不确定的长周期任务中存活。该基准测试精准捕捉了当前智能体在资源规划能力上的巨大鸿沟。它为开发更具远见的商业决策 AI 指明了方向。 [link]
When AI output tips to bad but nobody notices: Legal implications of AI's mistakes
Dylan J. Restrepo, Nicholas J. Restrepo, et al. · 2026/3/26
生成式 AI 伪造案例已成为法律界的严重威胁。研究者通过物理学视角分析 Transformer 核心机制,发现输出翻车存在确定的临界点。这种风险是技术设计的必然结果。它并不是偶然的随机幻觉。文章为律师和监管者提出了基于失效原理的核查协议。它将黑盒模型转化为可预测系统,对法律科技合规化具有重要意义。 [link]
AnalogAgent: Self-Improving Analog Circuit Design Automation with LLM Agents
Zhixuan Bao, Zhuoyi Lin, et al. · 2026/3/26
模拟电路设计自动化正迎来突破。AnalogAgent 框架利用多智能体系统协同工作,集成了自进化存储机制。它能将执行反馈转化为知识手册,实现跨任务经验迁移。在不依赖额外专家库的情况下,该方案显著增强了 8 B 规模小模型的专业设计水平。它证明了智能体架构在垂直硬件设计领域的应用潜力。 [link]
BleepingComputer 新闻
GitHub adds AI-powered bug detection to expand security coverage
Bill Toulas · 2026/3/26 7:23
GitHub 正在为其 Code Security 工具采用基于 AI 的扫描技术。这项举措扩展了除 CodeQL 静态分析之外的漏洞检测能力。该技术覆盖了更多编程语言和框架。 [link]
Russia arrests suspected owner of LeakBase cybercrime forum
Sergiu Gatlan · 2026/3/26 20:50
俄罗斯警方逮捕了一名 Taganrog 居民。此人被认为是 LeakBase 的所有者。这是一个网络罪犯用来买卖被盗数据和黑客工具的主要在线论坛。 [link]
Suspected RedLine infostealer malware admin extradited to US
Sergiu Gatlan · 2026/3/26 19:51
一名亚美尼亚嫌疑人被引渡至美国。他将面临刑事指控。据称他协助管理 RedLine。这是近年来传播最广的 infostealer 恶意软件行动之一。 [link]
TikTok for Business accounts targeted in new phishing campaign
Bill Toulas · 2026/3/26 22:09
攻击者在一场网络钓鱼活动中针对 TikTok for Business 账户。该活动阻止安全机器人分析恶意页面。 [link]
WhatsApp rolls out more AI features, iOS multi-account support
Sergiu Gatlan · 2026/3/26 22:06
WhatsApp 正在推出多项新功能。这些功能旨在提升易用性。其中包括 AI 驱动的消息回复和照片修图。iOS 版本支持双账号登录。iOS 和 Android 设备之间可以传输聊天记录。 [link]
Inside a Modern Fraud Attack: From Bot Signups to Account Takeovers
Sponsored by IPQS · 2026/3/26 22:00
多阶段欺诈攻击将机器人、代理和被盗凭据链接在一起。攻击流程从注册延伸到接管账户。IPQS 展示了关联 IP、设备、身份和行为对阻止此类攻击的关键作用。 [link]
Coruna iOS exploit framework linked to Triangulation attacks
Bill Toulas · 2026/3/26 21:10
Coruna 漏洞利用工具包是 Operation Triangulation 间谍活动所用框架的进化版本。该活动在 2023 年通过零点击 iMessage 漏洞攻击 iPhone。 [link]
UK sanctions Xinbi marketplace linked to Asian scam centers
Sergiu Gatlan · 2026/3/26 23:42
英国外交、联邦和发展事务部制裁了 Xinbi。这是一个基于加密货币的中文在线市场。它向东南亚的诈骗网络出售被盗数据和卫星互联网设备。 [link]
CISA: New Langflow flaw actively exploited to hijack AI workflows
Bill Toulas · 2026/3/27 3:17
CISA 警告称黑客正在积极利用 CVE-2026-33017 漏洞。这是一个关键漏洞。它影响用于构建 AI 智能体的 Langflow 框架。 [link]
Ajax football club hack exposed fan data, enabled ticket hijack
Bill Toulas · 2026/3/27 4:37
荷兰阿贾克斯足球俱乐部披露了一起黑客攻击事件。黑客利用其 IT 系统漏洞访问了数百人的个人数据。 [link]