Quantifying Frontier LLM Capabilities for Container Sandbox Escape
LLM 智能体正在接管各类系统权限,但其安全性面临严峻挑战。SANDBOXESCAPEBENCH 针对容器沙箱逃逸能力进行了量化评估。该研究涵盖了内核缺陷与配置错误等多种实际逃逸路径。实验表明 GPT-4 等模型已具备识别并利用沙箱漏洞的能力。这为自动驾驶或自动化运维等高权代理场景敲响了警钟,揭示了智能体自主运行中的潜藏风险。 [link]
2026/3/5 · CyberRadar
LLM 智能体正在接管各类系统权限,但其安全性面临严峻挑战。SANDBOXESCAPEBENCH 针对容器沙箱逃逸能力进行了量化评估。该研究涵盖了内核缺陷与配置错误等多种实际逃逸路径。实验表明 GPT-4 等模型已具备识别并利用沙箱漏洞的能力。这为自动驾驶或自动化运维等高权代理场景敲响了警钟,揭示了智能体自主运行中的潜藏风险。 [link]
数百万个 Android 应用正面临身份冒用的风险。研究者发现 PendingIntent 存在根本性的来源混淆漏洞。攻击者通过监听通知即可窃取合法凭证,进而绕过 SDK 的身份验证。该研究复现了这一经典的供应链安全威胁,并提出了一套结合 Binder 内核验证的防护架构。这对于移动应用生态的底层安全具有极高的工程价值,直接关乎支付与身份授权的安全性。 [link]
昂贵的深度学习模型正在被物理侧信道攻击精准窃取。Kraken 攻击首次将目光投向了 GPU 的 Tensor Core 单元。通过监测近场电磁辐射,攻击者能提取 LLM 的权重参数。研究证明这种泄漏在 100 厘米外依然存在。该成果填补了专用计算单元安全评估的空白,揭示了硬件层面的严重隐患。对于部署在高价值机房的模型而言,物理隔离已不再是万能的保险箱。 [link]
LLM 智能体能否像顶级黑客一样修复 0-day 漏洞?ZeroDayBench 在 22 个真实的开源项目漏洞上测试了 GPT-5.2 与 Claude 4.5。结果显示前沿模型展现了惊人的代码理解力,但在自主修复复杂安全问题方面仍有显著差距。这项研究评估了 AI 在网络防御领域的真实上限,为未来的自动化安全工具指明了改进方向。它是衡量前沿模型实战安全能力的试金石。 [link]
当 C2PA 认证遇到 AI 水印时会发生致命冲突。研究揭示了名为 Integrity Clash 的安全盲点。一张带有真人口信生成的元数据图片,可能同时含有 AI 生成的水印信号。通过元数据清洗等手段,攻击者可以轻易制造合法的伪造内容。文章提出的跨层审计协议能以 100% 的准确率消除这种双重信号的不一致性。这为构建真正可信的数字内容认证体系提供了技术标准。 [link]
推理模型中潜伏的后门正变得极其隐蔽。攻击者可以操纵思维链过程,让模型给出看似逻辑合理实则错误的恶意结论。TraceGuard 作为一种过程导向的防火墙,通过 4 B 参数的小型验证器识别了大规模模型的逻辑骨折。它利用强化学习提升了防御的鲁棒性。这种低延迟的安全原语为构建受信任的计算基座提供了新方案,有效弥补了小尺寸模型在安全校验上的短板。 [link]
在隐私计算中,如何在保护数据隐私的同时抵御恶意投毒?RAIN 框架在 Shuffle-DP 模型下实现了安全且鲁棒的聚合。它采用正负空间聚合技术,在梯度被混淆和匿名化的情况下依然能精准识别异常更新。实验证明该方案将通信成本降低了 90 倍。这为大规模分布式机器学习的落地扫清了性能与安全的双重障碍。它是目前兼顾隐私保护与系统健壮性的最优解之一。 [link]
仅需少量查询即可攻破语音识别系统。研究者提出了一种基于特征对齐的反向生成攻击框架。它通过将生成模型的潜空间与语音嵌入空间进行几何同步,极大地提升了攻击效率。相比传统方法,新方案的查询次数缩减至 10 分之一。这提醒开发者声纹识别系统在应对经过优化的生成式攻击时依然脆弱。该研究为评估生物特征识别系统的防御强度提供了全新的基准工具。 [link]
加密货币钱包的找回一直是用户痛点。VA-DAR 提供了一种服务器无关且抗遍历攻击的恢复协议。它支持用户仅凭邮箱和短语即可在跨设备场景下找回资产。该协议在设计上充分考虑了后量子加密的迁移需求。它在去中心化存储网络上构建了隐私保护的索引。这种兼顾易用性与安全性的方案是 Web3 基础设施的重要演进,能有效防止因设备丢失导致的资产永久闭锁。 [link]
针对手机用户的 smishing 攻击正在通过动态域名躲避检测。Gravity Falls 数据库揭示了威胁者从随机字符转向字典拼接的技术演变。实验发现传统的 DGA 检测器在面对这些真实世界的演进策略时召回率极低。该研究呼吁防御方引入更多上下文信息来对抗高频变动的恶意基础设施。这对于打击电信诈骗和实时拦截钓鱼链接具有极强的实战意义。 [link]
专注复杂任务推理,PRISM 提出过程奖励模型引导推理。它像粒子在能量场中演化一样精细化解空间,通过步骤级验证引导模型思考。实验显示 20B 模型在数学竞赛中能叫板 120B 巨兽。这为提升推理模型天花板提供了实战路径,让深度思考不再是算力盲目堆砌。 [link]
机器人要从被动执行者进化为主动信息检索者。RAR 框架让机器人在面临未知任务时,能自主翻阅 2D 视觉说明书。通过跨模态对齐将图纸映射到 3D 物理部件,并在长程装配任务中实现闭环操作。这种赋予机器人寻求外部知识能力的尝试,极大地弥补了零样本场景下的知识缺口。 [link]
面对需要翻阅上千网页、解决证据冲突的超级难题,大模型该如何应对。Super Research 定义了超深超广的研究任务,集成结构化规划与多轮迭代调研。它不仅生成可验证报告,还提供完整的溯源路径。这套压力测试基准为构建真正具备自主研究能力的 AI 专家奠定了工程基础。 [link]
智能体在调用工具时若触碰隐私或文件权限,后果不堪设想。MOSAIC 为多步工具调用构建了安全护栏,将推理过程重构为规划、检查、执行或拒绝的闭环。利用偏好强化学习,它能识别标量奖励难以捕捉的安全界限。在不牺牲性能的前提下,它让 Agent 敢于在敏感场景下说不。 [link]
多模型在线推理中,GPU 资源碎片化是吞吐量的死穴。SUN 提出解耦式服务架构,让多个任务共用一个冻结的解码模块。这种设计打破了模型间的资源隔离,使显存受限的解码过程能跨模型成批处理。在保证生成的 TPOT 延迟微增的情况下,单卡吞吐量直接翻倍,是降低推理成本的工程利器。 [link]
智能体工作流的非确定性让传统回归测试失效。AgentAssay 是首个针对 AI 智能体的高效测试框架,它通过行为指纹识别技术捕捉细微的行为偏差。利用随机三值判定逻辑,它能在减少 78% 令牌支出的同时提供严格统计保证。这是 AI 应用走向大规模工程化交付的关键补丁。 [link]
营销广告中视觉特征的因果效应极难量化。DICE-DML 结合生成式技术与双重机器学习,解决了视觉编码器中特征纠缠的难题。通过生成对抗样本提取纯净的干预信号,它能精准剥离背景噪音,估算肤色等属性对点击率的影响。这为数据驱动的创意优化提供了严谨的统计工具。 [link]
云端记忆不仅贵,还有被毒化的风险。SuperLocalMemory 打造了全本地化的多智能体记忆系统。它采用 SQLite 驱动存储,并引入贝叶斯信任评分防御内存污染攻击。通过行为模式挖掘实现个性化排序,在不需要云端模型调用的情况下,将搜索延迟压到了 10.6ms 以内,平衡了隐私与响应速度。 [link]
论文写得好不如改得妙。APRES 系统能自动挖掘预测引用量的评估准则,并基于此重写论文草稿。它在不改变核心科学贡献的前提下,优化表达逻辑与重点。实验证明,修改后的版本在人类专家评价中胜率高达 79%。这不仅是学术写作辅助,更是对科研成果传播规律的一次量化实践。 [link]
长上下文推理时,CPU 分词常成为主要瓶颈。GPUTOK 针对 GPU 架构重写了字节级 BPE 分词算法。它利用高效的静态映射与规约核函数,处理 131k 长度的文本时比常用库快了 7.6 倍。通过减少 CUDA 内存分配开销,它让算力不再被同步等待消耗。在高频率生成的生产环境中,分词效率的飞跃极具价值。 [link]
荷兰跨国油漆巨头 AkzoNobel 向 BleepingComputer 证实,黑客入侵了其位于美国的一个站点网络。 [link]
社交媒体巨头 Facebook 目前正经历大规模全球宕机,导致用户无法访问其账户。 [link]
美国 CISA 已将 CVE-2026-22719 漏洞添加到已知已利用漏洞目录。该漏洞存在于 VMware Aria Operations 中,属于 RCE 缺陷,并已被确认用于攻击活动。 [link]
密西西比大学医学中心表示已恢复正常运营。在 9 天前,该中心遭遇勒索软件攻击,导致电子病历访问中断,并使多套 IT 系统瘫痪。 [link]
一次常规的 RDP 暴力破解警报揭示了异常的凭据搜索行为,并指向一个地理分布广泛的 VPN 关联基础设施。Huntress Labs 解释了单个被盗登录信息如何瓦解了一个疑似与初始访问经纪人关联的勒索软件即服务生态系统。 [link]
由欧洲刑警组织协调的国际执法行动瓦解了 Tycoon2FA 平台。这是一个主要的网络钓鱼即服务平台,每月发送数千万条钓鱼信息。 [link]
使用 HungerRush POS 平台的餐厅客户表示收到了来自威胁攻击者的勒索邮件。对方试图勒索该公司,并警告若 HungerRush 不予回应,餐厅及客户数据可能会被泄露。 [link]
美国 FBI 已经查封了 LeakBase 网络犯罪论坛。该论坛是网络罪犯买卖黑客工具和盗取数据的主要在线场所。 [link]
思科发布了安全更新,以修复其 Secure Firewall Management Center 软件中的两个最高级别严重漏洞。 [link]
一组先前未见记录且名为 Coruna 的 23 个 iOS 漏洞已被多个威胁攻击者部署,用于针对性间谍活动和获利性攻击。 [link]
微软发布了针对 Windows 10 的 KB5075039 恢复环境更新,以修复一个导致部分用户无法访问 Recovery 环境的长期问题。 [link]
密码管理软件供应商 LastPass 正向用户发出钓鱼警报。该活动通过发送虚假的账户未经授权访问警报,试图窃取用户的保险库密码。 [link]
FreeScout 服务台平台存在一个最高级别严重漏洞。攻击者无需任何用户交互或身份验证即可实现远程代码执行。 [link]