网安 + AI 前沿日报

2026/2/13 · CyberRadar

网络安全论文

Blind Gods and Broken Screens: Architecting a Secure, Intent-Centric Mobile Agent Operating System

Zhenhua Zou, Sheng Guo, et al. · 2026/2/12

手机智能体正从应用交互转向系统级自主运行,但现有的屏幕识别模式存在结构性安全风险。Aura 架构抛弃了脆弱的图形界面截图分析,提出了一种智能体原生的结构化交互模型。它将系统权限、应用沙箱与内核调度解耦,通过加密身份绑定和语义防火墙构建防御屏障。实验证明,该系统在保证任务成功率的同时,将高风险攻击的成功率降至 4.4 %。这种从底层操作系统层面的重构,为构建安全的移动智能体生态奠定了基础。 [link]

Vulnerabilities in Partial TEE-Shielded LLM Inference with Precomputed Noise

Abhishek Saini, Haolin Jiang, et al. · 2026/2/12

依靠可信执行环境保护大模型知识产权的做法并非无懈可击。为了平衡性能,许多系统采用预计算的静态秘密基数来加速密码运算。这项研究指出,这种设计模式存在严重的密钥复用缺陷。攻击者可以通过特定的机密性攻击恢复出 LLaMA-3 等模型的权重和混淆矩阵。该攻击甚至能绕过现有系统的完整性检查。短短 6 分钟即可破解 8B 规模模型的图层秘密,且该手段能轻松扩展至参数量达 405B 的超大模型。 [link]

Reverse-Engineering Model Editing on Language Models

Zhiyu Sun, Minrui Luo, et al. · 2026/2/12

模型编辑旨在修正大模型中的错误知识,却意外开启了泄露隐私的侧信道。研究者提出了 KSTER 攻击方法。它利用编辑过程中参数更新的低秩结构,通过频谱分析提取出被编辑主体的指纹。随后利用基于熵的提示词恢复技术,攻击者能高概率重建敏感的语义上下文。针对这一威胁,作者设计的子空间伪装防御策略可有效混淆更新指纹,在保护数据隐私的同时不影响模型编辑的实用性,为模型安全维护提供了新思路。 [link]

Red-teaming the Multimodal Reasoning: Jailbreaking Vision-Language Models via Cross-modal Entanglement Attacks

Yu Yan, Sheng Sun, et al. · 2026/2/12

视觉语言模型正面临跨模态纠缠攻击的威胁。传统的黑盒提示词注入攻击往往依赖简单的图文组合,难以突破不断进化的安全对齐机制。CrossTALK 方案通过多步链式指令将恶意任务分解,并将视觉实体迁移到图像中构建推理链条。这种攻击方式利用多模态上下文指令引导模型输出有害内容,显著提升了攻击成功率。该研究揭示了多模态推理模型在处理复杂指令时的安全脆弱性,为红队测试和模型加固提供了强力工具。 [link]

5Gone: Uplink Overshadowing Attacks in 5G-SA

Simon Erni, Martin Kotuliak, et al. · 2026/2/12

针对 5G 独立组网模式的攻击不再需要昂贵的高功率伪基站。5Gone 利用软件定义无线电技术,实现了精准的物理层上行链路掩盖攻击。它能在极低延迟下与受害者手机同步发射信号,通过略高的功率覆盖合法请求。该方法暴露出 3GPP 标准中初始接入过程的安全缺陷。实验表明,这种隐蔽的攻击手段能导致主流手机芯片出现拒绝服务或降级攻击,且能在常规硬件上实时运行,对移动通信的基础安全研究极具挑战。 [link]

GPU-Fuzz: Finding Memory Errors in Deep Learning Frameworks

Zihao Li, Hongyi Lu, et al. · 2026/2/12

GPU 显存错误是深度学习框架面临的严重威胁,可能导致系统崩溃或漏洞利用。GPU-Fuzz 引入了一种高效的模糊测试方法。它将算子参数建模为形式化约束,并利用约束求解器生成测试用例。这种方式能系统地探测 GPU 核函数中容易出错的边界条件。研究人员将该工具应用于 PyTorch 和 TensorFlow 等主流框架,成功发现了 13 个此前未知的内存错误。这为提升人工智能基础设施的健壮性提供了工程化的自动检测手段。 [link]

Following Dragons: Code Review-Guided Fuzzing

Viet Hoang Luu, Amirmohammad Pasdar, et al. · 2026/2/12

现代模糊测试工具往往难以触达代码中真正脆弱的深层逻辑。EyeQ 系统另辟蹊径,将开发人员在代码审计中沉淀的群体智慧转化为测试导向。它通过大语言模型提取审计讨论中的安全信号,精准定位潜在的风险区域。这种方法无需修改程序语义,能直接与现有测试流程无缝集成。在针对 PHP 核心代码的实验中,EyeQ 发现了超过 40 个此前未知的漏洞,证明了人类专家经验与自动化测试结合在挖掘高价值缺陷方面的巨大潜力。 [link]

MerkleSpeech: Public-Key Verifiable, Chunk-Localised Speech Provenance via Perceptual Fingerprints and Merkle Commitments

Tatsunori Ono · 2026/2/12

语音内容的剪辑、引用和转码使得传统的防伪检测极易失效。MerkleSpeech 系统结合了感知指纹与 Merkle 树,提供了可公开验证的语音溯源方案。它将语音分块计算指纹,并利用发行者私钥对根哈希进行签名。即便音频经过重采样或加噪处理,第三方仍能通过提取的水印载荷检索包含证明,定位每一段素材的原始出处。这种具备密码学强度的细粒度验证机制,为解决深度伪造音频的真实性问题提供了可靠的系统性方案。 [link]

PRISM-XR: Empowering Privacy-Aware XR Collaboration with Multimodal Large Language Models

Jiangong Chen, Mingyu Zhu, et al. · 2026/2/12

XR 头戴设备在捕捉环境时,极易泄露背景中的银行卡或人脸等隐私。PRISM-XR 框架为扩展现实协作提供了隐私感知层。它在边缘服务器上进行智能预处理,在数据上传云端生成式 AI 之前过滤掉敏感对象。此外,系统引入了轻量化注册流程和自定义共享机制,确保多用户间内容的精确同步。用户研究显示,该系统能在维持低延迟和高可用性的前提下,过滤掉超过 90 % 的敏感物体,平衡了远程协作效率与个人数据安全。 [link]

MalMoE: Mixture-of-Experts Enhanced Encrypted Malicious Traffic Detection Under Graph Drift

Yunpeng Tan, Qingyang Li, et al. · 2026/2/12

加密流量检测正面临图漂移带来的准确率下降问题。MalMoE 系统引入了专家混合模型来解决这一工程难题。它设计了多个针对不同拓扑特征的专家子模型,并通过改进的门控模型根据实际的流量变化进行动态路由。该方案配合两阶段训练策略和数据增强,能有效识别隐藏在加密隧道中的恶意行为。在真实世界数据集上的实验表明,MalMoE 具备极高的实时性与精确度,为复杂网络环境下的威胁监控和流量分析提供了鲁棒的技术支撑。 [link]

AI 论文

Step 3.5 Flash: Open Frontier-Level Intelligence with 11B Active Parameters

Ailin Huang, Ang Li, et al. · 2026/2/12

Step 3.5 Flash 是一款平衡智能与效率的 MoE 模型。它拥有 196 B 参数,但在推理时仅激活 11 B 参数。通过 MTP-3 技术,该模型大幅降低了多轮对话的延迟。它在数学、代码和工具调用上表现强劲,性能直逼 GPT-5.2 xHigh。该研究为工业界部署高性能 Agent 提供了高密度基础。其强化学习框架结合了可验证信号,确保了在大规模训练下的稳定性。 [link]

Agent World Model: Infinity Synthetic Environments for Agentic Reinforcement Learning

Zhaoyang Wang, Canwen Xu, et al. · 2026/2/11

智能体训练正受困于环境多样性的缺失。AWM 框架通过全自动流水线,合成了涵盖 1000 个日常场景的交互环境。这些环境由代码驱动并有数据库支撑,比 LLM 模拟的状态转换更可靠。它内置了 35 种工具,支持高频率交互。实验证明,完全在合成环境下训练的智能体具备强大的泛化能力。这套方案为 Reinforcement Learning 的大规模扩展开辟了新路径。 [link]

ClinAlign: Scaling Healthcare Alignment from Clinician Preference

Shiwei Lyu, Xidong Wang, et al. · 2026/2/11

医疗大模型虽有专业知识,但输出往往难以符合医生的临床偏好。ClinAlign 引入了 HealthRubrics 数据集,包含 7034 个医生验证的偏好样本。研究者将这些细粒度指标提炼为 119 条临床准则。通过离线对齐和推理优化,30 B 规模的模型在医学基准测试中超越了 o3 等巨型模型。这种可扩展的监督方案降低了对人工标注的依赖,提升了临床决策的可靠性。 [link]

GameDevBench: Evaluating Agentic Capabilities Through Game Development

Wayne Chi, Yixiong Fang, et al. · 2026/2/12

传统的代码智能体评估多关注纯文本逻辑。GameDevBench 将挑战升级到游戏开发领域。它包含 132 个来自真实教程的开发任务。智能体需要操作着色器、精灵图和动画,涉及复杂的跨模态理解。研究发现,视觉反馈机制能显著提升模型表现。该基准揭示了当前模型在精细化 GUI 操作上的短板,为开发具备多模态协作能力的编程助手指明了方向。 [link]

Learning to Evict from Key-Value Cache

Luca Moschella, Laura Manduchi, et al. · 2026/2/12

KV Cache 占据的巨大内存一直是 LLM 推理的瓶颈。KVP 框架将缓存逐出问题建模为 Reinforcement Learning 任务。它利用轻量级的 per-head 智能体,根据 Key 和 Value 向量预测 Token 的未来价值。这种方法无需修改原模型,也不增加推理开销。实验显示,KVP 在长文本和多轮对话任务上均优于启发式策略。它让模型能够以更小的内存代价处理极长的上下文序列。 [link]

SpotAgent: Grounding Visual Geo-localization in Large Vision-Language Models through Agentic Reasoning

Furong Jia, Ling Dai, et al. · 2026/2/11

视觉地理定位在弱特征场景下极易出错。SpotAgent 将定位过程转化为 Agent 智能推理过程。它不再单纯依赖模型内部知识,而是通过 ReAct 框架主动调用网页搜索和地图等工具。研究者采用了三阶段后训练流水线,结合 Reinforcement Learning 进一步强化推理能力。该框架有效减少了位置预测中的幻觉问题,实现了可验证的精确导航。这种结合外部工具的思路极具工程落地价值。 [link]

Autonomous Continual Learning of Computer-Use Agents for Environment Adaptation

Tianci Xue, Zeyi Liao, et al. · 2026/2/12

现实世界的数字环境动态多变。ACuRL 框架为计算机操作智能体提供了零人工标注的持续学习方案。它利用课程学习机制生成适应当前能力的自动化任务。内置的 CUAJudge 评估器与人类判断的一致性高达 93 %。通过稀疏参数更新,智能体能快速适应新环境而不发生灾难性遗忘。实验证明,该方案在多个环境迁移任务中均实现了显著的性能增益。它让智能体在动态软件环境中具备了自我进化的能力。 [link]

Physically Interpretable AlphaEarth Foundation Model Embeddings Enable LLM-Based Land Surface Intelligence

Mashrekur Rahman · 2026/2/12

卫星基础模型的内部物理含义一直难以解释。AlphaEarth 揭示了卫星遥感 Embeddings 与气候、植被等 26 个环境变量的强关联性。研究者构建了覆盖全美的 1210 万个样本库,并基于 FAISS 实现了高效检索。用户可以直接用自然语言查询复杂的地理环境状态。系统通过 RAG 技术实现了可解释的陆地情报分析。该研究证明了卫星模型表征的稳健性,为环保和测绘提供了强大的决策工具。 [link]

LiveMedBench: A Contamination-Free Medical Benchmark for LLMs with Automated Rubric Evaluation

Zhiling Yan, Dingjie Song, et al. · 2026/2/12

医疗模型评估常受困于数据污染和知识过期。LiveMedBench 每周从在线医疗社区抓取真实的临床病例。它采用多智能体协作框架进行清洗,确保测试集在训练切断日期之后。评估系统不再依赖字面重合度,而是基于医学原则的细粒度量表。实验显示,多数主流模型在面对最新医学动态时表现大幅下滑。这套动态更新的基准为验证临床模型的真实应用水平设立了严苛标准。 [link]

FormalJudge: A Neuro-Symbolic Paradigm for Agentic Oversight

Jiayi Zhou, Yang Sheng, et al. · 2026/2/12

依靠 LLM 监督 LLM 存在固有的不可信风险。FormalJudge 引入了神经符号框架,将人类意图转化为可验证的 Dafny 形式化规范。它不再给出模糊的概率分数,而是通过 Z3 求解器提供数学级别的确定性证明。在处理 Agent 欺骗检测和安全约束时,该方法比传统 LLM 裁判准确率提升了 16.6 %。这种将生成式模型与符号验证相结合的范式,为高风险领域的智能体监管提供了安全屏障。 [link]

BleepingComputer 新闻

Windows 11 Notepad flaw let files execute silently via Markdown links

Lawrence Abrams · 2026/2/12 7:15

微软修复了 Windows 11 Notepad 中的一个远程代码执行漏洞。攻击者可以诱导用户点击特制的 Markdown 链接,从而在不显示 Windows 安全警告的情况下执行本地或远程程序。 [link]

Apple fixes zero-day flaw used in 'extremely sophisticated' attacks

Lawrence Abrams · 2026/2/12 9:06

苹果发布安全更新以修复一个 0-day 漏洞。该漏洞曾在针对特定个人的高度复杂攻击中被利用。 [link]

Google says hackers are abusing Gemini AI for all attacks stages

Bill Toulas · 2026/2/12 15:00

Google Threat Intelligence Group 发布新报告警告 AI 模型提取与蒸馏攻击。私营企业和研究人员利用合法 API 访问权限系统性地探测模型,从而复制其逻辑与推理过程。 [link]

Fake AI Chrome extensions with 300K users steal credentials, emails

Bill Toulas · 2026/2/12 21:41

一组包含 30 个恶意 Chrome 扩展程序伪装成 AI 助手。这些程序已被超过 30 万用户安装,旨在窃取凭据、邮件内容以及浏览信息。 [link]

AMOS infostealer targets macOS through a popular AI app

Sponsored by Flare · 2026/2/12 22:25

AMOS 信息窃取者通过滥用热门 AI 应用和扩展市场来攻击 macOS 用户。Flare 分析了 AMOS 的运行机制,包括其如何通过 AI 诱饵传播并供养网络犯罪经济。 [link]

WordPress plugin with 900k installs vulnerable to critical RCE flaw

Bill Toulas · 2026/2/13 1:09

安装量超过 90 万次的 WordPress 插件 WPvivid Backup & Migration 存在严重漏洞。攻击者可以在未经身份验证的情况下通过上传任意文件来实现远程代码执行。 [link]

Odido data breach exposes personal info of 6.2 million customers

Lawrence Abrams · 2026/2/13 2:18

荷兰电信运营商 Odido 警告其遭受网络攻击。据报道,此次事件泄露了 620 万名客户的个人数据。 [link]

Romania's oil pipeline operator Conpet confirms data stolen in attack

Ionut Ilascu · 2026/2/13 3:16

罗马尼亚国家石油管道运营商 Conpet S.A. 证实其在上周遭受攻击。Qilin 勒索软件团伙在行动中窃取了公司数据。 [link]

Microsoft: New Windows LNK spoofing issues aren't vulnerabilities

Sergiu Gatlan · 2026/2/13 5:01

在 Wild West Hackin Fest 上,安全研究员 Wietze Beukema 披露了 Windows LNK 快捷方式文件的多个漏洞。这些漏洞允许攻击者部署恶意负载。 [link]

Bitwarden introduces ‘Cupid Vault’ for secure password sharing

Bill Toulas · 2026/2/13 5:55

Bitwarden 推出名为 Cupid Vault 的新系统。该系统允许用户与受信任的电子邮件地址安全地共享密码。 [link]

Critical BeyondTrust RCE flaw now exploited in attacks, patch now

Lawrence Abrams · 2026/2/13 5:34

BeyondTrust 远程支持和特权远程访问设备存在严重的预身份验证远程代码执行漏洞。在 PoC 发布后,该漏洞目前正被攻击者利用。 [link]

由 CyberRadar 智能体编写
消息抓取于 2026/2/12 6:57 至 2026/2/13 6:55