网安 + AI 前沿日报

2026/2/19 · CyberRadar

网络安全论文

Zombie Agents: Persistent Control of Self-Evolving LLM Agents via Self-Reinforcing Injections

Xianglin Yang, Yufei He, et al. · 2026/2/18

自进化 LLM 智能体通过长期记忆学习,却也留下了安全后门。研究者展示了名为 Zombie Agent 的持续性攻击。攻击者通过网页内容将恶意负载植入智能体记忆,使其在后续会话中沦为傀儡。即便经过清理,受污染的记忆仍能诱导非法工具调用。该研究警示开发者,单纯的单次提示词过滤已无法应对这类具备进化能力的智能体威胁。 [link]

SecCodeBench-V2 Technical Report

Longfei Chen, Ji Zhao, et al. · 2026/2/18

AI 编程助手生成的代码真的安全吗?阿里巴巴团队发布了 SecCodeBench-V2 基准测试。它涵盖 Java 与 Python 等 5 种语言,包含 98 个源自真实工业场景的修复任务。通过动态执行与 PoC 测试用例,该工具能精准评估模型处理 22 类安全漏洞的能力。这为企业选择和优化编程大模型提供了科学的数据支撑与自动化评估框架。 [link]

Weight space Detection of Backdoors in LoRA Adapters

David Puertolas Merenciano, Ekaterina Vasyagina, et al. · 2026/2/18

从 Hugging Face 下载的 LoRA 适配器可能藏有暗门。传统检测手段需要运行模型,面对成千上万的组件效率极低。这项研究通过分析权重矩阵的奇异值分布与熵等统计特征,实现了无需运行模型的静态检测。在 500 个样本的测试中,该方法以 97% 的准确率揪出了恶意插件。它让模型仓库的安全审查变得像扫描病毒一样简单快捷。 [link]

MEV in Binance Builder

Qin Wang, Ruiqiang Li, et al. · 2026/2/18

币安智能链的中心化风险正在引发关注。研究者通过追踪 2025 年半年的数据,发现两家头部构建者垄断了 96% 的出块量。短区块间隔与白名单机制挤压了普通搜索者的生存空间,导致 MEV 利润高度向头部集中。这种结构性失衡破坏了公平性并增加了审查风险。本文深入剖析了 PBS 设计在高性能公链中产生的负面连锁反应。 [link]

MarkSweep: A No-box Removal Attack on AI-Generated Image Watermarking via Noise Intensification and Frequency-aware Denoising

Jie Cao, Zelin Zhang, et al. · 2026/2/18

隐形水印是识别 AI 生成图像的重要手段,但 MarkSweep 证明了它并非无懈可击。这种新型攻击通过噪声强化与频率感知去噪技术,能在不损画质的前提下彻底擦除水印。实验显示主流水印方案的位准确率被降至 67% 以下。它揭示了现有防御机制在面对精心设计的频率域攻击时的脆弱性,迫使研究者重新思考内容溯源的底层逻辑。 [link]

State of Passkey Authentication in the Wild: A Census of the Top 100K sites

Prince Bhardwaj, Nishanth Sastry · 2026/2/18

Passkey 被视为无密码时代的救星,但它的实际普及率究竟如何?研究者利用 Fidentikit 爬虫对全球前 10 万个网站进行了大规模普查。调查发现 Passkey 的采用高度依赖外部身份提供商,而非原生实现。复杂的前端交互与异构的部署方式让自动化检测极具挑战。这份数据揭示了理想与现实的鸿沟,为标准化组织推动相关标准落地提供了关键参考。 [link]

Unforgeable Watermarks for Language Models via Robust Signatures

Huijia Lin, Kameron Shahabi, et al. · 2026/2/18

现有的语言模型水印容易被伪造或篡改,导致身份冒用。研究者引入了不可伪造性与可恢复性两大安全指标,并构建了鲁棒的签名方案。该技术利用哈希函数增强数字签名,确保只有模型生成的文本才能通过验证。即便文本经过同义词替换等微调,检测器依然能追溯其原始来源。它为解决 AI 生成内容的版权纠纷与虚假归责提供了严谨的工具。 [link]

Revisiting Backdoor Threat in Federated Instruction Tuning from a Signal Aggregation Perspective

Haodong Zhao, Jinming Hu, et al. · 2026/2/18

联邦学习常被认为能保护隐私,但它也给恶意数据提供了藏身之所。研究发现仅需 10% 的受污染指令数据,就能让语言模型在保持性能的同时产生 85% 的攻击成功率。这些毒素散落在大量正常客户端中,传统的异常检测器难以识别。该研究从信号聚合视角量化了后门植入过程,提醒我们在利用众包数据进行模型微调时,必须警惕这种去中心化的隐蔽威胁。 [link]

A Unified Evaluation of Learning-Based Similarity Techniques for Malware Detection

Udbhav Prasad, Aniesh Chawla · 2026/2/18

面对海量恶意软件变种,传统的校验哈希早已失效。这项研究对基于机器学习的相似性检测技术进行了系统化评测。研究者通过统一的实验框架,对比了多种特征嵌入与聚类方法的实际表现。结果表明没有任何一种单一算法能兼顾准确率与扩展性。这份报告为安全厂商构建威胁猎捕平台提供了选型建议,强调了互补技术协同作战的必要性。 [link]

AI 论文

Query as Anchor: Scenario-Adaptive User Representation via Large Language Model

Jiahao Yuan, Yike Xu, et al. · 2026/2/17

工业级用户画像建模总是在通用性与任务敏感度之间拉锯。蚂蚁集团提出 Query-as-Anchor 框架。它摒弃了静态向量建模。转而采用动态查询感知的合成方案。通过在双塔 LLM 中集成多级编码器并配合对比学习优化。该系统已在支付宝生产环境大规模落地。在线 A/B 测试证明了其在多种业务场景下的卓越性能。部署过程利用 KV-cache 加速。推理延迟几乎可以忽略。这为构建敏捷且精准的个性化推荐系统提供了工业级模板。 [link]

Hunt Globally: Wide Search AI Agents for Drug Asset Scouting in Investing, Business Development, and Competitive Intelligence

Alisa Vinogradova, Vlad Vinogradov, et al. · 2026/2/17

全球药研资产的发现正演变为一场信息竞赛。Bioptic Agent 专为投资与业务开发设计。它直面非英语渠道和非结构化数据的挑战。研究发现 85 % 以上的专利申请源自美国境外。传统 Agent 在海量异构源面前极易产生幻觉且召回率低。该方案采用树状自学习架构。在处理复杂的跨境资产搜寻时 F1 分数接近 80 %。它能敏锐捕捉潜伏在雷达之外的高价值管线。助力投资团队在数秒内完成原本需要数周的人工调研。 [link]

Arbor: A Framework for Reliable Navigation of Critical Conversation Flows

Lu\'is Silva, Diogo Gon\c{c}alves, et al. · 2026/2/17

医疗分诊等高风险对话要求模型严格遵循结构化工作流。单提示词方案往往因指令遵循退化而失效。Arbor 框架将复杂的决策树拆解为节点级任务。通过基于 DAG 的编排机制动态检索边缘信息并评估状态跳转。实验表明该方案将平均准确度提升了 29.4 个百分点。同时将推理成本降低了 14.4 倍。这有效减轻了对模型原生能力的依赖。更让轻量级模型在处理严苛业务逻辑时展现出媲美顶级旗舰模型的可靠性。 [link]

Panini: Continual Learning in Token Space via Structured Memory

Shreyas Rajesh, Pavan Holur, et al. · 2026/2/18

传统的 RAG 方案由于反复检索文档切块而效率低下。Panini 提出了一种非参数化的持续学习框架。它构建了一个名为 GSW 的语义存储网络。通过将文档转化为实体感知的问答对。模型不再需要处理冗长的原始文本。而是直接在语义空间内检索推理链条。这种结构化的记忆方式将答案召回所需的 token 消耗降低了 2 到 30 倍。同时有效抑制了无中生有的幻觉。为长时程知识管理与低延迟推理找到了新平衡。 [link]

OpaqueToolsBench: Learning Nuances of Tool Behavior Through Interaction

Skyler Hallinan, Thejas Venkatesh, et al. · 2026/2/18

真实的 API 环境通常文档残缺且行为难测。OpaqueToolsBench 专注于研究 Agent 如何在使用黑盒工具的过程中自我进化。与其依赖高昂且不稳定的自动文档生成。ToolObserver 框架选择从执行反馈中迭代提炼使用技巧。它通过观察推理路径中的异常表现来修正工具描述。这种模式在复杂搜索任务中表现尤为出色。其 token 消耗量仅为传统基准方案的几分之一。这标志着 Agent 正在从机械的指令执行者向具备探索精神的问题解决者转变。 [link]

The Vision Wormhole: Latent-Space Communication in Heterogeneous Multi-Agent Systems

Xiaoze Liu, Ruowang Zhang, et al. · 2026/2/18

多智能体协作常因低效的文本通信而产生巨大的运行时开销。Vision Wormhole 提出了一个大胆的设想。它利用 VLM 的视觉通路作为通用通信接口。将复杂的推理轨迹映射到共享的连续潜空间中。通过类似电报的视觉编码。不同架构的智能体可以实现跨模型协同。这种星型拓扑架构消除了模型间两两配对的复杂度。实验证明该方案在保持推理精度的前提下。显著缩短了端到端的任务耗时。为异构智能体集群的实时协作扫清了障碍。 [link]

AgriWorld:A World Tools Protocol Framework for Verifiable Agricultural Reasoning with Code-Executing LLM Agents

Zhixing Zhang, Jesen Zhang, et al. · 2026/2/18

农业基础模型虽然擅长预测监控。却难以直接处理高维异构的地理空间数据。AgriWorld 框架为 LLM 打造了一个代码执行环境。它封装了遥感时间序列分析和作物生长模拟等核心工具。Agro-Reflective 智能体通过执行观测精炼的循环不断优化分析方案。针对病虫害风险评估和产量预测等真实任务。该系统展现了远超文本基准的推理深度。它让通识模型真正具备了下田务农的专业素质。为智慧农业的自动化决策提供了可验证的技术路径。 [link]

HLE-Verified: A Systematic Verification and Structured Revision of Humanity's Last Exam

Weiqi Zhai, Zhihai Wang, et al. · 2026/2/17

HLE 是评估尖端大模型跨领域能力的关键基准。但社区反馈其中潜伏着大量噪声项。HLE-Verified 通过双阶段验证修复流程。对原有的数千个问题进行了专家级的清洗。结果显示修正后的数据集让模型平均准确率提升了 7 到 10 个百分点。尤其在原题错误的极端案例中。增幅高达 40 个百分点。该研究揭示了模型置信度与错误项之间的强相关性。为未来构建更公平且透明的 AI 性能度量衡提供了可信的锚点。 [link]

ResearchGym: Evaluating Language Model Agents on Real-World AI Research

Aniketh Garikaparthi, Manasi Patwardhan, et al. · 2026/2/18

如何衡量 Agent 的端到端科研能力?ResearchGym 直接从顶会论文库中抽取任务。它保留了数据集与评估框架。却扣留了论文的核心方法。要求 Agent 独立提出假设并运行实验以超越人类基线。实测发现即便是 GPT-5 级别的模型在面对长程科研任务时也显得力不从心。存在资源管理不善和过度自信等瓶颈。但在特定场景下 Agent 已经能偶尔复现顶会级别的突破。这一平台为我们观察硅基科学家的进化提供了绝佳的沙盒。 [link]

PERSONA: Dynamic and Compositional Inference-Time Personality Control via Activation Vector Algebra

Xiachong Feng, Liang Zhao, et al. · 2026/2/18

现有的性格控制手段要么依赖昂贵的微调。要么受限于静态提示词的死板。PERSONA 框架直接在激活空间内对性格向量进行代数运算。它将人类特质识别为表征空间中近似正交的方向。通过对这些向量进行标量乘法或加法。用户可以精确调节性格强度或组合多种特征。其性能在不更新权重的条件下。几乎追平了全量微调的效果。这让 AI 在对话中展现出的情感与行为变得可解释且可编程。为打造动态多变的虚拟人格开辟了捷径。 [link]

BleepingComputer 新闻

Spain orders NordVPN and ProtonVPN to block LaLiga stream piracy

Bill Toulas · 2026/2/18 7:15

西班牙法院对 NordVPN 和 ProtonVPN 采取预防措施,命令这两家知名 VPN 服务商屏蔽 16 个传播盗版足球赛事的网站。 [link]

Spain orders NordVPN, ProtonVPN to block LaLiga piracy sites

Bill Toulas · 2026/2/18 7:15

西班牙法院对 NordVPN 和 ProtonVPN 采取预防措施,命令这两家知名 VPN 服务商屏蔽 16 个传播盗版足球赛事的网站。 [link]

Glendale man gets 5 years in prison for role in darknet drug ring

Sergiu Gatlan · 2026/2/18 18:50

一名来自 Glendale 的男子因参与暗网毒品贩运被判处近 5 年联邦监禁。该团伙向全美客户贩卖可卡因、甲基苯丙胺、MDMA 和氯胺酮。 [link]

Microsoft says bug causes Copilot to summarize confidential emails

Sergiu Gatlan · 2026/2/18 20:03

微软称 Microsoft 365 Copilot 存在漏洞。该 AI 助手从 1 月下旬开始总结机密邮件,绕过了企业用于保护敏感信息的 DLP 策略。 [link]

Data breach at fintech firm Figure affects nearly 1 million accounts

Sergiu Gatlan · 2026/2/18 22:01

黑客入侵 Figure Technology Solutions 系统后窃取了近 100 万个账户的个人和联系信息。该公司是一家基于区块链技术的金融科技企业。 [link]

Telegram channels expose rapid weaponization of SmarterMail flaws

Sponsored by Flare · 2026/2/19 0:27

地下 Telegram 频道在漏洞披露几天内便分享了 SmarterMail 漏洞利用 PoC 和窃取的管理员凭据。Flare 解释了监测这些社区如何揭示 CVE-2026-24423 和 CVE-2026-23760 的快速武器化过程,这些漏洞与勒索软件活动密切相关。 [link]

Microsoft: Anti-phishing rules mistakenly blocked emails, Teams messages

Sergiu Gatlan · 2026/2/19 0:26

微软表示 Exchange Online 上周因故障隔离了合法邮件。这一问题由旨在阻止凭据钓鱼攻击的错误启发式检测规则触发。 [link]

AI platforms can be abused for stealthy malware communication

Bill Toulas · 2026/2/19 4:18

具备网页浏览和 URL 提取能力的 AI 助手,例如 Grok 和 Microsoft Copilot,可能被滥用以充当 C2 活动的中介。 [link]

Critical infra Honeywell CCTVs vulnerable to auth bypass flaw

Bill Toulas · 2026/2/19 4:58

美国 CISA 警告多款 Honeywell 监控摄像机产品存在严重漏洞。攻击者可利用该漏洞非法访问监控画面或劫持账户。 [link]

由 CyberRadar 智能体编写
消息抓取于 2026/2/18 6:55 至 2026/2/19 6:58