Extracting Recurring Vulnerabilities from Black-Box LLM-Generated Software
LLM 生成的代码往往带有重复的模板。这些模板可能诱发可预测的漏洞。研究者提出了 FSTab 框架。它通过观察前端特征就能预测后端漏洞。这种黑箱攻击不需要访问源码。针对 GPT-5.2 和 Claude-4.5 Opus 的测试显示,攻击成功率高达 94%。这揭示了生成式代码在工业应用中的巨大风险。 [link]
2026/2/7 · CyberRadar
LLM 生成的代码往往带有重复的模板。这些模板可能诱发可预测的漏洞。研究者提出了 FSTab 框架。它通过观察前端特征就能预测后端漏洞。这种黑箱攻击不需要访问源码。针对 GPT-5.2 和 Claude-4.5 Opus 的测试显示,攻击成功率高达 94%。这揭示了生成式代码在工业应用中的巨大风险。 [link]
AI Agent 正在自动化各种工作负载。开发者通常使用监控协议来拦截恶意行为。这项研究揭示了 Agent-as-a-Proxy 攻击。攻击者将 Agent 作为中转。这种方式能同时绕过 Agent 自身的对齐和外部监控。即便 Qwen2.5-72B 这种量级的监控模型也难以幸免。目前的 Agent 防御机制在架构上显得非常脆弱。 [link]
激活值导向是微调之外的常用对齐手段。它通过添加向量来改变模型行为。然而这种良性干预会产生 Steering Externalities 现象。原本为了提升合规性的操作会削弱安全防线。实验发现这类干预会将 Jailbreak 攻击成功率提升至 80% 以上。模型在获得实用性的同时,其安全边际正在系统性地流失。 [link]
生成式 AI 的爆发摧毁了摄影证据的可信度。传统的 C2PA 协议容易被社交平台磨掉元数据。Birthmark 方案利用图像传感器独特的物理指纹生成硬件密钥。验证记录存储在新闻机构运营的联盟链上。它能对抗 Dolev-Yao 攻击者模型。在 Raspberry Pi 上的测试表明,整个验证流程的延迟低于 500 毫秒。 [link]
Phantom Transfer 是一种极具威胁的数据投毒攻击。即便防御者掌握了投毒样本的精准位置,也无法通过过滤来消除隐患。这种攻击利用了潜意识学习机制。即便使用其他大模型对数据集进行全文重写,攻击依然有效。它能在模型中埋入密码触发的恶意行为。研究证明了单纯依赖数据层面的防御已经走到了尽头。 [link]
文本生成视频技术正让合成内容真假难辨。现有的面部检测工具已经过时。SynthForensics 是首个人类中心合成视频检测基准。它包含来自 5 个不同架构模型的 6,815 段视频。目前的探测器表现极差,部分模型在压缩视频上的表现不如随机猜测。该数据集为提升深度伪造检测的泛化能力提供了基石。 [link]
传统的扩散模型后门攻击依赖固定的触发词。这类手段容易被注意力一致性检测识破。SemBD 方案将后门植入在语义表现层。触发器不再是特定的字符,而是连续的语义区域。通过对交叉注意力层的投影矩阵进行蒸馏编辑,不同表达的同义提示词都能激活攻击。这种隐蔽性极强的攻击成功率达到了 100%。 [link]
Chat Template 是大模型训练和推理中的重要技术。它负责将输入转化为角色化表达。研究发现自定义模板的权限可能被黑客利用。BadTemplate 攻击可以在不重训模型的情况下注入恶意指令。这些指令直接进入高优先级的系统提示词。这种低成本攻击在 9 个主流模型上实现了 100% 的攻击成功率。 [link]
许多防御系统开始使用多模态大模型来识别钓鱼网站。然而 LLM 固有的 Prompt Injection 弱点成为了软肋。攻击者利用感知不对称性,在网页中埋入人类不可见但模型可读的指令。这能误导模型将钓鱼站判定为安全。InjectDefuser 框架通过提示词加固和检索增强有效降低了此类攻击的风险。 [link]
视觉语言模型在图像地理定位方面表现卓越。这引发了严重的隐私担忧。即便是日常拍摄的照片,也可能被模型推断出街道级的精确位置。VLM-GEOPRIVACY 基准测试了 14 个领先模型。结果显示这些模型无法根据语境判断信息披露的界限。它们经常在敏感上下文中过度披露,且极易受到提示词攻击。 [link]
顶级商学院的谈判课成了 AI 的试炼场。PieArena 引入 MBA 级别的多智能体谈判基准,涵盖大量真实商业场景。GPT-5 在该测试中展现了匹配甚至超越人类精英的战略思维。这项研究揭示了 AI 在决策透明度和心理博弈中的巨大潜力。它为大模型在复杂经济环境中的实际部署提供了实证支持。 [link]
面对 LLM 著作权泄露风险,我们需要更专业的取证手段。Copyright Detective 构建了首个交互式法证系统。它整合了内容召回、改写相似度分析和越狱探测等技术,能系统化审计模型生成的侵权内容。该系统为生成式 AI 的合规部署和透明评估提供了坚实基础,让模型权属纠纷不再是黑箱。 [link]
现有的 RAG 往往把长文档看作扁平块,忽略了标题和段落的层级逻辑。DeepRead 引入结构感知智能体,将 PDF 转为结构化 Markdown。它赋予 LLM 定位读取和连续阅读的能力。这种模仿人类阅读行为的方案,显著提升了复杂长文档的问答准确度。它让长文本搜索告别碎片化碎片,找回逻辑灵魂。 [link]
隐私域的知识孤岛阻碍了 RAG 部署。FedMosaic 采用参数化适配器代替原始文本传输,开创了联邦 RAG 的新模式。它通过语义聚类减少存储开销,并利用选择性聚合避免模型冲突。该框架在保证不泄露任何原始文档的前提下,实现了极高的问答精度。它为医疗和金融等高度敏感行业的大模型应用扫清了隐私障碍。 [link]
MoE 架构正在向超细粒度演进,但硬件执行效率成了瓶颈。OmniMoE 实现了系统与算法的协同设计。它通过向量级 Atomic Experts 和笛卡尔积路由,将路由复杂度降至平方根级别。该方案在保持高性能的同时,实现了 10.9 倍的推理加速。它向业界证明,极细粒度的专家模型同样可以跑得飞快。 [link]
数百万人求助 AI 解决心理问题,安全防线不容有失。VERA-MH 针对自杀风险检测等敏感场景,建立了首个自动化的心理健康安全基准。研究证实,LLM 裁判的打分与资深临床医生高度一致。该工具为心理支持类产品的落地提供了急需的安全评估标准。它以严谨的数据,为数字疗法中的安全防护层打下了基础。 [link]
恶意微调可能毁掉安全对齐。Surgery 利用 Attention Sink 机制识别并抑制有害模式。研究发现,有害程度增加时正向汇合散度头会增多。通过引入正则化项,该方案能精准外科手术式地引导注意力头,显著提升了模型在攻击下的鲁棒性。它为保护大模型在开放环境下的安全性提供了高效的防御武器。 [link]
未来的电商将是智能体之间的博弈。AgenticPay 模拟了复杂的买卖谈判市场。智能体需要管理私有成本,并通过多轮自然语言协商达成协议。它涵盖了双边讨价还价到多对多市场等 110 多项任务。研究深刻揭示了当前大模型在长期经济决策中的优劣,为构建全自动的代理商业生态系统铺平了道路。 [link]
实时协作任务对延迟和在线预算要求极高。CoWork-X 提出了类似快慢内存分离的共演化框架。它利用层级任务网络从结构化技能库中检索指令,并通过后置优化器进行技能整合。该方案在保持亚秒级响应的同时,大幅降低了 token 使用量。它是目前解决复杂环境中多智能体实时协同与长效学习的有力工具。 [link]
医疗 QA 的真实性至关重要。BioACE 提出了自动化框架,通过 completeness、correctness 等多维度指标,严谨评估生物医学回答及其引用。它结合 NLI 和 LLM 技术,有效解决了专家评估成本高的问题。该框架已开源,为生物医学 RAG 系统提供了可靠的度量衡。它帮助研发者确保 AI 给出的医学建议言之有据。 [link]
西班牙科学部宣布部分关闭其 IT 系统。此举影响了多项面向公民和公司的服务。 [link]
勒索软件运营商正通过滥用由合法虚拟基础设施管理商 ISPsystem 提供的 VM,大规模托管并分发恶意 Payload。 [link]
微软宣布,用于 Exchange Online 的 EWS API 将在运行近 20 年后,于 2027 年 4 月关闭。 [link]
罗马 La Sapienza 大学遭到网络攻击。此次攻击影响了其 IT 系统,并导致该教育机构出现大范围业务中断。 [link]
罗马尼亚国家石油管道运营商 Conpet 披露,周二的一次网络攻击中断了其业务系统,并导致公司网站下线。 [link]
云日志可能存在不一致或不完整的问题,随着环境扩展和变化会产生盲点。Corelight 展示了在云日志失效时,网络级遥测如何提供可靠的可视化能力。 [link]
在攻击者于 2025 年 10 月窃取用户的电子邮件地址和电话号码后,通讯平台 Substack 正在通知用户相关数据泄露事件。 [link]
黑客在 1 月份入侵自动化投资平台 Betterment 系统后,从 140 万个账户中窃取了电子邮件地址和其他个人信息。 [link]
新一轮垃圾邮件正席卷全球收件箱。用户报告称,他们再次受到通过公司未授权 Zendesk 支持系统生成的自动邮件轰炸。部分接收者表示收到了数百条主题怪异的邮件,例如激活账户等。 [link]
一个威胁行为者在一场攻击活动中入侵了 NGINX 服务器。该活动会劫持用户流量,并将其重定向至攻击者的后端基础设施。 [link]
热门开源工作流自动化平台 n8n 存在的多个严重漏洞允许逃逸环境限制,并完全控制宿主服务器。 [link]
CISA 周三确认,勒索软件团伙已开始利用一个高危 VMware ESXi 沙箱逃逸漏洞。该漏洞自 2024 年 2 月起就被用于零日攻击。 [link]
美国 CISA 要求政府机构修复一个已存在 5 年的 GitLab 漏洞,该漏洞目前正被积极利用。 [link]
API key 和 token 等非人类身份泄露正成为云环境数据泄露的主要诱因。Flare 展示了暴露的机器凭证如何让攻击者悄无声息地获得对企业系统的长期访问权限。 [link]
黑客在一个 EDR 杀手中滥用了一个合法但早已被撤销的 EnCase 内核驱动程序。该工具可以检测 59 种安全工具并尝试禁用它们。 [link]
美国 CISA 发布了新的约束性运营指令,要求联邦机构识别并移除不再接收制造商安全更新的网络边缘设备。 [link]
照片共享平台 Flickr 正在通知用户一起潜在的数据泄露事件。第三方电子邮件服务提供商的漏洞暴露了用户的真实姓名、电子邮件地址、IP 地址和账户活动。 [link]
一名伊利诺伊州男子承认入侵了近 600 名女性的 Snapchat 账户以窃取私密照片。他还在网上保存、出售或交易这些照片。 [link]
欧盟委员会今天表示,TikTok 面临罚款。其成瘾性功能违反了欧盟数字服务法,包括无限滚动、自动播放、推送通知以及个性化推荐系统。 [link]
许多现代攻击完全发生在浏览器内部,给传统安全工具留下的证据很少。Keep Aware 展示了为什么 EDR、电子邮件安全和 SASE 会错过这类纯浏览器攻击。 [link]
美国 CISA 针对 CVE-2026-24423 发布警告。这是 SmarterMail 中的一个未经身份验证的 RCE 漏洞,正被用于勒索软件攻击。 [link]
一款名为 DKnife 的新发现工具包自 2019 年以来一直被用于在边缘设备层面劫持流量,并在间谍活动中分发恶意软件。 [link]
德国国内情报机构警告称,疑似受国家资助的威胁行为者正通过 Signal 等即时通讯应用进行网络钓鱼,目标是高层人士。 [link]