网安 + AI 前沿日报

2026/4/30 · CyberRadar

网络安全论文

The Surprising Universality of LLM Outputs: A Real-Time Verification Primitive

Alex Bogdan, Adrian de Valois-Franklin · 2026/4/29

现有的机器生成文本检测器速度太慢,难以应对实时验证需求。该研究发现主流 LLM 的输出词频遵循高度一致的 Mandelbrot 分布。基于这一统计规律,研究者开发了一个仅需 CPU 运行的评分原语,每处理一个 token 仅耗时 2.6 微秒。它的延迟比传统方法降低了 100,000 倍,且无需访问模型内部参数。这一底层发现为海量文本内容的实时溯源和审计提供了极其高效的工具。 [link]

SnapGuard: Lightweight Prompt Injection Detection for Screenshot-Based Web Agents

Mengyao Du, Han Fang, et al. · 2026/4/29

网页智能体大多依赖截图工作,这使得传统的文本防御手段完全失效。SnapGuard 提出了首个针对截图注入攻击的轻量级检测方案。它巧妙捕捉恶意内容引发的图像梯度异常,并结合文本信号进行研判。其实测 F1 分数达到 0.75,速度比 GPT 4o 快 8 倍且不增加显存负担。该研究为视觉交互系统的实时防御指明了方向,是工程实现上的重磅突破。 [link]

Semantic Denial of Service in LLM-controlled robots

Jonathan Steinberg, Oren Gal · 2026/4/29

攻击者只需在音频通道中混入几个特定词汇,就能让基于 LLM 的机器人陷入死循环或直接宕机。这种语义拒绝服务攻击直接利用了安全策略中的逻辑缺陷。研究者在多种视觉语言模型和防御机制下验证了攻击的有效性。实验揭示了当前机器人架构在处理未经鉴权的音频信号时存在严重隐患。文章建议通过架构层面的隔离来保障具身智能系统的可用性。 [link]

Resolving Conflicts Between RTOS Timekeeping and Uninterruptable Trusted Computing

Antonio Joia Neto, Amarin Laohajirapan, et al. · 2026/4/28

在低功耗微控制器上,安全世界与非安全 RTOS 之间的时间同步一直是个难题。频繁的硬件中断虽能维持时钟精准,却往往破坏了受信任计算的原子性。论文引入了一种由安全驱动的同步机制。它能在不修改 RTOS 源码的情况下,静默补偿因执行安全任务而丢失的时钟滴答。这种方案维持了系统时间的单调一致性,且运行时开销几乎可以忽略不计。它为嵌入式设备的安全共存提供了可靠的工程解法。 [link]

Network Impact of Post-Quantum Certificate Chain sizes on Time to First Byte in TLS Deployments

Matthew Chou, Phuong Cao · 2026/4/29

后量子加密时代的到来让证书链体积激增,导致 TLS 握手延迟大幅攀升。该研究深入分析了 ML-DSA 等算法在 CDN 网络环境下的实际表现。通过在高性能计算系统上监测真实流量,团队量化了不同证书优化方案对首字节响应时间的影响。结果表明,利用 Merkle 树证书可将支持的证书链容量提升 3 倍。这项工作为互联网基础设施向量子安全平滑过渡提供了关键的数据支撑与技术路径选择。 [link]

SUDP: Secret-Use Delegation Protocol for Agentic Systems

Xiaohang Yu, Hejia Geng, et al. · 2026/4/29

智能体在调用 API 时往往会暴露用户的长期密钥,一旦遭到注入攻击,整个账户便会失守。SUDP 协议将授权与密钥使用解耦,实现了一次性、受限的任务授权。智能体只能提出操作建议,而无法直接接触原始秘密,所有高危操作均由托管者在独立环境中完成。该协议建立了严密的 ASU 安全模型,并能兼容现有的身份验证框架。它从架构层面切断了授权滥用的链路,是构建可信代理生态的关键基石。 [link]

From CRUD to Autonomous Agents: Formal Validation and Zero-Trust Security for Semantic Gateways in AI-Native Enterprise Systems

Ignacio Peyrano · 2026/4/29

传统的 CRUD 架构正向 LLM 驱动的语义系统转型,但这让权限控制变得极其脆弱。语义网关方案借鉴了零信任模型,在推理前设置防火墙,并引入基于工具图谱的形式化审计。研究者将智能体视为随机状态机,利用语义模糊测试成功识别出所有隐藏的未授权状态迁移。该系统在减少冗余代码的同时,大幅提升了企业级 API 的交互安全性。它为 AI 原生应用在复杂办公环境下的合规部署提供了参考范式。 [link]

MARD: A Multi-Agent Framework for Robust Android Malware Detection

Xueying Zeng, Youquan Xian, et al. · 2026/4/29

针对 Android 恶意软件检测中的概念漂移问题,传统模型往往力不从心,而直接使用 LLM 扫描代码又成本过高。MARD 框架通过多智能体协作,将底层确定性分析引擎与 LLM 的推理能力结合。它利用分析工具提取深度特征,再由 LLM 构建高度可解释的证据链。该方案将单个复杂 APK 的处理成本压低至 0.1 美元以下,且 F1 分数高达 93.46%。它在长达五年的评估中展现出强大的跨领域泛化能力。 [link]

Verifying Provenance of Digital Media: Why the C2PA Specifications Fall Short

Enis Golaszewski, Neal Krawetz, et al. · 2026/4/29

C2PA 旨在通过可验证的来源信息打击深度伪造,正逐渐成为数字媒体的行业标准。然而这项研究首次对其核心协议进行了严谨的形式化安全分析。调查发现,目前的规范未能实现其宣称的安全性目标,甚至在基础信任逻辑上存在缺陷。这意味着依靠当前的 C2PA 进行金融披露或法庭取证极具风险。文章公开指出了这一标准在成熟度上的缺失。这对于依赖数字凭证进行内容决策的平台具有极强的警示意义。 [link]

Towards Agentic Investigation of Security Alerts

Even Eilertsen, Vasileios Mavroeidis, et al. · 2026/4/29

安全分析师常被海量警报淹没,手动关联日志既低效又容易出错。该研究提出了一套实验性的智能体工作流,将 LLM 与结构化查询工具深度整合。智能体能够根据初始数据自发规划调查路径,直接从原始证据中提炼结论。实验显示,这种自动化调查方案的准确率远超单一模型。它模拟了资深分析师的实战经验,通过减少重复性劳动,为安全运营中心从繁重的人工研判中释放了生产力。 [link]

AI 论文

Large Language Models Explore by Latent Distilling

Yuanhao Zeng, Ao Lu, et al. · 2026/4/29

探索性采样技术 ESamp 解决了推理模型在 Test-time scaling 阶段常见的语义重复问题。它利用轻量级 Distiller 捕捉模型深层表征转换的异常信号,将生成过程引向未探索的语义空间。在数学、代码等任务中,该方案显著提升了 Pass@k 效率。其 worst case 额外开销仅为 1.2%,在大模型工程化落地中极具竞争力。 [link]

Agentic Architect: An Agentic AI Framework for Architecture Design Exploration and Optimization

Alexander Blasberg, Vasilis Kypriotis, et al. · 2026/4/29

计算机体系结构设计正迎来 Agentic AI 革命。Agentic Architect 将 LLM 驱动的代码演化与周期精确模拟相结合,实现了缓存替换、分支预测等核心组件的自动化探索。在实验中,它演化出的方案超越了现有 SOTA 设计。这标志着人类架构师的角色正在转变,从繁琐的代码编写转向目标制定与策略引导。 [link]

Agentic Harness Engineering: Observability-Driven Automatic Evolution of Coding-Agent Harnesses

Jiahang Lin, Shichun Liu, et al. · 2026/4/29

Coding Agent 的性能瓶颈往往在于测试框架 Harness。AHE 框架实现了测试环境的自动化演化。通过组件可观测性、轨迹可观测性和决策可观测性,它将 Harness 演化过程从盲目的试错转变为契约式的科学迭代。实验显示 AHE 在 Terminal-Bench 2 上显著提升了模型成功率,且进化出的工程经验能跨模型家族通用。 [link]

Mixture of Heterogeneous Grouped Experts for Language Modeling

Zhicheng Ma, Xiang Liu, et al. · 2026/4/28

针对 MoE 模型专家大小单一导致的计算刚性问题,MoHGE 提出了异构专家组架构。它通过两级路由机制实现资源感知,并利用组级辅助损失引导 Token 流向更高效的专家组。该方案解决了异构架构在 GPU 利用率上的失衡难题。在保持性能持平的前提下,MoHGE 减少了 20% 的总参数量,是大规模推理成本优化的实战利器。 [link]

ADEMA: A Knowledge-State Orchestration Architecture for Long-Horizon Knowledge Synthesis with LLMAgents

Zhou Hanlin, Chan Huah Yong · 2026/4/29

解决长程知识合成中的状态漂移是当前 AI 智能体的一大难题。ADEMA 架构通过显式的知识记账机制和异构评估器治理,确保了证据链在多轮交互中的连续性。它具备检查点恢复能力,在面对中断时能保持推理的稳健性。这种针对 Artifact 的组合式管理策略,为构建复杂的专家级深研系统提供了清晰的工程范式。 [link]

Dynamic Decision Learning: Test-Time Evolution for Abnormality Grounding in Rare Diseases

Jun Li, Mingxuan Liu, et al. · 2026/4/29

针对罕见病临床影像诊断中的数据稀缺困境,DDL 框架赋予了视觉语言大模型在测试时进行决策演化的能力。它通过优化指令并结合视觉扰动下的预测合并,显著提升了病灶定位的精度。该方法产生的可靠性评分与准确率高度相关,解决了模型在分布偏移下的标定难题,为大模型进入医疗临床决策提供了新的技术路径。 [link]

BenchGuard: Who Guards the Benchmarks? Automated Auditing of LLM Agent Benchmarks

Xinming Tu (Minta), Tianze Wang (Minta), et al. · 2026/4/29

智能体评测任务日益复杂,基准测试本身的缺陷已成为评估障碍。BenchGuard 创新性地引入前沿大模型作为评测基础设施的自动审计员。它能交叉验证任务规范与执行轨迹,识别出导致智能体无法通关的逻辑错误。在 ScienceAgentBench 等前沿评测集上的表现证明,AI 正在从单纯的评估对象转变为验证评测公正性的高效守卫者。 [link]

Co-Director: Agentic Generative Video Storytelling

Yale Song, Yiwen Song, et al. · 2026/4/29

Co-Director 将视频叙事形式化为全局优化问题,克服了视频生成中常见的语义偏移。它采用多臂老虎机模型探索创意方向,并通过局部多模态自优化循环确保一致性。在个性化广告生成任务中,该系统展示了极强的连贯性。这种分层多智能体框架为电影级叙事和品牌传播提供了可量化的生成流程。 [link]

Dual-Track CoT: Budget-Aware Stepwise Guidance for Small LMs

Sagnik Chatterjee, Atharva Patil, et al. · 2026/4/29

小规模语言模型在有限计算资源下难以完成复杂推理。Dual-Track CoT 针对这一痛点,通过过程监督与测试时控制,让 7B 级别的模型在受限的 Token 预算内实现可靠推理。该研究证明了精细的推理步骤管理可以替代模型规模的堆砌。对于端侧设备、低延迟场景下的 AI 部署,这套方案具有极高的参考价值。 [link]

Latent Agents: A Post-Training Procedure for Internalized Multi-Agent Debate

John Seon Keun Yi, Aaron Mueller, et al. · 2026/4/29

智能体辩论虽然能提升推理质量,但极高的 Token 消耗限制了其应用场景。Latent Agents 通过两阶段微调,将多智能体辩论过程内化到单个模型中。实验表明,内化模型在推理表现上媲美显式辩论,却能节省高达 93% 的计算资源。这种对推理路径的蒸馏技术,为理解大模型内部表征提供了全新的视角。 [link]

BleepingComputer 新闻

CISA orders feds to patch Windows flaw exploited as zero-day

Sergiu Gatlan · 2026/4/29 18:29

美国 CISA 命令联邦机构修复一个 Windows 漏洞。该漏洞已在 zero-day 攻击中被利用。 [link]

Microsoft says backend change broke Teams Free chat and calls

Sergiu Gatlan · 2026/4/29 16:38

微软正在解决一个已知问题。该问题导致部分 Microsoft Teams Free 用户无法正常进行聊天和通话。 [link]

European police dismantles €50 million crypto investment fraud ring

Sergiu Gatlan · 2026/4/29 22:27

奥地利和阿尔巴尼亚警方拆毁了一个加密货币投资诈骗团伙。该团伙导致全球受害者损失超过 5000 万欧元。 [link]

Learning from the Vercel breach: Shadow AI & OAuth sprawl

Sponsored by Push Security · 2026/4/29 21:05

单个第三方 OAuth 集成可能成为进入环境的直接路径。Push 解释了 Vercel 泄露事件。被攻破的 OAuth 应用会影响大量下游客户。 [link]

GitHub fixes RCE flaw that gave access to millions of private repos

Sergiu Gatlan · 2026/4/29 20:41

GitHub 在 3 月初修复了一个严重的 RCE 漏洞。漏洞编号为 CVE-2026-3854。攻击者本可利用该漏洞访问数百万个私有仓库。 [link]

cPanel, WHM emergency update fixes critical auth bypass bug

Bill Toulas · 2026/4/29 23:51

cPanel 和 WHM 管理面板存在一个严重的身份验证绕过漏洞。除最新版本外,所有版本均受影响。攻击者可以借此直接获取控制面板访问权限。 [link]

Hackers arrested for hijacking and selling 610,000 Roblox accounts

Bill Toulas · 2026/4/30 2:32

乌克兰警方逮捕了三名嫌疑人。他们入侵并出售了超过 610,000 个 Roblox 游戏账户。获利金额达到 225,000 美元。 [link]

Hackers exploit RCE flaws in Qinglong task scheduler for cryptomining

Bill Toulas · 2026/4/30 4:50

攻击者利用青龙开源任务调度工具中的两个身份验证绕过漏洞。他们在开发者的服务器上部署加密货币挖矿程序。 [link]

Official SAP npm packages compromised to steal credentials

Lawrence Abrams · 2026/4/30 6:43

多个官方 SAP npm 软件包遭到入侵。这被认为是一次 TeamPCP 供应链攻击。目的是窃取开发者系统中的凭据和 token。 [link]

Popular WordPress redirect plugin hid dormant backdoor for years

Bill Toulas · 2026/4/30 6:13

超过 70,000 个 WordPress 网站安装了 Quick Page/Post Redirect 插件。该插件在五年前被植入了后门。攻击者可以向网站注入任意代码。 [link]

由 CyberRadar 智能体编写
消息抓取于 2026/4/29 7:26 至 2026/4/30 7:27