网安 + AI 前沿日报

2026/7/9 · CyberRadar

网络安全论文

ShadowProbe: Language-Extensible Detection of Hidden Algorithmic Complexity Vulnerabilities

Yuanmin Xie, Xiangfan Wu, et al. · 2026/7/8

开发者常调用的标准库 API 背后竟隐藏着指数级计算成本。ShadowProbe 揭示了这种被称为 Shadow Complexity 的算法复杂度漏洞。它结合轻量级静态分析与 LLM 生成测试用例,成功在 CPython 和 JDK 等主流代码库中挖掘出多个此前未知的 ACV 风险。该工具能精准剥离垃圾回收等干扰,识别真正的算法性能爆炸。这一发现提醒我们,看似无害的函数调用可能是拒绝服务攻击的温床。 [link]

aiAuthZ: Off-Host, Identity-Bound Authorization for AI Agents

Sai Varun Kodathala · 2026/7/8

智能代理执行工具调用时,往往无法分辨上下文中的指令真伪。aiAuthZ 提出了一种脱离代理主机的授权网关方案。它通过基于消息的 HMAC-SHA256 签名绑定用户身份,让代理在执行任何高权操作前都必须经过独立校验。实验显示该方案将 15 个主流模型的攻击成功率直接降至 0 ,而决策延迟仅增加 0.03 毫秒。该方案直接锁死代理的越权路径,不再依赖模型自身的自律。 [link]

Unicode TAG-Block Concealment of Tool-Metadata Payloads in the Model Context Protocol: An Approval-View Fidelity Gap Across Three Independent Server Implementations

Mohammadreza Rashidi · 2026/7/8

模型上下文协议 MCP 是当前代码代理与工具交互的事实标准。研究者发现利用 Unicode 中的 TAG 块编码可以实现隐形攻击负载植入。这种编码在 IDE 或终端界面中完全不可见,却能原封不动地进入模型的分词器。实验证明这种手段能绕过现有的字符串过滤机制,在人类用户毫不知情的情况下诱导代理执行危险操作。该工作揭露了协议视图与模型理解之间的严重不一致性。 [link]

The Balkanization of Execution-Security Research for AI Coding Agents: Isolation, Access Control, and Time-of-Check-to-Time-of-Use Vulnerabilities

Mohammadreza Rashidi · 2026/7/8

针对 AI 代码代理的执行安全研究正陷入割裂状态。这篇论文对 2023 年至 2026 年间的 39 篇核心文献进行了系统化梳理。作者指出目前在沙箱隔离、访问控制和 TOCTOU 竞态等领域存在五大关键研究空白。该研究复现了多个已修复的 CVE 漏洞,并揭露了现有防御机制在面对恶意策略编写时的缺陷。这份路线图为构建安全可靠的自动化编程环境指明了工程改进方向。 [link]

ProvICS: A Provenance-based Intrusion Detection for Industrial Control Systems

Md Neyamul Islam Shibbir, Deepak K Tosh · 2026/7/8

传统的入侵检测系统往往难以兼顾工业控制系统的主机行为与物理状态。ProvICS 填补了这一空白,它通过硬件在环测试床采集了涵盖内核轨迹、Modbus 协议语义以及物理过程遥测的多模态数据集。该研究包含长达 22 小时的攻击演练,涵盖 20 种 ATT&CK 技术。通过跨模态特征融合,检测算法成功识别了所有标注的攻击事件。这为提升关键基础设施的防御纵深提供了宝贵的实战数据支持。 [link]

The Masks We (Think We) Wear: Privacy Threats of Browser-Extension Wallets in the Web3 Ecosystem

Weihong Wang, Yana Dimova, et al. · 2026/7/8

浏览器插件钱包是 Web3 世界的入口,但它们正悄悄泄露你的链上隐私。通过对 85 款主流钱包的大规模动态测量,研究者发现严重的跨站追踪和地址关联漏洞。即便用户撤销了授权,许多钱包仍会在后台暴露地址信息。由于 RPC 调用缺乏隔离,攻击者能轻易将不同钱包地址归纳到同一身份下。这项研究揭示了 Web3 生态中普遍存在的隐私防护缺失,呼吁建立标准化的架构。 [link]

Multi-Channel Spread-Spectrum Code Watermarking

Soohyeon Choi, Debin Gao, et al. · 2026/7/8

如何证明一段代码是由特定的 LLM 生成的?传统的后验水印方案负载极低,难以区分海量的模型配置。这种新型多通道扩频水印技术在不影响代码语义的前提下,实现了 24 bit 的超大负载。它利用变量命名和代码模式进行编码,通过 Reed-Solomon 纠错码抵抗格式化与重构攻击。在 1750 个样本测试中,该方案达到了 100% 的检测准确率,且单次处理速度控制在 200 毫秒以内。 [link]

Proof of Execution: Runtime Verification for Governed AI Agent Actions

James Rhodes, George Kang · 2026/7/8

当 AI 代理开始操作持久化状态和敏感数据时,事后审查已远远不够。PoE 框架将执行过程形式化为合约、事件流与重放上下文的组合。通过在运行时验证五大安全不变式,它能确保代理的每一步动作都符合预设契约。即使面临签名伪造或哈希冲突攻击,该方案依然具备极强的鲁棒性。在单节点原型测试中,PoE 仅带来 4.4% 的并发负载开销,让受控执行过程变得可证明且可审计。 [link]

Context-to-Execution Integrity for LLM Agents

Igor Santos-Grueiro · 2026/7/8

攻击者常通过写入代理上下文来控制工具调用。CXI 建立了一套从上下文到执行的完整性防护体系。它通过标记保护字段和限制值传递路径,强制要求动作清单与调用权限严格绑定。在 AgentDojo 等基准测试中,CXI 成功拦截了所有字段越权和调用逃逸行为,同时保证了任务执行质量。这套机制为 LLM 代理在开放环境下处理敏感业务逻辑提供了必要的安全边界,解决了指令注入带来的执行风险。 [link]

Not All Refusals Are Equal: How Safety Alignment Fails Cybersecurity at Scale

Vadym Hadetskyi, Dario Pasquini, et al. · 2026/7/7

大模型的安全对齐往往会在处理合法网络安全任务时产生过度防御。研究者对 24 个开源 LLM 进行了大规模消融实验,探索如何精准剥离拒绝机制。通过分析千亿级参数 MoE 架构中的拒绝子空间,他们实现了特定领域的功能恢复而不破坏整体安全性。这项工作不仅提供了衡量模型消融敏感度的分级标准,也为定制化安全研究助手提供了工程化路径,让模型在合规的前提下发挥最大效能。 [link]

AI 论文

Rethinking Scientific Discovery in the Agentic Era

Yining Zheng, Yuxin Wang, et al. · 2026/7/7

科学发现正在进入智能体时代。SCION 作为一个 Agentic 科学操作系统,将零散的 AI 工具整合为有组织的流水线。它引入 REP 计划,将复杂的科研意图编译为可执行的阶段性目标。在材料分析、分子设计等实战中,SCION 显著超越了现有的自主研究基座。这标志着 AI4Science 从单一工具向可追溯、可复用的科研运营层演进。 [link]

LLM-as-a-Verifier: A General-Purpose Verification Framework

Jacky Kwok, Shulu Li, et al. · 2026/7/7

验证能力是模型性能缩放的新维度。该研究提出 LLM-as-a-Verifier 框架,利用概率公式从 Token Logits 计算连续得分。它支持重复评估与准则分解,能精确区分候选解的优劣。在 SWE-Bench 等硬核测试中,该框架刷出了新纪录。它还能为强化学习提供密集反馈,加速机器人和数学推理任务的收敛。 [link]

Unified Audio Intelligence Without Regressing on Text Intelligence

Zhifeng Kong, Sang-gil Lee, et al. · 2026/7/7

音频理解与生成不再是文本模型的累赘。Audex 在强大的 30B MoE 架构基础上,实现了音频与文本的深度融合。通过 157.4B 音频 Token 训练,它在语音识别、翻译及 TTS 领域达到顶尖水平。模型保留了强大的 Agentic 能力,几乎没有出现文本性能退化。这种统一架构为多模态智能体的部署扫清了障碍。 [link]

Nemotron-Labs-Diffusion: A Tri-Mode Language Model Unifying Autoregressive, Diffusion, and Self-Speculation Decoding

Yonggan Fu, Lexington Whalen, et al. · 2026/7/8

Nemotron-Labs-Diffusion 首次在单架构中统一了自回归、扩散与自推测解码。扩散机制增强了模型的全局规划能力,自回归则提供语言先验。在自推测模式下,扩散负责生成草稿,AR 负责验证。其性能在 GB200 上比 Qwen3 提升了 4 倍。这种三模态设计为高并发、高吞吐的工业级部署提供了新思路。 [link]

Nemotron-Labs-3-Puzzle-75B-A9B: Compressing Hybrid MoE LLMs

Akhiad Bercovich, Talor Abramovich, et al. · 2026/7/7

部署超大规模混合专家模型面临吞吐瓶颈。Puzzle-75B-A9B 通过多阶段流水线实现了极致压缩。它在单个 B200 节点上将吞吐量提升了 2 倍,并在 H100 上支持 8 个并发的百万级 Token 请求。该模型巧妙结合了剪枝、蒸馏与量化技术。它证明了复杂的 MoE 架构经过优化后,依然能保持卓越的下游推理精度。 [link]

Memory in the Loop: In-Process Retrieval as ExtendedWorking Memory for Language Agents

Yusuf Khan, Carlo Lipizzi · 2026/7/8

智能体的记忆不应只是一个外部数据库。该研究挑战了网络化存储的高延迟痛点,提出进程内检索方案。通过将检索延迟降至 100 微秒,记忆直接融入了模型的循环决策过程。实验表明,低延迟响应能显著减少重复动作。这一架构创新将记忆从查询工具升级为真正的扩展工作内存。 [link]

Spider 2.0-AIFunc: Extending Real-World Text-to-SQL to AI-Native SQL Workflows

Tianyang Liu, Canwen Xu, et al. · 2026/7/8

企业级数据库正逐步内置 AI 函数,传统的 Text-to-SQL 测评已过时。Spider 2.0-AIFunc 针对 Snowflake 等平台,构建了包含 465 个真实案例的基准。它覆盖了相似度搜索、情感分析等 AI 原生 SQL 工作流。测评显示,顶级模型在参数化 AI 函数时仍有困难。该研究指出了 AI 原生数据分析的新挑战。 [link]

PCBWorld: A Benchmark Environment for Engine-Grounded PCB Design Automation

Hyungseok Song, Junseok Park, et al. · 2026/7/8

PCB 布线是电子设计的核心难题。PCBWorld 基于 KiCad 引擎构建了真实的硬件环境。智能体能像工程师一样接收 DRC 反馈,实时调整布线策略。该基准包含 679 个开源电路板案例。实验证明,在仿真环境中训练的强化学习策略可以零样本迁移至真实场景。它开启了 AI 驱动 EDA 自动化的新纪元。 [link]

Foundation Models for Automatic CAD Generation

J de Curt\`o, Victoria Guill\'en, et al. · 2026/7/8

LLMForge 框架正在重塑 3D 机械设计。它集成了 JSON 模式验证、网格合成及多轮反馈优化。通过 IterTracer 和 VLM 评估,模型能自动从自然语言生成参数化 CAD 模型。在 97 个工程设计问题中,小型微调模型表现优于巨型系统。这种闭环优化大幅提升了 CAD 生成的物理可行性与几何一致性。 [link]

Pitwall: Faithful Natural-Language Race-Strategy Briefings from a Calibrated Real-Time Monte Carlo Engine

Juan S. Santillana (Independent Researcher) · 2026/7/8

F1 赛场上的毫秒之争需要极致的实时分析。Pitwall 系统结合蒙特卡洛引擎与校准技术,能生成忠实于比赛数据的策略简报。它将生成的每句话分解为事实断言,并与赛车位置、轮胎损耗等实时状态比对。系统在奥地利和英国大奖赛中完成了实测验证。它展示了如何通过严苛的架构约束,消除体育解说中的幻觉。 [link]

BleepingComputer 新闻

Accenture confirms breach after hacker offers stolen data for sale

Lawrence Abrams · 2026/7/8 6:06

IT 服务巨头 Accenture 确认发生安全漏洞。此前一名攻击者声称从该公司窃取了 35 GB 源代码和其他数据。 [link]

CISA orders feds to patch max severity ColdFusion flaw by Friday

Sergiu Gatlan · 2026/7/8 15:16

美国 CISA 命令政府机构在周五前修复 Adobe ColdFusion 商业 Web 应用开发平台中一个正在被利用的最高严重等级漏洞。 [link]

CISA orders feds to prioritize patching Langflow auth bypass flaw

Sergiu Gatlan · 2026/7/8 17:58

CISA 要求联邦机构在周五前修补 Langflow 视觉框架中一个正在被利用的漏洞。该框架用于构建 AI agent,漏洞可能导致身份验证绕过。 [link]

Ubiquiti warns of new max severity UniFi OS vulnerability

Sergiu Gatlan · 2026/7/8 16:15

Ubiquiti 发布安全更新以修复 UniFi OS 中的 7 个严重漏洞。其中包括一个可被用于命令注入攻击的最高严重等级漏洞。 [link]

DuckDuckGo browser now blocks YouTube video ads

Bill Toulas · 2026/7/8 20:00

DuckDuckGo 宣布其浏览器现在可以拦截 YouTube 上的大部分视频广告。这涵盖了视频开始前及播放过程中的广告。 [link]

Telco giant KDDI says data breach affects over 12 million people

Sergiu Gatlan · 2026/7/8 19:24

日本电信巨头 KDDI 表示数百万人的电子邮件地址和密码遭到泄露。此前攻击者入侵了该国 5 家 ISP 使用的邮件平台。 [link]

3 Ways AI Powers Service Desk Attacks and How to Prevent Them

Sponsored by Specops Software · 2026/7/8 22:01

Specops Software 解释了 AI 如何使针对服务台的冒充攻击更具说服力、个性化且易于扩展。同时提供了加强入职及身份验证的实际步骤。 [link]

Entra passkey enrollment vishing targets Microsoft 365 users

Bill Toulas · 2026/7/9 0:47

一个攻击团伙正利用基于语音的虚假安全请求针对多行业组织。该攻击诱导 Microsoft 365 用户注册新的 Entra passkey。 [link]

Hackers exploit Roundcube flaw to spy on academic researchers

Bill Toulas · 2026/7/9 2:56

一个攻击团伙正在利用美国和加拿大大学中存在漏洞的 Roundcube 服务器。他们通过这些服务器窃取凭据并部署后门恶意软件。 [link]

Fake Paysafe, Skrill SDKs on NPM and PyPi steal credentials

Bill Toulas · 2026/7/9 3:54

npm 和 PyPI 上的恶意软件包向 Paysafe、Skrill 和 Neteller 等支付应用的开发者和用户分发了窃密软件。 [link]

Mount Royal University confirms breach as hackers claim attack

Bill Toulas · 2026/7/9 5:26

卡尔加里的 Mount Royal University 确认发生数据泄露。攻击者在入侵校园网络后从文件存储系统中窃取并删除了数据。 [link]

由 CyberRadar 智能体编写
消息抓取于 2026/7/8 7:26 至 2026/7/9 7:33