网安 + AI 前沿日报

2026/7/8 · CyberRadar

网络安全论文

Git Hash Chain Malleability

Jacob Ginesin · 2026/7/7

签名真的不可伪造吗?研究发现 Git 哈希链存在延展性漏洞。攻击者无需密钥即可生成哈希不同但签名验证通过的提交。 GitHub 的 Verified 徽章也无法幸免。研究者揭示了 ECDSA 和 RSA 等签名在 Git 协议中的结构性缺陷。该漏洞可能导致依赖锁定失效。这挑战了 Git 的完整性假设,也对软件供应链安全提出了严峻警告。 [link]

Ghost Traffic: ICMP Tunneling-Based Billing Bypass in LTE Networks

Jung Jin Kim, Sungyup Nam, et al. · 2026/7/7

免费上网的漏洞依然存在。 Ghost Traffic 利用 LTE 网络中 ICMP 计费策略的盲点,实现了免流上网。即使手机未 root ,也能通过 Android 的 VpnService 隧道绕过流量统计。研究在美日韩 7 家运营商中进行了实测,多处环境成功触发。由于 ICMP 常被视为控制流量而非数据,这一运维习惯成了计费系统的阿喀琉斯之踵。防御方案已提交给受影响的厂商。 [link]

MOSAIC: Knowledge-Guided CLI Command Composition Attack in LLM Coding Agents

Jiangrong Wu, Huaijin Wang, et al. · 2026/7/7

智能代码 Agent 正在成为开发者帮手,但也引入了全新的攻击面。 MOSAIC 揭示了一种基于命令组合的新型攻击。攻击者通过构造看似良性的 CLI 命令序列,在操作系统状态中埋下陷阱。当 Agent 顺序执行这些工具时,便会触发提权或泄露。实验显示其在 5 个真实 Agent 上的攻击成功率高达 96.59 % 。这是一次对 Agent 逻辑连贯性的深度侧击。 [link]

DualView: Preventing Indirect Prompt Injection in Personal AI Agents

Juhee Kim, Woohyuk Choi, et al. · 2026/7/7

个人 AI Agent 在处理本地文件和邮件时,极易受到间接提示注入攻击。 DualView 针对存储型注入提出了创新的双视图方案。它在 Agent 上下文之外通过文件系统和网络钩子追踪不信任数据。 Agent 视角下看到的是占位符标签,而用户视角则保留原始数据。这种隔离机制从根源上切断了恶意代码执行路径。系统已作为插件在 OpenClaw 中部署,且几乎不损失性能。 [link]

Measuring Healthcare Data Leaks and Security Flaws at Internet Scale

Nico Br\"uggemann, Lukas Schmidt, et al. · 2026/7/7

互联网上的医疗隐私正在裸奔。这是一项针对 DICOM 、 HL7 和 FHIR 等核心医疗协议的全球扫描研究。结果显示大量医疗系统暴露在公网且存在认证漏洞。研究者发现了数千个未授权即可访问的节点,数百万份患者记录面临泄露风险。许多系统甚至不支持传输加密,或者运行着包含已知高危漏洞的陈旧软件。这项研究为医疗数字化转型的安全底座敲响了警钟。 [link]

PathMark: Protecting Intellectual Property of Mixture-of-Expert LLMs via Path Watermarks

Yudong Gao, Qingyue Wang, et al. · 2026/7/7

MoE 架构的大模型越来越普及,但其版权保护却是难题。 PathMark 是首个专门为 MoE 设计的水印方案。它利用 MoE 独有的动态路由机制,通过引导 Token 进入特定专家组合来嵌入指纹。这种水印隐蔽性极强,且对量化和剪枝等模型压缩手段具有极佳的鲁棒性。验证过程支持黑盒模式,在保证输出质量的同时,为昂贵的智力资产打上了无法擦除的烙印。 [link]

Agent Data Injection Attacks are Realistic Threats to AI Agents

Woohyuk Choi, Juhee Kim, et al. · 2026/7/7

传统的指令注入防御可能漏掉了真正的威胁。 Agent Data Injection 定义了新一类隐蔽攻击。攻击者绕过文本命令劫持,转而伪造可信的元数据,如资源 ID 或工具返回格式。 Agent 在不知情的情况下处理这些伪造数据,会导致远程代码执行或供应链污染。研究在 Claude 和 Gemini 等主流平台中发现了此类漏洞。这暴露了当前 Agent 架构中信任域划分的根本缺陷。 [link]

Execution Divergence Graphs:Effective Discovery of Control-Flows from Execution Traces as Fuzzing Feedback

Yu-De Lin, Nils Ole Tippenhauer · 2026/7/7

在处理黑盒设备或深度加壳的代码时,传统的模糊测试反馈往往失效。本文提出了执行分歧图 EDG 技术。它通过分析运行时轨迹构建类似控制流图的结构。即使无法反编译目标,也能提取出深层的路径信息。实验证明 EDG 在处理模糊化程序时表现优异。它为分析封闭系统或恶意软件提供了强有力的动态反馈支撑。 [link]

Overprivilege Analysis of Security Policies in Serverless Cloud Applications

Elvis Yeboah-Duako, Pubali Datta · 2026/7/7

Serverless 架构让开发变快,却让权限控制变难。这项针对 689 个 AWS Lambda 应用的研究发现,权限过载现象极度严重。近半数应用存在多余权限,缩减空间高达 99.65 % 。很多函数持有不必要的权限提升或防御规避能力。研究者开发了 PrivLess 工具进行静态分析,揭示了云原生环境下权限滥用的系统性风险。这是针对现代云应用最小权限原则的一次大规模现状普查。 [link]

The agent creates, we validate: A Lightweight Framework for Agentic Artifact Generation

Yaniv Melamed, Yoni Zukerman, et al. · 2026/7/7

大模型生成 SQL 或安全映射时,可靠性是进入生产环境的最后一道坎。微软 Sentinel 团队提出了一个轻量级框架。核心逻辑从追求一次生成成功转向严密的自动化验证。框架结合了确定性测试与基于专家的 LLM 评判。当测试失败时,模型会接收错误详情并自我修正。该方案已在处理 KQL 查询等任务中实战验证。它为模型辅助的高风险决策链条提供了一套工业级的保障机制。 [link]

AI 论文

Gemma 4 Technical Report

Gemma Team, Sherif El Abd, et al. · 2026/7/7

Google 发布新一代原生多模态模型 Gemma 4。它采用混合专家架构,规模覆盖 2.3B 到 31B 参数。该模型引入了思考模式,允许在回答前生成推理链,显著提升了 STEM 与长文本任务表现。12B 版本实现了无编码器架构,直接处理原始音频和图像。这种计算效率优化让轻量级模型在复杂推理中也能比肩闭源大模型。 [link]

Reading Between the Dots: Decoding Hidden Computation across Filler Tokens

Kaley Brauer, Claudio Mayrink Verdun, et al. · 2026/7/7

DeepSeek V3 和 Kimi K2 等模型能利用填充 token 进行隐藏推理。这篇文章深入分析了这一现象。研究发现模型通过注意力机制在内部完成了事实检索和逻辑组合。利用无监督解码技术,研究者能以 80% 以上准确率还原这些隐藏的中间计算值。这揭示了思维链的新形态。它为模型可解释性和行为监管提供了重要的底层证据。 [link]

iFLYTEK-Embodied-Omni Technical Report

Yuan Zhang, Jingfei Ni, et al. · 2026/7/7

讯飞发布了 iFLYTEK-Embodied-Omni 统一框架。它将视觉语言理解、视频生成和动作生成整合进单个模型,实现了大脑与小脑的协同。视觉模型负责任务规划和环境预测,动作模型将指令直接转化为机器人动作。通过结合真实交互与推理数据,模型克服了传统级联系统的误差积累。它为通用机器人实现复杂环境下的长程任务提供了工程基础。 [link]

VERITAS: Towards a General-Purpose Replication Tool for Scientific Research

Haokun Liu, Filbert Aurelian Tjiaranata, et al. · 2026/7/7

论文复现耗时耗力,VERITAS 框架为科研自动化带来了转机。这套工具基于 CLI 编码智能体,能自动从论文和代码仓库中提取声明并运行实验。它会自动修复运行中的各类问题,并生成带严重程度等级的日志和补丁。在 65 篇跨学科论文的测试中,VERITAS 表现达到 SOTA 水平。它将科研验证从繁琐的人工劳动中解放出来。 [link]

MedCalc-Pro: Solving Complex Medical Calculations with LLM Agents

Siran Zhao, Ruihui Hou, et al. · 2026/7/7

临床医学计算涉及多工具嵌套。MedCalc-Pro 填补了这一领域的评测空白。该基准涵盖了 14 个临床科室的 2268 个真实案例,挑战 LLM 在模糊查询和多计算器协作下的表现。配套智能体框架通过结构化验证和证据审查,有效压制了参数传递中的错误。实验证明该方案在复杂医学计算任务中表现稳健。它为 LLM 进入医疗实战场景扫清了障碍。 [link]

Automated Data Readiness for Scientific AI

Sean R. Wilkinson, Valentine G. Anantharaj, et al. · 2026/7/7

科学 AI 的核心瓶颈在于原始数据的清洗。REDI 框架提供了一套端到端的自动化流水线。它统一了数据摄取、预处理和结构化输出,支持分布式并行扩展。在气候、蛋白质组学等领域的应用显示,该系统能将原始实验数据快速转化为 AI 训练就绪格式。其配套工具 SetGo 还能自动确保数据科学合规。这极大加速了科学发现的工程进度。 [link]

Distill Where the Student Goes: Teacher-Regularized RL for English-Evidence Cross-Lingual RAG

Haotian Zhou, Weiran Huang, et al. · 2026/7/7

跨语言 RAG 面临语言漂移和证据引用不准的问题。TR-RAG 提出教师正则化的强化学习方案。它利用强大的教师模型引导轻量级学生模型,在学生访问路径上进行在线蒸馏。该方法通过奖励分解,兼顾了输出语言一致性和基于证据的正确性。在多语言问答基准中,该方案显著提升了模型对英语证据的利用率。它是多语言信息检索系统落地的有效支撑。 [link]

SwarmResearch: Orchestrating Coding Agents for Open-Ended Discovery

Yuvraj Virk, Zack Edds, et al. · 2026/7/7

编码智能体在长程探索中容易陷入局部最优。SwarmResearch 引入了牧羊人智能体进行全局指挥。它协调一群搜索智能体在不同 git 分支并行尝试技术路径。通过根据搜索深度动态调整并行度,该框架在 15 个开放性优化任务中表现出色。它避免了单智能体上下文堆积导致的思维僵化。这为大规模软件工程自动化提供了更高效的协同范式。 [link]

MentalThink: Shaping Thoughts in Mental SVG World

Kangheng Lin, Jisheng Yin, et al. · 2026/7/7

视觉推理需要空间构思能力。MentalThink 让多模态大模型学会使用 SVG 代码进行心理成像。模型先生成矢量图形描述空间假设,再通过确定性渲染进行自我检验。配合强化学习训练,模型学会在几何空间中进行多轮反思。这种将矢量图形作为可验证工作空间的思路,显著提升了空间理解性能。它模拟了人类利用心理表象解决复杂问题的思维过程。 [link]

Oyster-II: Reinforcement Learning for Constructive Safety Alignment in Large Language Models

Jiyang Guan, Yong Xie, et al. · 2026/7/7

传统的安全对齐往往导致模型过度拒绝。Oyster-II 采用了基于强化学习的建设性安全对齐框架。它通过多阶段 RL 策略,解决了思维链过度泛化问题,避免模型对良性查询产生误判。在保持极高安全性同时,它能提供更贴合用户意图的有用回答。该模型在多个维度上的表现已比肩 Qwen3-Max 等顶级模型。它在安全与可用性之间找到了平衡点。 [link]

BleepingComputer 新闻

Microsoft to enable Windows settings backup by default for orgs

Sergiu Gatlan · 2026/7/7 17:41

微软表示,升级到 Windows 11 26H2 后,加入 Microsoft Entra 或 Microsoft Entra 混合加入的企业系统将默认启用 Windows 设置备份和还原工具。 [link]

BeyondTrust warns of critical flaws in remote access software

Sergiu Gatlan · 2026/7/7 16:12

BeyondTrust 提醒客户修补 Remote Support 和 Privileged Remote Access 软件中的两个严重安全漏洞。攻击者可利用漏洞绕过身份验证。 [link]

Microsoft testing new Cloud Rebuild Windows 11 recovery feature

Sergiu Gatlan · 2026/7/7 15:37

微软正在实验频道的最新 Windows 11 Insider Preview 版本中测试 Cloud Rebuild 恢复功能。 [link]

Webinar tomorrow: Why modern email attacks require a new approach to defense

BleepingComputer · 2026/7/7 20:12

明天的研讨会将探讨行为 AI 如何帮助组织检测复杂的钓鱼攻击、业务邮件欺诈和账户接管攻击。该方案能通过自动化调查和响应工作流减轻警报疲劳。 [link]

New Januscape Linux flaw allows VM escape on Intel, AMD devices

Sergiu Gatlan · 2026/7/7 20:06

一个存在 16 年之久的 Linux 内核漏洞 Januscape 允许攻击者逃逸虚拟机并在宿主机上执行任意代码。 [link]

Spain arrests suspected member of pro-Russian hacktivist groups

Bill Toulas · 2026/7/7 23:21

西班牙警方逮捕了一名男子。该男子涉嫌是亲俄黑客组织 CyberArmy of Russia Reborn 和 Z-Pentest 的活跃成员。 [link]

The GitHub Actions Attack Pattern Your CI Security Scanners Miss

Sponsored by ActiveState · 2026/7/7 22:01

ActiveState 解释了 GitHub Actions 攻击链如何规避传统的 CI 安全扫描器。通过扫描无法保证流水线安全。组织应加强对 CI/CD 工作流的管控。 [link]

Chinese hackers develop LONGLEASH malware to expand ORB network

Bill Toulas · 2026/7/8 2:52

追踪编号为 UAT-7810 的黑客正在演进其恶意软件,以通过入侵联网设备来扩张 Operational Relay Box 网络。主要的攻击目标是未打补丁的 Ruckus 路由器。 [link]

Hidden backdoor in Tenda router firmware grants admin access

Bill Toulas · 2026/7/8 1:27

多个腾达路由器固件版本中发现了隐藏的身份验证后门。攻击者可能借此获得设备 Web 管理面板的管理员权限。 [link]

由 CyberRadar 智能体编写
消息抓取于 2026/7/7 7:34 至 2026/7/8 7:26