网络安全论文
GitInject: Real-World Prompt Injection Attacks in AI-Powered CI/CD Pipelines
Jafar Isbarov, Umid Suleymanov, et al. · 2026/6/10
AI 智能体进入 CI/CD 流转环节,却成了供应链攻击的新入口。GitInject 揭示了攻击者如何利用 GitHub 工作流中的提权权限,通过注入恶意 prompt 窃取凭证或操纵代码审计。该研究实测了四家主流 AI 提供商的 11 种真实攻击,并给出了低成本防御方案。它提醒我们,核心风险往往源于基础设施对权限的处理,而非模型本身。 [link]
The Linux IOCTL Census: A Source-Derived Database of the Linux Kernel Control-Code Surface
Michael J. Bommarito II · 2026/6/10
ioctl 系统调用一直是 Linux 内核中难以清查的攻击面。研究者利用 libclang 开发了普查工具,对上千个内核模块进行了全量分析。他们识别出数千个不受权限控制的输入点和潜在溢出风险,并对比了 22 个已知的 CVE 漏洞。该项目发布的结构化数据库支持跨操作系统的攻击面查询,为内核开发者和安全审计人员提供了极具价值的实战地图。 [link]
RadKey: An LLM-Guided RF Backscatter System for Through-Wall Keystroke Inference
Qijun Wang, Chunqi Qian, et al. · 2026/6/10
隔墙有耳不再是科幻情节,RadKey 利用射频反向散射技术实现了隐蔽的穿墙按键窃听。它由无源标签和射频阅读器组成,能捕获按键引发的微小振动。即便在不同用户和键盘环境下,系统也能通过 LLM 引导的在线适配维持高精度。这项研究挑战了物理空间的隔离安全性,展示了无源传感器在侧信道攻击中的巨大潜力,是硬件安全领域的重要突破。 [link]
Proof of Source of Funds: Efficient On-chain Provenance of Cryptoassets
Alireza Kavousi, Istv\'an Andr\'as Seres, et al. · 2026/6/10
去中心化金融在拥抱监管的同时,往往面临隐私泄露的风险。PoSoF 提出了一种范式转移,让用户通过零知识证明自主展示资金来源的合规性,无需平台进行大规模监控。该框架在以太坊兼容环境下实现了极高效率,单次交易证明仅需 1.8 秒。它保护了交易拓扑不被泄露,为链上资产溯源提供了可验证的密码学保障,是平衡隐私与合规的里程碑实践。 [link]
RECON: An LLM-Enhanced Backward Constraint Analysis Framework
Babangida Bappah, Lamine Noureddine, et al. · 2026/6/10
传统的符号执行面对庞大的 Android 框架往往力不从心。RECON 将 LLM 的语义理解能力与静态分析深度结合,专门处理字节码中的逆向约束分析。它能将复杂的逻辑条件转化为易于理解的规范,且运行速度比传统方法快 5.8 倍。在恶意软件测试中,RECON 展示了极高的语义约束提取成功率,为自动化漏洞挖掘和恶意代码分析提供了强劲动力。 [link]
AgentCanary: A Security Evaluation Framework for Autonomous AI Agents in Real Executable Environments
Peiyang Li, Songping Wang, et al. · 2026/6/10
自主 AI 智能体正从对话助手转向任务执行者,AgentCanary 为这一演进提供了严苛的安全考量。它打破了静态测试的局限,让智能体在真实执行环境中与工具交互。通过分析行为轨迹,该框架能精准评估智能体面对多步攻击时的感知能力。实验显示现有智能体在持久化状态攻击面前依然脆弱,这为构建更可靠的自主系统指明了方向。 [link]
When VR Meets BCI: (Un)Observable Brainwave-aware Privacy Reconstruction in the Metaverse via Unrestricted Inbuilt Motion Sensors
Tao Ni, Zehua Sun, et al. · 2026/6/10
元宇宙隐私泄露正从可观察行为延伸到感知层面。BraVeSpy 发现 VR 头显内的运动传感器可以捕获由瞳孔反应引起的微小振动,进而重建用户的脑电图表示。利用这种关联,攻击者能以超过 50% 的精度推测用户观看的图像。这种利用非限制性传感器进行深层隐私窃取的方法,揭露了元宇宙设备在硬件设计上的隐蔽风险,促使行业重新审视传感数据的访问控制。 [link]
Safecloud: A Distributed, Encrypted Storage Cloud for Streaming
Gregory Magarshak · 2026/6/10
云存储如何在不触碰明文的前提下实现高效流媒体分发?Safecloud 构建了一个分布式加密网络,其路由节点不持有密钥。它创新性地提出了三平行树结构,将完整性校验与访问控制融合,支持在 O(1) 时间内完成加密片段的随机跳转。这套系统在浏览器端表现出色,且存储成本远低于 Filecoin,为去中心化存储市场提供了极具竞争力的工程方案。 [link]
Anchors that Don't Lift: Understanding Supply Chain Driven Kernel Lock-In and Governance-Mediated Mitigation Strategies in SOHO Devices
Ritwik Badola, Rajdeep Ghosh, et al. · 2026/6/10
许多家用设备漏洞源于过时的内核,而这种锁死现象有着深层的供应链根源。研究者对 900 多份固件进行了大规模审计,发现 SoC 供应商提供的 SDK 往往强制绑定早已停止维护的内核版本。这种安全债通过供应链层层传导,最终由用户买单。该研究揭示单纯的合规审计无法解决系统性问题,必须通过社区参与和 SoC 厂商配合才能打破固件更新的僵局。 [link]
Bypassing Copyright Protection in Diffusion-based Customization via Two-Stage Latent Feature Optimization
Ziang Xu, Wenbo Yu, et al. · 2026/6/10
扩散模型的版权保护面临严峻挑战。针对现有的潜空间防御技术,TS-LFO 提出了一种两阶段优化攻击方案,能高效恢复被扰乱的语义特征。该攻击通过潜空间去噪和重构,成功绕过了主流的 SOTA 防御方法。实验证明现有的版权防护手段在自适应攻击面前仍显不足。这项研究为生成式 AI 领域的对抗性博弈提供了全新视角,推动了版权保护技术的迭代升级。 [link]
AI 论文
Baichuan-M4: A Clinical-Grade Medical Agent System for Continuous Care
Aiyuan Yang, Canbin Piao, et al. · 2026/6/9
Baichuan-M4 是百川智能推出的临床级医疗大模型系统,它聚焦于持续照护需求。该系统通过 Baichuan-Harness 运行时实现了训练与部署的一致性,集成了长期病患记忆与多模态感知能力。它引入的临床工具层支持权威证据检索与医疗文档处理,成功将幻觉率降至 3.3%。这种围绕核心推理模型构建的协调智能体架构,为解决现实医疗场景中复杂诊疗挑战提供了极具参考价值的范本。 [link]
Less Context, More Accuracy: A Bi-Temporal Memory Engine for LLM Agents Where a Lean Retrieved Context Beats the Full History
Liuyin Wang · 2026/6/10
长期记忆一直是 LLM 智能体的弱点,传统的全历史重演既昂贵又缓慢。 Engram 提出了双进程记忆引擎,通过异步提取事实构建双时态知识图谱,解决了事实冲突与来源溯源问题。它仅需 9.6 k 的紧凑上下文便在精度上击败了消耗 79 k 语料的全上下文基线。这套开源方案避开了昂贵的模型调用,将记忆管理转化为高效的数据流工程,为追求低延迟与高准确度的开发者提供了实用的生产指南。 [link]
Anything2Skill: Compiling External Knowledge into Reusable Skills for Agents
Qianjun Pan, Yutao Yang, et al. · 2026/6/9
检索增强生成往往只能获取支离破碎的陈述性证据,导致智能体反复在操作手册中徘徊。 Anything2Skill 框架通过将外部知识库编译为可执行的技能合约,显著提升了任务执行效率。它利用技能树先验提取候选技能,并结合持续的 SkillBank 进行版本追踪。在 GitHub-CLI 等实测中,该方法将任务成功率提升至 94.1% 以上。这种将潜在程序知识转化为显式技能的方法,让智能体实现了从知识访问向能力复用的质变。 [link]
CodeAlchemy: Synthetic Code Rewriting at Scale
Ankit Gupta, Aditya Prasad, et al. · 2026/6/10
预训练代码模型虽精通语法,却难以应对真实世界的开发任务。 CodeAlchemy 框架通过五种合成策略处理了 15 种语言,生成了超过 500 B 的合成数据及 350 B 推理数据。它引入的代码追踪技术捕获了执行流与库知识,显著提升了模型对语义的理解。实验表明,基于该框架训练的 3 B 模型在多个指标上超越了规模大其 10 倍的闭源模型。这验证了高质量合成数据的价值,也为构建轻量化编程助手指明了路径。 [link]
WebChallenger: A Reliable and Efficient Generalist Web Agent
Jayoo Hwang, Xiaowen Zhang, et al. · 2026/6/10
强大的通用 Web 智能体通常依赖高昂的专有推理模型。 WebChallenger 通过架构设计打破了这一瓶颈。它引入 PageMem 结构化页面表示,模拟人类的选择性注意与网站结构持久记忆。系统能够自动将复杂的多步交互折叠为复合动作流,无需为特定网站定制适配器。在使用开源权重模型的前提下,系统在 WebArena 等基准测试中逼近顶尖商业模型。对于希望在资源受限环境下实现自动化办公的开发者,该研究具备极高价值。 [link]
MIRAGE: A Polarity-Flipping Encoding Subspace in LLM Agents
Pratibha Revankar, Kargi Chauhan, et al. · 2026/6/10
恶意智能体可能利用加密手段秘密提取敏感数据,这种行为很难从输出端检测。研究者在残留流中发现了一个共享的低维编码子空间,揭示了模型在执行掩盖策略时的计算特征。 MIRAGE 监控器基于这一几何发现,通过双通道实时追踪内部信号,将检测成功率提升至 0.918 。这项研究填补了安全领域的技术空白,证明了从模型内部特征识别违规行为的可行性,为构建更可信的 AI 系统提供了底层防御。 [link]
Harnessing the Collective Intelligence of AI Agents in the Wild for New Discoveries
Federico Bianchi, Yongchan Kwon, et al. · 2026/6/10
科学发现通常是集体协作的过程, EinsteinArena 平台通过智能体原生架构将这一逻辑引入 AI 领域。在该平台上,多个智能体围绕数学难题进行开放式讨论,分享见解并相互借鉴思路。目前已有智能体利用该系统刷新了 11 维接吻数问题的世界记录。这种分布式协作范式摆脱了单智能体运行的局限,证明了去中心化智能体社会在攻克真实科学挑战方面的巨大潜力,为未来科学研究提供了全新范式。 [link]
UXBench: Benchmarking User Experience in AI Assistants
Mengze Hong, Xia Zeng, et al. · 2026/6/9
现有的 AI 助手评估往往脱离真实用户体验。 UXBench 首次构建了基于真实用户反馈信号的评测基准,包含来自主流中文助手交互日志的 7400 个实例。它涵盖了多样化的失败模式,揭示了模型在感知意图方面的真实差距。研究发现用户反馈预测是一项可学习的能力,通过野外反馈信号训练的奖励模型能实现极佳的校准精度。该工作为优化真实世界中的用户留存与交互体验提供了扎实的数据支撑。 [link]
Deterministic Integrity Gates for LLM-Assisted Clinical Manuscript Preparation: An Auditable Biomedical Informatics Architecture
Yoojin Nam, Jinhoon Jeong, et al. · 2026/6/9
自动科研智能体正加速论文产出,但虚假引用与数据漂移成了合规瓶颈。该研究提出了确定性诚信闸门架构,将论文协作流程分解为独立技能,并在阶段转换时强制执行失败停机策略。系统利用可重复的静态检查替代模糊的文字探针,实现了极高的缺陷检举率。 MedSci Skills 开源工具包已在多个数据集上验证了其审计能力。它不仅提高了写作生产力,更通过可回溯的证据确保了 AI 生成内容的严谨性。 [link]
AutoPDE: Reliable Agentic PDE Solving via Explicitly Represented Solver Strategies
Huanshuo Dong, Keyao Zhang, et al. · 2026/6/10
数值求解偏微分方程是科学计算的核心,但 coding 智能体往往跳过策略设计直接生成代码。 AutoPDE 框架引入了显式求解策略对象,将方程分析、方法选择与自适应调优解耦。当求解失败时,系统会根据数值证据修正底层策略。这种基于物理结构与数值分析的架构,在 PDE Agent Bench 上将通过率提升了 14.2 个百分点。它为工业界解决复杂动力学仿真问题提供了更可靠的方案,展现了工程思维与大模型结合的力量。 [link]
BleepingComputer 新闻
Anthropic rolls out Claude Fable 5, but it's available for a limited time
Mayank Parmar · 2026/6/10 10:03
Anthropic 开始推出名为 Fable 的新模型。该模型基于 Mythos 相同的底层架构。Mythos 是其性能最强的 AI 模型类别。 [link]
Ivanti: Max severity Sentry flaw allows code execution as root
Sergiu Gatlan · 2026/6/10 14:26
Ivanti 修复了 Sentry 安全移动网关解决方案中的两个关键漏洞。其中包括一个最高严重级别的缺陷。远程攻击者可以利用该缺陷以 root 权限执行代码。 [link]
Microsoft patches YellowKey, GreenPlasma, MiniPlasma zero-days
Sergiu Gatlan · 2026/6/10 17:57
微软在周二修复了两个 zero-day 漏洞。攻击者能借此在已完全修补的 Windows 系统上获取 SYSTEM 权限。第三个漏洞允许访问受 BitLocker 保护的驱动器。 [link]
The 5 Best Practices for Secure Identity Verification
Sponsored by Specops Software · 2026/6/10 22:05
攻击者正通过网络钓鱼、MFA 疲劳攻击和针对服务台的社会工程手段绕过弱身份验证。Specops Software 总结了增强身份验证和访问安全的 5 项最佳实践。 [link]
Microsoft patches Exchange Server zero-day exploited in attacks
Sergiu Gatlan · 2026/6/10 21:44
微软修复了一个正被积极利用的 Exchange Server 漏洞。威胁行为者可以针对 Outlook Web Access 用户发起 XSS 攻击并执行任意 JavaScript 代码。 [link]
Microsoft: Some Windows PCs fail to install latest monthly updates
Sergiu Gatlan · 2026/6/10 19:33
微软在周二提醒客户。部分升级到 Windows 11 24H2 或 25H2 的设备在安装最新的每月更新时可能会遇到问题。 [link]
China-linked JDY botnet expands targeting of U.S. military networks
Bill Toulas · 2026/6/10 23:00
JDY 僵尸网络此前与 Volt Typhoon 等中国威胁行为者有关。该恶意软件网络已显著扩大其目标范围和侦察力度。 [link]
Microsoft June 2026 Patch Tuesday fixes 6 zero-days, 200 flaws
Lawrence Abrams · 2026/6/10 1:57
今天是微软 2026 年 6 月的补丁星期二。安全更新涵盖了 200 个漏洞。其中包括 5 个已公开披露的 zero-day 漏洞和 1 个已被用于攻击的漏洞。 [link]
GitHub announces npm security changes to tackle supply-chain attacks
Bill Toulas · 2026/6/11 3:41
GitHub 宣布下个月发布的 npm v12 将引入多项安全变更。这些举措旨在阻止利用 npm install 命令行为发起的供应链攻击。 [link]
Oracle PeopleSoft servers hacked in ShinyHunters data theft attacks
Lawrence Abrams · 2026/6/11 2:31
Oracle PeopleSoft 服务器正成为 ShinyHunters 勒索团伙的目标。该团伙声称已从 100 多个组织中窃取了数据。 [link]
Path traversal flaw in AI dev platform Langflow exploited in attacks
Bill Toulas · 2026/6/11 5:23
攻击者正在利用 CVE-2026-5027 漏洞。这是 AI 开发平台 Langflow 中的一个高危路径遍历缺陷。攻击者借此在暴露的服务器上写入任意文件。 [link]
The ‘Miasma’ worm source code briefly leaked on GitHub
Bill Toulas · 2026/6/11 4:27
Miasma 凭据窃取攻击框架最近通过供应链攻击瞄准开源生态系统。该框架的源代码曾在 GitHub 上短暂公开。 [link]