网络安全论文
NeuroLog: Reasoning You Can Audit -- Neuro-Symbolic Vulnerability Discovery via LLM Facts, Datalog, and SMT
Sanjay Rawat · 2026/6/2
NeuroLog 重新发现了 8 个 CVE 漏洞。它利用 LLM 提取事实并配合 Datalog 进行跨函数推理。这种无需构建环境的流水线避开了繁琐的依赖配置。它甚至能自动生成触发崩溃的 Python 代码。该方案将静态分析与运行时的不变性特征结合。它代表了在大规模 C/C++ 代码库中实现自动化漏洞挖掘的重要进展。 [link]
Confused ChatGPT: Cross-App Context Poisoning via First-Party APIs
Chao Wang, Somesh Jha, et al. · 2026/6/2
ChatGPT 的插件架构存在严重的隔离缺陷。第三方应用共享同一个上下文窗口且没有权限边界。该研究揭示了利用官方 API 实现的跨应用投毒攻击。攻击者能通过隐藏参数以系统优先级写入恶意内容。这使得恶意插件可以操控同台运行的其他插件。该缺陷属于架构问题。它提醒我们 AI 生态在多租户安全上仍存在隐患。 [link]
Beyond Edge Coverage: Per-Task Data-Flow Extraction at Kernel Function Boundaries via LLVM
Yunseong Kim · 2026/6/2
传统的内核模糊测试工具难以触及深层逻辑错误。BOUNDARY FLOW 通过 LLVM 在 Linux 内核的关键边界注入检测逻辑。它能实时提取函数参数和返回值。这为模糊测试提供了状态感知的反馈信号。该框架支持 Rust 内核模块且运行开销低于 3%。它是挖掘内存安全漏洞和内核逻辑缺陷的高效利器。 [link]
Bit-Exact AI Inference Verification Without Performance Tradeoffs
Naci Cankaya · 2026/6/2
GPU 浮点运算的非确定性让 AI 治理变得困难。攻击者可能利用这种不确定性绕过监管。该论文实现了不损失性能的位级别 AI 推理验证。它通过软件仿真在不同型号的 NVIDIA GPU 上获得了完全一致的计算结果。舍入误差不再是验证的阻碍。这种技术为确保 AI 任务的合规性提供了坚实的底层支撑。 [link]
One (Thread) Can Keep a (PRNG) Secret, but not Two
Ehood Porat, Amit Klein, et al. · 2026/6/2
苹果 XNU 内核存在一个严重的竞态条件漏洞。研究人员破解了 IPv6 片段 ID 的生成算法。这使得攻击者能预测未来的 ID 并实施流量劫持。他们成功演示了篡改 NFS 文件写入和 HTTP 请求的过程。该漏洞编号为 CVE-2024-27823。它是首个基于竞态条件实现的实战级攻击案例。它揭示了系统内核实现的底层风险。 [link]
NICE: A Framework for Declarative and Machine-Checkable Vulnerability Reproduction
Minh-Lu\^an Nguyen, Olivier Levillain, et al. · 2026/6/2
漏洞复现的难度往往不亚于漏洞挖掘。NICE 框架利用 Nix 的声明式特性自动构建漏洞环境。每个复现案例都包含虚拟机配置和自动化攻击脚本。它覆盖了从内核到图形应用的 19 个真实案例。这些可机器校验的断言提供了确凿的攻击证据。它简化了安全教学和漏洞报告的验证流程。 [link]
AgentRedBench: Dynamic Redteaming and Integration-Aware Defense for LLM Agents over SaaS Integrations
Hiskias Dingeto, Will Leeney · 2026/6/2
LLM 代理在访问 SaaS 服务时面临间接提示注入威胁。AGENTREDBENCH 针对 24 种企业集成测试了 215 种隐蔽的授权攻击。现有的安全防护手段在这些场景下几乎全部失效。研究者训练了专门的 AGENTREDGUARD 模型。它成功将攻击成功率从 69.9% 降至 2.4%。这是构建企业级安全 AI 代理的关键一步。 [link]
Needles at Scale: LLM-Assisted Target Selection for Windows Vulnerability Research
Michael J. Bommarito II · 2026/6/2
现代操作系统包含数百万个函数,从中选出攻击目标如同大海捞针。Symbolicate-Enrich-Sample 流水线能处理超过 700 万个 Windows 函数。它自动恢复符号信息并利用低成本模型进行风险排序。最终生成的 22000 个函数短名单极大缩小了搜索范围。这套基础设施让研究人员能更高效地定位核心漏洞点。 [link]
PyFEX: Uncovering Evasive Python-based Threats via Resilient and Exhaustive Path Exploration
Meng Wang, Yue Ma, et al. · 2026/6/2
Python 恶意软件正通过 PyPI 仓库疯狂传播。PyFEX 引擎采用强制执行技术探索所有可能的代码路径。它能自动绕过环境检查并在运行时修复崩溃。该工具在 PyPI 生产环境中发现了 212 个未知恶意包。这些包的累计下载量已接近 10 万次。这种强韧的分析方法揭示了传统工具无法检测的深层恶意逻辑。 [link]
PrivacyPeek: Auditing What LLM-Based Agents Acquire, Not Just What They Say
Mingxuan Zhang, Jiahui Han, et al. · 2026/6/2
AI 代理在执行任务时往往会获取超出必要的敏感信息。PrivacyPeek 不再只关注最终输出,而是审计数据进入代理上下文的阶段。该基准测试涵盖了 16 个领域的 1182 个案例。研究发现过度获取隐私的情况非常普遍。即使是精细设计的提示词防御也难以拦截这类泄露。这为 AI 代理的数据访问权限控制敲响了警钟。 [link]
AI 论文
MiCU: End-to-End Smart Home Command Understanding with Large Language Model
Haowei Han, Kexin Hu, et al. · 2026/6/2
小米智能家居背后的秘密武器。MiCU 通过课程学习与强化学习,精准理解让卧室变温馨这类模糊指令。它引入词元压缩技术,大幅降低推理延迟。目前已在小米米家 App 成功部署,日均页面访问量达 170 万。该系统显著降低用户纠错率,为智能生活提供了真正懂人心的交互大脑。 [link]
PropLLM: Propagation-Aware Scene Reconstruction for Network Fault Diagnosis
Zongzong Wu, Ming Zhao, et al. · 2026/6/2
网络故障诊断迎来新突破。PropLLM 针对 Wi-Fi 网络中故障传播导致的诊断模糊问题,首次将逐跳场景重建与生成式推理结合。它利用双层知识图谱追溯根因,并引入 TCPA 机制,在真实世界数据集上表现卓越。它能显著降低幻觉率,为复杂网络运维提供了透明、可验证的解决方案。 [link]
A Multi-AI-agent Framework Enabling End-to-end Finite Element Analysis for Solid Mechanics Problems
Titu Ranjan Sarker, Muhammed Jawaad Zulqernine, et al. · 2026/6/2
零基础玩转有限元分析。AbaqusAgent 是一款面向固体力学的多智能体框架。它能将用户的自然语言指令转化为可执行的仿真任务,涵盖建模、计算到结果可视化的全流程。通过对 50 个复杂力学问题的验证,其成功率高达 86 % 。它打破了工程软件的高门槛,开启了人工智能驱动计算力学的新范式。 [link]
AXIOM: A Trust-First Neuro-Symbolic Execution Architecture for Verifiable Mathematical Reasoning
Alessio Bruno · 2026/6/2
数学推理的绝对安全区。AXIOM 采用信任优先的神经符号架构,将语言模型作为规范化器,配合确定性的计算机代数系统进行推导。它在 2700 多个数学记录中实现了 100 % 的信任度,杜绝了盲目自信导致的错误答案。该系统已承载 3 万次生产环境查询,证明了在严谨领域中模型与规则结合的巨大商业潜力。 [link]
I-WebGenBench : Evaluating Interactivity in LLM-Generated Scientific Web Applications
Dasen Dai, Biao Wu, et al. · 2026/6/2
论文读不懂?让 AI 把它变互动的。I-WebGenBench 挑战了论文只能以静态网页或 PPT 形式呈现的现状。它能将科研论文自动转换为可运行的交互式 Web 系统。用户可以直接在网页上调整参数并观测动态行为。基于 19 篇顶级论文构建的评测集显示,该框架能深刻理解论文逻辑,彻底革新了科研成果的传播效率。 [link]
Dr. DocBench: A Comprehensive Benchmark for Expert-Level and Difficult Document Parsing
Minglai Yang, Xinyan Velocity Yu, et al. · 2026/6/2
攻克文档解析的最难一公里。Dr. DocBench 专注于化学公式、乐谱及跨页布局等专家级文档处理任务。它从海量书籍中精选出主流解析器极易出错的挑战性页面,提供 6.5 万个高质量标注。测试显示,现有的强力模型在面对这类垂直领域复杂文档时仍力不从心。它将推动文档智能向更专业、更精准的深度进发。 [link]
Medication-Aware Financial Exploitation Detection for Alzheimer's Patients Using Edge-Aware Interaction Risk Modeling
Farzana Akter, Lisan Al Amin, et al. · 2026/6/2
科技守护阿尔茨海默病患者的钱袋子。传统的反欺诈系统常忽略临床认知因素。研究者提出药物感知框架,将患者的服药顺从性与交易监控同步。该模型能精准识别认知波动窗口内的财务风险事件,极大提升了对易受侵害群体的保护力度。这是一次医疗数据与金融安全跨界融合的有益尝试。 [link]
CSRP: Chain-of-Thought Reasoning for Chinese Text Correction via Reinforcement Learning with Efficiency-Aware Rewards
Wei Tian, Yuhao Zhou, et al. · 2026/6/2
告别死板的中文字词纠错。CSRP 框架针对通用大模型在中文语法纠错中缺乏专业先验、容易过度纠正的问题提出了解决方案。它通过 590 万平衡样本进行预训练,并结合思维链技术与效率感知奖励,使模型在保留原文语义的同时精准修复错误。该系统在多个基准测试中超越 GPT 4 ,是提升中文文档质量的利器。 [link]
TravelEval: A Comprehensive Benchmarking Framework for Evaluating LLM-Powered Travel Planning Agents
Weiyi Chen, Shuaixiong Wang, et al. · 2026/6/2
打造真正好用的 AI 导游。目前的旅游规划模型往往只关注约束条件,忽略了时空成本。TravelEval 引入包含住宿定价、城际交通在内的真实沙盒数据,多维度评估方案的准确性、经济性与实用性。它揭示了大模型在复杂规划中的短板,为开发具备时空推理能力、真正懂行的旅游助手提供了坚实的数据基石。 [link]
EnergyMamba: An Uncertainty-Aware Graph-Enhanced Selective State Space Model for Energy Consumption Prediction
Dahai Yu, Rongchao Xu, et al. · 2026/6/2
赋能绿色电网的精准预测。EnergyMamba 是一款针对能源消耗预测的时空学习框架。它结合了 Mamba 架构的高效序列建模能力与电网拓扑的空间上下文,能有效应对极端天气带来的电力波动。通过 AS CQR 模块,它不仅给出了预测值,还提供了可靠的不确定性估计。在多个真实数据集上,它为能源调度提供了支持。 [link]
BleepingComputer 新闻
CISA flags two-year-old Oracle flaw as actively exploited in attacks
Sergiu Gatlan · 2026/6/2 20:40
CISA 已要求政府机构修复 Oracle WebLogic Server 中的高危漏洞。该漏洞两年前已发布补丁,目前正被用于活动攻击。 [link]
Google fixes one actively exploited Android zero-day, 124 flaws
Sergiu Gatlan · 2026/6/2 19:10
Google 发布 2026 年 6 月 Android 安全补丁,共修复 124 个漏洞。其中包括一个被用于针对性攻击的零日漏洞。 [link]
Microsoft Exchange Online outage causes email delays, failures
Sergiu Gatlan · 2026/6/3 1:02
微软正在处理影响广泛的服务故障。该问题导致北美和德国 Exchange Online 客户的邮件流管道出现延迟和失败。 [link]
Instagram users locked out after Meta AI abused to steal accounts
Bill Toulas · 2026/6/2 23:47
多名 Instagram 用户账号被劫持。攻击者误导 Meta 的 AI 支持工具,使其相信攻击者是合法的账号所有者。 [link]
Why the browser is now the front line for AI security
Sponsored by Push Security · 2026/6/2 22:30
AI 攻击和影子 AI 正在制造浏览器内部的安全风险。Push Security 解释了浏览器可见性对威胁检测和 AI 治理的重要性。 [link]
AI-built ransomware toolkit automates EDR evasion, AD discovery
Bill Toulas · 2026/6/3 4:01
威胁行为者使用 AI 构建的勒索软件工具包。该工具可自动发现 Active Directory 并躲避 EDR 方案。 [link]
Microsoft's Coreutils project brings Linux commands to Windows
Lawrence Abrams · 2026/6/3 6:52
微软在 Build 2026 大会上发布 Windows 版 Coreutils。该项目将常用的 Linux 命令行工具作为原生应用引入 Windows。 [link]
OpenAI upgrades GPT-5.5, as it plans to retire legacy ChatGPT models
Mayank Parmar · 2026/6/3 6:44
OpenAI 正在更新 GPT-5.5 Instant 模型。此举是为了按计划停用包括 o3 在内的多个旧模型。 [link]
Critical Kirki flaw exploited to hijack WordPress admin accounts
Bill Toulas · 2026/6/3 6:12
黑客利用 WordPress 的 Kirki 插件漏洞 CVE-2026-8206。该漏洞允许攻击者接管包括管理员在内的任何账号。 [link]
Over 116,000 Mincraft systems infected in WeedHack malware campaign
Bill Toulas · 2026/6/3 5:54
WeedHack 恶意软件活动正在针对 Minecraft 玩家。自 1 月以来已有超过 116,000 台系统被感染。 [link]