Follow feeds: blogs, news, RSS and more. An effortless way to read and digest content of your choice.
Get Feederpaper.seebug.org
Get the latest updates from paper - Last paper directly as they happen.
Follow now 574 followers
Last updated 3 days ago
3 days ago
作者:Md Fazley Rafy 摘要 大语言模型(LLM)辅助的能源管理工具可以将自然语言上下文转换为结构化的电网指令,但语法有效性并不等同于物理可接受性。本文提出TwinGridShield——一个与模型无关的运行时授权层,它在释放任何拟议动作之前,先在确定性网络孪生(network twin)中对其进行评估。该原型检查连通性、支路潮流、发电机以及切负荷不变量,并将每次决策记录在哈希链日志中...
4 days ago
作者:Mikiyas Alemayehu, Mohamed Chahine Ghanem, Hamza Kheddar, Aohan Li, and J. J...
18 days ago
作者:Ruoqi Guo, Yi Liu, Gelei Deng, Yiheng Xiong, Yuekang Li, Ying Zhang...
19 days ago
作者:Zidong Zhang,Zhentao Xie,Wenrui Diao,Jianliang Wu 原文链接:https://arxiv.org/pdf/2607.00333v2 摘要 由视觉语言模型(VLM)驱动的第三方移动智能体已成为自动化智能手机交互的一种前景广阔的新范式。这些智能体充当高权限决策者,通过截图感知设备状态,并借助VLM推理执行操作,从而改变了智能体应用与环境(即其他应用...
24 days ago
作者:Amal Alshehri, Cihan Tunc 原文链接:https://arxiv.org/html/2607.17035v1 摘要 尽管物联网(IoT)已变得不可或缺,但它们也带来了严重的安全和隐私挑战,尤其是在关键任务环境中。传统设备容易受到病毒、数据泄露和未经授权访问的攻击,而更新这些设备的成本高得难以承受。作为解决方案,本文提出了一种面向零信任物联网架构的联邦学习与大语言模型驱...
27 days ago
作者:Aswani Kumar Cherukuri, Siddhaarth S Prabhu 原文链接:https://arxiv.org/pdf/2607.17573 摘要 面向公共网络的在线银行和金融服务日益增多,这使得加密协议的安全性成为一个严重的系统性问题。RSA-2048是当今互联网上绝大多数交易(包括资金转账、身份验证交换和新会话的密钥协商)所使用的密钥长度。一种非常隐蔽的威胁向量——...
30 days ago
作者:Yimeng Chen,Nathanaël Denis,Roberto Di Pietro,Jürgen Schmidhuber 原文链接:https://arxiv.org/html/2607.17986v1 摘要 自托管的AI智能体通过读写自身的内存和配置文件来运行。智能体可能因其自身状态的损坏而受到攻击——这种损坏是通过合法的操作系统系统调用实现的。我们将这类威胁称为自状态攻击。本文研...
about 1 month ago
作者: Devina Jain,David Hartmann,Chuan Li 原文链接:https://arxiv.org/html/2607.18063v1 摘要 基于LLM的智能体在处理外部内容时,会暴露于提示注入和多轮次操纵的风险之中。大多数安全基准测试使用评估前收集的固定攻击池来评估防御方,无论是单轮次还是多轮次。本文提出了一个包含21个场景的基准测试,用于对无记忆LLM防御方进行自适应...
about 1 month ago
作者: Saifur Rahman Tamim, Amir Labib Khan 原文链接:https://arxiv.org/pdf/2607.16010v1 摘要 各国政府正越来越多地强制要求LLM生成的内容携带水印。欧盟《人工智能法案》要求标记"足够可靠和稳健"。加利福尼亚州SB 942法案要求披露信息"永久性或极难移除"。这两项强制性规定都建立在一个...
about 1 month ago
作者:Corban Villa, Sijun Tan, Alp Eren Ozdarendeli, Raluca Ada Popa 原文链接:https://arxiv.org/pdf/2607.08147v1 摘要...
about 1 month ago
作者:Anupam Wagle, Ifrat Ikhtear Uddin, Chaowei Zhang, Longwei Wang 原文链接:https://arxiv.org/pdf/2607.07903v1 摘要 大型语言模型(LLM)展现出卓越的能力,但仍然极易受到对抗性提示和越狱攻击的影响。现有方法主要通过输入-输出行为或归因方法来分析这些失败,对于对抗性扰动如何改变模型内部推理的洞察有限...
about 1 month ago
作者:Andrej Bogdanov,Alon Rosen,Neekon Vafa 原文链接:https://arxiv.org/pdf/2607.09532v1 摘要 我们展示了对抗性模型训练者如何在一大类深度前馈神经网络中植入后门。这些后门在白盒设置下是统计上不可检测的,这意味着即使给定模型的完整描述(例如所有权重),植入了后门的模型与诚实训练的模型在总变差距离上仍然非常接近。该后门为每个输入...