Everything you care about in one place

Follow feeds: blogs, news, RSS and more. An effortless way to read and digest content of your choice.

Get Feeder

paper.seebug.org

paper - Last paper

Get the latest updates from paper - Last paper directly as they happen.

Follow now 576 followers

Latest posts

Last updated about 3 hours ago

多源 LLM 智能体输入中分段级投毒的检测与定位

about 4 hours ago

作者:Xue Tan, Changhui Wang, Sanrui Yang, Hao Luan, Zhuyang Yu, Jin Wei...

面向安全漏洞的自动化程序修复智能体的对抗性测试

3 days ago

作者:Fares Trad, Simin Chen, Hung Viet Pham, Gias Uddin, Baishakhi Ray 原文链接:https://arxiv.org/pdf/2609.15963v1...

大模型中转站研究与测评报告(2026)

4 days ago

作者:知道创宇404积极防御实验室 前言 随着大语言模型在编码、Agent(智能体)等场景中的深入应用,开发者对多模型、低成本、开箱即用的模型 API 需求持续增长,大模型中转站逐渐成为连接开发者与模型服务的重要基础设施。中转站对外提供与主流模型 API 兼容的统一接口,将不同模型厂商的服务进行聚合,调用者通常只需修改模型名称即可完成切换。 与直接调用模型厂商官方 API 不同,开发者在使用中转站...

当世界说谎:面向下游控制的潜在世界模型后门攻击

7 days ago

作者:Roberto Riaño, Gorka Abad, Stjepan Picek, Aitor Urbieta 原文链接:https://arxiv.org/pdf/2609.15781 摘要 预训练世界模型——一种学习得到的模拟器,它将观测编码为潜在状态并预测该状态在动作作用下如何演化——正开始像如今的预训练编码器和语言模型那样,被作为现成的动力学骨干网络复用于控制任务。我们表明,这种复用...

融合谱特征与激活聚类用于医疗影像模型后门检测:方法、实现与评估

9 days ago

作者:Suresh Tamang 原文链接:https://arxiv.org/pdf/2609.14290v1 摘要 机器学习模型正越来越多地部署于医疗影像流程中,用于辅助诊断,而针对这些模型的训练期攻击已成为一个被明确点名的行业级关切:医疗行业指南将模型投毒与对抗攻击列为需要专门防御措施的威胁,而联邦政策则指示将扩展的人工智能漏洞检测工具提供给农村医院等关键基础设施运营方。谱特征分析(spec...

POLYFLOW:一种用于静态跨语言信息流分析的神经符号框架

15 days ago

作者:Haoran Yang、Zhixuan Zhong、Jiawei Guo、Haipeng Cai 原文链接:https://arxiv.org/pdf/2608.29808v1 摘要 现代软件系统通常由多种相互交互的编程语言构建而成。这种构建方式导致了额外的、往往隐蔽的漏洞,这些漏洞深藏于因语言交互而产生的复杂信息流之中。现有的静态分析器受到不同语言异构语义的阻碍,而动态方法则受限于(可用和...

UiAs:基于多模态无线信号的用户无关3D人脸反欺骗

20 days ago

作者:Zhiwei Chen,Lebin Lyu,Yimo Zhang,Dingyu Zhong等 原文链接:https://arxiv.org/pdf/2608.29084v1 摘要 人脸认证已广泛应用于安全敏感的应用中,而日益逼真的3D欺骗攻击正构成越来越大的威胁。高保真3D面具可以再现人脸外观和几何结构,但无法复制活体组织的固有物理响应,而无线信号可以主动探测这些响应。然而,由无线信号捕获的...

SIR:面向计算机使用智能体的自我改进型红队测试

22 days ago

作者:Chen Xiong, Zhiyuan He, Pin-Yu Chen, Stjepan Picek, Tsung-Yi Ho 原文链接:https://arxiv.org/html/2608.30207v1 摘要...

Drishti:面向 5G 核心网的AI主导、人工导向的漏洞审计

23 days ago

作者:Sriram Ramachandran、Levente Csikor、Dinil Mon Divakaran 原文链接:https://arxiv.org/html/2608.30112v1 摘要 开源漏洞的候选生成已不再是稀缺资源。AI辅助代码审查如今能廉价地产生缺陷候选,而行业项目则将其与专家人工分诊相结合。真正稀缺的在于验证与影响评估,而这一差距在5G核心网等关键基础设施软件中最为突出...

通过基于搜索的优化从工业网络流量中恢复过程变量

27 days ago

作者:Chuan Sheng, Shan Jiang, Xiaogang Zhu, Wanlun Ma, Jianming Zhao, Yu Yao...

基于结构化风险指标的零样本威胁检测大语言模型框架

about 1 month ago

作者:Abdullah Alghamdi, Siamak Layeghy, Marius Portmann 原文链接:https://arxiv.org/pdf/2608.16508v1 关键词:入侵检测、内部威胁检测、高级持续性威胁、大语言模型、零样本学习、检索增强生成、异常检测 摘要 我们提出了一种两阶段大语言模型(LLM)框架,用于从异构安全日志中零样本检测内部威胁和高级持续性威胁(APT)...

TwinGridShield:面向LLM电网智能体动作的后果感知运行时授权

about 1 month ago

作者:Md Fazley Rafy 摘要 大语言模型(LLM)辅助的能源管理工具可以将自然语言上下文转换为结构化的电网指令,但语法有效性并不等同于物理可接受性。本文提出TwinGridShield——一个与模型无关的运行时授权层,它在释放任何拟议动作之前,先在确定性网络孪生(network twin)中对其进行评估。该原型检查连通性、支路潮流、发电机以及切负荷不变量,并将每次决策记录在哈希链日志中...