bfs
-
面向多智能体的传染性越狱
本报告围绕多智能体系统的传染性越狱安全风险展开,重点关注如何通过攻击单个智能体,利用多智能体间的通信、记忆检索与协作机制,将越狱效应在系统中指数级扩散。报告从多智能体架构、攻击面、…
-
智能体的第三方组件安全:从工具到技能
本报告围绕智能体第三方组件安全展开,重点关注Tool和 Skill在增强Agent外部交互与任务执行能力的同时所带来的潜在安全风险。随着智能体对第三方组件的依赖不断加深,攻击者可能…
-
环境注入攻击EIA
本次报告围绕环境注入攻击展开,首先阐述了环境注入攻击的基本概念、研究背景和研究意义,然后介绍了环境注入攻击的研究现状。接着详细介绍了EIA和eTAMP两种具备代表性的方法,包括各自…
-
机生文本检测中的对抗攻击与鲁棒防御
大语言模型生成文本规模持续扩大,释义改写、词语替换和字符扰动等对抗攻击削弱了检测可靠性。本次学术报告聚焦机生文本检测攻防对抗,系统介绍基于释义逆变换与动态对抗训练的鲁棒防御方法,分…
-
多模态意图识别
聚焦多模态意图识别场景下复杂意图理解与细粒度语义推理问题,概述文本、视频、音频等模态融合中的语义异构、噪声干扰、模态冲突与粗粒度表示的局限;重点介绍 LGSRR 基于大模型引导的细…
-
面向联邦学习的后门攻击检测与防御
聚焦联邦学习与联邦图学习场景下的后门攻击检测与防御,概述分布式隐私保护训练中的隐蔽后门风险、Non-IID数据异构挑战与现有防御方法局限;重点介绍FedID基于曼哈顿距离、欧氏距离…
-
面向LLM Agent的提示注入攻击
本报告聚焦大模型Agent提示注入攻击研究,重点解析CrossInject跨模态攻击与ToolHijacker工具劫持两大提示注入攻击框架,CrossInject首次实现“视觉+文…
-
安卓原生库和系统服务的漏洞挖掘
本学术报告围绕Android原生库的自动化模糊测试问题展开。内容涵盖:安卓原生库漏洞挖掘的主流方法;介绍了两种模糊测试算法的原理以及两篇工作的实验验证与局限性分析。报告旨在分享安卓…
-
机器合成数据生成与评价方法
本学术报告系统梳理了机器合成数据生成技术(GAN/VAE/扩散模型)的发展脉络,重点解读了两篇顶会论文——TabDiff(ICLR 2025,面向表格数据的混合型扩散模型)和Fai…
-
基于大模型微调的后门攻击
本学术报告围绕大模型微调中的后门攻击问题展开。内容涵盖:后门攻击的基本原理与主流微调方法;两种新型攻击技术的设计与危害分析;以及针对现有防御体系的不足与盲区,展望后门攻击的未来演进…