机生文本检测中的对抗攻击与鲁棒防御

大语言模型生成文本规模持续扩大,释义改写、词语替换和字符扰动等对抗攻击削弱了检测可靠性。本次学术报告聚焦机生文本检测攻防对抗,系统介绍基于释义逆变换与动态对抗训练的鲁棒防御方法,分析检测器失效机理与改进思路,为提升开放场景下检测稳定性、泛化性提供参考。

2026072013280134

原创文章,作者:bfs,如若转载,请注明出处:https://www.isclab.org.cn/2026/07/20/%e6%9c%ba%e7%94%9f%e6%96%87%e6%9c%ac%e6%a3%80%e6%b5%8b%e4%b8%ad%e7%9a%84%e5%af%b9%e6%8a%97%e6%94%bb%e5%87%bb%e4%b8%8e%e9%b2%81%e6%a3%92%e9%98%b2%e5%be%a1/

(0)
bfsbfs
上一篇 2026年7月15日 上午8:00
下一篇 2026年7月21日

相关推荐

  • AFL–基于覆盖的模糊测试工具

    本次报告介绍了模糊测试以及各种分类方法,并且讲解了目前流行的模糊测试工具AFL的原理,阐明了AFL工具是如何提高代码覆盖率的。针对AFL存在的测试用例生成盲目性的问题,介绍了一种基…

    2021年3月29日
    3.9K
  • 大模型也不安全-小心信息被泄露

    研究大模型隐私泄露攻击,揭示了大模型面临的隐私信息泄露风险。本次学术报告介绍了大模型的应用价值和市场体量,讲述了关于大模型隐私泄露攻击的最新方法,指明了现有的缺陷和未来发展方向。

    2025年8月27日
    4.3K
  • 基于神经网络的源代码表示方法

    简介:神经网络算法在自然语言和计算机视觉等领域取得了快速发展和成熟应用,且在程序分析领域也具有广泛应用,如代码克隆检测、程序分类、漏洞分析和代码搜索等任务。然而不同的程序源代码表示…

    2020年7月19日
    3.7K
  • Android MediaRecorder架构详解

    1. 简介 在android中录制音频有两种方式,MediaRecorder和AudioRecord。两者的区别如下: (1) MediaRecorder 简单方便,不需要理会中间…

    2014年12月7日
    4.6K
  • 强化学习中的信用分配

    本报告围绕强化学习中的“信用分配”难题,系统梳理了延迟/稀疏奖励场景下如何精准识别关键动作的研究脉络, 介绍LaRe与VinePPO两项新工作 ,分别利用大模型先验与无偏采样提升奖…

    2026年1月12日
    4.0K
  • 数据挖掘项目实战

          数据挖掘项目实战,主要以kaggle竞赛平台Titanic生存预测为例详细讲解数据挖掘项目的工作流程,具体包…

    学术报告 2018年5月2日
    3.3K
  • 降维算法(二)—— MDS

    2014年10月22日
    3.0K
  • 一段话,多个情绪?模型如何识别“情绪变化”的蛛丝马迹

    情绪变化识别在人机交互、情绪计算等对话智能领域中具有重要价值,显著增强了模型对动态语境的理解能力。本次报告将介绍对话与语音中的情绪建模任务,分析其研究背景与应用意义,并重点讲解两类…

    2025年4月14日
    3.6K
  • 基于智能体的自动化漏洞重现方法

    本次报告分享的主题是基于智能体的自动化漏洞重现方法,报告通过梳理漏洞重现领域的基本发展历程和基本概念,然后讲解两种不同类型的智能体系统构建方法,分别针对通用应用程序漏洞PoV生成和…

    2026年3月16日
    3.4K
  • 针对文本嵌入模型的模型反演攻击方法研究

    研究针对文本嵌入模型的模型反演攻击,揭示了自然语言处理领域面临的隐私泄露风险。本次学术报告介绍了关于文本嵌入模型模型反演攻击的最新方法,并指明了现有的缺陷和未来发展方向。

    2024年11月5日
    3.4K