大语言模型生成文本规模持续扩大,释义改写、词语替换和字符扰动等对抗攻击削弱了检测可靠性。本次学术报告聚焦机生文本检测攻防对抗,系统介绍基于释义逆变换与动态对抗训练的鲁棒防御方法,分析检测器失效机理与改进思路,为提升开放场景下检测稳定性、泛化性提供参考。
2026072013280134原创文章,作者:bfs,如若转载,请注明出处:https://www.isclab.org.cn/2026/07/20/%e6%9c%ba%e7%94%9f%e6%96%87%e6%9c%ac%e6%a3%80%e6%b5%8b%e4%b8%ad%e7%9a%84%e5%af%b9%e6%8a%97%e6%94%bb%e5%87%bb%e4%b8%8e%e9%b2%81%e6%a3%92%e9%98%b2%e5%be%a1/