基于神经机器翻译模型的文本零水印算法
丁长浩
于琪
王帆
南京信息工程大学数字取证教育部工程研究中心 南京 210044
摘要:文本零水印作为版权保护和认证的重要手段,能够有效侦测文本信息是否被篡改或盗用.但现在文本零水印仍然面临着鲁棒性较低、对大幅度内容修改攻击抵抗性差的问题.论文针对上述问题,提出了一种基于神经机器翻译模型生成零水印的方法.该方法将需要进行保护的文本输入经过预训练的神经机器翻译模型,获得原文本的译文编码及其生成过程中的信息熵值,将它们作为零水印送入可信第三方进行保存.而在进行版权验证时,算法通过计算两段译文的BLEU值与信息熵差值进行相似性验证.该方法可以有效抵抗如同义词替换攻击、内容调换、文本删减等攻击方式,提高了文本零水印在遭到攻击时的鲁棒性.
关键词:文本零水印神经机器翻译信息熵
分类号:TP301.6(计算技术、计算机技术)
论文发表日期:2025-10-20
在线出版日期:2026-01-16(本平台首次上网日期,不代表文献的发表时间)
页数:6( 2697-2702 )
英文信息
