基于神经机器翻译的文本隐写方法
2021-01-04尉爽生杨忠良江旻宇黄永峰
应用科学学报 2020年6期
尉爽生,杨忠良,江旻宇,黄永峰
1.清华大学电子工程系,北京100084
2.莱斯大学计算机科学系, 美国得克萨斯州77005
Shannon 在1949 发表的《保密系统的通信理论》中描述了解决安全问题的3 种技术方案:加密系统、隐私系统和隐藏系统[1].虽然加密系统和隐私系统至今依然是网络系统中的主要安全方案,但它们在保护信息安全的同时也暴露了信息的重要性和存在性,因此容易遭受各种针对性攻击.信息隐藏利用载体数据的信息冗余空间[5]进行秘密信息嵌入,掩盖了信息的存在性,从而减少被攻击的风险.
自然语言文本是人们日常生活中使用最广泛的信息载体,基于文本的信息隐藏存在广阔的应用空间.文本信息隐藏的方法主要有基于文本格式[2-4]、基于文本语法、语义[5-6]和基于文本生成[7-11]的方法.基于文本格式的方法主要是通过修改文本文件的一些格式属性实现信息的嵌入,例如使用不可见字符(空格、制表符等)在单词间增删[2],还有对格式化文本(WORD 等)通过行移编码和字移编码[3-4]对文本的行间距或字符间距做微小改变来进行信息嵌入.这类方法主要出现在早期的研究中,鲁棒性较差,重新排版或者清除格式后隐藏的秘密信息也会丢失.基于语法、语义的信息隐藏方法结合语言学、统计学理论以自然语言处理(natural language processing, NLP)技术为基础,通过对文本进行词汇、语法、语义变换来实现秘密信息的嵌入,在这类方法中相对成熟的有同义词替换算法[5-6].
基于自然语言文本……
登录APP查看全文
