随着人工智能生成的文本越来越像人类书写的内容,检测机器生成文本的能力变得至关重要。为了应对这一挑战,我们提出了 GPTWatermark,这是一种强大而高质量的解决方案,旨在确定一段文本是否源自特定模型。我们的方法扩展了现有的水印策略,并采用固定组设计来增强对编辑和释义攻击的鲁棒性。我们表明,我们的带水印的语言模型在生成质量、检测正确性和针对规避攻击的安全性方面享有强有力的可证明保证。在各种大型语言模型 (LLM) 和不同数据集上的实验结果表明,我们的方法实现了卓越的检测准确率和可比的复杂度生成质量,从而促进了 LLM 的负责任使用。代码可在 https://github. com/XuandongZhao/GPTWatermark 获得。
摘要 - 如今,信息和通信技术的进步以及智能手机等电子设备的易于访问,已经实现了敏捷,高效的存储,版本以及数字多媒体文件的分布。但是,缺乏法规导致了与知识产权认证和版权保护相关的几个问题。此外,在非法打印剥削的情况下,问题变得复杂,涉及打印和扫描过程。为解决这些问题,已经提出了几种与加密算法结合使用的数字水印。在本文中,定义了一种强大的水印策略,该策略由墨西哥文化遗产的数字化摄影图像的管理和检测组成。所提出的策略基于两种类型的数字水印的组合,这是一种基于空间域的可见型膜类型,而另一种基于频域的不可见类型,以及粒子群的优化。实验结果表明,在打印扫描过程或数字动物攻击以及常见的图像几何和图像处理攻击(例如JPEG压缩)中所面临的算法的高性能。此外,通过PSNR评估水印的不可识别性,并将其与其他先前提出的算法进行比较。关键字 - 数字水印,图像处理,信息安全,身份验证,版权保护,文化遗产
