近日,Anthropic公司对外公布了其AI模型Claude新水印技术的更多细节。该技术旨在为AI生成的内容添加隐形标记,以便追踪和验证内容的来源,从而应对深度伪造和虚假信息问题。Anthropic表示,水印将嵌入在文本的生成过程中,通过微调词汇选择或句式结构来编码信息,而不会影响文本的可读性和自然度。

针对用户关心的“水印能否被编辑隐藏”问题,Anthropic回应称,水印设计具有鲁棒性,即使经过删减、改写或重排,仍能被检测系统识别。不过,完全重写或翻译可能会削弱水印的有效性。此外,对于代码生成场景,Anthropic强调水印不会影响代码的正确性和功能性,开发者可以放心使用。

目前,该水印技术已进入测试阶段,Anthropic计划在未来几个月内向公众开放。公司还承诺将开源部分检测工具,以鼓励第三方研究和应用,共同构建更可信的AI内容生态。