我最近自己动手写了一个简单偏教学性质的版本,思路参照了 SynthID-Text 那种语言模型水印方案
之前看到 Anthropic 说,他们准备给模型生成的内容加 watermark,我就很好奇:这水印到底怎么加?难不成会在回答中间突然插点广告之类的?
后来去读了他们的文章才明白,所谓水印根本不是可见的文字,而是在模型选词的时候,悄悄埋进去了一种很细微的统计规律
我这个实现并不是原版 SynthID-Text 的精确复刻为了让项目更好懂,我把其中一些模块做了简化,或者用别的方式重写了一遍,不过核心思路应该还是在的