【文本水印:一场大模型实验室与监管层的合规共演】GPTZero首席技术官拆解了主流厂商普遍采用的KGW方案:在模型预测下一个Token时,利用私钥将词库划分为红绿分区并人为拉高绿色词权重,检测器通过分析文本中的绿色词占比来识别身份。这种概率性方案在面对代码、短句或激进的洗稿手段时相当脆弱,只需经过另一台模型重写或人为润色即可失效。从行业视角看,水印的出现更多是为了满足欧盟等地的监管合规要求,而非真正建立一道不可逾越的技术墙。对普通用户来说,比起担忧水印本身,更值得关注的是检测器在高压环境下可能产生的误判。社区评论担忧这种技术正演变成大型企业获利的工具,甚至可能因模型间的互相抓取训练而造成生态层面的“特征污染”。这是一场猫鼠游戏,但目前看来,猫并不打算拼命抓老鼠,只是为了给围观者一个交代。 x: alexcdot/status/2087078010524406137

