" />
近日 人工智能公司Anthropic公布 推出的新一代Claude模子 将默许为天生文本 插手呆板可辨认的“隐形水印” 同时为图片等文件 添加数字来历标识 然而不久后 一个去水印神器代码库 于GitHub上爆火 有媒体称 它采用MIT开源和谈 不仅能抹除了Claude的水印 还有让google及OpenAI的 隐形标志也“难逃一劫” AI内包庇藏水印被“破解” 据媒体报导 这个名叫 watermarks-remover的 水印去除了步伐 发布仅五天 就已经于GitHub 得到年夜量“星标” 针对于Anthropic的水印元数据 watermarks-remover 采用三层洗濯手腕 举行去除了 第一层 查抄隐蔽的Unicode字符 并直接删除了 第二层 精准定位并去除了 差别格局文档中的 文件来历信息和鉴权数据 第三层则是 经由过程Agent挪用外部模子 对于文本举行 年夜幅改写、回译或者者从头说话 粉碎token采样层面的统计模式 从而笼罩年夜模子溯源标志 对于在添加了图象水印的图片 该步伐可于原图的基础上 “受控地从头天生” 一张高度相似的图 并于处置惩罚完成后 引入外部开源模子 举行检测与验证 确保水印全数断根 今朝 该水印去除了步伐 已经可笼罩 Claude、Gemini、OpenAI 三年夜主流厂商的AI办事 新规催生“圆周率轨迹”水印 这次Anthropic 给内容添加“AI水印” 源在欧盟《人工智能法案》中 关在AI天生内容透明度的 举动准则 法案要求 AI天生或者把持的 文本、图象、音频及视频 需要以呆板可读的方式 举行标志 而且可以或许被检测出来 欧盟委员会暗示 只要AI于流程中 饰演了要害脚色 相干方就有义务让用户知情 为满意新规要求 Anthropic采用了 基在google的SynthID-Text方案 即“统计型文本水印” 年夜语言模子天生文字的素质 是“词接龙” 即每一次天生token 都经由过程随机数作几率选择 Anthropic于官方博客中 以豪富翁游戏举行类比 豪富翁进步步数 原本靠掷骰子决议 此刻官方偷偷把骰子 换成为了圆周率 玩家每一次进步步数彻底根据 圆周率小数点后的数字 对于在玩家来讲 每一次的步数依然是“随机”的 文素质量没有任何降落 但只要官方过后拿着 圆周率(密钥) 去查对步数轨迹 就能刹时抓包 “嘿,这段话 是你用Claude天生的!” 也就是说 对于在AI天生的内容 只要不举行彻底重写 纵然做稍微的修改 这个统计学上的 “圆周率轨迹”依然存于 水印就永远没法去除了 “AI水印”激发热议 Anthropic暗示 这套“AI水印”机制 不局限在欧盟规模 而是面向全世界 而且水印从模子层插手 不管从Claude、API 还有是第三方云办事挪用 Claude天生的内容 城市带上“AI水印” 动静宣布后 迅速于全世界规模内引起热议 据《贸易黑幕》报导 一些用户担忧事情结果中 会留下持久存于的标志 袒露本身利用AI的环境 已经取缔了Claude的定阅 撑持水印的用户暗示 深度伪造及AI天生的 虚伪信息正于泛滥 溯源是须要的大众基础举措措施 有否决水印的用户担忧 水印创造了一种 隐形的“AI内容二等公平易近”身份 纵然内容彻底原创 只让Claude做 翻译、拼写查抄或者批改援用 文本仍可能会留下水印 也有不雅点认为 若利用“隐形水印” 则可能于不经意间 将本应由内容出产方 或者平台负担的 核查责任 转嫁到了读者及吸收者身上
