Share - WeChat
据媒体报道
OpenAI宣布
将开始在欧盟境内
为ChatGPT和Codex生成的文本
添加不可见水印
以履行欧盟
《人工智能法案》的透明度义务
欧盟要求AI内容满足“透明度规则”
欧盟自8月2日起
扩大《人工智能法案》适用范围
开始执行透明度规则
以及针对
通用人工智能模型提供商的
相关规则

根据新的透明度规则
聊天机器人等交互式AI系统
在使用过程中
必须告知用户
利用人工智能
生成的“深度伪造”内容
并作出标识
人工智能生成或修改的内容
还须带有机器可读标记
以便易于识别
欧盟委员会表示
这些规定
旨在减少欺骗和操纵行为
目前
欧盟的《人工智能法案》
已正式成为
具有法律约束力的
全域AI监管框架
藏在文本选词逻辑里的隐形水印
10月6日
OpenAI对外公开
textGrain文本水印技术
计划在未来数周内
在欧盟完成部署
有分析称
textGrain
是OpenAI面向欧盟监管要求
推出的合规技术方案
一种可验证、可跟随文本迁移
肉眼不可见的溯源信号

textGrain到底怎么“隐形盖章”?
据OpenAI介绍
所谓水印
并非可见的符号或标注
而是通过微调模型的用词分布
在文本内部形成一种
读者无法察觉
但检测器能够识别的统计模式
简单说
它不改字、不加标、不插括号
甚至不碰标点
在模型“选词”那一毫秒的
决策缝隙里
就悄悄埋下了
统计学意义上的“微节奏”
比如
在同义词簇中
优先选择某个特定词根的变体
在句法结构允许的边界内
微调连接词分布概率
构成了独一无二的水印信号
由于水印内嵌于文字本身
文本在被复制粘贴时
同样会随之转移
据报道
通过百万级样本训练
textGrain文本水印技术
能从一段200个token的英文段落中
以80%置信度识别出
来自OpenAI的文本
易被改写消解的“数字指纹”
当然
textGrain并非完美方案
OpenAI表示
短文本是这项技术的“短板”
200个token的文本
检出率约80%
400个token的文本
检出率跃升至95%
数学推导、代码注释
公式描述这类高度结构化
低自由度的内容
检出率会出现明显下滑
只要对文本进行少量改写
比如将“迅速”改成“快速”
“优化”换成“提升”
替换10%同义词
检出率就从92%暴跌到66%
替换25%同义词后
检出率仅剩17%
检测能力基本失效
此前
为满足新规要求
人工智能公司Anthropic
也推出过
针对Claude模型的隐形水印
Anthropic采用了
基于谷歌的SynthID-Text方案
即“统计型文本水印”
然而不久后
一个去水印神器
watermarks-remover
在GitHub上爆火
该工具通过改写文本
替换词汇的方式
破坏统计水印信号
业内分析认为
一个现实问题不容忽视
AI内容
真正“防伪难点”
从来不在生成端
而在编辑端、传播端、语境端
AI水印
主要防范未经修改的
复制粘贴行为
但很难抵御
人为二次改写创作
据报道
正因如此
OpenAI没把检测器
公开上传至GitHub
供大众下载
OpenAI在公告中提及
检测技术存在性能局限
出于负责任使用的考量
检测器仅对经资质审核的机构开放
2022年7月12日,世界互联网大会国际组织正式成立,从互联网领域的国际盛会发展为国际组织,总部设于中国北京。我们将致力于搭建全球互联网共商共建共享平台,推动国际社会顺应信息时代数字化、网络化、智能化趋势,共迎安全挑战,共谋发展福祉,携手构建网络空间命运共同体。