L3.10.1visible labels vs embedded watermarks设计研究
标识分为可见标注与嵌入式水印,二者的失效方式与适用场景不同
别名: 可见标注 · 嵌入水印 · two disclosure channels
概念解释
一张图左上角写着「合成」,人一眼能读;另一张把不可见的水印嵌进像素,人眼什么也看不到,只有检测器能读。可见标注与嵌入水印(visible labels vs watermarks)是两条通道:一条为人眼准备,一条为机器准备。它们不是同一标识的浓淡,失效方式和该出场的场景都不同。
内容要可被识别,是接收者侧的要求。这里问的是用哪条通道去满足,以及这条通道会死在哪里。
机制
可见标注走注意:裁边、遮挡、换封面、重编码成纯像素截图,字就没了。它的优点是不需要工具,缺点是与内容可分离。水印走载体:抗裁切、抗压缩的设计让它在像素里多活几跳,但人眼读不到,没有检测器就等于没有标识。水印还会在转述、重绘、用另一模型再生成时死去——语义走了,载体没走。
所以适用场景跟着失效走。需要当场校准的接收者(看新闻、看广告)必须有可见通道。需要事后追责、跨平台取证的,必须有嵌入通道。只用一条,等于在另一条的失效点上裸奔。
怎么研究
同一生成物,只可见、只水印、双通道。沿裁切、截图、转述、再生成四条操作,测人眼可读率与检测器召回。自变量:通道组合、操作类型。因变量:人的来源判断、机器检出、双通道同时失败的比例。
分别报人侧失败和机器侧失败。合成一个「标识成功率」会把两种死法平均掉。
边界
纯文本聊天几乎没有可嵌的载体,水印弱,可见文句是主通道。音频、视频有更成熟的水印,可见角标反而容易在播放器皮肤上被关掉。无障碍环境里可见若只靠颜色,对人眼通道也不成立。这条不处理检测失败能不能当人类创作的证据,也不处理守规者负担。
怎么落地
- 对人要当场判断的出口,放可见标注;对可能被取证或入库的出口,加水印。默认双通道,而不是二选一。
- 不要把水印当成给人看的标识。界面上仍要有人能读的字。
- 说明两条通道各自怕什么:可见怕裁切,水印怕转述和再生成。
- 验证:只留可见,裁掉角标后问来源;只留水印,不给检测器问来源。两种「答不出」应对应两条通道的职责,不要用其中一条去顶另一条。