• 我的订阅
  • 科技

谷歌DeepMind研究再登Nature封面,隐形水印让AI无所遁形

类别:科技 发布时间:2024-11-09 13:34:00 来源:新智元

谷歌DeepMind研究再登Nature封面,隐形水印让AI无所遁形

【新智元导读】近日,谷歌DeepMind发表的一项研究登上了Nature期刊的封面,研究人员开发了一种名为SynthID-Text的水印方案,已经在自家的Gemini上投入使用,跟踪AI生成的文本内容,使其无所遁形。

君可知,我们每天在网上的见闻,有多少是出自AI之手?

谷歌DeepMind研究再登Nature封面,隐形水印让AI无所遁形

除了「注意看!这个男人叫小帅」让人头皮发麻,

真正的问题是,我们无法辨别哪些内容是AI生成的。

养大了这些擅长一本正经胡说八道的AI,人类面临的麻烦也随之而来。

(LLM:人与AI之间怎么连最基本的信任都没有了?)

子曰,解铃还须系铃人。近日,谷歌DeepMind团队发表的一项研究登上了Nature期刊的封面:

谷歌DeepMind研究再登Nature封面,隐形水印让AI无所遁形

研究人员开发了一种名为SynthID-Text的水印方案,可应用于生产级别的LLM,跟踪AI生成的文本内容,使其无所遁形。

谷歌DeepMind研究再登Nature封面,隐形水印让AI无所遁形

论文地址:https://www.nature.com/articles/s41586-024-08025-4

一般来说,文本水印跟我们平时看到的图片水印是不一样的。

图片可以采用明显的防盗水印,或者为了不影响内容观感而仅仅修改一些像素,人眼发现不了。

但本文添加的水印想要隐形貌似不太容易。

谷歌DeepMind研究再登Nature封面,隐形水印让AI无所遁形

为了不影响LLM生成文本的质量,SynthID-Text使用了一种新颖的采样算法(Tournament sampling)。

与现有方法相比,检测率更高,并且能够通过配置来平衡文本质量与水印的可检测性。

谷歌DeepMind研究再登Nature封面,隐形水印让AI无所遁形

怎么证明文本质量不受影响?直接放到自家的Gemini和Gemini Advanced上实战。

研究人员评估了实时交互的近2000万个响应,用户反馈正常。

SynthID-Text的实现仅仅修改了采样程序,不影响LLM的训练,同时在推理时的延迟也可以忽略不计。

另外,为了配合LLM的实际使用场景,研究者还将水印与推测采样集成在一起,使之真正应用于生产系统。

大模型的指纹

下面跟小编一起来看下DeepMind的水印有何独到之处。

识别AI生成的内容,目前有三种方法。

第一种方法是在LLM生成的时候留个底,这在成本和隐私方面都存在问题;

第二种方法是事后检测,计算文本的统计特征或者训练AI分类器,运行成本很高,且限制在自己的数据域内;

而第三种就是加水印了,可以在文本生成前(训练阶段,数据驱动水印)、生成过程中、和生成后(基于编辑的水印)添加。

数据驱动水印需要使用特定短语触发,基于编辑的水印一般是同义词替换或插入特殊Unicode字符。这两种方法都会在文本中留下明显的伪影。

SynthID-Text 生成水印

本文的方法则是在生成过程中添加水印。

下图是标准的LLM生成过程:根据之前的token计算当前时刻token的概率分布,然后采样输出next token。

谷歌DeepMind研究再登Nature封面,隐形水印让AI无所遁形

在此基础之上,生成水印方案由三个新加入的组件组成(下图蓝色框):随机种子生成器、采样算法和评分函数。

随机种子生成器在每个生成步骤(t)上提供随机种子 r(t)(基于之前的文本token以及水印key),采样算法使用 r(t) 从LLM生成的分布中采样下一个token。

谷歌DeepMind研究再登Nature封面,隐形水印让AI无所遁形

通过这种方式,采样算法把水印引入了next token中(即r(t)和x(t)的相关性),在检测水印的时候,就使用Scoring函数来衡量这种相关性。

下面给出一个具体的例子:简单来说就是拿水印key和前几个token(这里是4个),过一个哈希函数,生成了m个向量,向量中的每个值对应一个可选的next token。

谷歌DeepMind研究再登Nature封面,隐形水印让AI无所遁形

然后呢,通过打比赛的方式,从这些token中选出一个,也就是SynthID-Text使用的Tournament采样算法。

如下图所示,拿2^m个token参加m轮比赛(这里为8个token3轮比赛,token可重复),

谷歌DeepMind研究再登Nature封面,隐形水印让AI无所遁形

每轮中的token根据当前轮次对应的向量两两pk,胜者进入下一轮,如果打平,则随机选一个胜者。

以下是算法的伪代码:

谷歌DeepMind研究再登Nature封面,隐形水印让AI无所遁形

水印检测

根据上面的赛制,最终胜出的token更有可能在所有的随机水印函数(g1,g2,...,gm)中取值更高,

所以可以使用下面的Scoring函数来检测文本:

谷歌DeepMind研究再登Nature封面,隐形水印让AI无所遁形

把所有的token扔进所有的水印函数中,最后计算平均值,则带水印的文本通常应该得分高于无水印的文本。

由此可知,水印检测是一个程度的问题。影响评分函数检测性能的主要因素有两个。

首先是文本的长度:较长的文本包含更多的水印证据,可以让检测有更多的统计确定性。

第二个因素是LLM本身的情况。如果LLM输出分布的熵非常低(意味着对相同的提示几乎总是返回完全相同的响应),那么锦标赛采样(Tournament)无法选择在g函数下得分更高的token。

此时,与其他生成水印的方案类似,对于熵较小的LLM,水印的效果会较差。

LLM本身的熵取决于以下几个因素:

模型(更大或更高级的模型往往更确定,因此熵更低); 来自人类反馈的强化学习会减少熵(也称为模式崩溃); LLM的提示、温度和其他解码设置(比如top-k采样设置)。

一般来说,增加比赛的轮数(m),可以提高方法的检测性能,并降低Scoring函数的方差。

但是,可检测性不会随着层数的增加而无限增加。比赛的每一层都使用一些可用的熵来嵌入水印,水印强度会随着层数的加深而逐渐减弱。本文通过实验确定m=30。

文本质量

作者为非失真给出了由弱到强的明确定义:

最弱的版本是单token非失真,表示水印采样算法生成的token的平均分布等于LLM原始输出的分布;

更强的版本将此定义扩展到一个或多个文本序列,确保平均而言,水印方案生成特定文本或文本序列的概率与原始输出的分布相同。

当Tournament采样为每场比赛配置恰好两个参赛者时,就是单token非失真的。而如果应用重复的上下文掩码,则可以使一个或多个序列的方案不失真。

在本文的实验中,作者将SynthID-Text配置为单序列非失真,这样可以保持文本质量并提供良好的可检测性,同时在一定程度上减少响应间的多样性。

计算可扩展性

生成水印方案的计算成本通常较低,因为文本生成过程仅涉及对采样层的修改。

对于Tournament采样,在某些情况下,还可以使用矢量化来实现更高效率,在实践中,SynthID-Text引起的额外延迟可以忽略不计。

在大规模产品化系统中,文本生成过程通常比之前描述的简单循环更复杂。

产品化系统通常使用speculative sampling来加速大模型的文本生成。

谷歌DeepMind研究再登Nature封面,隐形水印让AI无所遁形

小编曾在将Llama训练成Mamba的文章中,介绍过大模型的推测解码过程。

简单来说就是用原来的大模型蒸馏出一个小模型,小模型跑得快,先生成出一个序列,大模型再对这个序列进行验证,由于kv cache的特性,发现不符合要求的token,可以精准回滚。

这样的做法既保证了输出的质量,又充分利用了显卡的计算能力,当然主要的目的是为了加速。

所以在实践中,生成水印的方案需要与推测采样相结合,才能真正应用于生产系统。

对此,研究人员提出了两种带有推测采样算法的生成水印。

一是高可检测性水印推测采样,保留了水印的可检测性,但可能会降低推测采样的效率(从而增加整体延迟)。

二是快速水印推测采样,(当水印是单token非失真时)保留了推测采样的效率,但可能会降低水印的可检测性。

作者还提出了一个可学习的贝叶斯评分函数,以提高后一种方法的可检测性。当速度在生产环境中很重要时,快速带水印的推测采样最有用。

谷歌DeepMind研究再登Nature封面,隐形水印让AI无所遁形

上图表明,在非失真类别中,对于相同长度的文本,非失真SynthID-Text提供比Gumbel采样更好的可检测性。在较低熵的设置(如较低的温度)下,SynthID-Text对Gumbel采样的改进更大。

参考资料:

https://x.com/GoogleDeepMind/status/1849110265645678807

https://www.nature.com/articles/d41586-024-03462-7

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2024-11-09 15:45:01

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

AI一本正经地胡说八道 有种办法可以识破它
...队在《自然》(Nature)上发表的封面文章提供了一种文本水印方案,可以提高 AI 生成文本的检测精度。AI 生成内容检测的必要性在文本、图像和音乐中,AI 生成的文本是最难
2024-12-23 17:03:00
再也不能用chatgpt写作业了,新算法给ai生成文本加水印
AI生成文本,又遇新对手!凭借识别AI生成文本中的“水印”,一种新算法能够准确判断文本到底是谁写的。无需访问模型参数、API
2023-02-09 14:19:00
NeurIPS 2024|水印与高效推理如何两全其美?最新理论:这做不到
近日,DeepMind 团队将水印技术和投机采样(speculative sampling)结合,在为大语言模型加入水印的同时
2024-11-22 09:49:00
OpenAI开发ChatGPT「反作弊神器」,99.9%超高命中率!但没发布
【新智元导读】OpenAI又左右互搏上了,给AI生成的文本打水印,高达99.9%准确率抓「AI枪手」作弊代写。去各大高校图书馆转一圈,会发现头上一副耳机、手边一杯咖啡,电脑上一个
2024-08-06 09:28:00
OpenAI自研反AI神器,憋了两年啥也不是?
...OpenAI为何对这个功能如此纠结?更重要的是,这个所谓的水印真的能百分百破解GPT生成的文本吗?给GPT打“码”想象一下
2024-08-11 19:03:00
...类器法(也被称为监督分类器法)、零样本分类器法、文本水印法。“三种检测方法本质上都是利用AI检测AI,且各有优劣。”鲍光胜说。模型训练分类器法,首先要收集大量人类创作内容与A
2024-08-16 10:04:00
谷歌发布音乐AI工具MusicFX:一句话就能生成一首音乐
...”的创作工具结合了谷歌此前发布的MusicLM模型和DeepMind的水印技术SynthID,以便在事后识别出它们是否由AI制作而成
2023-12-14 17:26:00
字节版Sora火爆24小时,同名论文再次被热议
...描述。不过WebVid-10M存在一个问题,即所有视频上都带有水印,这导致生成的视频中也会包含水印。因此,团队将训练数据扩展为另外自收集的50万个无水印视频片段,它们包含真实
2024-09-26 13:41:00
谷歌DeepMind推出SynthID工具,能在AI生成的图像中嵌入隐形水印
...SynthID 的工具,可以在 AI 生成的图像中嵌入人眼不可见的水印,但可以用专门的人工智能检测工具检测出来,以便于区分真实和虚假的内容。该工具已经在谷歌云平台上向部分客户
2023-08-30 10:15:00
更多关于科技的资讯:
国务院新闻办公室1月21日上午举行新闻发布会,工业和信息化部介绍2025年工业和信息化发展成效有关情况,并答记者问。全国所有乡镇以及95%的行政村已通5G在移动网络方面
2026-01-22 08:12:00
1月21日,市场监管总局召开专题新闻发布会,通报了2025年综合整治“内卷式”竞争十大典型案例。十大案例中,首案为公开约谈货拉拉
2026-01-22 08:13:00
2025年12月底,全国多家头部家装企业密集推出“资金存管”业务,在行业掀起了一股加强资金安全的新风。资金存管模式在互联网金融
2026-01-22 08:13:00
能治疗癌症的CAR-T细胞疗法有了“国家级说明书”!
大河网讯 你听说过用“特种兵”免疫细胞(CAR-T细胞)来精准打击癌症吗?日前,由郑州大学第一附属医院生物细胞治疗中心牵头编制的《CAR-T细胞疗法临床应用技术规范》《CAR-T
2026-01-22 10:08:00
杭州日报讯 从全球大火的游戏到艺术展再到专门的衍生品零售店,杭州出品的“黑神话”IP的每一场活动都引发了粉丝的关注。这个周末(1月23日-25日)
2026-01-22 08:19:00
日前,太重智能高端装备产业园区的厂房内一片欢腾。由企业自主研发的智能轴承,成功应用于大型电铲并顺利完成厂内模拟测试,各项性能指标均优于设计标准
2026-01-22 07:03:00
最近有件事儿越来越常见:外国人不光来中国旅游,还专门“打飞的”来看病。不是出于好奇体验,而是真心觉得值!值在哪儿?三个字
2026-01-21 21:52:00
中新经纬1月21日电 广东省政府网站21日公布《广东省人工智能赋能交通运输高质量发展若干政策措施》(下称《政策措施》)
2026-01-21 20:20:00
织金平远公司完成 500kVⅡ 组母线母差保护装置校验及传动
多彩贵州网讯(通讯员 史凡莉)近日,织金平远公司厂区内,500kVⅡ组母线设备区域一派忙碌景象。电热检修部与发电运行部工作人员有条不紊地开展母差保护A屏
2026-01-21 17:15:00
九阳太空厨房已安全稳定运行超1500天
中国消费者报报道(记者桑雪骐)航天员们如何健康、舒适地展开太空生活和吃好一日三餐,是大家都很关心的话题。据了解,这背后其实有一个我国自主研制的太空厨房
2026-01-21 18:05:00
秦皇岛经开区第一小学开展人工智能科技实践活动
河北新闻网讯(李佳新)日前,秦皇岛经开区第一小学开展以“AI探索,智创未来”为主题的人工智能科技实践,通过沉浸式实训活动激发学生的科技探索热情
2026-01-21 18:11:00
马年将至(农历),在广州大夫山森林公园,一些徒步爱好者分享了一种创意玩法——“画马”,相关穿越路线攻略一时引发追捧。所谓“画马”
2026-01-21 18:36:00
三重蝶变,中天钢铁解锁“企业主理”新范式
大寒虽寒,热潮涌动。原点空间路演大厅内,由中天钢铁主理的第37场沙龙——“AI智能体创新大赛总结沙龙”以三重蝶变,为常州“智能体+场景应用”示范城市建设吹响了热力全开的奋进号角
2026-01-21 18:28:00
苏州市女企协秘书长、国浩律师(苏州)事务所合伙人葛霞青律师荣登《钱伯斯大中华区指南2026》推荐榜单
江南时报讯 1月15日,全球领先的法律研究和分析机构钱伯斯(Chambers & Partners)发布《钱伯斯大中华区指南2026》(Chambers Greater China Region Guide 2026)
2026-01-21 15:23:00
盐城盐都:“翼”技傍身 照亮前程
江南时报讯 启动无人机,校准飞行参数,规划测绘航线,精准捕捉地面数据……日前,2026年盐城市盐都区首期无人机测绘操控员技能培训在都U+乐业空间正式开班
2026-01-21 15:24:00