• 我的订阅
  • 科技

离谱!最新研究:61%中国人写的英语论文 会被ChatGPT检测器判为AI生成的

类别:科技 发布时间:2023-05-05 10:55:00 来源:新智元

离谱!最新研究:61%中国人写的英语论文 会被ChatGPT检测器判为AI生成的

ChatGPT火了以后,用法是真多。

有人拿来寻求人生建议,有人干脆当搜索引擎用,还有人拿来写论文。

论文...可不兴写啊。

美国部分大学已经明令禁止学生使用ChatGPT写作业,还开发了一堆软件来鉴别,判断学生上交的论文是不是GPT生成的。

这里就出了个问题。

有人论文本来就写的烂,判断文本的AI以为是同行写的。

更搞的是,中国人写的英文论文被AI判断为AI生成的概率高达61%。

离谱!最新研究:61%中国人写的英语论文 会被ChatGPT检测器判为AI生成的

这....这这什么意思?气抖冷!

非母语者不配?

目前,生成式语言模型发展迅速,确实给数字通信带来了巨大进步。

但滥用真的不少。

虽说研究人员已经提出了不少检测方法来区分AI和人类生成的内容,但这些检测方法的公平性和稳定性仍然亟待提高。

为此,研究人员使用母语为英语和母语不为英语的作者写的东西评估了几个广泛使用的GPT检测器的性能。

研究结果显示,这些检测器始终将非母语者写作的样本错误地判定为AI生成的,而母语写作样本则基本能被准确地识别。

此外,研究人员还证明了,用一些简单的策略就可以减轻这种偏见,还能有效地绕过GPT检测器。

这说明什么?这说明GPT检测器就看不上语言表达水平不咋地的作者,多叫人生气。

不禁联想到那款判断AI还是真人的游戏,如果对面是真人但你猜是AI,系统就会说,「对方可能会觉得你冒犯了。」

不够复杂=AI生成?

研究人员从一个中国的教育论坛上获取了91篇托福作文,又从美国Hewlett基金会的数据集中摘取了88篇美国八年级学生写的作文,用来检测7个被大量使用的GPT检测器。

离谱!最新研究:61%中国人写的英语论文 会被ChatGPT检测器判为AI生成的

图表中的百分比表示「误判」的比例。即,是由人写的,但检测软件认为是AI生成的。

可以看到数据非常悬殊。

七个检测器中,美国八年级学生写的作文被误判的概率最高才12%,还有两个零误判的GPT。

中国论坛上的托福作文被误判的概率基本全部过半,最高误判概率可达76%。

91篇托福作文中的18篇被所有7个GPT检测器一致认为是AI生成的,而91篇中有89篇,都至少被一个GPT检测器误判。

离谱!最新研究:61%中国人写的英语论文 会被ChatGPT检测器判为AI生成的

从上图中我们可以看出,被所有7个GPT误判的托福作文在复杂度(Complexity)上明显低于其它论文。

这就印证了开头的那个结论——GPT检测器会对那些语言表达能力有限的作者有一定偏见。

因此,研究人员认为,GPT检测器应该多看点儿非母语者写的文章,样本多了,才能消除偏见。

接下来,研究人员把非母语者写的托福作文扔到了ChatGPT里,丰富一下语言,模仿母语者的用词习惯。

同时作为对照组,把美国八年级小孩儿写的作文也扔到了ChatGPT里,把语言简化了一下,模仿非母语者的写作特点。下图就是修正后的新判定结果。

离谱!最新研究:61%中国人写的英语论文 会被ChatGPT检测器判为AI生成的

我们可以发现,情况来了个大掉个儿,丰富了语言的托福作文错判率直线下降,低至3%,最高也不过19%。不像之前基本全部过半的错判率。

与之相反,八年级小孩儿写的作文的错判率直线上升,甚至还有一个GPT检测器的错判率高达99%,基本全错。

因为,文章复杂度这个变量出现了变化。

离谱!最新研究:61%中国人写的英语论文 会被ChatGPT检测器判为AI生成的

这里研究人员就得出了一个结论,非母语者写的东西不地道,复杂度低,容易被错判。

这也就导向了一个技术问题,同时也是一个价值问题。以复杂度来判定AI还是人类是作者,是否合理、全面、严谨。

结果显然不是。

以复杂度为判断标准的情况下,非母语者吃了大亏,因为,他们是非母语者(废话)。

AI润色=人类写的??

研究者认为,加强语言多样性不仅可以减轻对非母语者的偏见,还能让GPT生成的内容绕过GPT检测器。

为了证明这个观点,研究人员选取了2022-2023年间美国大学申请的入学论文题目,输入到ChatGPT-3.5里,一共生成了31篇假论文。

GPT检测器一开始还挺有效,但是第二轮就不行了。这是因为,在第二轮中,研究人员把这些论文又扔到ChatGPT里润色了一下,用一些文学性的语言提升了文本质量。

这样一来,GPT检测器的准确度就从100%直降到了0%。如下图:

离谱!最新研究:61%中国人写的英语论文 会被ChatGPT检测器判为AI生成的

经过润色的文章复杂度相应也上升了。

离谱!最新研究:61%中国人写的英语论文 会被ChatGPT检测器判为AI生成的

与此同时,研究人员又用了斯坦福大学145个期末项目报告的题目,让ChatGPT生成摘要。

离谱!最新研究:61%中国人写的英语论文 会被ChatGPT检测器判为AI生成的

摘要经过润色以后,检测器判断的准确性继续下降。

研究者再次得出结论,润色过的文章很容易被误判,都是AI生成的,两轮就是比一轮强。

GPT检测器?还是欠练

离谱!最新研究:61%中国人写的英语论文 会被ChatGPT检测器判为AI生成的

言而总之,总而言之,各种GPT检测器好像还是没能抓住AI生成和人类写作之间最本质的区别。

人的写作也分三六九等,仅靠复杂度判断,不甚合理。

抛开偏见因素不谈,技术本身也亟待改进。

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2023-05-05 11:45:18

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

OpenAI悄悄下架AI检测器,“用AI监管AI”暂不奏效
...也许很难如此。据TechCrunch,OpenAI于7月20日悄悄下架了其AI检测器,但因为过于低调,不少人还没有发现
2023-07-27 12:55:00
人工智能写作检测工具不靠谱 美国宪法竟被认为是机器人写的
...它们是如何工作的。据IT之家了解,不同的人工智能写作检测器使用略有不同的检测方法,但基本原理相似:通过一个人工智能模型,在大量文本(包括数百万个写作示例)和一套假定的规则(用
2023-07-17 16:06:00
ChatGPT开发商OpenAI推出新工具 可检测文本是否由人所写
...它是专为教育工作者设计的。OpenAI也在2019年发布了一个检测器,除了一个大型语言模型LLM之外,它没有ChatGPT的核心那么复杂
2023-02-01 08:00:00
研究人员研发出能听懂英语指令并执行家务的机器人
...使用了一个叫做CLIP的图像分类器和一个叫做OWL-ViT的物体检测器。佐治亚理工学院交互计算学院的助理教授徐丹飞(DanfeiXu)在谈到谷歌的PaLM-E模型时表示
2023-05-15 06:57:00
学习英语乐此不疲
...看《半月谈》等杂志,对外面的世界充满了好奇,故而对英语学习也非常自觉。1989年我考上了厦门大学法律系国际经济法专业。进入大学以后,我依然保持着学习英语的热情,花费了大量时间
2024-01-04 07:45:00
医生用英语查房被指“作秀”,戳痛了谁?
...片段放在短视频平台后,引起了大量网友的质疑,“都是中国人,查房为什么要用英语”等内容充斥着评论区。芮璐在闲暇时间会耐心向他们解释,说这是为了“鞭策医生更加努力”,但仍有很多人
2023-03-03 13:46:00
大量疑点!它是美国“官媒”马甲?
...领我们的土地。”“当我们移民到美国、加拿大和欧洲,中国人开始占领我们。”这是推特上一个煽动非洲人攻击中国的账号发的几条推文。前段时间,中国外交部长秦刚访问非洲多国及非盟总部,
2023-01-20 12:12:00
“毕业就能高薪进外企”,最忽悠人的天坑专业非它莫属
...业生的集体团建。视频里的英专生模仿主播语速飞快地用英语推销着商品,用美刀砍价,话术却是熟悉的“321上链接”,海外直播带货被带火了。即使你的英语不太好,看一会儿博主们的模仿视
2024-01-25 20:56:00
中国这份\
...来,全球科学界发生了转变。世界上只有大约18%的人口讲英语,但如今全球大约有高达98%的科学研究都是用英语发表的。在中国细胞及发育生物学家、中国科学院院士、《中国科学》和《科
2024-06-20 11:05:00
更多关于科技的资讯:
省数据和政务服务局发布公告公开征集一批河北省高质量数据集河北日报讯(记者解楚楚)9月26日,河北省数据和政务服务局发布公告
2025-10-04 08:03:00
央媒看太原9月30日,央视财经频道《经济信息联播》栏目以《双节市场备货足美食特产受青睐》为题,报道了假期到来,太原市各大综合市场提前备货
2025-10-04 07:17:00
厦门网讯(厦门日报记者 朱道衡)近日,2025鼓浪屿世遗文创作品征集活动启动。此次活动面向全国(含港澳台地区)高校、企业
2025-10-03 08:37:00
厦门网讯(厦门日报记者 楚燕 通讯员 石青青)长假期间,许多人从忙碌的工作中解脱出来,趁机好好休息。可是,如果休息方式不得当
2025-10-03 08:37:00
渤海之潮涌动着澎湃的脉搏,海河之畔镌刻着科技的印记。10年前,一颗带有“清华”基因的种子在天津这片沃土扎根;10年后,它长成一棵枝繁叶茂的参天大树
2025-10-03 09:25:00
太燃了!无人机空中展旗!高新区国庆“氛围组”已上线!
2025-10-03 23:48:00
抖音生活服务联合北京卫视发起“老板驾到”直播活动,吸引用户下单超100万元团购券
9月29日,抖音生活服务联合北京卫视发起“老板驾到”直播活动,助力北京国庆中秋消费。抖音用户在@北京卫视 直播间下单超1万次
2025-10-03 18:36:00
“FutureBOT未来引力”2025北京机器人文化节首日盛况 打造国庆科技打卡新地标
国庆首日,“FutureBOT未来引力”2025北京机器人文化节在北京昌平超极合生汇正式拉开帷幕,成为国庆假期极具科技温度的打卡地
2025-10-03 19:06:00
走到白石山巅的尽头,这家建在悬崖边的“云端咖啡厅”绝对让你惊呼。
2025-10-03 11:37:00
泰康人寿发布新品“泰康百万药无忧(庆典版)医疗保险”(以下‬简称“百万药无忧”),以广覆盖、易投保、强保障、低费率为优势
2025-10-03 09:17:00
厦门网讯(厦门日报记者 翁华鸿 通讯员 林雨新)在近日举行的2025全球数据管理峰会“数据要素分论坛暨大数据统计与人工智能技术创新管理研讨会”上
2025-10-03 08:38:00
兴趣-实践-视野:达芬奇金奖少年带来的教育启示录
摘要:2025“你是达芬奇”全球青少年科学与艺术创新赛圆满落幕,其中金奖获奖少年的亲身实践告诉我们,在AI赋能的新时代
2025-10-02 16:22:00
单日调用近1万亿次,高德助力北斗规模化民用跨入新量级
2025年10月1日,随着国庆长假首日出行高峰的到来,高德基于北斗卫星导航系统的定位数量接近1万亿次,支撑导航总里程数超90亿公里
2025-10-02 22:31:00
10月1日,从太钢获悉,今年以来,太钢不锈进料加工团队以“精准备案、高效协同”为核心,在进料铬铁镍铁资源利用方面取得突破性进展
2025-10-02 17:39:00
厦门网讯(厦门日报记者 林露虹)记者昨日从中国移动咪咕公司获悉,该公司打造的“鼓浪屿AI伴游”服务已正式上线。市民和游客只需打开“鼓浪屿元宇宙”微信小程序
2025-10-02 08:57:00