首页 > 行业 >

离谱!最新研究:61%中国人写的英语论文,会被ChatGPT检测器判为AI生成的-微速讯

2023-05-05 07:45:26 来源:手机网易网

新智元报道

编辑:拉燕

【新智元导读】非母语者写的文章=AI生成?气抖冷。


(相关资料图)

ChatGPT火了以后,用法是真多。

有人拿来寻求人生建议,有人干脆当搜索引擎用,还有人拿来写论文。

论文...可不兴写啊。

美国部分大学已经明令禁止学生使用ChatGPT写作业,还开发了一堆软件来鉴别,判断学生上交的论文是不是GPT生成的。

这里就出了个问题。

有人论文本来就写的烂,判断文本的AI以为是同行写的。

更搞的是,中国人写的英文论文被AI判断为AI生成的概率高达61%。

这....这这什么意思?气抖冷!

非母语者不配?

目前,生成式语言模型发展迅速,确实给数字通信带来了巨大进步。

但滥用真的不少。

虽说研究人员已经提出了不少检测方法来区分AI和人类生成的内容,但这些检测方法的公平性和稳定性仍然亟待提高。

为此,研究人员使用母语为英语和母语不为英语的作者写的东西评估了几个广泛使用的GPT检测器的性能。

研究结果显示,这些检测器始终将非母语者写作的样本错误地判定为AI生成的,而母语写作样本则基本能被准确地识别。

此外,研究人员还证明了,用一些简单的策略就可以减轻这种偏见,还能有效地绕过GPT检测器。

这说明什么?这说明GPT检测器就看不上语言表达水平不咋地的作者,多叫人生气。

不禁联想到那款判断AI还是真人的游戏,如果对面是真人但你猜是AI,系统就会说,「对方可能会觉得你冒犯了。」

不够复杂=AI生成?

研究人员从一个中国的教育论坛上获取了91篇托福作文,又从美国Hewlett基金会的数据集中摘取了88篇美国八年级学生写的作文,用来检测7个被大量使用的GPT检测器。

图表中的百分比表示「误判」的比例。即,是由人写的,但检测软件认为是AI生成的。

可以看到数据非常悬殊。

七个检测器中,美国八年级学生写的作文被误判的概率最高才12%,还有两个零误判的GPT。

中国论坛上的托福作文被误判的概率基本全部过半,最高误判概率可达76%。

91篇托福作文中的18篇被所有7个GPT检测器一致认为是AI生成的,而91篇中有89篇,都至少被一个GPT检测器误判。

从上图中我们可以看出,被所有7个GPT误判的托福作文在复杂度(Complexity)上明显低于其它论文。

这就印证了开头的那个结论——GPT检测器会对那些语言表达能力有限的作者有一定偏见。

因此,研究人员认为,GPT检测器应该多看点儿非母语者写的文章,样本多了,才能消除偏见。

接下来,研究人员把非母语者写的托福作文扔到了ChatGPT里,丰富一下语言,模仿母语者的用词习惯。

同时作为对照组,把美国八年级小孩儿写的作文也扔到了ChatGPT里,把语言简化了一下,模仿非母语者的写作特点。下图就是修正后的新判定结果。

我们可以发现,情况来了个大掉个儿,丰富了语言的托福作文错判率直线下降,低至3%,最高也不过19%。不像之前基本全部过半的错判率。

与之相反,八年级小孩儿写的作文的错判率直线上升,甚至还有一个GPT检测器的错判率高达99%,基本全错。

因为,文章复杂度这个变量出现了变化。

这里研究人员就得出了一个结论,非母语者写的东西不地道,复杂度低,容易被错判。

这也就导向了一个技术问题,同时也是一个价值问题。以复杂度来判定AI还是人类是作者,是否合理、全面、严谨。

结果显然不是。

以复杂度为判断标准的情况下,非母语者吃了大亏,因为,他们是非母语者(废话)。

AI润色=人类写的??

研究者认为,加强语言多样性不仅可以减轻对非母语者的偏见,还能让GPT生成的内容绕过GPT检测器。

为了证明这个观点,研究人员选取了2022-2023年间美国大学申请的入学论文题目,输入到ChatGPT-3.5里,一共生成了31篇假论文。

GPT检测器一开始还挺有效,但是第二轮就不行了。这是因为,在第二轮中,研究人员把这些论文又扔到ChatGPT里润色了一下,用一些文学性的语言提升了文本质量。

这样一来,GPT检测器的准确度就从100%直降到了0%。如下图:

经过润色的文章复杂度相应也上升了。

与此同时,研究人员又用了斯坦福大学145个期末项目报告的题目,让ChatGPT生成摘要。

摘要经过润色以后,检测器判断的准确性继续下降。

研究者再次得出结论,润色过的文章很容易被误判,都是AI生成的,两轮就是比一轮强。

GPT检测器?还是欠练

言而总之,总而言之,各种GPT检测器好像还是没能抓住AI生成和人类写作之间最本质的区别。

人的写作也分三六九等,仅靠复杂度判断,不甚合理。

抛开偏见因素不谈,技术本身也亟待改进。

参考资料:

https://arxiv.org/pdf/2304.02819.pdf

上一篇:

盛泽专做桃皮绒的厂家_桃皮绒 吴江市宇勇鑫织造厂

下一篇:

最后一页

x
推荐阅读

离谱!最新研究:61%中国人写的英语论文,会被ChatGPT检测器判为AI生成的-微速讯

盛泽专做桃皮绒的厂家_桃皮绒 吴江市宇勇鑫织造厂

葛恒云(关于葛恒云的简介) 环球速讯

CPS Technologies(CPSH.US):2023年Q1财报实现营收710万美元

干煸鸭做法?

每日聚焦:法媒:纽卡有意马耶尔,雷恩要价4000万欧

天天观天下!双向推力角接触球轴承安装图(双向推力角接触球轴承特点)

2的32次方减1化简 2的32次方减1-当前视点

神角智能2022年亏损219.76万同比亏损增加 公司客户回款不及预期-天天速读

美国防部:调派1500名现役士兵赴美墨边境_当前热闻

热消息:川大三星堆遗址考古队荣获中国青年五四奖章

湖南省临武县提升民兵应急应战本领

广饶县育英幼儿园举行第二届班级足球友谊赛 全球速读

男子花217元买下价值2600万豪宅,激动到说不出话:不敢相信

今日最新!2023广州海珠区民办小学怎么报名?

每日视点!假日嘴巴忙,节后调胃肠,看这篇就够了!

坐便器安装尺寸一般是多少寸(坐便器安装尺寸一般是多少)-每日消息

多主力现身龙虎榜,青松建化涨停(05-04)

小学生消防手抄报内容怎么写_小学生消防手抄报内容

新乳业:公司在淄博烧烤节以及淄博的市场有产品露出及提供_天天速递

今日时讯:科尔有些接触在季后赛不会吹犯规 科尔杰迈克尔格林对国王出场不多出于对位考虑但他时刻准备着

油烫伤了家用处理方法涂什么药(油烫伤了家用处理方法)

「怪物新人」金施恩夺百想:活着活着就得奖了,人生还是很美好的 头条

克里姆林宫遭无人机袭击 美国回应:事先并不知情-最资讯

观速讯丨核桃花怎么处理才能吃_可以怎么吃呢

陕西省平利县发布雷电黄色预警-当前速讯

环球实时:看,这是黑土地上的春耕“科技范儿”

视焦点讯!hicar智行如何自动播放音乐 操作方法介绍

李斌被ES7车主“逼宫”!汽车迭代过快也是罪?

罕见跌停!格力电器分红低于预期,董明珠豪爽不起来

游客如织!“五一”假期,古都新郑接待游客43.6万人次-全球聚看点

【全球聚看点】为基层足球少年搭建竞赛平台,“星体验”系列赛首站尉氏完赛

今日热门!新城悦服务参股成立河南城市运营服务公司 经营涉市政设施管理

持续用力筑牢产业“四梁八柱”_环球热点评

综述:欧洲经济增长疲弱 面临下行风险

从2022年ESG报告,看蓝月亮(06993.HK)的价值生长

主力资金连续5日以上净流入圆通速递等65股 天天热门

奇招频出,“马车”跑得欢

环球观点:马天宇女装动漫(马天宇女装)

当前头条:2.74亿人次!“五一”游客爆棚商家订单接到手软

2-1!梅西护卫世界波救主,尤文一战甩开国米,坐稳意甲前三

两名中国游客在巴厘岛一酒店身亡具体详细内容是什么 世界热资讯

全球讯息:五一热经济丨出行支付同比翻倍增长 各地花式促消费烟火气全面回归

3成首付 5年0息 “家轿卷王”新408限时轻松贷 世界今头条

焦点速讯:莫斯科郊外的晚上_莫斯科郊外的晚上歌词

全球热消息:都市巅峰高手笔趣阁_都市巅峰高手

食品科学与工程考研方向及学校_食品科学与工程-天天简讯

大湾区聚变力量(01189)进一步延迟刊发2022年度业绩|速读

美国半导体协会总裁:我们不能缺席中国市场

当前通讯!石家庄教学质量怎么样西山校初中好还是西安好