【导读】非母语者写的文章=AI生成?气抖冷。

ChatGPT火了以后,用法是真多。

有人拿来寻求人生建议,有人干脆当搜索引擎用,还有人拿来写论文。

论文...可不兴写啊。

美国部分大学已经明令禁止学生使用ChatGPT写作业,还开发了一堆软件来鉴别,判断学生上交的论文是不是GPT生成的。

这里就出了个问题。

有人论文本来就写的烂,判断文本的AI以为是同行写的。

更搞的是,中国人写的英文论文被AI判断为AI生成的概率高达61%。

这....这这什么意思?气抖冷!

非母语者不配?

目前,生成式语言模型发展迅速,确实给数字通信带来了巨大进步。

但滥用真的不少。

虽说研究人员已经提出了不少检测方法来区分AI和人类生成的内容,但这些检测方法的公平性和稳定性仍然亟待提高。

为此,研究人员使用母语为英语和母语不为英语的作者写的东西评估了几个广泛使用的GPT检测器的性能。

研究结果显示,这些检测器始终将非母语者写作的样本错误地判定为AI生成的,而母语写作样本则基本能被准确地识别。

此外,研究人员还证明了,用一些简单的策略就可以减轻这种偏见,还能有效地绕过GPT检测器。

这说明什么?这说明GPT检测器就看不上语言表达水平不咋地的作者,多叫人生气。

不禁联想到那款判断AI还是真人的游戏,如果对面是真人但你猜是AI,系统就会说,「对方可能会觉得你冒犯了。」

不够复杂=AI生成?

研究人员从一个中国的教育论坛上获取了91篇托福作文,又从美国Hewlett基金会的数据集中摘取了88篇美国八年级学生写的作文,用来检测7个被大量使用的GPT检测器。

图表中的百分比表示「误判」的比例。即,是由人写的,但检测软件认为是AI生成的。

可以看到数据非常悬殊。

七个检测器中,美国八年级学生写的作文被误判的概率最高才12%,还有两个零误判的GPT。

中国论坛上的托福作文被误判的概率基本全部过半,最高误判概率可达76%。

91篇托福作文中的18篇被所有7个GPT检测器一致认为是AI生成的,而91篇中有89篇,都至少被一个GPT检测器误判。

从上图中我们可以看出,被所有7个GPT误判的托福作文在复杂度(Complexity)上明显低于其它论文。

这就印证了开头的那个结论——GPT检测器会对那些语言表达能力有限的作者有一定偏见。

因此,研究人员认为,GPT检测器应该多看点儿非母语者写的文章,样本多了,才能消除偏见。

接下来,研究人员把非母语者写的托福作文扔到了ChatGPT里,丰富一下语言,模仿母语者的用词习惯。

同时作为对照组,把美国八年级小孩儿写的作文也扔到了ChatGPT里,把语言简化了一下,模仿非母语者的写作特点。下图就是修正后的新判定结果。

我们可以发现,情况来了个大掉个儿,丰富了语言的托福作文错判率直线下降,低至3%,最高也不过19%。不像之前基本全部过半的错判率。

与之相反,八年级小孩儿写的作文的错判率直线上升,甚至还有一个GPT检测器的错判率高达99%,基本全错。

因为,文章复杂度这个变量出现了变化。

这里研究人员就得出了一个结论,非母语者写的东西不地道,复杂度低,容易被错判。

这也就导向了一个技术问题,同时也是一个价值问题。以复杂度来判定AI还是人类是作者,是否合理、全面、严谨。

结果显然不是。

以复杂度为判断标准的情况下,非母语者吃了大亏,因为,他们是非母语者(废话)。

AI润色=人类写的??

研究者认为,加强语言多样性不仅可以减轻对非母语者的偏见,还能让GPT生成的内容绕过GPT检测器。

为了证明这个观点,研究人员选取了2022-2023年间美国大学申请的入学论文题目,输入到ChatGPT-3.5里,一共生成了31篇假论文。

GPT检测器一开始还挺有效,但是第二轮就不行了。这是因为,在第二轮中,研究人员把这些论文又扔到ChatGPT里润色了一下,用一些文学性的语言提升了文本质量。

这样一来,GPT检测器的准确度就从100%直降到了0%。如下图:

经过润色的文章复杂度相应也上升了。

与此同时,研究人员又用了斯坦福大学145个期末项目报告的题目,让ChatGPT生成摘要。

摘要经过润色以后,检测器判断的准确性继续下降。

研究者再次得出结论,润色过的文章很容易被误判,都是AI生成的,两轮就是比一轮强。

GPT检测器?还是欠练

言而总之,总而言之,各种GPT检测器好像还是没能抓住AI生成和人类写作之间最本质的区别。

人的写作也分三六九等,仅靠复杂度判断,不甚合理。

抛开偏见因素不谈,技术本身也亟待改进。

离谱!最新研究:61%中国人写的英语论文,会被ChatGPT检测器判为AI生成的相关推荐

  1. 专门替中国人写的英语语法

    第一章 英文文法的最基本规则 专门替中国人写的英语语法 英文和我们中文最大的不同,是在动词,我们中文的动词很简单,没有所谓的第几人称,也没有复数和单数之分,更 没有过去式或进行式,英文可不同了,凡是用 ...

  2. #今日论文推荐# 朱松纯团队最新研究:机器人可与人类“推心置腹”!还说下一步要造“AI大白”

    #今日论文推荐# 朱松纯团队最新研究:机器人可与人类"推心置腹"!还说下一步要造"AI大白" 机器人能否像<超能陆战队>中的"大白&quo ...

  3. 朱松纯团队最新研究:机器人可与人类“推心置腹”!还说下一步要造“AI大白”...

    羿阁 万博 发自 凹非寺 量子位 | 公众号 QbitAI 机器人能否像<超能陆战队>中的"大白"一样,理解人类情感和价值观,统一目标齐心协力解决问题? 现在,这个问题 ...

  4. 《专门替中国人写的英语语法》(四)

    本文主要介绍"一般过去时"(the past tense)和"过去进行时"(the past continuous tense)两种时态. 一.一般过去时 一般 ...

  5. ChatGPT研究(二)——ChatGPT助力跨模态AI生成应用

    ✏️写作:个人博客,InfoQ,掘金,知乎,CSDN

  6. 有关于计算机英语的论文题目,容易写的计算机英语论文选题 计算机英语论文题目哪个好...

    [100道]容易写的计算机英语论文选题供您参考,希望能解决毕业生们的计算机英语论文题目哪个好相关问题,选好题目那就开始写计算机英语论文吧! 一.比较好写的计算机英语论文题目: 1.关于高等院校计算机英 ...

  7. 格式英语计算机,计算机英语论文大纲格式 计算机英语论文提纲如何写

    [100个]计算机英语论文大纲格式供您参考,希望能解决毕业生们的计算机英语论文提纲如何写相关问题,写好提纲那就开始写计算机英语论文吧! 五.基于概念隐喻理论的计算机英语词汇教学研究论文提纲 摘要 Ab ...

  8. 计算机网络英语技术支持题目,计算机网络英语学论文选题 计算机网络英语论文题目选什么比较好...

    精选了[100道]关于计算机网络英语学论文选题供您后续的写作参考,在写计算机网络英语论文之前,很多大学生总是被计算机网络英语论文题目选什么比较好难倒怎么办?请阅读本文! 一.比较好写的计算机网络英语论 ...

  9. 比较两种计算机语言的英语论文,计算机英语论文,关于计算机英语的语言特点教学方法探析相关参考文献资料-免费论文范文...

    导读:本论文可用于计算机英语论文范文参考下载,计算机英语相关论文写作参考研究. 徐欣 (江苏省徐州技师学院 江苏徐州 221151) 摘 要:计算机英语因其特殊性,在教学过程中需要有其特有的教学方法. ...

最新文章

  1. 长春机械电子计算机类,长春机械电子学校
  2. 6大最流行、最有用的自然语言处理库对比
  3. 终身学习这件事,比你想的还要重要
  4. python中链表和数组_Python
  5. Windows下编程需要看哪些书
  6. jpa jsf_完整的Web应用程序Tomcat JSF Primefaces JPA Hibernate –第3部分
  7. 前端页面加水印插件_没用过这7款浏览器插件,你一定是假的程序员
  8. 体检异常率98%?数据分析告诉你如今的90后身体状况到底有多差?
  9. php连接memcache(php.ini配置)
  10. 大学生买macbookpro合适吗?
  11. 高中会考计算机网络技术试题,高中信息技术会考练习复习试题及答案
  12. CTPN OCR目标检测及源码
  13. 宽带路由器中关于IP带宽控制功能的详解
  14. 路由及路由器工作原理深入解析3:路由与端口
  15. 发那科机器人GI分配_发那科机器人应用-运动指令入门(1)
  16. 计算机管理上移动硬盘显示其他设备,win7系统拔出移动硬盘提示“该设备正在使用”怎么处理...
  17. 近期基金有所上涨,你的基金回本了吗?如果回本了,你还会继续持仓吗?
  18. [小说连载]张小庆,在路上(30)-保持希望
  19. vue 实现出生日期计算年龄
  20. android adb shell am 可以用来启动activity ,而且可以通过-e 传入参数, 牛牛牛

热门文章

  1. setTimeout用法
  2. Windows 10 安装 NVIDIA cuDNN v7.6.0 for CUDA 10.1
  3. 首页搬迁 - 一步一步指导搬家
  4. 第二篇web前端面试自我介绍(刚毕业的菜鸟)
  5. 24.ES中什么是match查询?match查询可以做什么?如何使用match查询?嘻哈的简写笔记——Elastic Search
  6. nginx安装与调优部署文档(Linux)
  7. 网络环境ping丢包率测试
  8. Sql Server datetime 常用日期格式转换
  9. [练习]简易留言板制作
  10. 车联网TBOX硬件定制开发-新能源汽车TBOX硬件软件系统设计