ESC
科技 1 分钟阅读

AI检测工具正在制造新的不信任时代

从教育界到出版业,AI检测工具被广泛采用,但其误报率和对非英语母语者的偏见引发争议。文章回顾了多起虚假指控案例,指出耶鲁、MIT等名校已禁用或限制此类工具,并探讨了替代方案。AI检测不仅未能解决信任问题,反而加剧了人与人之间的猜疑。

来源:The Verge

这是 《The Stepback》,一份每周拆解科技界一则重要故事的通讯。想了解更多AI如何改变日常生活的新闻,请关注 Emma Roth。《The Stepback》于美国东部时间上午8点发送至订阅者邮箱。点击 此处 订阅《The Stepback》。

这一切如何开始

早在ChatGPT出现之前,教育工作者和编辑就经常使用反抄袭工具来检查写作者是否诚实地完成了自己的作品。这些工具的工作原理是将书面作品与包含全网内容、学术文章等数据库进行比对,以检查是否存在匹配的句子和短语。有些工具(如Turnitin)会给出一个百分比,声称能显示学生写作与其它作品的重合程度。由于存在误报的可能性以及无法确定作品是否被有意重复使用,一些教育工作者已经放弃使用该特定工具。

但现在,对抄袭内容的追查正在演变为一场针对AI生成内容的战争。学生们以惊人的速度开始使用ChatGPT、Google Gemini和Microsoft Copilot,而教师们也同样迅速地采用了所谓的AI检测器。民主与技术中心的一项调查发现,2024年至2025年间,美国43%的六年级至十二年级教师经常使用AI检测器。一些已在学习管理系统中使用Turnitin的大学发现,该服务在2023年推出AI检测功能时自动启用了这一选项。

与比较书面内容片段不同,GPTZero、Pangram以及Turnitin所开发的AI检测器依靠自身的AI模型来猜测某段文字是否可能非人工撰写——这一过程可以说比在网络上匹配文本更加模糊。正如GPTZero所指出的,AI检测器使用算法分析文本的措辞、节奏和结构,并捕捉在长度和语调上可能更常见于AI文本的模式。这种相对主观的评估不如通过在线匹配文本那样可靠,并且容易被以英语为第二语言的写作者干扰。尽管如此,Turnitin表示其AI检测器将不到1%的人工撰写内容误标为AI,而Pangram声称其误报率仅为万分之一。GPTZero则称其将人类内容误判为AI的比率同样很低。

现状如何

网上已经有人互相指责对方“听起来像AI”,而AI检测工具的唾手可得更是为这场针对大语言模型的猎巫行动火上浇油。在一些备受关注的案例中,AI写作指控直接影响了人们的生计和声誉。上个月,出版商Minotaur因担心作者Jerry Falade使用了AI,取消了一笔200万美元的图书合约——Falade对此坚决否认。

还有法国公民Thierry Rignol,他去年起诉了耶鲁大学,起因是一名教授指控他在期末考试的部分内容中使用了AI,导致他考试不及格并被停学一年。该教授使用GPTZero扫描了Rignol的写作以寻找AI痕迹,但诉讼认为“AI监控和检测工具已知会不公平地针对非英语母语者”,而Rignol正是如此。今年2月,阿德尔菲大学的一名学生赢得了对学校的诉讼,此前他的教授同样声称他用AI写了一篇文章。虽然诉讼没有说明教授使用了哪种AI工具来检查学生的文章,但阿德尔菲大学与Turnitin签有许可协议。

2023年斯坦福大学的一项研究发现,AI检测器将非英语母语者撰写的文章误标为AI的频率高于母语者。(许多服务商至今仍声称他们的工具在处理非母语者文本时是准确的。)这些工具也可能对神经多样性写作者存在偏见。

正如加州大学洛杉矶分校所指出的,AI检测工具经过训练,能够识别可能表明AI使用的模式,例如重复的词语和短语、听起来过于正式或非正式的文字,以及无意义的措辞。有些工具(如QuillBot)还会衡量文本的“不可预测性”,因为“与人类写作相比,AI倾向于做出最‘明显’或最常见的语言选择”。它们还可能将通篇保持不变的句子结构视为另一个AI迹象。但这些指标本身并不能证明是AI,因为有些人可能恰好具有这类写作风格。

尽管Turnitin标榜其低误报率,但它也坚称其工具“可能并不总是准确的”,不应被用来对学生采取处罚措施。Grammarly警告用户“绝不应仅依赖AI检测器的结果”,而GPTZero则表示“没有任何AI检测器能真正做到100%完美”。OpenAI甚至因准确率低而在2023年关闭了自家的AI写作检测器。

但AI写作指控仍在网络上满天飞。上周,Ozzy Osbourne的儿子Jack在一段向其社交媒体频道超过350万粉丝播放的视频中,指责记者兼《The Verge》撰稿人Kat Tenbarge使用AI为《Rolling Stone》撰写文章,并炫耀AI检测器Getsolved的结果作为其说法的“证据”。Tenbarge在视频和她网站上的帖子中驳斥了这一指控,但Osbourne并未撤回指控或删除视频,留下Tenbarge独自应对网络喷子。

从作家到学生,有无数被错误指控的例子,许多指控者都未能正视某些AI检测工具附带的使用声明。

接下来会发生什么

围绕AI检测器的不确定性,已足以让一些教育机构完全停止使用它们。耶鲁大学、约翰霍普金斯大学、范德比尔特大学、乔治城大学等已禁用或限制AI检测工具的使用。麻省理工学院也警告称“AI检测器不可靠”。

许多学校不再依赖工具来剔除AI内容,而是鼓励教育工作者重新思考教学设计。例如,芝加哥大学建议告诉学生放慢阅读速度,将较长的写作任务拆分成多个部分,并要求学生对作业进行反思。斯坦福大学表示教授们可以考虑在课堂上进行考核,而MIT则建议教授们为学生留出空间,让他们在不受处罚的情况下披露是否在作业中寻求了AI帮助。

随着AI在课堂内外日益普及,辨别文字究竟出自人类还是机器的努力也在加强。一些在线平台正在加剧对AI使用的猜疑。Substack已将Pangram内置到其应用中,允许用户扫描博客以发现疑似AI生成的内容,而LinkedIn则添加了一个“看起来像AI垃圾”的按钮。结果是进入了一个新的不信任时代——读者不断质疑所读内容是否为AI所写,而真正的人类写作者则竭力让自己听起来不像AI。

顺便一提

  • 美国作家协会正在帮助作家通过颁发“人类撰写”认证来提前应对指控。还有Not by AI和Written by Human徽章,用户可以将其添加到在线作品中。
  • 维基百科创建了一份指南,帮助编辑识别AI写作,包括查找“夸大”主题重要性或提供“对信息的肤浅分析”的文字。该网站还禁止了AI生成的文章。

延伸阅读

  • 《纽约时报》有一个有趣的测验,让你看五对段落并选出你更喜欢的一段——其中一段是由AI撰写的。
  • 《Inside Higher Ed》采访了一些教育工作者,了解他们在学校中如何处理AI问题,其中一位讲师对AI-proof作业可能带来的成本与资源消耗表示担忧。
  • 我的同事Jess Weatherbed详细报道了同人小说社区在如何判定哪些故事由AI生成的问题上正在发生的内部斗争。

关注本报道中的话题和作者,即可在个性化首页feed中看到更多类似内容,并接收邮件更新。

  • Emma Roth

最受欢迎

最受欢迎

  1. 这款450美元的无名品牌笔记本电脑真的物有所值吗?
  2. Buc-ee’s避开John Oliver,起诉另一家小企业
  3. AI机器人创立了一个宗教——人类立刻追随
  4. Werewolf把我的旧设备改造成了USB-C供电
  5. Nitecore最新移动电源最轻最紧凑

[广告客户内容

这是原生广告的标题](/)

更多专栏

Rachika Nayar的《Heaven Come Crashing》是一首充满绝望渴望的器乐史诗

折叠屏现在有点无聊了——这对苹果来说是个好消息

也许我们不该给24岁的年轻人几十亿美元去赌AI

《Champagne and Bullets》理应跻身烂片名人堂

竖屏视频的全面接管来了

我一天中追踪的数据

Rachika Nayar的《Heaven Come Crashing》是一首充满绝望渴望的器乐史诗

Terrence O’Brien 8月2日

折叠屏现在有点无聊了——这对苹果来说是个好消息

Dominic Preston 8月2日

也许我们不该给24岁的年轻人几十亿美元去赌AI

Elizabeth Lopatto 7月30日

《Champagne and Bullets》理应跻身烂片名人堂

Terrence O’Brien 7月26日

竖屏视频的全面接管来了

David Pierce 7月26日

我一天中追踪的数据

Victoria Song 7月24日

[广告客户内容

这是原生广告的标题](/)

头条新闻

8月8日

这款450美元的无名品牌笔记本电脑真的物有所值吗?

8月7日

为什么苹果一直封禁Telegram,却从不封禁X?

8月8日

Nitecore最新移动电源最轻最紧凑

8月6日

AI机器人创立了一个宗教——人类立刻追随

8月8日

音乐人兼企业家Tom Vek正在打造一款数字音乐播放器,但别叫它复古

通知抽屉

登录以查看你的通知,或创建账户加入对话。 登录