据美国科技媒体The Verge报道,人工智能检测工具正在引发新的信任危机。尽管这些工具被宣称能准确识别AI生成内容,但其误判风险已导致多起争议事件,甚至影响到个人的学业和职业生涯。
The Verge在近期报道中指出,从学生到教师,从出版社到大学,越来越多的人开始使用AI检测工具。美国公民自由联盟下属机构“民主与技术中心”的一项调查显示,2024至2025年间,美国六年级至十二年级教师中有43%定期使用AI检测工具。部分大学在将Turnitin集成至学习管理系统时,发现该服务在2023年推出AI检测功能后即自动启用。
然而,这类工具的工作原理并非简单比对网络数据库,而是利用自身AI模型猜测文本是否由人类撰写。GPTZero等工具会分析文本的措辞、节奏和结构,以及长度和语气中可能更常见的AI模式。这种相对主观的评估方式并不像在线文本匹配那样可靠,且容易将英语非母语者误判为使用AI。尽管Turnitin声称其AI检测器将不到1%的人类写作内容误判为AI,Pangram称误报率仅为万分之一,但争议事件依然不断。
报道列举了多个高关注度案例。上月,出版商Minotaur因担心作者杰里·法拉德使用AI而撤销了价值200万美元的图书合同,法拉德对此予以坚决否认。法国公民蒂埃里·里尼奥尔去年起诉耶鲁大学,起因是教授用GPTZero扫描其期末考试作文后称其使用AI,导致他考试不及格并被停学一年。诉讼认为,这类检测工具已知会不公平地针对非英语母语者。今年2月,阿德尔菲大学一名学生因教授类似指控而起诉学校并获判胜诉,尽管诉讼未指明使用的工具,但该校与Turnitin签有许可协议。
斯坦福大学2023年一项研究发现,AI检测器将非英语母语者撰写的文章误判为AI的比例高于英语母语者。加州大学洛杉矶分校指出,这些工具被训练去捕捉重复术语、过于正式或随意的语气、不自然的措辞等模式,也可能关注句式的单一性,但这些特征本身并不能证明是AI生成。Turnitin虽声称误报率低,但也承认其工具“可能并不总是准确”,不应被用于对学生采取处分措施。报道认为,随着越来越多的人在网络上指责他人“听起来像AI”,检测工具的普及正在给这场语言模型猎巫式的指责火上浇油。