什么样的文章“一看就是AI写的”?
鉴别AI,本质上是在维护“人的创作”这件事的稀缺性,也在维护“我还能分辨”这件事的尊严。
01 鉴别AI文,不是不可以
2026年夏,第23届台积电青年学生文学奖得奖名单揭晓,小说组第一次决审时取得最高评价的《实白》随后却被匿名检举,指控其使用了AI创作。作者随即和主办方进行了数轮沟通说明审辩,提供了创作阶段的各种相关资料,表示自己只使用了AI修改错别字,并未使用AI进行创作。但最终,《实白》仍被取消了首奖名次,降为优胜。这是该奖第一次因AI嫌疑而撤换首奖。
随后舆论愈演愈烈,更有网友指出散文组的优胜奖《我爸在看电视》几乎全篇多次使用AI常见句式,而文学奖的官方账号下公布的各组的参赛文章评论区,更是一片鉴AI之声。
第23届台积电青年学生文学奖散文组优胜奖《我爸在看电视》文章截图(上下滑动查看)
但风潮已起,打开任何一个社交平台,但凡超过了300字的文章,不管什么文体,评论区几乎必定会出现“一看就是AI写的”、“AI味好重”这类句式。不管愿不愿意,鉴别AI似乎已经成为了这个时代读者们一种新的阅读本能。
但怎么鉴别呢?图片和视频虽然同样深陷AI的泥潭,但想要抹去一张图或者一段视频的AI痕迹,多少需要一点操作或是技术门槛。但文字不一样,人人能读写,人人会改动,故而成为了鉴别AI这场战争中最激烈的战场。
鉴别一段文字是否是AI写的,一种主流的方法是特征识别。特征识别不需要AI厂商的配合,每家大语言模型的输入都有一些自己的奇妙句式,发展到如今已经能被做成了梗图,甚至可以开始被人类模仿。
“哈哈,这恰恰说明AI的语言特征已经深入人心了。”
“不是大家变敏感了,而是AI的表达方式太有辨识度了。”
“更狠的是,这些梗图的传播本身就是一场全民参与的语感训练。”
熟悉AI的朋友们都知道,怀疑容易定罪难,定罪得要有法条。维基百科作为全球最大的由志愿者协作编辑的在线百科全书网站,大概算是最早开始以规章条款认真对待AI生成文本的地方。2023年底,一群维基百科的编辑者们建立了一个名为“WikiProject AI Cleanup”的项目。他们标记了500多篇疑似AI撰写的文章,然后于2025年8月发布了一份AI检测指南来发布他们认为AI写作常见的规律,例如AI喜欢列排比句说123,又或者AI喜欢将普通事物冠以“最关键的”“至关重要的”等“凸显重要性”的形容词,以及一些根本找不出来源的“专家认为”“有人发现”“研究证明”,指南甚至列举了不同版本的不同厂商的模型的“方言”特征。到了2026年3月,英文维基百科以44对2的投票结果正式禁止AI生成内容出现在词条中。
这份报告很快就成为了识别AI写作的重要参考文献,但人力有时而穷,面对AI产生的海量内容,人是不够用的,自然,我们需要工具。
以当前国内认可度较高知名度较广的AI文本检测工具“朱雀”为例,它由腾讯公司的朱雀实验室开发,使用了数百万份AI生成的和人类创作的内容来进行训练,包括学术论文,小说,散文,新闻等文体,通过自然语言处理和特征提取大数据分析等技术来判断人类创作和AI写作的细微区别,最终给出一个扇形图,显示被检测文字由人类撰写还是AI生成或者可能是AI的三类比例。简单来说,这类工具分析了各类AI写作的模式特征,例如用词的可预测性、平稳的句式结构、或是段落的分布与过渡等等,然后给出了AI生成的概率,从而进行识别。
AI文本检测工具“朱雀”
有了能处理海量文本的工具后,各大网文平台开始着手处理日益变多的AI小说,2026年8月,拥有7000万用户的起点中文网一举下架了大量疑似使用AI创作的小说,其中不乏均订过万的爆款作品。一向被认定为是AI小说重灾区的番茄小说,整个7月也处理了5.4万本AI低质书籍,拒绝了16万本的AI生成和空洞水文书籍的签约。
《何时是读书天》剧照
02 灰色地带
看起来鉴别AI在这个方向上蒸蒸日上,一切向好。但真的靠谱吗?
我们可以从朱雀工具的一个小变化来管中窥豹。朱雀自己的跑分数据其实看起来很不错,在中英文的几个常见的文本测试集上都有超过96%的正确率,部分测试集甚至有100%。但这些测试集都是干净的二分数据集——要么是人写的,要么是AI写的。而实际的应用场景远比测试集复杂,存在着不少灰色地带:人类的写作用AI润色,AI的写作人类去修改,又或是人类恰好写出了符合AI写作习惯的特征句等等。这类灰色区域尚不包括在测试集的覆盖范围内。
或许正因为如此,为了更准确的表明检测的能力,朱雀自己也做出了调整,早期它给出的结果尚且只是人类/AI的二类式比例断定,现在已经改成了人类/疑似AI/AI的三类比例扇形图,对疑似AI部分,朱雀的说明是“显示了一些和AI生成文本文本相似的表达模式,但仍需上下文判断,并非最终确定结果。”
《her》剧照
技术上是诚实的,但“疑似使用AI”和“确认使用AI”的话语份量,在舆论场上其实是等价的,几乎没有区别。
2026年7月,尼日利亚裔作家Jerry Falade的出道作犯罪小说Call Me, I'll Hide the Body引发了14家出版社的版权代理竞标大战,最终Macmillan出版集团旗下的Minotaur出版社以超过200万美元的竞价拿下合约。但随后一次会议上,有编辑提出对书稿的句型和语感提出质疑,认为该书可能使用了AI。Falade否认了这一猜测,坚称自己只是使用AI查资料和转换英式与美式英语,没有让AI代笔创作。由于无法证明这部小说从开始创作到完成时完全是由人类创作的,最终整笔交易还是被叫停了,而Falade的经纪人和公司也全面终止了和他的合作。
注意,这里举证的责任反而落在了被指控者身上,因为“疑似使用AI”,所以要拿出“没有使用AI”的证明,但这基本上是不可能完成的自证。
因此,无论是AI腔梗图,还是维基的检测指南,或者是朱雀的概率扇形图,特征识别这条检测道路上都会存在着一个困境,你没有办法跨越“像不像AI”和“是不是AI”之间的鸿沟,看似99%的准确率是针对海量数据的,但每一次误判的代价,都会由具体的人来承担。
同时,每一次误判引发的声浪,都会侵蚀这种检测本身的公信力,那些完全靠自己创作的人会开始怀疑AI判定的误杀率,那么真正使用AI的人就可以利用这些怀疑混水摸鱼,检测工具越不被信任,真正的AI使用就会越安全,这条道路就会陷入死循环。
更何况,有人总结AI的写作特征,就有人研究如何让AI避开这类特征,基于维基的检测被人原封不同做成反检测插件“Humanizer.skill”,中文也有人开发“活人感写作.skill”工具包,教AI写人话。特征识别,是一场没法赢的军备竞赛。
03 另一条路
2026年8月,AI公司Anthropic确认Claude在之后的版本更新中将会给所有生成的文字添加不可见的数字水印,而9月1日刚刚发布的Fable 5.1和Mythos 5.1,也已经正式带上了水印。
《被裁掉的女孩》AI短剧剧照
这举是为了符合欧盟的《人工智能法案》,该法案目前已经进入一般适用阶段。 其中要求生成音频、视频、图像、文本以及通用人工智能的提供者,需要确保人工智能的输出以机器可读的格式进行标注,并可以检测是否是AI生成的内容。大约有 190 个公司和组织已经签署了配套的《人工智能生成内容透明度行为准则》,其中包括Anthropic、Google、OpenAI等著名AI大厂,只有马斯克的xAI暂时未列其中。Google的Gemini更是早在2024年就已经部署了水印SynthID-Text。
那么什么是数字水印?和朱雀这类检测工具又有什么不同?
大语言模型生成文本的原理是每一步都在基于前文来预测下一个词元的概率分布。例如“今天天气真”后面,“好”的概率可能是40%,“热”是30%,“冷”是20%,“糟糕”是9%,“怪”是1%,模型会抽取一个随机数,比如0.66,位于0.4~0.7之间,所以选择了“热”,然后继续预测下一个。
《猎罪图鉴2》剧照
一种无偏水印的做法就是在这个随机数中动手脚,如果在选择随机数时,用一把只有模型发布者才知道的密钥生成伪随机数,这些随机数本身看起来仍然服从均匀分布,因此从结果上看,“好”仍然有40%的机会出现,“热”还是30%,整个模型的输出概率分布没有因此改变。但知道密钥的人,却能发现生成出来的词元序列能和密钥生成的伪随机数序列之间存在一种特殊的统计相关性,从而标记出AI生成的痕迹。
就像一枚硬币,正常情况下掷出正面和反面的概率都是50%,但是如果有一枚被你做了手脚的硬币,和一张只有自己知道的秘密表格,写着010101101010111000。对于不知道这张表格的人来说,这枚硬币掷出正面和反面的概率仍然和正常硬币一样,但当你拿出秘密表格,就会发现它掷出的结果序列总是和这个表格的序列对应,那么这种一致性就很难用偶然来解释,可以被认定是有问题的了。


