开眼视点
26-06-28 15:38 微博认证:C114通信人家园3G版主、专栏作者李建昆,出版作品有《如影随形》 科技博主

GPT 5.6被曝创下史上最高作弊率,我给大家从技术角度讲一下它为什么这么难被检测。
先说AI检测工具的工作原理。目前的AI内容检测器主要依靠以下几种方法:
一是"困惑度分析"。AI生成文本往往在遣词造句上过于"完美",每个词出现的概率分布跟人类写作有所不同。检测器通过统计分析文本中的词汇选择模式,来判断是否为AI生成。
二是"模式识别"。AI生成文本在句子结构、段落组织、过渡词使用等方面有一些固定的模式,检测器可以通过识别这些模式来判断。
三是"水印检测"。一些AI厂商会在生成内容中嵌入微妙的统计模式(水印),检测器通过寻找这些水印来判断内容来源。
GPT 5.6之所以能创下最高作弊率,是因为它在以下几个方面做了针对性的改进:
第一,输出多样性的提升。GPT 5.6在生成文本时引入了更多的随机性和变化,让生成的文本在统计特征上更加接近人类。
第二,人类写作习惯的模仿。GPT 5.6能够更好地模仿特定作者的写作风格,包括个人习惯用语、句式偏好等。
第三,减少了AI特有的"模式化表达"。比如"总体而言"、"综上所述"、"值得注意的是"等AI常用过渡词的使用频率大幅降低。
从技术角度看,GPT 5.6这种"难以被检测"的特点,既是一种进步,也是一种风险。进步在于它确实更"像人"了,风险在于它可能被滥用于学术作弊、虚假信息生成等场景。
现在的关键是,检测技术能不能跟上AI的发展速度。如果不能,教育、法律、新闻等行业都需要重新思考"如何验证内容的真实性"这个根本问题。

发布于 安徽