判断一段文字是否为 AI 生成,可从三条线索切入:一是核对是否有 AI 生成的典型标识,二是检查内容来源的创作主体归属,三是分析内容的风格与逻辑特征,需接受判断的不确定性,不可强行下绝对结论。
该方法适用于需核实内容原创性、排查 AI 生成的虚假信息、区分人工与 AI 产出的场景,如学术引用审核、内容真实性验证、信息溯源等。不适用仅需快速区分内容大致风格(如散文与议论文)的场景,因部分 AI 生成内容会模仿人工风格,判断结果存在偏差,需结合其他佐证。
多数 AI 生成内容会带有平台生成的隐性或显性标识,如特定格式的水印、生成时间戳的特殊标记,这些标识通常不会出现在人工创作内容中,且部分标识可通过公开工具核验,需注意不同平台的标识形式存在差异,不要混淆人工排版与 AI 专属标识。
人工创作的内容通常有明确的个人创作主体,如署名、个人账号发布的内容,而 AI 生成内容的来源往往是无明确个人归属的集体或平台,部分来源会显示“自动生成”“AI 创作”等提示,这是人工内容不会出现的明确归属提示,需注意区分来源的实际创作主体性质。
AI 生成内容常存在风格统一但缺乏个人特色的问题,比如所有段落的句式结构、用词频率高度一致,且部分内容会出现逻辑断层,如前后话题跳转无自然过渡,而人工创作内容会带有个人的表达习惯、情绪倾向和逻辑转折,这是判断的核心依据之一。
AI 生成内容为了符合语法规范,常出现不必要的冗余表述,如重复的修饰语、无意义的过渡句,而人工内容会更简洁直接,带有个人的取舍,比如人工会删除无关的铺垫,而 AI 可能保留所有生成的内容,需注意区分冗余是刻意优化还是生成缺陷。
人工内容也会使用特定格式排版,如加粗、编号,这些排版并非 AI 专属标识,部分人会误将人工可实现的排版特征当作 AI 生成的依据,导致判断错误。绕过去的方法是,重点关注创作平台官方发布的 AI 生成专属标识,而非人工可实现的排版样式,需核对标识的来源是否为创作平台的官方提示。
部分高级 AI 生成内容会模仿人工的个人风格,如特定创作者的语气,此时内容的风格特征会接近人工创作,导致判断者误判为人工内容。绕过去的方法是,结合内容的逻辑深度和细节真实性,人工创作会加入个人的经历细节,而 AI 模仿的内容可能缺乏真实的个人体验细节,需对比真实人工内容的特征进行判断。
仅用一条线索判断会出现偏差,比如部分人工内容来自无明确个人归属的集体账号,而部分 AI 内容来自有个人署名的账号,导致判断错误。绕过去的方法是,结合至少两条线索进行交叉验证,比如同时检查来源归属和内容风格特征,提高判断的准确性。
判断内容是否为 AI 生成,可通过与用户共写经确认的历史机制辅助:对比待判断内容与系统内人工共写内容的特征,人工共写内容会带有明确的个人创作痕迹,如修改记录、个人观点标注,而 AI 辅助生成的共写内容会带有系统生成的统一格式标记。若需更精准的来源核验,可使用可核验的长期记忆机制,每条记忆会标注来源类型,但该机制目前仅覆盖系统内部分内容,外部内容的核验能力还在完善,眼下可先对比系统内的共写历史特征进行初步判断。