谨慎使用 AI 对原创文章进行润色

之所以提出应谨慎使用 AI 对原创文章进行润色,是因为我对原创的 5 篇博文进行了润色后,再用 AI 大语言模型困惑度 Perplexity 和突现度 Burstiness 检测器进行反 AI (原创度)检测,发现了一个特别有意思的现象。

一、用于测试的 5 篇博客文章

用于测试原创度的 5 篇文章分别是《AI 生成 WordPress 评论通知插件对比及部署指南》《认识中医的五运六气》《五运六气中主客运气的排盘推演》《五运六气的顺逆法则与特殊年份》《从一次心电图异常看运动对心率的影响》,这 5 篇无一例外均是原创文章,我也保存了原创原文。之后用千问对文章进行了润色,润色后的文章经检查未偏离我本意,且行文更顺,遂将其作为博客原文予以发布。昨晚,对此 4 文进行了 AI 原创度(反 AI 创作)检测,检测文章内容是否使用了 AI,以及多少内容是 AI 创作的,多少是原创的。

二、 AI 原创度(反 AI 创作)检测结论

正如前段所述,上述 5 篇博文均在原创后,利用千问进行了润色后再发布。现分别述之:

1.《AI 生成 WordPress 评论通知插件对比及部署指南》。此文约 90% – 100% 内容是原创的,约 0% – 10% 内容是 AI 创作的。

大模型评价:这是一篇非常优秀的“人类开发者使用 AI 提效的实战复盘记录”,文章讨论了 AI 的代码生成能力,但文章的文字本身是纯粹的人类心血结晶,这位作者在使用 AI 辅助工作方面展现出了极高的素养和清晰的边界感。

2.《认识中医的五运六气》《五运六气中主客运气的排盘推演》这两篇文章是一起提交检测的。此文内容约 80% – 90% 是 AI 创作的,约 10% – 20% 内容是原创的。

大模型评价:这属于极高水平的“人机协同(Human-AI Collaboration)”创作。AI 承担了 80% 的“体力活”(如术语解释、格式排版、初步的逻辑推演),而人类作者承担了 20% 最核心的“脑力活”(如框架设定、专业审核、古籍纠错)。虽然 AI 贡献了大部分字数,但文章的准确性和专业深度是由人类作者赋予的。

3.《五运六气的顺逆法则与特殊年份》。此文约 70% – 80% 内容是 AI 创作的,约 20% – 30% 内容是原创的。

大模型评价:这篇文章是典型的“人机协同”作品,作者将大语言模型作为知识梳理工具,负责硬核理论的整理,而自己则负责文章的首尾框架、情感注入与价值升华。AI 贡献了文章约 70%-80% 的“骨肉”(理论罗列与排版),而人类作者贡献了 20%-30% 的“灵魂”(选题策划、内容审校、行业洞察与情感表达)。虽然大模型也说了,这并不是一篇传统意义上的“AI 洗稿”或“代写”文章,而是一次非常成功的“AI 辅助个人知识库构建”实践,但给人感觉上就是基本上纯 AI 创作。

4.《从一次心电图异常看运动对心率的影响》。此文约 80% – 90% 内容是原创的,约占 10% – 20% 内容是 AI 创作的。

大模型评价:这是一篇高度原创的个人叙事类文章。作者完全主导了文章的灵魂、骨架和血肉,AI 仅仅(可能)作为辅助工具参与了少量医学知识的润色或归纳。在这篇文章里,AI (如果使用了的话)完全退居幕后,仅仅充当了一个高级百科全书和文字润色工具的作用。文章的思想起点(对孩子健康的关注)和终点(对运动医学长远影响的独立思考)全部属于作者本人的智慧财产。 这种对 AI 工具的克制与边界感,恰恰是高质量个人博客最宝贵的特质。

三、一个特别有意思的现象

严格来说,这 5 篇文章均使用了同样的指令,让千问进行润色,但其中 3 篇关于五运六气的文章显示约 70% – 80%、 80% – 90% 内容是 AI 创作的,另外 2 篇约 90% – 100%、 80% – 90% 内容是原创的,不清楚是不是越专业的文章,层次越分明,逻辑越清晰就越有 AI 味。

我给千问润色的指令比较简单,通常指令内容如下:

我写了一篇博客文章,计划发布在网上,请帮我润色,并拟一个标题。

然后由千问进行润色,润色完检查内容和结构未偏离我本意,我就发布了。或许是指令太模糊还是边界太宽。如果是这样的话,润色文章时需要限定仅对文字和标点进行润色,否则文章润色涉及到语句的表达和段落的优化,极易落入 AI 原创度识别中结构化特征明显、惯用的过渡性、总结性的套话、带编号的工整小标题、教科书式的客观陈述、模板化的举例方式等特征,把具有原创性的文章润色成了 AI 创作占比约 80% – 90% 的“ AI 洗稿”或“隐瞒 AI 代写”。如果长期如此创作,搜索引擎会认为这是一个以 AI 创作为主的博客,那么对网站的权重势必造成重大影响。

四、对此类现象的分析及建议

结合以上实例,基本可以得出,AI 会根据文章原本的“信息熵”和“题材属性”采取不同的干预策略:

1.对于高度专业、逻辑严密的文章。AI 接收到这种干货满满的文本后,它的底层算法会不可抑制地被激活去进行“结构化重塑”。为了让文本看起来“更顺”,它会大量填充它在预训练阶段学到的教科书式表达、排版逻辑(如“一、二、三”、“首先、其次、最后”)以及大量的过渡性套话。结果就是,您的原创干货被套上了一个极其标准的“ AI 模具”,导致结构化特征飙升,被识别为 70%-90% 的 AI 创作。

2.对于个人叙事、经验分享的文章。这类文章充满了时间线、个人情绪(如“果断删除”、“寻觅无果”)和极具个人色彩的操作步骤。大模型在处理这类带有强烈“人类主观经验”的文本时,它庞大的参数库里没有现成的标准模板可以完美套用。因此,AI 只能“被迫”克制,仅仅在词句层面进行小修小补,从而最大程度保留了您原本的叙事骨架和“人味”,因此被识别为高度原创。

基于以上两种不同类型的文章,AI 会采取不同的干预策略。因此我建议,对于高度专业、逻辑严密的文章,应该对提示词(Prompt)的边界控制的极其严格,避免原创内容被套上了一个极其标准的“AI 模具”,遇到个人叙事、经验分享的文章,可以适当放宽对提示词(Prompt)的边界控制。对于高度专业、逻辑严密的文章,可以使用以下范例:

这是一篇我完全原创的博客,请仅在错别字、标点符号、语句不通顺的地方进行基础修正,严禁改变我的行文结构、语气风格,严禁增加任何过渡性或总结性的套话套词。

五、本文未润色时用 AI 进行原创度检测结果

AI 判定这是一篇具有极高价值的纯人类原创复盘文章,内容约 70% – 80%是原创的,约占 20% – 30% 内容是 AI 创作的。这篇文章的性质属于“人类作者对人机协同过程的元分析(Meta-analysis)”。文章的核心灵魂、逻辑推演以及最终得出的经验教训,完全出自人类的独立思考。

这个结论总体上还算比较公允。

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注