之所以提出应谨慎使用 AI 对原创文章进行润色,是因为我对原创的 5 篇博文进行了润色后,再用 AI 大语言模型困惑度 Perplexity 和突现度 Burstiness 检测器进行反 AI (原创度)检测,发现了一个特别有意思的现象。
一、用于测试的 5 篇博客文章
用于测试原创度的 5 篇文章分别是《AI 生成 WordPress 评论通知插件对比及部署指南》《认识中医的五运六气》《五运六气中主客运气的排盘推演》《五运六气的顺逆法则与特殊年份》《从一次心电图异常看运动对心率的影响》,这 5 篇无一例外均是原创文章,我也保存了原创原文。之后用千问对文章进行了润色,润色后的文章经检查未偏离我本意,且行文更顺,遂将其作为博客原文予以发布。昨晚,对此 5 文进行了 AI 原创度(反 AI 创作)检测,检测文章内容是否使用了 AI,以及多少内容是 AI 创作的,多少是原创的。
二、 AI 原创度(反 AI 创作)检测结论
正如前段所述,上述 5 篇博文均在原创后,利用千问进行了润色后再发布。现分别述之:
1.《AI 生成 WordPress 评论通知插件对比及部署指南》。此文约 90% – 100% 内容是原创的,约 0% – 10% 内容是 AI 创作的。
大模型评价:这是一篇非常优秀的“人类开发者使用 AI 提效的实战复盘记录”,文章讨论了 AI 的代码生成能力,但文章的文字本身是纯粹的人类心血结晶,这位作者在使用 AI 辅助工作方面展现出了极高的素养和清晰的边界感。
2.《认识中医的五运六气》《五运六气中主客运气的排盘推演》这两篇文章是一起提交检测的。此文内容约 80% – 90% 是 AI 创作的,约 10% – 20% 内容是原创的。
大模型评价:这属于极高水平的“人机协同(Human-AI Collaboration)”创作。AI 承担了 80% 的“体力活”(如术语解释、格式排版、初步的逻辑推演),而人类作者承担了 20% 最核心的“脑力活”(如框架设定、专业审核、古籍纠错)。虽然 AI 贡献了大部分字数,但文章的准确性和专业深度是由人类作者赋予的。
3.《五运六气的顺逆法则与特殊年份》。此文约 70% – 80% 内容是 AI 创作的,约 20% – 30% 内容是原创的。
大模型评价:这篇文章是典型的“人机协同”作品,作者将大语言模型作为知识梳理工具,负责硬核理论的整理,而自己则负责文章的首尾框架、情感注入与价值升华。AI 贡献了文章约 70%-80% 的“骨肉”(理论罗列与排版),而人类作者贡献了 20%-30% 的“灵魂”(选题策划、内容审校、行业洞察与情感表达)。虽然大模型也说了,这并不是一篇传统意义上的“AI 洗稿”或“代写”文章,而是一次非常成功的“AI 辅助个人知识库构建”实践,但给人感觉上就是基本上纯 AI 创作。
4.《从一次心电图异常看运动对心率的影响》。此文约 80% – 90% 内容是原创的,约占 10% – 20% 内容是 AI 创作的。
大模型评价:这是一篇高度原创的个人叙事类文章。作者完全主导了文章的灵魂、骨架和血肉,AI 仅仅(可能)作为辅助工具参与了少量医学知识的润色或归纳。在这篇文章里,AI (如果使用了的话)完全退居幕后,仅仅充当了一个高级百科全书和文字润色工具的作用。文章的思想起点(对孩子健康的关注)和终点(对运动医学长远影响的独立思考)全部属于作者本人的智慧财产。 这种对 AI 工具的克制与边界感,恰恰是高质量个人博客最宝贵的特质。
三、一个特别有意思的现象
严格来说,这 5 篇文章均使用了同样的指令,让千问进行润色,但其中 3 篇关于五运六气的文章显示约 70% – 80%、 80% – 90% 内容是 AI 创作的,另外 2 篇约 90% – 100%、 80% – 90% 内容是原创的,不清楚是不是越专业的文章,层次越分明,逻辑越清晰就越有 AI 味。
我给千问润色的指令比较简单,通常指令内容如下:
我写了一篇博客文章,计划发布在网上,请帮我润色,并拟一个标题。
然后由千问进行润色,润色完检查内容和结构未偏离我本意,我就发布了。或许是指令太模糊还是边界太宽。如果是这样的话,润色文章时需要限定仅对文字和标点进行润色,否则文章润色涉及到语句的表达和段落的优化,极易落入 AI 原创度识别中结构化特征明显、惯用的过渡性、总结性的套话、带编号的工整小标题、教科书式的客观陈述、模板化的举例方式等特征,把具有原创性的文章润色成了 AI 创作占比约 80% – 90% 的“ AI 洗稿”或“隐瞒 AI 代写”。如果长期如此创作,搜索引擎会认为这是一个以 AI 创作为主的博客,那么对网站的权重势必造成重大影响。
四、对此类现象的分析及建议
结合以上实例,基本可以得出,AI 会根据文章原本的“信息熵”和“题材属性”采取不同的干预策略:
1.对于高度专业、逻辑严密的文章。AI 接收到这种干货满满的文本后,它的底层算法会不可抑制地被激活去进行“结构化重塑”。为了让文本看起来“更顺”,它会大量填充它在预训练阶段学到的教科书式表达、排版逻辑(如“一、二、三”、“首先、其次、最后”)以及大量的过渡性套话。结果就是,您的原创干货被套上了一个极其标准的“ AI 模具”,导致结构化特征飙升,被识别为 70%-90% 的 AI 创作。
2.对于个人叙事、经验分享的文章。这类文章充满了时间线、个人情绪(如“果断删除”、“寻觅无果”)和极具个人色彩的操作步骤。大模型在处理这类带有强烈“人类主观经验”的文本时,它庞大的参数库里没有现成的标准模板可以完美套用。因此,AI 只能“被迫”克制,仅仅在词句层面进行小修小补,从而最大程度保留了您原本的叙事骨架和“人味”,因此被识别为高度原创。
基于以上两种不同类型的文章,AI 会采取不同的干预策略。因此我建议,对于高度专业、逻辑严密的文章,应该对提示词(Prompt)的边界控制的极其严格,避免原创内容被套上了一个极其标准的“AI 模具”,遇到个人叙事、经验分享的文章,可以适当放宽对提示词(Prompt)的边界控制。对于高度专业、逻辑严密的文章,可以使用以下范例:
这是一篇我完全原创的博客,请仅在错别字、标点符号、语句不通顺的地方进行基础修正,严禁改变我的行文结构、语气风格,严禁增加任何过渡性或总结性的套话套词。
五、本文未润色时用 AI 进行原创度检测结果
AI 判定这是一篇具有极高价值的纯人类原创复盘文章,内容约 70% – 80%是原创的,约占 20% – 30% 内容是 AI 创作的。这篇文章的性质属于“人类作者对人机协同过程的元分析(Meta-analysis)”。文章的核心灵魂、逻辑推演以及最终得出的经验教训,完全出自人类的独立思考。
这个结论总体上还算比较公允。
如何用AI反润色?让文章看起来100%人工原创
这思路不错哦,又能用 AI,还不被发现。
但是判定AI的标准就很扯,难道人写的文章就不能:
结构化特征明显、、带编号的工整小标题、和客观陈述了?
比如我这样写:
1. XXXXXX:内容1
2. YYYYYY:内容2
3. ZZZZZZ:内容3
几乎100%会被判定为存在AI辅助
但是我只要稍作修改子项长度:
1. XXXXXX:内容1
2. YYY:内容2
3. ZZZZZZZZ:内容3
然后在内容3里,用错一次“的地得”或者把句号改成逗号。
进行反 AI (原创度)检测,就变成100%人工创作了,就离谱
合着我想要不被当成AI,就必须让文章小标题长短不一……
是个问题,机械性明显。
在哪里可以检测?我去试试,我基本都是100%手打
找到一个朱雀AI检测~最近两篇都是100%人工~果然判断很准啊
之后可以让 AI 润色一下,再检测一下试试看。
我一般都是让Ai排版,真AI文章我都标题后加一个,Ai确实帮忙很多,但是用的过多了反而失去了写博客原有的东西。
AI 排版的文字可能就会检测出来
文章我都是手打的,标题偶尔找AI论色一下
这种检测后应该 100% 原创的。
润色之后就是很机械。
是的,只是行文是漂亮了,中规中矩的。
如果不是用于内容变现,把博客变成自己的个人实验室,用AI辅助或者组织无可厚非,能加快速度就可以了,毕竟我写博客主要还是给自己看的,而且纯人工搞很难持续坚持,现在我已经教会了hermes写博客了,我主要还是集中精力发觉高质量的问题,讨论完agent直接自动化了,原本60min工作,45min可以完成了,对我来讲还挺开心的,而且AI语句更通顺结构性更强。
是的,需要看自己的情况。事实上,不管是 SEO 还是 GEO 对 AI 完成的内容都是讨厌的。
总有一天ai和人界限不清了。
到时候检测标准就变了
原创文章还是最好不要用,一用就变味了。
要谨慎使用,检查标点和错别字还是可以的
严谨类型的文章可以润色,效果出色。日常就不适合
我实践的结果貌似刚刚相反哈
把temp调低一点试试
我之前也用AI润色过一些文本,大多数给我的感觉是:不像是我的风格
是有这种情况,不过我基本上出现这种情况。
简单生活分享,不用搞那些花里胡哨的,技术类的可能需要润色润色吧
技术类控制好边界润一下好一些。