AI 写的中文为什么都是同一张脸?AI领域知名博主卡兹克把根治方法开源了!

📅 发布时间:2026/8/11 4:34:55
AI 写的中文为什么都是同一张脸?AI领域知名博主卡兹克把根治方法开源了! 前几天数字生命卡兹克在 GitHub 上传了一个新仓库human-writing中文名「活人感写作」。我第一眼以为又是一个让 AI 写得更像人的 Prompt 包。但读完 README 和更新日志之后改观了。这里面有一个值得认真聊的方法论升级——从 1.0 到 1.1它把对付 AI 腔的防线从字面层移到了修辞动作层。这个思路我没见过有人系统地做过。先说那个你说不清的问题用 AI 写过文章的人应该都有一种感觉读完觉得挺流畅但说不出是谁写的。没有错也没有惊喜像一篇没有主人的文章。更烦的是你知道它有问题但你说不清楚问题在哪。其实是可以说清楚的。翻案腔是第一个。你以为 XXX其实 YYY不是 A而是 B回头才发现。AI 热衷于这个动作——先给读者立一个他没有的误解再用推翻它来制造深度感。人偶尔也会这样写但 AI 写什么都这样读多了就成了识别符号。车轱辘话是第二个。同一个意思用不同的字面说了三遍读的时候觉得内容丰富回头看其实三段都在原地转圈什么新东西都没带来。连词过密是第三个但更隐蔽。因为……所以……、然而……但是……、因此……逻辑链条焊得很紧读起来严丝合缝但这不是人说话的样子。人说话会跳跃会留白会在句子之间没有明示的逻辑的情况下衔接过去。human-writing 想解决的就是这些。卡兹克是谁简单说一下背景不了解他的人可能有点陌生。数字生命卡兹克虚实传媒创始人AI 内容创作者公众号「数字生命卡兹克」的作者。在 AI 领域做内容大概三年风格是那种有明确立场、会直接说我觉得的人。今年年初他就开源过一次——把自己写公众号用的写作 Skill「卡兹克风格创作.skill」放出来了里面是他自己的写作节奏、句式偏好、禁忌词清单和四层自检体系。那次开源在 AI 创作圈子里传得挺广。这次 human-writing 是另一回事。khazix-writer 管的是如何写得像卡兹克human-writing 管的是如何写得像一个活人——不是特定风格的模仿而是一套通用的去 AI 味规则集适用于知乎、公众号、博客、评测、小说、口播等大多数中文写作场景。1.0 的路子禁词列表先说 1.0 的思路才能理解 1.1 为什么重要。应对 AI 腔最直觉的做法是列禁词——不能用不是……而是……不能用冒号不能用赋能、打法、闭环这类黑话。这个方法有效但有个根本缺陷模型会换一套字面继续做同样的事。你禁了不是 A而是 B它换成与其说 A不如说 B你禁了你以为……其实……它换成表面上看……但深究起来……你禁了回头才发现它换成当时没意识到……现在想来……。换完衣服底下的姿势没动。读者认的是姿势不是字。字符串禁令在字面层打补丁永远追不上模型的变体速度。这是 1.0 的局限。1.1 的核心洞察禁动作不禁字1.1 的升级把防线从字面移到了修辞动作层。规则不再是不能出现不是……而是……而是禁止先给读者立一个他没有的误解再推翻它这件事本身。不管穿什么外衣这个修辞动作就是不行。changelog 里有一句话说得很清楚你以为……其实……、回头才发现和不是A而是B是同一个姿势读者认的是姿势不是字。这个洞察看起来简单但实现起来需要两件事同步完成一是规则要重写。从列举字符串变成描述动作。翻案腔不是某几个词是一种叙事策略——先设误解再反转用这个落差来制造深度感。规则要能让模型识别这个策略的各种变体而不是认字符串。二是检测脚本要跟上。规则变了但检测还在查字符串升级等于白做。1.1 的check_prose.py同步更新了翻案句的正则覆盖了跨句情况——句子结束了。而是……这种情况也会判失败覆盖了换字变体——倒不如、毋宁这类同义表达也在检测范围内加了警告层——变形翻案句、三连以上同构排比、名词化句式、模型偏爱抒情词安放、抵达、微光、褶皱……硬停不到的情况给出警告最有意思的是加了两个统计指标句长变异系数人写中文句子长短自然会有起伏AI 倾向于写一堆差不多长的句子整齐排列。变异系数低是模型腔的信号。连词密度人说话有跳跃和留白AI 喜欢把逻辑链条用连词焊死。连词密度过高读起来像论证不像聊天。这两个阈值参考的是 CCL 2023 人机中文对照研究不是拍脑袋的数字。文件结构整个 Skill 打包得挺干净human-writing/ ├── SKILL.md ← 入口材料门槛 写作流程 交付禁令 ├── references/ │ ├── forum-prose.md ← 知乎/公众号/论坛帖的节奏和措辞做法 │ ├── reality.md ← 真人、历史、新闻、数据的事实边界 │ ├── fiction.md ← 小说、对白、虚构散文的创作规则 │ ├── formats.md ← 口播、演讲、教程、评测等特殊形式 │ └── revision.md ← 初稿写完怎么改七遍检查清单 ├── scripts/ │ └── check_prose.py ← 检查成稿有没有踩硬禁令 └── dist/ └── human-writing-lite.md ← 两千字蒸馏版聊天窗口直接粘贴用核心是SKILL.md管三件事材料门槛、写作流程、交付禁令。材料门槛是一个前置检查——写之前先确认手上有没有东西可写。现实题材要查资料查不到就追问或缩短篇幅不能拿车轱辘话凑字数。虚构题材可以创造人物和情节但每个场景要有目标、有动作、有变化。写作流程管三件事用表格很清楚材料推进中文现实写作核准事实、数字、引语和亲历。虚构写作检查人物、行动与因果。每段都要带来新东西——新事实、新动作、新例子或新后果。写过的不重复。白话打底在意词序和停顿清掉报告腔、模型腔和翻案句。check_prose.py可以单独跑检查任意一篇文章python check_prose.py 你的文章.txt输出分硬停必须修改和警告建议检查两层末尾附句长变异系数和连词密度的统计数值。如果你用的是 ChatGPT、千问这类只有聊天窗口、没法安装 Skill 的工具可以用human-writing-lite.md两千字以内的蒸馏版整段复制进系统提示就能用效果打折但比裸跑好很多。安装方式支持 Skill 安装的 Agent比如 Claude Code直接发这句话帮我安装这个skillhttps://github.com/KKKKhazix/human-writingAgent 会自动读取仓库、找到 human-writing 文件夹完成安装。装好之后显示名为「活人感写作」。如果 Agent 不支持自动安装从 Releases 页面手动下载复制到本机 Skills 目录~/.agents/skills/human-writing/装好之后这样触发使用$human-writing把我的材料写成一篇有活人感和中文韵律的作品。我的感受试了一轮之后最明显的变化是翻案腔少了很多。原来让 AI 写十段文章七八段会出现某种形式的你以为……其实……现在这个姿势被管住了模型只好从正面下判断先给结论再给依据读起来干净很多。连词密度这个指标让我回头测了一篇自己之前让 AI 写的文章超出阈值挺多的。重新看那篇文章句子之间的逻辑连接词密集排列读起来像在推论证明不像一个人在聊事情。把连词砍掉一半、重新组织那几段之后节奏确实活了。有一点值得说这个项目管的是规则和工具不是风格本身。check_prose.py检查的是已经写明的硬规则不替你决定风格——它告诉你哪里踩线了怎么修是你自己的事。这个边界划得挺清楚没有越俎代庖。仓库里只有原创规则和工具没有第三方文章、训练语料或模型权重MIT 开源。卡兹克在 README 里说碰到规则冲突、误报或者某个模型上表现不对欢迎提 Issue附上提示词和模型输出片段他想维护一个可以持续改进的规则集。开源地址https://github.com/KKKKhazix/human-writing你用 AI 写东西的时候哪种模型腔让你最头疼欢迎评论区聊聊。 本文涉及工具项目human-writing活人感写作v1.1.0作者数字生命卡兹克GitHubKKKKhazix开源协议MIT地址https://github.com/KKKKhazix/human-writing谢谢你阅读我的文章~我是顾北我们下期再见PS本文部分内容由AI辅助创作