越写越不像原著,是有原因的——20 轮漂移实验记录

AI 续写第一段很像原著,第十段开始「翻译腔」,第二十段像换了个作者——这不是错觉。我们用一本 890 万字的玄幻书做了组对照实验:裸提示词的链 20 轮后句式持续均匀化、比喻堆叠、意象自我复读;给上下文标注「哪段是原著、哪段是 AI 写的」再配一句基准声明,漂移显著放缓,甚至出现越写越像的反向曲线。

一幅长卷上的字迹从右往左逐渐漂移变形,中段一枚朱红印章之后笔迹恢复工整

用户描述的现象很一致:AI 续写的第一段读着挺像原著,第十段开始有点「翻译腔」, 第二十段像换了一个作者。我们想知道这是错觉还是规律,就搭了一个能量化它的实验。

实验材料是一本 890 万字的传统玄幻,文风指纹很锋利:平均句长 32 字但波动剧烈 (变异系数 0.84,短句和长句猛烈交错),对话占 16%,比喻词每千字只出现 1 次。 从 55% 深度的一个战斗场景开始,让模型连续续写 20 轮,每轮的产物拼回上下文—— 窗口固定 1.6 万 token,写满后原著从头部被截走。这正是真实阅读器里发生的事: 续写越多,上下文里 AI 自己的文字占比越高。

裸提示词的链,漂移长这样

对照组不加任何文风指令。前五轮的句长波动系数还有 0.64,到第十六至二十轮掉到 0.52—— 离原著的 0.84 越来越远,句子长度在均匀化。这个数字背后是能读出来的变化: 原著那种「一句话一段、拟声词单独占一行」的碎劲儿逐渐消失,段落越写越长、越写越圆润。

盲评审(不知道分组)对这条链的评语更直接:文艺腔密度随轮数上升, 到后段「比喻成链」——枪影如龙、剑光如瀑、声音冰冷如铁;同一个动作意象 「指尖拂过剑身」在中后段反复自我复制。这就是自回归的代价: 模型第 15 轮的参考文本里,一大半是它自己前 14 轮的手笔。

标注来源之后,曲线反过来了

实验组做两件事。第一,在上下文里插分界行,标明哪段是原著正文、哪段是此前的 AI 续写; 第二,配一句固定声明:文风、用词、句式节奏以原著正文段落为基准。

这条链前几轮反而不如对照组——上下文里 AI 段落还少,标注提供的信息量有限。 转折发生在中后段:随着 AI 段落越积越多,「哪段才是原著」这个信息越来越值钱, 句长波动系数从 0.56 回升到 0.64,两个互不知情的盲评审在不同的匿名映射下 独立写出了同一个观察:「反向漂移,越写越像」「最差的窗口反而是开头」。 其中一个评审把它的最后一个窗口评为全场最贴近原著的一段。

换句话说:标注不是让每一段都变好一点的均匀增益,它是随 AI 占比上升而增值的长跑保护器。 轻度用户感知不明显,重度续写用户吃到的保护最多。

一句措辞差点毁掉整个机制

这套标注在多数模型上工作正常,但在 Gemini 3.1 Pro 上翻了车,翻车方式很有教育意义。 我们的声明原来写的是「AI 续写段落仅供情节衔接参考」——本意是文风别学它们。 Gemini 把「仅供参考」理解成了「不算正文」,于是每一轮都跳过全部已续写内容, 回到原著末尾重新写第一段。20 轮,20 次重写同一个开场。

更有意思的是消融实验:把声明整个删掉、只留分界行,8 轮里仍有约 6 轮回退—— 对一个陌生标记不做解释,模型的默认理解仍然可能是「被标注的内容不算数」。 把声明改成两句拆开的显式表述(剧情上:这些是已发生的正文,必须从最后一段继续; 文风上:以原著段落为基准),同一个模型 20 轮零回退。

我们把这条写进了工程规范:给上下文里的特殊标记写说明,措辞按最容易误读的模型设计, 并且说明不可省略——没有说明只比错误说明好一点点。

标注管不了的事

诚实交代边界。第一,句式节奏的完全对齐做不到:无论加不加标注,所有实验组的句长 波动都够不到原著的 0.84——「短句剁开」的节奏是目前所有大模型共同的短板, 一句指令改不动生成习惯。第二,场景锚定不归它管:20 轮之后所有组都从血云禁地 漂进了密林山谷,有一组还写出了「阳光斑驳」。世界状态要靠设定词条和状态追踪去锁, 文风指令只负责文风。

这两条边界划清楚,剩下的部分就是纯收益:在 Foreverse 里来源标注是一个开关, 默认配好了声明措辞,打开之后每次续写自动生效——上下文该标注的地方标注, 输出里如果模型复读了标记行也会被拦下来,不会污染你的正文。

常见问题

为什么 AI 续写会越写越不像原著?

因为续写是自回归的:AI 写的每一段都会拼回上下文,成为下一段的「参考文本」。第一轮上下文全是原著,第二十轮上下文里可能一半以上是 AI 自己的输出——模型越来越多地在模仿自己,而不是原著。我们实测裸提示词的链在 20 轮里句长波动持续收窄、文艺腔比喻密度上升、同一个意象反复自我复制。

把原著多塞一点进上下文,能不能自动让 AI 学会原著文风?

实测不能。我们做过 4k 到 20 万 token 五档的对照:把 27 万字原著整个塞进上下文,不加任何指令的组照样写出满篇「宛如/仿佛/一丝」,比喻密度是原著的 10 倍。上下文提供的是可模仿的材料,「以谁为基准」必须显式说,模型不会自己猜对。

来源标注是什么?普通用户需要自己配置吗?

它是续写上下文里的分界行,告诉模型「从这里往上是原著正文,从这里往下是此前的 AI 续写」,配合一句固定声明:文风、用词、句式节奏以原著段落为基准。在 Foreverse 里这是设置里的一个开关,打开即生效,不需要写任何提示词。

有想法或问题?来 Discord 聊聊 →

AI 续写为什么越写越不像原著?我们跑了 60 条 20 轮的链找答案 · Foreverse · 新梦