后四十回吵了两百年,这次你可以自己续

《红楼梦》后四十回是人类史上最著名的续写公案:高鹗背了一百年骂名,2008 年人民文学出版社把署名改成「无名氏续」。今天你可以在手机上自己下场:公版全本哪里找、断点选第八十回末还是黛玉焚稿前、哪些模型接得住典雅书面语(甄嬛传九模型横评的真实数据)、怎么用分支让「黛玉不死线」和「宝钗视角线」并存。

一函线装《红楼梦》摊开在案头,第八十回末页牵出几条朱红丝线,各自系着一页新写的手稿

2008 年,人民文学出版社的《红楼梦》换了署名:印了半个多世纪的「曹雪芹、高鹗著」, 改成「前八十回曹雪芹著,后四十回无名氏续,程伟元、高鹗整理」。一部小说的续写者是谁, 红学界吵了一百年,吵到出版社把书脊上的名字改掉(光明日报刊过论证全文)。高鹗自胡适 1921 年考证起背了一个世纪「狗尾续貂」的骂名,如今学界的主流看法是: 他大概率只是整理者,连挨骂的资格都是错发的。

这桩公案对今天想用 AI 续写《红楼梦》的人有两个用处。一是提醒:你加入的是一个两百多年的传统。 程伟元 1791 年刻程甲本时,「后四十回从哪来」就已经说不清;此后《后红楼梦》《红楼梦补》一类续书 层出不穷,没有一种服众(中国作家网这篇梳理过署名之争的来龙去脉)。二是安慰:历史上挨骂的续写有个共同点——要付印、要流通、要顶着原著的名字卖。 你在手机里给自己续的第八十一回不进这条传播链,也就不背这份骂名。

先把公版全本拿到手

《红楼梦》文本层面没有任何版权障碍:曹雪芹逝世约 260 年,程高刻本问世也有 230 多年。中国哲学书电子化计划(ctext.org)收录了一百二十回全文,维基文库有程甲本的整理页,都可以免费在线读。

两个注意。第一,市面校注本(比如红研所校注本)里的注释、校记和标点是当代整理者的劳动, 有自己的权益,拿公开电子文本当底本最干净。第二,脂评本系统只到第八十回,程高本是一百二十回, 你打算从哪里续,决定你需要哪个本子。整理成 txt 或 epub 后导入 Foreverse,原文进书架, 之后所有续写都落在分支上,正文一个字节不动。

断点选在哪一回?

两种选法。正统派从第八十回末接:脂评本止于此,两百年来所有续书人都从这里开笔, 你和那位「无名氏」站在同一个起点。情节派在任意一段划开:读到第九十七回黛玉焚稿咽不下这口气, 就从焚稿前一段划词开分支,写一条「黛玉不死线」。

操作是同一个动作:划中一段,让 AI 从这里接着写,新内容落进新分支。分支之间并存, 「黛玉不死线」和「宝钗视角线」可以同时活着,各写各的,互不覆盖,随时切换对比。 写崩了不用删,那条线放着就是。

文风接得住吗?看一场真实横评

诚实说:我们没做过《红楼梦》专项评测。手里最接近的数据是《后宫·甄嬛传》九模型续写横评—— 流潋紫写的正是红楼一路的典雅书面语、严密称谓礼数和绵里藏针的对话, 九个模型各连续续写 20 轮、双盲评审排名,结论可以当参照。

那场横评里,DeepSeek V4 Pro 和 GPT-5.6 Terra 站上第一梯队,前者是唯一稳定复现原著 「话中有话+叙述解码」双层结构的系统;而玄幻场的冠军 DeepSeek V4 Flash 跌到第六, 白话直给的本能在典雅语体里使不上力。推论很直接:续《红楼梦》别看通用总榜, 挑在古言场验证过的模型,最好几家各试一段再定,同一本书里也可以逐段换着用。

另一个要防的现象是记忆污染。甄嬛传实验撞见过模型写出电视剧版专名:小说里太后住颐宁宫, 它写成剧版的寿康宫,暴露训练时记的是剧不是书。《红楼梦》的记忆分层更厚, 程高本、脂评本、87 版电视剧各是一套;从第八十回往下续,模型多半会自动滑向程高本的既定情节。 想走自己的线,得在续写指令里显式声明不沿用后四十回,把方向写清楚。

还有长跑问题:AI 续写越写越不像原著是可量化的规律,我们跑过 60 条 20 轮的链, 后段句长均匀化、比喻堆叠;给上下文标注「哪段是原著、哪段是 AI 续写」并声明以原著为基准, 漂移显著放缓,在 Foreverse 里这是个开关。该交代的天花板也交代: 没有模型学得会原著短句长句剧烈交错的节奏,目前谁都不行。

写完之后

只给自己看,法律上最省心:原著公版,续写私存,不发布不变现,两百年公案里挨骂的每一步你都没走。 想发出去,事情复杂一层——2025 年 9 月 1 日起施行的《人工智能生成合成内容标识办法》要求 AI 生成内容亮明身份,各平台另有自己的标注规则;版权层面的细节我们在另一篇里逐条整理过

红学家还在争后四十回里有没有曹雪芹的残稿、有多少。你的第八十一回不用等这个结论: 写坏了就再开一条分支,横竖没人给你写脂批。

常见问题

AI 能写出曹雪芹的文笔吗?

接近纹理可以,复刻魂魄做不到,这是实测过的诚实答案。我们在《甄嬛传》九模型续写横评(同属典雅书面语+严密称谓礼数的路数)里看到:第一梯队能稳住语体和礼数,拿到「全程零事故」这样的工艺评语,但没有评审说过任何一家「像原作者」;整个横评系列里最高的赞语也只到「像一个笔更细的同题材作者」。所有模型还共享一个指纹:句子长度越写越均匀,学不会原著短句长句剧烈交错的节奏。把预期设在「工整的仿写」,惊喜留给个别段落。

公版《红楼梦》全本去哪里下载?

文本本身早已公版:曹雪芹逝世约 260 年,程高刻本问世 230 多年。中国哲学书电子化计划(ctext.org)收录一百二十回全文,维基文库有 1791 年程甲本的整理页,都可免费在线读。注意两点:脂评本系统只到第八十回,从哪续决定你要哪个本子;市面校注本里的注释、校记、标点是当代整理者的劳动,有独立权益,拿公开电子文本当底本最干净。整理成 txt 或 epub 即可导入手机阅读器。

用 AI 续写《红楼梦》犯法吗?续出来能发表吗?

原著公版,续写本身没有版权障碍,这一点比续写当代网文干净得多。只写给自己看、存在自己设备里,是最省心的形态。要公开发表则多一层义务:2025 年 9 月 1 日起施行的《人工智能生成合成内容标识办法》要求 AI 生成内容亮明身份,各发布平台也有各自的 AI 内容标注规则,发之前查清楚目标平台的政策。本文不构成法律意见。

从第八十回续写,AI 会不会自动写成程高本的情节?

很可能,要主动防。模型训练语料里流通最广的是一百二十回程高本,从第八十回末往下写,它大概率会滑向掉包计、黛玉焚稿这些「既定结局」。这种记忆惯性是实测过的现象:甄嬛传横评里就有模型写出电视剧版专名(小说里太后住颐宁宫,它写成剧版的寿康宫),暴露训练记忆的来源。想走自己的线,在续写指令里显式声明「不沿用后四十回情节」,并把你要的方向写明。

有想法或问题?来 Discord 聊聊 →

用 AI 续写《红楼梦》会怎样?从两百年续书公案,到你自己的第八十一回 · Foreverse · 新梦