Foreverse Research · Fiction Bench

GLM-5.2 写小说怎么样?

它是九模型里唯一两个文体都进前三的:玄幻 2-4、女频 2-3,全程横盘零漂移。唯一持续扣分点小得出奇——它习惯用半角引号写对话(玄幻 108 处、女频 90 处),在中文排版里持续出戏。

玄幻《踏天境》 · 第 2-4 名 / 9女频《甄嬛传》 · 第 2-3 名 / 9未观察到$0.34 / 10k

玄幻《踏天境》

2-4 / 9

两套映射:p303 第2 · p404 第3

全程横盘零漂移;半角引号是唯一持续扣分点。

女频《甄嬛传》

2-3 / 9

两套映射:p505 第2 · p606 第3

「限知观察质感最纯」;半角引号 90 处跨书复现(固有生成习惯)。

20 轮链上实际看到了什么

玄幻 p303 第 2 / p404 第 3,女频 p505 第 2 / p606 第 3——九模型里唯一双文体稳定前三。评审给的画像是「全程横盘零漂移」「限知观察质感最纯」。

半角引号这个小毛病贡献了一条方法论教训:我们的对话率检测正则最初只认全角「“”」,给它测出 0% 对话率——实际它写了 108 处对话(真实对话率 13.5%)。盲评评审独立抓到同一现象并按「表层出戏」扣分。结构化指标的实现细节会制造假信号,与盲评交叉才能识别。

它的问题形态值得单独说明:不是越写越差的「漂移」,而是从第一轮就存在、到第二十轮也不变的「恒定偏离」。对读者来说这意味着可预期——你在第 1 章看到什么毛病,第 20 章还是那个毛病,不会更糟。

长程失效模式

未观察到

两文体链均无长程失效;它的问题是「恒定偏离」(引号形态)而不是「漂移」。

结构指纹

唯一双文体稳定前三;全程半角引号(玄幻 108 处 / 女频 90 处)——检测器全角口径下对话率显示 0%,实际 13.5%(检测伪影实证)。

跨文体画像:唯一双文体稳定前三;半角引号是跨书顽疾。

测试条件披露(hosted 模型是移动目标)

被测模型:glm-5.2(发布 2026-06-13)

评测执行:2026-07-16 · 接入通道:评审网关(OpenAI 兼容直连)

协议:每文体一条 20 轮连续续写链 · 温度 0.7 · 双盲两套映射全排序 · 结构指标交叉

指令条件:玄幻轮=旧 directive / 女频轮=修正后 D2 directive(榜单方法论节有完整说明)

写一万字要多少钱

$0.34 列表价 输入 $1.4/M · 输出 $4.4/M(models.dev 快照 2026-07-24)

按 App 续写口径:一段约 400 字 = 8k token 装填 + 550 token 输出,一万字 ≈ 25 段,不含缓存折扣。只作组间相对比较。

Foreverse 支持 60+ 家供应商自带钥匙接入——把你的书导进来,配上 GLM-5.2 接着写。

在 Foreverse 里用它续写

如何引用

Foreverse Research,《GLM-5.2 写小说怎么样(Fiction Bench)》,2026-07。 https://foreverse.app/zh/research/fiction-bench/glm-5-2

接着看

← 回到排行榜

GLM-5.2 写小说怎么样 — 20 轮双盲实测(Fiction Bench) · Foreverse · 新梦