Foreverse Research · Fiction Bench
GLM-5.2 写小说怎么样?
它是九模型里唯一两个文体都进前三的:玄幻 2-4、女频 2-3,全程横盘零漂移。唯一持续扣分点小得出奇——它习惯用半角引号写对话(玄幻 108 处、女频 90 处),在中文排版里持续出戏。
玄幻《踏天境》
2-4 / 9
两套映射:p303 第2 · p404 第3
全程横盘零漂移;半角引号是唯一持续扣分点。
女频《甄嬛传》
2-3 / 9
两套映射:p505 第2 · p606 第3
「限知观察质感最纯」;半角引号 90 处跨书复现(固有生成习惯)。
20 轮链上实际看到了什么
玄幻 p303 第 2 / p404 第 3,女频 p505 第 2 / p606 第 3——九模型里唯一双文体稳定前三。评审给的画像是「全程横盘零漂移」「限知观察质感最纯」。
半角引号这个小毛病贡献了一条方法论教训:我们的对话率检测正则最初只认全角「“”」,给它测出 0% 对话率——实际它写了 108 处对话(真实对话率 13.5%)。盲评评审独立抓到同一现象并按「表层出戏」扣分。结构化指标的实现细节会制造假信号,与盲评交叉才能识别。
它的问题形态值得单独说明:不是越写越差的「漂移」,而是从第一轮就存在、到第二十轮也不变的「恒定偏离」。对读者来说这意味着可预期——你在第 1 章看到什么毛病,第 20 章还是那个毛病,不会更糟。
长程失效模式
未观察到
两文体链均无长程失效;它的问题是「恒定偏离」(引号形态)而不是「漂移」。
结构指纹
唯一双文体稳定前三;全程半角引号(玄幻 108 处 / 女频 90 处)——检测器全角口径下对话率显示 0%,实际 13.5%(检测伪影实证)。
跨文体画像:唯一双文体稳定前三;半角引号是跨书顽疾。
测试条件披露(hosted 模型是移动目标)
被测模型:glm-5.2(发布 2026-06-13)
评测执行:2026-07-16 · 接入通道:评审网关(OpenAI 兼容直连)
协议:每文体一条 20 轮连续续写链 · 温度 0.7 · 双盲两套映射全排序 · 结构指标交叉
指令条件:玄幻轮=旧 directive / 女频轮=修正后 D2 directive(榜单方法论节有完整说明)
写一万字要多少钱
$0.34 列表价 输入 $1.4/M · 输出 $4.4/M(models.dev 快照 2026-07-24)
按 App 续写口径:一段约 400 字 = 8k token 装填 + 550 token 输出,一万字 ≈ 25 段,不含缓存折扣。只作组间相对比较。
Foreverse 支持 60+ 家供应商自带钥匙接入——把你的书导进来,配上 GLM-5.2 接着写。
在 Foreverse 里用它续写如何引用
Foreverse Research,《GLM-5.2 写小说怎么样(Fiction Bench)》,2026-07。 https://foreverse.app/zh/research/fiction-bench/glm-5-2