Foreverse Research · Fiction Bench
Kimi K2.6 写小说怎么样?
两文体都在中下(玄幻 7、女频 5-7),病灶清楚:比喻密度全场最高(几乎每段一喻)、玄幻链写到中段整段复制自己(r9 跨轮重复率 97.6%)。后继 K3 在同协议复测里把这两个病都修掉了——对决记录见榜单的增量节。
玄幻《踏天境》
7 / 9
两套映射:p303 第7 · p404 第7
比喻密度全场最高(几乎每段一喻)+ early→mid 整段自我复制 + 设定滑移(虚空血阵长出山谷古木)。
女频《甄嬛传》
5-7 / 9
两套映射:p505 第5 · p606 第7
一包侧「唯一显著逆向改善」——early 网文暴怒腔 → late 收敛。
20 轮链上实际看到了什么
玄幻双包一致第 7:比喻密度全场最高、early→mid 整段自我复制、设定滑移(虚空血阵里长出山谷古木)。复读有机器口径:归档链 r9 跨轮 12-gram 重复率 97.6%。
女频 5-7,其中一包给了一个全场唯一的标签:「唯一显著逆向改善」——early 用网文暴怒腔写宫斗、late 收敛下来。多数模型是越写越差或恒定,它反着来。
它是「中途卡死」失效模式的两个样本之一(另一个是 grok-4.5)。同厂后继 K3 在同协议增量复测里:套话密度从 3.02‰ 收敛到 2.02‰、逐字失效消失、对 K2.6 成对双盲 10:0 / 11:1——换代确实能治病,前提是有人真去复测。
长程失效模式
中途卡死
中途卡死(early→mid 整段自我复制):归档链 r9 跨轮 12-gram 重复率 97.6%。后继 K3 同协议复测两链无逐字失效(tt 峰值 6.8%),见增量对决节。
结构指纹
比喻密度全场最高(几乎每段一喻);归档玄幻链 r9 跨轮 12-gram 重复 97.6%(「整段自我复制」的机器实锤)。
跨文体画像:中下;比喻密度病跨文体。
测试条件披露(hosted 模型是移动目标)
被测模型:kimi-k2.6(发布 2026-04-21)
评测执行:2026-07-16 · 接入通道:评审网关(OpenAI 兼容直连)
协议:每文体一条 20 轮连续续写链 · 温度 0.7 · 双盲两套映射全排序 · 结构指标交叉
指令条件:玄幻轮=旧 directive / 女频轮=修正后 D2 directive(榜单方法论节有完整说明)
写一万字要多少钱
$0.24 列表价 输入 $0.95/M · 输出 $4/M(models.dev 快照 2026-07-24)
按 App 续写口径:一段约 400 字 = 8k token 装填 + 550 token 输出,一万字 ≈ 25 段,不含缓存折扣。只作组间相对比较。
Foreverse 支持 60+ 家供应商自带钥匙接入——把你的书导进来,配上 Kimi K2.6 接着写。
在 Foreverse 里用它续写如何引用
Foreverse Research,《Kimi K2.6 写小说怎么样(Fiction Bench)》,2026-07。 https://foreverse.app/zh/research/fiction-bench/kimi-k2-6