K2.6 升 K3:写小说的人分三类,各有一笔账
K3 发布后,开放平台首页挂着最高返券 30% 的充值活动,模型列表里 moonshot-v1 和 kimi-k2.5 标了 8 月 31 日全平台下线,夹在中间用 K2.6 写书的人最纠结。我们刚跑完 K3 对 K2.6 的同协议成对双盲:两本书 24 票,K3 拿 21 票、K2.6 拿 1 票,连 K2.6 引以为傲的后程都没守住。这篇按三类用户拆:长跑党看双盲实证,预算党算输入 3 倍输出 3.7 倍的差价加思考税,观望党先确认 K2.6 根本不在下线清单里。

用 K2.6 写书的人,这两天打开 Kimi 开放平台会同时看到三样东西:首页顶栏的 K3 发布横幅,充值限时最高返券 30% 的角标, 还有模型列表页里 moonshot-v1 全系和 kimi-k2.5 的下线通告, 全平台停用定在 8 月 31 日。三件事叠在一起,很容易读成「再不升级就要被清场」。先把最要紧的一句说了: K2.6 不在下线清单里。你不用恐慌性迁移,但升不升级确实值得算,因为我们刚跑完 K3 对 K2.6 的同协议成对双盲, 结果是 21 比 1。
这篇按三类人拆:想知道升级到底换来什么的,读第一节的双盲实证;对着输入 3 倍、输出 3.7 倍的价差犹豫的,读第二节的账; 纯粹被下线新闻吓进来的,第三节两分钟读完就能出去。
长跑党:K2.6 的看家本领,K3 也接走了
先交代 K2.6 的定位。在九模型《甄嬛传》双盲横评里它排 5-7 名,评语是「唯一显著逆向改善的系统: 开局网文暴怒腔,越写越收敛回宫斗正轨」。多数模型连写二十轮越写越漂,它是少数越写越紧的, 这条曲线是很多人守着它长跑的理由。所以这次成对双盲,我们最关心的不是总票数,是分窗计票。
协议一句话:同两本书(890 万字传统玄幻加《后宫·甄嬛传》)、同起点、同提示,K3 和 K2.6 各连写 20 轮, 产物匿名后交 6 个异构评委,每本书做两套甲乙翻转映射对冲位置偏差,合计 24 票。 结果:玄幻场 10 比 0(另有 2 票无效,评委拒绝输出裁决格式),女频场 11 比 1。 唯一那张反对票,同一个评委在翻转映射里又把同样的位置投给了 K3,两票自相矛盾,属甲位偏好,不是稳定判断。 分窗看更彻底:把 20 轮切成 early、mid、late 三窗逐窗计票,玄幻场三窗全是 10 比 0,女频场三窗全是 11 比 1。 K2.6 引以为傲的后程收敛,没有在任何一个窗口扳回局面。
赢在哪,评委的细读引用很具体。K3 被点名「完美复刻原著短段落、拟声词独立成段及『~~~』标点习惯」, K2.6 被点名「辞藻堆砌」「战斗篇幅长、节奏急促」。这和结构指标对得上:K2.6 的老毛病是比喻套话密度全场最高, 玄幻链每千字 3.68 次,K3 降到 2.02,尾段大段清零;女频更干脆,0.63,比原著自己的 1.0 还低。 另一处是剧情推进:同一本玄幻、同一个起点,K2.6 的新链让反派去而复返,第 9 轮开打、第 11 轮逃走、第 17 轮折回再战, 评委独立写下「倒带感」;K3 的 20 轮一路推进到新场景,没有绕圈。 逐轮样张和全部裁决原文在 K3 实测记录里,可以复查。
长跑党的结论最简单:升级收益有实证,21 比 1 不是营销数字,是我们自己数出来的票。
预算党:3.7 倍差价,加一笔看不见的思考税
牌价先摆平(Kimi 官方定价页,2026-07-18 核实):
| 计费项(元/百万 tokens) | K2.6 | K3 |
|---|---|---|
| 输入(缓存未命中) | 6.5 | 20 |
| 输入(缓存命中) | 1.1 | 2 |
| 输出 | 27 | 100 |
| 上下文 | 256K | 1M |
输入贵 3 倍,输出贵 3.7 倍,这只是账的上半截。下半截是思考税:K3 思考恒开、当前只有 max 一档, 我们两条链实测,输出 token 里 81% 到 86% 是思考过程,可见正文每轮只有 250 字上下, 思考部分照 100 元的输出价一分不少地收。落到实付,两本书各 20 轮加验通探针总共花了 12.21 元, 摊到每段约 3 毛;同用量的 K2.6 按牌价折算一段一毛出头。所以每段的真实差距比 3.7 倍温和, 落在 2 到 3 倍之间,因为 K2.6 自己开思考模式时也在烧输出 token,它至少还给你留了个关的开关。 时间成本同理:K3 每轮 37 到 54 秒,睡前续三段等两分半,能不能忍看个人。
值不值,按用法分。日更量产、整卷预处理这类跑量的活,差价按千段放大,一本 500 段的中篇 K3 要一百五十块上下, K2.6 五六十块,量产选便宜的没什么可争。关键章节精修是另一回事:一章高潮戏十来段,K3 比 K2.6 多花两块钱, 换评委点名的那种短段落和拟声词纹理,这笔钱不算冤。 两头都要的老办法是混用,量产 K2.6、精修 K3,在 Foreverse 里续写逐段可换模型,同一本书里切着用不需要任何仪式。 接入步骤照 Kimi 续写教程,模型名换成 kimi-k3 即可,其余全同。
观望党:下线的不是你的模型,返券才和你有关
再说一遍时间表,免得被标题吓到。8 月 31 日全平台下线的是 moonshot-v1 全系和 kimi-k2.5,两者已停止向新注册用户开放; 更早的 kimi-k2 系列 5 月 25 日就停了。K2.6 不在任何一份下线通告里。 要做的检查只有一个:全局搜一遍代码和配置里的模型名,还挂着 moonshot-v1-8k、kimi-k2.5 这类旧名的,8 月底前改掉, 完整的迁移节点表在今夏停用日历里。
返券活动倒是真金白银。2026 年 7 月 15 日到 8 月 11 日,单笔充值满 99 元按阶梯返代金券, 5000 元及以上档最高返 30%,赠券 1 个工作日内到账、90 天有效。反正打算充的,卡在 8 月 11 日前充; 但别为了够返券档位囤钱,开放平台充值不退款,赠券又会过期,按 90 天内真实写得完的量充就好。 顺带一句,Moonshot 的限速等级看累计充值金额,不看当前余额,充过的钱在限速档位上是永久学历。
诚实节:K3 的三个坑,照抄实测记录
第一个,半角引号。两本书约 85% 的对白用半角引号写成,玄幻 39 对半角对 9 对全角,女频 52 对 8, GLM 5.2 的同款顽疾,中文网文读者一眼出戏,导出成稿要自己做一遍标点替换。 第二个,第一人称过密。写《甄嬛传》这类第一人称古言时,「我」的密度每千字 16.2 次,原著是 9 次, 1.8 倍,读起来会有点「戏太满」。第三个就是上一节的思考税,钱和时间都躲不开,而且没有开关。 三个坑没有一个动摇 21 比 1 的结论,但升级之前应该知道自己在换什么。
我们自己的用法收个尾:量产段留在便宜档,K3 只管精修,返券档按一季度的实际用量充。 下一场排期是 K3 对 DeepSeek 双档的同场成对盲评,同门内战打完了,该跨家了。
常见问题
K2.6 和 K3 写小说差距大吗?
同协议成对双盲的答案是大。同两本书(玄幻加宫斗古言)、同起点各连写 20 轮,6 个异构评委、每书两套匿名映射共 24 票:K3 拿 21 票,K2.6 拿 1 票,2 票无效,且唯一反对票在映射翻转下自相矛盾,属位置偏差。按 early、mid、late 三窗逐窗计票,玄幻场三窗全是 10 比 0、女频场三窗全是 11 比 1,K2.6「越写越收敛」的后程优势没有在任何一个窗口扳回局面。
K2.6 会像 moonshot-v1 一样下线吗?
官方现状:不在清单里。8 月 31 日全平台下线的是 moonshot-v1 全系和 kimi-k2.5(已停止向新注册用户开放),K2.6 仍列在官方模型列表的在售主力位,定价页照常挂牌。官方没有公布过 K2.6 的退役时间表,我们不替它猜。可以确定的是 Moonshot 清场有节奏:kimi-k2 系列 5 月 25 日下线、v1 系 8 月底下线,用旧模型名的代码每季度值得全局搜一遍。
从 K2.6 升到 K3 要改什么?
代码层面一行:model 字段从 kimi-k2.6 改成 kimi-k3,base_url 和 key 都不动。预算和习惯层面有三件事:K3 思考恒开且当前只有 max 一档,关不掉,每轮多等几十秒;思考 token 按输出价 100 元每百万计费,我们实测输出的 81% 到 86% 是思考过程;输出预算要给思考留量,别按可见正文的字数设上限。
充值返券活动值得等吗?
活动期 2026 年 7 月 15 日到 8 月 11 日,单笔充值满 99 元按阶梯返代金券,5000 元及以上档最高返 30%,赠券 90 天有效,具体档位以开放平台充值页说明为准。反正要充的,8 月 11 日前充合算;不建议为凑返券档位囤钱,Kimi 开放平台充值不支持退款,赠券又有有效期,按你 90 天内真实写得完的量充。
有想法或问题?来 Discord 聊聊 →