Labs · 文本分析仪
一段正文的体质:
节奏、对话、复读。
贴一章正文进来:句长分布直方图、我们评测体系领跑的错落度指标、对照真实语料区间的对话密度,以及逐字复读片段——看结构与节奏,不看错别字和同义词。
Ctrl/Cmd + Enter 直接分析 · 文本只在浏览器本地计算,不上传。
体质报告会出现在这里。
指标从哪来
这些指标是我们小说续写评测线的结构半区:给九个模型各跑二十轮续写打分用的,就是同一套句子切分和对话规则——移植到浏览器后与原实现做过小数点后九位的对照测试。句长错落度 = 句长总体标准差 ÷ 均值;对话占比统计引号段(“”「」『』与成对英文引号都认)在全文中的字符份额;复读是滑窗指纹找出的 16 字以上逐字重复片段。
参照区间于 2026-07-24 从 10 本自有小说的 378 个章节样本算出——语料完全自有,这也是为什么「填入示例」贴的是为这页专门写的原创段落,而不是任何真实作品。
数字看不见的
这些指标描述纹理,不判断好坏——很多好章节坐在每一条中间带的外面。复读检测抓的是字面循环(模型把同一段重打一遍的失效形态);换着词说同一件事的主题重复,它抓不到。而且结构只是 AI 味问题的一层:我们的双盲实验里,大模型评委把人类写作判成 AI 的比例高得难堪——所以任何单一自动化信号(包括这页)都当透镜用,别当判决书。
常见问题
「句长错落度」是什么?为什么说它是 AI 味的第一信号?
它是句长的变异系数——句长标准差除以均值。人写小说会把三个字的短句和四十字的长句混着用;机器续写则向中间收拢。我们的九模型二十轮续写实验里,人写原著稳定在 0.64 上下,裸模板 AI 一轮比一轮均匀、掉到 0.52。结构上的均匀是第一个露馅的信号,所以这页把它放在最前面。
为什么这页不给文本打分?
因为诚实的输出是「描述」不是「评级」。对话占比低不代表书不好看,节奏跳跃也不自动等于文笔好。参照区间告诉你这段文字在 378 个真实章节样本里坐在什么位置——坐在那个位置意味着什么,是读者的判断,我们不越权替你下。
和 AI 味体检器有什么区别?
层面不同。AI 味体检器查词汇层——套话和句式模具(「眼底闪过一丝」「带着几分」);这页看骨架层——句长分布、对话份额、段落形态、逐字复读。一段文字可能过了一边、栽在另一边;两页都跑一遍,同一段话就有了词汇和结构两个视角。
参照区间是哪来的?
来自 10 本自有中文小说的 378 个章节样本,2026-07-24 用与本页完全相同的句子与对话规则离线计算。这套语料里,句长错落度的中间带(P25–P75)是 0.62–0.72,对话占比的中间带是 22%–40%。它们是「我这段坐在哪」的参照点,不是质量及格线。