Labs · 人味图灵场

四个 AI 评委来做这套题,只对了 12%。
到你了。

每天一题:两段小说并排盲读——挑出经过人工把关的那段成书文字,或者按指纹认出是哪家模型的手笔。 套话词表、比喻密度、句长的均匀感,答完逐条给你标出来。然后复制战绩格子,去晒。

免费 · 零账号 · 战绩只存你的浏览器

这个工具怎么来的

题库由两套完全自有的语料生成。语料一:官方产线小说——AI 初稿,过结构校验、评分闸、人工抽读三道把关后上架的成书(中文 10 本,2026-07)。语料二:九模型续写横评(2026-07)的裸产出——同书、同锚点、同指令、同温度,DeepSeek、Anthropic、Google、xAI、月之暗面、智谱、阿里、OpenAI 九家各写各的。标注「同开头」的模型对战题,配的是两家模型对同一锚点的第一轮续写。

指纹高亮用的是 AI 味体检器同一套 v10.7 规则词表(高频套话、解说归因句式、伪精确数字),加三项结构指标:句长离散度、比喻密度、对话占比。「12%」这个对照数字来自我们的双盲评委可靠性实验(4 评委 × 7 对 × 正反双顺序,金标来自真实读者,2026-07)。

它做不到什么

答对一题不等于你是检测器,我们也不是:结构完美的 AI 文案能骗过这页所有规则。我们自己的金标校准实验恰恰证明「人味没有自动化银弹」——每日一题练的是眼力,发不了证书。

现在还没有「人写的」题型。官方小说的初稿也是 AI 写的(人工把关在流程里),每次揭晓都会如实写。真正的人类文本题要等拿到干净的展示授权——社区征集在计划里,上线会标注。

「全站今日正确率」这一期没有——本页零后端。你现在的对手是那个固定的 12%:有日期、有出处、是真数字。

常见问题

题目是哪来的?每天怎么换?

两类语料,版权都在我们自己手里:一类是官方产线小说的选段(AI 初稿,但整卷过了结构校验、评分闸和人工抽读三道把关才上架);另一类是九模型续写横评(2026-07)的裸产出——同一本书、同一个锚点、同一条指令、同一个温度,九家模型各写各的。生成脚本把它们切成 60 天的题库,按北京时间的日期确定性取题,0 点换题;往期题保留可玩,算练习不计连胜。

「AI 评委只对了 12%」是怎么测出来的?

2026 年 7 月我们跑的双盲可靠性实验:4 个不同基座的大模型当评委,对 7 对角色卡文案正反两个顺序各评一轮,金标来自真实读者的判断。结果评委之间 86% 一致,对金标却只有 2/16 = 12%——一致地错:它们把细节密集、打磨均匀的文本读成「真人写的」,而真实读者恰恰觉得那是 AI 味。这个数字就是你在这页要打败的对手。

为什么问的是「经过人工把关的成书文字」,不是「人写的」?

因为官方小说的初稿也是 AI 写的——诚实的差别在流程:一边是校验、评分、人工抽读三道把关后的成书,一边是模型一次性输出、没人碰过的裸产出。真正的「人写 vs AI 写」题型需要我们有干净展示授权的人类文本,正在向社区创作者征集,上线时会明确标注。

我的战绩存在哪?有排行榜吗?

只存在你浏览器的 localStorage 里,零账号、零上传。「全站今日正确率」这一期还没有(本页没有后端),先拿 12% 的 AI 评委分数当固定对照——这个数字有出处有日期。众包正确率在二期路线图上。

相关工具与阅读

← 全部免费工具

人味图灵场 — 每天一题,猜哪段是机器写的 · Foreverse · 新梦