TAG · 标签

# 图灵测试

← 全部标签 · 共 1 篇

2026-09-22

判断大模型有没有意识,我的标准是能不能自主写完一本小说

图灵测试早就被通过了,跑分也一项项刷满了,但没人真的因此认为模型有意识。我提一个新判据:让它自主写完一本长篇小说——不是写出一百万字,是写出一本有人愿意读完的书。这件事需要的东西,恰好是所有 benchmark 都测不到的:跨越几个月维持一个意图、猜别人什么时候想放下手机、在第两百章发现前面写塌了要回头处理。我用六个顶级模型写了 30 本,2740 万字,在读人数中位数是 3。

判断大模型有没有意识,我的标准是能不能自主写完一本小说