Lode 需求雷达
--卡片
--主题
--失败
HN讨论 · 身份未知

用公共领域老文本做对照组辨别 AI 模仿文风

一个让用户区分 AI 模仿与历史文本的在线测试:人类段落取自 1660–1922 年公共领域作品,AI 部分由 Opus 5 续写同样风格。作者指出常见 spot-the-AI 游戏因采用现代文本作为对照而难以证明设计有效性。

目标用户

喜欢玩“AI 还是人类”测验的普通玩家、文学爱好者,以及关注 AI 风格模仿与文本鉴别的内容创作者。

潜在需求

玩家需要一种可验证、确实非 AI 的对照组文本,才能判断 AI 模仿历史作家文风的真假,而不是在现代文本里猜测。

发生场景

玩家在玩 spot-the-AI 类游戏时,常见题目的“人类文本”实际是现代文章,难以确认是否由 AI 生成,识别结果因此缺乏说服力;本游戏以 1660–1922 年公共领域旧书原文为人类对照组,另一组由 Opus 5 模仿同一作者风格续写。

来源证据

常见的 spot-the-AI 游戏以现代文本为对照,难以证明对照文本并非由 AI 写作。

Every spot-the-AI game I've seen uses modern text as its control, so it's hard to prove it wasn't entirely written by AI. The human paragraphs here are verbatim from public domain works published between 1660 and 1922 (Pepys, Gilbert White, Twain, Jerome, the Grossmiths, Wodehouse), so they predate the clankers by a century; the other half is Opus 5 continuing in the same voice. There are 10 rounds, I managed to get a ~60% win rate.
https://news.ycombinator.com/item?id=49385557

为什么值得留意

该信号把 AI 文本识别的难点落到对照组的可验证性上,用公共领域文本给出低成本解法;同时暴露“spot-the-AI 游戏”在设计上的共同漏洞,对研究 AI 风格模仿和内容鉴别的人有参考价值。

已有方案

  • spot-the-AI 类游戏(作者所见均为现代文本对照)

未满足部分

  • 现有 spot-the-AI 游戏的对照文本无法被证明是纯人类写作

可能延伸 · 模型推测

  • 将历史文本对照思路整理为可复用的 AI 风格模仿评测数据集(模型推测)
  • 用于写作教学、内容平台或版权场景中辅助人类/AI 文本鉴别(模型推测)

目前未知

  • 信号来自项目作者自述,无独立用户评论或第三方测试记录
  • 60% 胜率是作者自测 10 轮结果,样本量小
  • 未说明 Opus 5 的生成参数、随机种子等细节

继续核实

  • 独立玩家体验时能否稳定区分 AI 与历史原文?
  • 除英文经典作家外,该对照方法对其他语言和文体是否有效?
  • 这类测试能否转化为可重复的 AI 风格模仿评估工具?

主题词

ai text detectionwriting style imitationpublic domain corpusspot-the-ai gameliterary style comparison

管理令牌