Humanly: A Configurable and Traceable Environment for Human-AI Collaborative Writing
Humanly 是一个可配置的写作平台,它通过记录详细活动和 AI 辅助来生成密封证书,从而将写作过程转化为可验证的证据,进而实现对人机协作的检测,并在教育和专业场景中区分人工打字与自动化操作。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
隐形墨水的谜团
想象你是一名试图破解谜题的侦探,但你唯一的线索只是桌上留下的最后一张便条。你可以读懂上面的文字,却完全不知道是谁写的,是他们在键盘上敲出来的,是他们向机器人口述的,还是他们从书本上抄录的。这就是我们数字世界中“写作真实性”现状的写照。长期以来,我们一直试图仅通过观察最终成品来猜测一段文字是由人类还是人工智能(AI)创作的。这就像仅仅通过品尝一口蛋糕,就想判断它是从头开始手工烘焙的,还是从商店里买来的。有时,一位文笔流畅的人会被指控使用机器人,而一个文笔略显笨拙的机器人却能逃脱检查。
问题在于,“最终文本”并不能讲述完整的故事。它掩盖了文字究竟是如何诞生的那段混乱、富有创意且有时甚至有些无序的过程。作者是为一个句子苦思冥想了一个小时吗?他们是否请求过聪明的计算机来修正语法错误?或者是一个机器人写完了整篇文章,而人类只是按下了“提交”键?为了解决这个问题,计算机科学和语言学领域的科学家们正在开发一些工具,这些工具不仅仅是观察“蛋糕”,而是观察整个“烘焙过程”。他们想要创建一个系统,记录每一次按键、每一次停顿以及每一次人类请求 AI 协助的过程,将不可见的流程转化为可见且可信的记录。
HUMANLY 登场:作者的“黑匣子”
这就是名为 HUMANLY 的新平台登场的地方。请不要仅仅把 HUMANLY 看作一个文字处理器,而要把它看作一个高科技、透明的写作“烘焙工作室”。HUMANLY 不仅仅是给你一个空白页并寄希望于结果,它允许负责人(如教师、会议组织者,甚至作者本人)在任何人开始打字之前设定好游戏规则。他们可以决定:“你可以使用 AI 来润色你的句子,但你不能让它代写全文,”或者“你有 30 分钟时间,且不能从互联网上复制粘贴。”
规则设定好后,作者进入工作区。当作者打字时,HUMANLY 就像一个超级敏锐的安全摄像头,它并不监视你在思考什么,而是监视你如何工作。它会记录一份详细的“活动日志”。它知道你打字的速度是否缓慢,是否长时间停顿,是否通过高亮文本来寻求 AI 的帮助,或者是否突然粘贴了一大段文本。它甚至能追踪你是否离开了屏幕,或者你的打字节奏是否突然快到人类无法企及。
当写作完成后,HUMANLY 不仅仅是保存文档。它会将整个会话打包成一份密封证书。想象一下,这份证书就像一个时间胶囊,包含了最终的故事、整个写作过程的回放(就像整个会话的“倒带”按钮),以及一个证明记录未被篡改的特殊数字印章。如果老师或读者想要检查作品,他们可以打开这份证书,查看文档是如何制作出来的。例如,他们可以看到:“86% 的文本由人类打字完成,3% 为粘贴,11% 得到了 AI 的辅助。”
“打字侦探”与机器人测试
HUMANLY 最酷的部分之一是它的“打字检测器”。研究人员想知道这个系统能否分辨出人类敲击按键与机器人(或计算机代理)代为打字之间的区别。为了测试这一点,他们玩了一场“红队测试”(Red Teaming)的游戏,这类似于一种友好的安全演习,旨在尝试迷惑系统。他们让真人进行正常写作,然后让一个强大的 AI 代理控制计算机并为他们输入文本。
结果非常明确。HUMANLY 打字检测器的表现极其出色,能够精准识别机器人。在测试中,它在从未误判真实人类作者(人类的误报率为 0%)的情况下,成功识别了自动化打字,准确率高达 85%。此外,它的速度极快,能在不到一秒钟内分析出打字模式,而其他使用大型语言模型的方法则需要数秒甚至数分钟才能做出判断。该系统关注的是微小的细节,比如按键之间的间隙。人类通常会有细微的停顿和不规则的节奏;而机器人往往以完美的、机器般的速率打字,或者其间隙短到人类手指无法实现。
为什么这很重要(以及它做不到什么)
论文指出,HUMANLY 是教师、编辑以及任何需要信任写作内容的人的一项有用工具。在用户研究中,扮演教师、学生和评审角色的参与者发现该系统易于使用,并认为它提供了公平的证据。它有助于消除困惑——例如当一名学生的写作看起来“过于完美”时,或者当一位作者被不公平地指控使用 AI 时。
然而,作者也非常谨慎地说明了该系统无法做到的事情。HUMANLY 证书并不是一个神奇的读心者。它只记录发生在 HUMANLY 窗口内 的行为。如果作者使用另一台电脑、将故事口述到录音机中,或者从一个未连接到 HUMANLY 的网站上复制文本,系统是无法察觉的。它无法证明作者没有从外部获取帮助,它只能证明它在屏幕上所见到的情况。它是一个强大的透明度工具,但并不是对一个人诚实程度的完美裁决。
最终,HUMANLY 将对话的主题从“这段文本看起来像 AI 写的吗?”转向了“这里是这段文本是如何制作出来的确切过程”。它将写作过程从一个谜团变成了一个可以被阅读、被检查并被信任的故事,一步一个按键,真实可循。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。