← 最新论文
🤖 AI

Empowering Children to Create AI-Enabled Augmented Reality Experiences

本文介绍了 Capybara,这是一个由人工智能驱动的可视化编程环境,它通过利用生成式人工智能进行角色创建,以及利用计算机视觉来连接虚拟与现实世界,赋予儿童创建、定制并动画化交互式 3D 增强现实体验的能力,并已通过在美国和阿根廷进行的用户的研究得到了验证。

原作者: Lei Zhang, Shuyao Zhou, Amna Liaqat, Tinney Mak, Brian Berengard, Emily Qian, Andrés Monroy-Hernández

发布于 2026-08-13
📖 1 分钟阅读☕ 轻松阅读

原作者: Lei Zhang, Shuyao Zhou, Amna Liaqat, Tinney Mak, Brian Berengard, Emily Qian, Andrés Monroy-Hernández

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象一下,数字世界是一个巨大的、充满魔力的游乐场,那里的规则是用代码编写的。多年来,孩子们一直能够在这个游乐场里建造城堡和赛车,使用的是像 Scratch 这样的工具,它让孩子们通过拼接彩色的拼图块,而不是输入复杂的指令。但有一个问题:大多数这些数字世界都被困在屏幕之内。它们看不见你周围的真实世界,也无法对你桌上的咖啡杯或在你脚边走过的狗做出反应。

现在,想象一下如果这个数字游乐场能够触及、触摸现实世界,并根据它所看到的东西发生变化。这就是**增强现实(AR)的魔力,它就像戴上了一副特殊的眼镜,让你能看到数字角色就漂浮在你的真实客厅之上。如果你把人工智能(AI)**加入其中,这就好比给这些数字角色装上了大脑,让它们能够理解自己正在看什么。研究人员提出的一个大问题是:我们能否将这个神奇、聪明的游乐场的钥匙交给孩子们?我们能否让他们不仅是在这些智能数字世界中“玩耍”,而是真正去“构建”它们,将他们的想象力与现实世界的物体融合在一起?

这正是研究人员通过一个名为 Capybara 的新工具所致力于实现的目标。把 Capybara 想象成一个“面向未来的乐高套装”,但你使用的不是塑料积木,而是语音指令和肢体动作来进行构建。研究人员开发了一个平板电脑应用,让孩子们可以创造自己的 3D 角色,让它们跳舞,并编写程序让它们与香蕉或键盘等真实物体进行互动。

它是这样运作的:首先,孩子可以对着应用说话,说:“我想要一只戴着巫师帽的水豚”,AI 会立即画出一个 3D 版本。接着,孩子可以站起来挥动手臂;应用会观察他们的身体动作,并让数字角色模仿这些动作,就像一个提线木偶师在控制木偶一样。最后,孩子可以使用“感知模块”来告诉角色:“如果你看到地板上有一个香蕉,就跳过它。”应用会利用它的摄像头识别出那个真实的香蕉,并让数字角色对此做出反应。

研究团队在美国和阿根廷对 20 名 7 到 16 岁的儿童进行了测试。他们发现,孩子们能够成功地使用 Capybara 来创作这些混合现实故事。孩子们非常喜欢那种能让角色完全符合自己想象、并随自己的动作起舞的自由感。他们觉得自己在创造一些真正独特的东西,架起了他们的物理房间与数字世界之间的桥梁。

然而,研究人员也注意到了一些坎坷之处。有时,AI 会变得有点困惑。如果一个孩子要求一种特定类型的帽子,AI 可能会做出一个看起来有点奇怪的帽子,这让孩子们感到沮丧。此外,有些孩子因为太兴奋地尝试让 AI 画出完美的角色,以至于忘记了完成他们想要讲述的故事。这项研究表明,虽然这个工具是孩子们学习编程和 AI 的一种有趣且强大的方式,但它需要更多的引导,以帮助他们保持专注,并应对 AI 偶尔出现的错误。

简而言之,Capybara 表明,孩子们已经准备好成为智能交互世界的建筑师,但他们需要那些既有耐心又清晰明确的工具,来匹配他们同样富有创造力的思维。这是迈向未来的一步,在那个未来,孩子们不仅仅是数字内容的消费者,更是能够创造出与现实世界并存的、属于自己的神奇现实的创造者。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →