✨ 要点🔬 技术摘要
想象一下《易经》(或称《变易之书》)如同一位来自中国的古老而睿智的神谕。数千年来,人们用它来询问关于人生的问题,投掷硬币以获得随机的答案,然后阅读特定的文本来理解该答案对其处境意味着什么。
在 20 世纪,一位名叫约翰·凯奇(John Cage)的著名美国作曲家发现了《易经》。他钟爱“偶然”的理念。他利用投掷硬币来决定音符,却忽略了文本的意义 。对他而言,《易经》仅仅是一个随机数生成器,帮助他停止思考,让声音自然发生。
“变爻之乐”(Music of Changing Lines)是一个新项目,它提出:如果我们不抛弃其中的意义,会怎样?
以下是该系统的运作方式,简明解释如下:
1. 设置:一场数字仪式
用户并非仅仅按下按钮来获取一首歌曲,而是经历一场仪式 。
提问 :你首先输入一个问题或你心中的忧虑(例如“我该接受这份工作吗?”或“我的关系状况如何?”)。
投掷 :你在屏幕上虚拟地投掷三次硬币,共进行六次。在此过程中,电脑会播放音乐。
类比 :这就像建造一座房子。每次投掷硬币,就会在房间中增添一层新的声音(如鼓、笛子或吉他)。音乐会根据你得到的是“正面”还是“反面”而变化,但在此阶段,它仅仅是一种反映投掷动作 本身的声音景观,尚未涉及意义 。
2. 翻译:AI 作为译者,而非主宰
这是该项目与约翰·凯奇方法不同的地方。
解读 :一旦你完成投掷,系统会查看你特定的正反组合模式。它将你的问题与该模式对应的古老文本结合,并发送给一个智能 AI(称为Gemini )。
AI 的职责 :AI 并不直接创作音乐。相反,它充当译者 的角色。它阅读古老文本和你的问题,然后撰写一段简短、诗意的描述,概括答案的“氛围”或“情绪”。
类比 :想象 AI 是联合国的一名翻译。它将一场复杂的演讲(即《易经》的解读)翻译成一套给音乐家的简单指令(例如:“演奏一段缓慢、神秘且充满希望的音乐”)。
3. 结果:一首契合你故事的音乐
来自翻译 AI 的“情绪指令”随后被发送给一个音乐创作 AI(称为Lyria )。
音乐 :Lyria 生成一段简短的氛围音乐(30–60 秒),以契合解读的情绪。
体验 :你在屏幕上看到古老的符号和文本解释的同时,聆听这段音乐。这段音乐并非随机的噪音;它是对你的占卜意义 的声音映射。
为何这很重要
该论文指出,虽然约翰·凯奇将《易经》用作创作音乐的掷骰子 ,但本项目将其用作一场对话 。
旧方式(凯奇) :“让我们掷硬币来决定下一个音符是高还是低。意义并不重要。”
新方式(本项目) :“让我们掷硬币,看看宇宙对你的问题有何回应,然后让音乐讲述 该答案的故事。”
作者们将 AI 视为并非接管工作的作曲家,而是一个中间人 或中介 。它有助于弥合古老哲学文本与现代音乐体验之间的鸿沟,将焦点保持在“提问、解读和聆听”的过程 上,而不仅仅是生产一首成品歌曲。
简而言之 :它将一场电脑音乐实验转变为一次数字化的、互动式的占卜会话,其中音乐向你讲述你答案的故事。
技术摘要:变爻之乐
问题陈述 本文指出,《易经》(Book of Changes)在西方实验音乐中的应用存在历史与概念上的空白。尽管约翰·凯奇(John Cage)及后续作曲家采纳《易经》作为决定音乐参数(如音高、时值、力度)的偶然操作机制,但这种方法在很大程度上将文本的形式机制从其传统的解释、哲学和占卜语境中剥离。在这些现有系统中,《易经》充当的是中立的随机化器,而非承载意义的框架,有效地将占卜过程后传统上伴随的语义、仪式和文化维度排除在外。作者认为,这种还原主义观点忽视了《易经》作为在特定文化情境中解释不确定性与变化的系统之作用。
方法论 为解决这一问题,作者开发了“变爻之乐”(Music of Changing Lines),这是一款交互式网络应用程序,旨在将《易经》重新确立为意义构建的框架。该系统通过三个 distinct 阶段,将传统的“文王法”(King Wen Method)硬币占卜过程操作化,并将生成式人工智能整合为解释性中介,而非作曲权威:
输入阶段 :用户提交个人询问或问题。系统通过可选地请求姓名来保护隐私,但重点在于用户的具体情境。
起卦阶段 :用户进行六次交互式抛硬币(每次抛三枚硬币)以生成卦象。
音乐实现 :在此阶段,系统采用基于规则的、概率性的音乐过程,类似于凯奇的偶然操作,但不进行语义解释。
声音设计 :每一行硬币触发一个基于循环的声部层,对应从音色库中采样的特定乐器(太鼓、筝、尺八、三味线、笛子、尼龙弦吉他)。
概率映射 :硬币结果(例如,三枚正面/老阳 vs. 三枚反面/老阴)影响音高方向(上行 vs. 下行)和时值(较长 vs. 较短)。所有旋律均限定在五声音阶内,以保持和声连贯性并与东亚传统审美保持一致。
解读阶段 :此阶段重新引入传统上与《易经》相关的语义深度。
文本生成 :系统聚合用户的询问、本卦(Ben Gua)、任何变爻(Dong Yao)以及之卦(Zhi Gua)。这些数据通过 API 发送至 Gemini 2.5 Flash (一个大语言模型)。
提示工程 :提示大语言模型生成针对用户问题量身定制的解读,综合卦辞(Gua Ci)和爻辞(Yao Ci)。关键在于,大语言模型还提取关于情绪、能量、动态和空间特质的具体关键词。
音乐实现 :这些关键词作为 Lyria (Google GenAI 套件中的文本转音乐模型)的提示。Lyria 生成一段 30 至 60 秒的氛围乐曲,在声音上实现占卜结果。
系统架构 :后端利用 Web Audio API 和 Tone.js 进行实时声音合成与路由。系统在等待大语言模型处理期间,通过循环起卦阶段的音乐来保持声音的连续性,随后过渡到生成式播放阶段。
主要贡献
《易经》的再语境化 :该作品将《易经》从纯粹随机性的工具转变为计算机音乐中一种处于特定文化情境、承载意义的框架。
人工智能作为解释性中介 :本文展示了生成式人工智能在音乐系统中的新颖角色。人工智能并非作为自主作曲家或固定产物的直接生成者,而是充当“解释性中介”。它将占卜语义转化为音乐描述符,从而支持一个以人类能动性和仪式为核心的参与式过程。
过程驱动的参与式音乐 :该系统扩展了过程驱动计算机音乐的谱系(参考马克斯·马修斯(Max Mathews)的“指挥家”概念),展示了生成式人工智能如何促进以意义驱动的音乐过程,而无需预设僵化的音乐结构。
技术整合 :该实现成功地将传统占卜仪式与现代生成式人工智能(大语言模型和文本转音乐模型)在一个连贯、沉浸式的网络环境中架起桥梁。
结果 该系统成功生成了对占卜过程具有响应性的声音表征。起卦阶段生成了一种分层的、概率性的声景,反映了互动时刻的“宇宙动态”,而不传达特定的语义意义。解读阶段产生独特的文本解读,以及由 Lyria 生成的相应音乐作品,该作品反映了从用户询问和卦象转化中得出的特定情绪和结构轨迹。界面通过允许用户查看用于音乐生成的确切提示,提供了透明度。
意义 本文声称,“变爻之乐”提供了一种人机音乐交互的替代模型。通过突出仪式、解释和参与,该系统超越了优化或自动化。它表明,语言模型可以作为文化意义与声音输出之间的桥梁,在交互系统中发挥作用,而非取代人类创造力。该作品提出,声音可以作为一种表达不确定性、解释和“生成”(becoming)的手段,从而将参与式计算机音乐的历史愿景延伸至现代、以意义驱动的人工智能工具的语境中。作者承认了局限性,特别是关于 Lyria 等文本转音乐模型的可控性,指出当前系统可能无法始终与细致的文本提示完美对齐,但他们坚持认为,这种方法在《易经》的语境中成功重新平衡了偶然与意义之间的关系。
每周获取最佳 computer science 论文。
受到斯坦福、剑桥和法国科学院研究人员的信赖。
请查收邮箱确认订阅。
出了点问题,再试一次?
无垃圾邮件,随时退订。