查尔斯·道奇:作曲家如何让计算机用人声歌唱





想象一下 1972 年。没有神经网络,没有方便的插件,甚至没有带有图形界面的常用显示器。只有巨大的、冰冷的房间里嗡嗡作响的大型机,其大小相当于一辆公共汽车。空气中弥漫着臭氧和穿孔卡片烧焦的气味。在这种无菌的、纯粹的数学现实中,响起了令人难以置信的声音。声音是男性的,略带金属质感,但却令人恐惧地栩栩如生。他朗读着超现实主义的诗歌,拉长元音,以至于没有人能真正做到这一点而不窒息。

这不是魔法。这是数学,它有了一个灵魂。而进行这种肉体与硅之间招魂仪式的人是查尔斯·道奇。

查尔斯·道奇:作曲家如何让计算机用人声歌唱

贝尔实验室的幽灵

在那些年里,新泽西州的贝尔实验室是科学家的奥林匹斯山。晶体管、激光器和 UNIX 操作系统在那里被发明出来。艺术在那里更像是一种偶然的异常现象,是无聊天才的副作用。像马克斯·马修斯这样的物理学家已经教会计算机发出旋律 - 还记得库布里克电影中 HAL 9000 演唱的“雏菊花”吗?那是他们的工作。

但道奇,一位受过古典教育的年轻作曲家,是为了别的事情来到这里的。他不需要有趣的哔哔声和砰砰声。他正在寻找人类的语调。他明白一个简单的道理:世界上没有任何乐器能像人声那样准确而无情地触动神经。

使用早期的语音合成算法是一场噩梦。这不是你对着程序说话,它就播放一首歌。道奇在穿孔卡片上打孔,用数千行数字编码音素、音高、共振峰和声音的持续时间。然后他将这堆卡片喂给一台巨型 IBM 360 计算机。

然后是等待。几个小时。有时是几天。只是为了听到录在磁带上的两秒钟的声音。如果你在第 402 张卡片上的一个数字出错 - 声音就会变成难以忍受的数字嘎嘎声。你必须重新开始。

来自数字镜中世界的歌曲

当道奇写下“演讲歌曲”(1972 年)时,突破发生了。这部作品至今仍令人毛骨悚然。他采用了诗人马克·斯特兰德的荒诞诗歌 - 例如关于一个男人听着收音机,直到他的房子慢慢消失的诗句 - 并通过合成器播放它们。

这就是吸引人的地方。道奇意识到,计算机可以打破音高与其速度之间的联系。在现实生活中,如果你更快地滚动磁带,声音就会变得尖细,像一只花栗鼠。但计算机可以让你将“海洋”这个词拉伸半分钟,同时保持说话者低沉的低音。

“我不是试图让机器模仿人。我试图找到人结束的地方,而一个全新的、不可能的工具开始的地方”,道奇后来这样说。

当你听“演讲歌曲”时,会产生一种奇怪的感觉。就像你接到了来自遥远未来的幽灵的电话。声音是合成的,没有呼吸,但语调——叹息、停顿、问题结尾处突然的音调升高——是绝对人类的。这是同理心战胜冷酷算法的胜利。

查尔斯·道奇:作曲家如何让计算机用人声歌唱

太阳风的音乐

道奇并没有止步于语音合成。他对无形世界的声音感兴趣。1970 年,他创作了“地球磁场”。这个名字听起来像一张用于冥想的新时代专辑,但技术背景很严峻。

他获取了由太阳辐射引起的地球磁场在特定年份的波动图,并将这些数据转换为音符。今天,这被称为“数据声化”。当时,这似乎是纯粹的疯狂。

事实证明,磁暴听起来像令人不安的、破碎的前卫爵士乐。道奇并没有以古典意义上的方式创作任何东西 - 他只是给了宇宙一份乐谱,并让它在合成器上演奏。他与其说是作曲家,不如说是翻译。

查尔斯·道奇:作曲家如何让计算机用人声歌唱

我们今天听到的回声

现在我们生活在一个神经网络在几分钟内克隆已故歌手声音的时代。我们听着虚拟主播演唱弗兰克·西纳特拉的热门歌曲。我们认为我们正处于技术的顶峰。但这一切都始于贝尔实验室嗡嗡作响的房间里。

唯一的区别是,现代技术试图欺骗我们,假装成真人。查尔斯·道奇没有欺骗任何人。他向我们展示了机器和人之间的缝隙,让我们欣赏这个缝隙。

他证明了技术本身是死的。它只是一个空容器。只有坐在夜晚堆满穿孔卡片的桌子上的作曲家才能将痛苦、讽刺和渴望注入这个容器中。

查尔斯·道奇:作曲家如何让计算机用人声歌唱

如果在网上找到“演讲歌曲”,请打开它们。闭上眼睛。听听这种奇怪的、磕磕绊绊的、金属般的低语。这是一个首次接触数字思维并迫使它阅读关于爱和孤独的诗歌的人的声音。