如何为 AI 混音准备你的分轨

在进入混音流程的关键阶段时,你花在准备分轨(stems)上的时间会带来巨大的回报。

本指南将为你拆解如何花费大约五分钟时间来准备分轨,以便在 Automix 中充分发挥它们的作用。

无论你使用哪种 DAW(数字音频工作站),这里的原则都适用。如果你想了解特定工具的具体导出步骤,请查看如何在 Ableton LiveFL StudioApple Logic ProGarageBand 中进行操作。 

以下内容是关于无论你使用哪种 DAW 都应该遵守的通用原则。

下方的视频涵盖了 Automix 中完整的分轨准备工作流,包括命名、分类、重要性(Importance)设置以及 DAW 导出——或者你也可以继续阅读文字指南。

Automix 的工作原理

当你将分轨上传到 Automix 时,AI 会单独以及结合乐段中的其他所有元素来分析每个文件。它会检测哪些元素在互相遮蔽。它会根据听到的内容以及你对每个轨道设置的信息,做出均衡(EQ)、压缩、声像(panning)和混响决定。

这些决定的质量完全取决于所提供源素材的质量。干净、定义明确且分类准确的分轨能为其提供最佳的起点。混乱、格式不佳或分类错误的分轨带来的混音结果也会反映出这些问题。

这并不是技术的局限性——任何混音流程都是如此。输入质量差,输出质量就差,这一原则同样适用于 AI 混音,就像适用于人类混音师一样。

在可能的情况下,独立分轨优于组合分轨

当你将整个鼓组导出一个单一的立体声分轨(将底鼓、军鼓、头顶话筒和房间话筒全部合并导出)时,Automix 会将其视作一个元素来处理。所有的 EQ 和压缩决定都会应用到整个鼓组上。你会失去对其中每一个乐器的精准控制。

而当你将每个鼓元素作为独立的分轨导出时,Automix 可以对它们进行独立处理。它能管理底鼓与贝斯之间的关系,独立控制军鼓的动态,并在不影响近距离话筒的情况下调整头顶话筒。每个元素的定义越明确,处理就越有针对性。

同样的逻辑适用于整个乐段。相比于两个独立的分轨,包含节奏和主音部分的单一吉他分轨能给 Automix 提供发挥的空间要小得多。将主音和和声合并导出的母带人声分轨,比单独上传的分轨更难平衡。

如果你的工程文件是为每个乐器或声部构建了独立的分轨,请以此方式导出。如果你使用的是 AI 生成的音频或预先做好的组合分轨,那就直接使用你拥有的素材——Automix 对组合分轨的处理也很好。但如果你有选择的余地,单独的分轨是非常值得为此付出额外导出时间的。

无论你是在网页端使用 Automix,还是在 Mac 上离线使用 Automix Desktop (Beta),这些分轨准备原则都同样适用。已包含在 Automix Pro 中。

格式和技术设置

导出为 WAV 格式。不要使用 MP3、AAC 或任何压缩格式。压缩格式会引入杂音,进而影响 AI 对音频的读取。出于这个原因,Automix 只接受 WAV 文件。

使用 16-bit、44.1 kHz 作为你的标准设置,因为这符合输出规格。上传 32-bit float(单精度浮点制)分轨并没有实质性的好处,这只会增加文件大小。

保持合理的音量电平。在上传之前,你的分轨不需要处于任何特定的电平——Automix 网页端会将增益阶段(gain staging)作为混音流程的一部分来处理。但如果有轨道过载剪切(clipping),请在导出前解决。如果轨道声音小到几乎听不见,也请将其修复。AI 是将音频作为信号进行读取的——请给它一个干净、稳定的信号来读取。

全部从 0:00 开始

每个分轨在时间线上都需要从同一点开始。这听起来很简单,但在遇到时间对齐问题的工程中,这是最常见的问题。

如果你的底鼓在第 1 小节开始,而你的人声在第 5 小节才开始(因为前 4 小节没人声),请在导出人声时,在开头保留 4 个小节的静音。当所有的分轨都从 0:00 开始并运行到同一个结束点时,Automix 就能精确地知道每个元素在时间上的对应关系。如果人声从第 4 秒开始,并且开头丢失了 4 秒的音频,那么返回的混音中人声与其余声部之间的时间关系就会错乱。

导出从项目最开始到最结束的所有内容。

效果器——保留什么,去掉什么

属于声音本身一部分的创意效果器——例如决定吉他特性的特定混响、对编曲至关重要的人声延迟、属于音色一部分的贝斯饱和度——请保留它们。保留这些效果器进行导出。如果混响是该乐器的一部分,它就是分轨的一部分。

你为了作为起点而应用的一些修正性处理——例如在所有轨道上加的高通滤波器、为了驯服极具动态的表现而加的粗略压缩器、为了解决某个问题而做的 EQ——你可以保留它们,也可以把它们去掉。Automix 会应用它自己的修正性处理。如果你已经做了一些有用的处理,可以留着。如果你不确定它是起了好作用还是坏作用,请把它去掉,让 AI 从原始音频开始处理。

有一点要避免:在上传前对单个分轨进行重度限幅(limiting)或母带级别的处理。如果分轨已经被重度限幅,Automix 在混音阶段能使用的动态范围就会变小,结果也会反映出这一点。

命名你的轨道

在导出之前命名每一个分轨。不要使用 Track 1、Track 2、Track 3 这样的名字——请使用能告诉你该轨道是什么的具体描述性名称。

这有两个重要的原因。第一,你需要在 Automix 中为每个分轨分配一个乐器类别,而准确地分配类别是提高混音结果最重要的步骤之一。如果你面对的是一堆名为 Track 1 到 Track 12 的文件,你会拖慢自己的进度,并且增加分错类别的概率。如果文件名为 Kick、Snare、Overheads、Lead Vocal、Acoustic Guitar 等,这个过程就会变得又快又准。

第二,描述性的名称会让项目文件下载变得更加实用。当你在 DAW 中打开 Ableton Live Set 或 DAWproject 文件时,你会希望立刻知道每个音轨是什么。命名良好的分轨能让这一切变得毫不费力。

在 Automix 中正确分类分轨

分轨上传后,你要为每个分轨分配一个乐器类别。在分轨质量本身之外,这一步是对结果影响最大的一步,也是最容易被草率对待的一步。

Automix 通过这些类别来理解每个元素在混音中扮演的角色。应用在底鼓上的处理与应用在合成器铺底(synth pad)上的处理完全不同。分错类别意味着 Automix 正基于错误的信息做出决策。

以下是一些值得了解、不那么显而易见的分类:

Toms(通通鼓)归在 Percussion(打击乐)下,而不是 Drums(鼓组)。通通鼓与核心鼓组元素扮演的角色不同——它们更具瞬态且不那么持续——Percussion 是它们的正确分类。

Hi-hats(踩镲)归在 Cymbals(镲片)下,而不是 Drums。

Claps(拍手声)归在 Snares(军鼓)下。

Drums 类别仅适用于完整混合在一起的鼓组分轨。如果你导出了独立的鼓元素,请为每一个鼓元素使用其对应的特定类别。

Bells 和 synth bells(钟声与合成器钟声)归在 Cymbals 下。

黑胶唱片杂音(Vinyl crackle)、噪音和环境特效(atmospheric FX)归在 FX(效果音)或 Other(其他)下。不要强行将这些归入某种乐器类别。

主唱和伴唱(Lead vocal & backing vocals)在可能的情况下应该作为独立的分轨。这能让 Automix 对大多数混音中最重要的元素进行针对性控制。欲了解更多关于处理好人声分轨的信息,可以阅读《如何使用 AI 混音人声》以获取更多人声特有的详细决策指南。

Automix 具有自动检测功能,会自动为你选择并推荐乐器分类。如果它们不符合你想设定的分类,你可以进行手动切换。

关于鼓组分轨分类的完整解读,可阅读《如何使用 AI 混音鼓组》,该文章更加深入地研究了每个鼓元素。

花点时间确保正确地执行这一步是非常值得的。这是你上传分轨后能做的最有价值的事情。

在生成前设置重要性(Importance)

在生成预览之前,为每个分轨设置重要性级别——低(low)、中(medium)或高(high)。这能告诉 Automix 每个元素在最终混音中应该有多突出。它会影响全面的处理链,而不仅仅是音量。

思考一下你的音轨中哪些是主导元素,哪些是辅助元素。主唱、主旋律(main riff)、听众耳朵跟随着的部分——设为高(high)。节奏吉他、铺底(pads)、和声层——设为中(medium)。氛围声、微妙的纹理质感、背景元素——设为低(low)。

如果你的首次预览听起来不合适,重要性设置是第一个需要重新审视的部分。进行调整并重新生成——在你执行此操作前,预览是不会更新的。

要想完整了解如何使用重要性设置以及 Automix 中的其他功能以获得最佳结果,在此之后《如何充分利用 Automix》是最佳的阅读去处。

简短总结

尽量导出单条音轨。WAV 格式,16-bit。所有部分都从 0:00 开始。保留创意效果器,去除重度限幅。清晰地为每个分轨命名。准确进行分类——特别是将 toms 分为 Percussion,将 hi-hats 分为 Cymbals。在生成前设置重要性(Importance)。

上传前进行五分钟的准备。返回的就会是一个明显更好的混音。

无论你是在网页端使用 Automix,还是在 Mac 上离线使用 Automix Desktop (Beta),这些分轨准备原则都同样适用。已包含在 Automix Pro 中。

立即前往 Automix 体验 AI 混音。你可以免费预览最多 16 个分轨的混音,Automix Pro 则支持多达 32 个分轨的混音。