分轨这件事,过去几年被 Moises、LALAL.AI 这类云服务做成了一门订阅生意:上传一首歌,等几十秒,人声鼓贝斯自动分开,效果好、速度快,前提是你得付钱、联网、把原始音频交给别人的服务器。
StemDeck 反过来做减法:开源、免费、不需要账号,音频全程留在你自己电脑上处理。官方文档说得很直白——这是给"想本地处理、不想付钱"的人准备的,不是 Moises 的平替。
六条音轨,全部留在本机处理
StemDeck 靠 Meta AI 开源的 Demucs htdemucs_6s 模型分轨,最多能拆出人声、鼓、贝斯、吉他、钢琴和其他,六条音轨。支持 MP3、WAV、FLAC、OGG、MP4、M4A 等常见格式,也能直接粘贴 YouTube 链接导入。
分完轨不是甩给你几个文件就完事。软件内置一个 DAW 风格的波形编辑器,能单独静音、独奏、调音量、拉波形、圈区间循环。分轨结果还能重新混成一份新音频导出,对练耳、扒谱、二次创作的人基本够用。
YouTube 导入只是省事的入口,不是下载工具。软件本身不缓存、不再分发下载内容,用户得自己确认对这段音频有处理权限——拿别人的版权音乐来练耳是一回事,拿分轨结果去二次分发是另一回事,软件免费不会替你解决这层授权问题。
首次运行仍需联网,下载 Python 运行环境、FFmpeg 和大约 170MB 的模型文件。"全程本地"说的是处理阶段,不是整个使用流程都不碰网络。
速度看硬件,功能有边界:适合谁,不适合谁
本地处理最大的变量是电脑本身。有 GPU(NVIDIA CUDA 或苹果芯片的 MPS)会明显更快,纯 CPU 跑一首歌可能要等很久——官方文档没给出具体分钟数,只强调这个差距是真实存在的,用什么硬件跑,体验差别很大。
云端服务不用担心这件事,算力在服务器上,跟你自己电脑好坏没关系。这是它们速度稳定的来源,也是本地处理绕不开的短板。
StemDeck 目前一次只能处理一个任务,没有移动端,也没有移调、和弦识别、歌词提取这些商业产品常见的附加功能。这些差距不是细节问题,而是决定了它适合谁。
| 人群 | 适合吗 | 该怎么做 |
|---|---|---|
| 想练耳、扒谱、做二次创作的音乐爱好者 | 适合 | 直接下载试用,接受比云服务更长的等待时间,有独立 GPU 的电脑体验会好不少 |
| 赶工期、按效率计价的职业制作人 | 不太适合 | 老实用 Moises 或 LALAL.AI,省下的时间比订阅费更值 |
| 在意隐私、想用可自托管工具的技术用户 | 适合 | 值得留意这类项目,自己看一眼开源代码,确认没有静默上传行为 |
| 想处理版权音乐再拿去分发 | 不适合 | 无论本地还是云端,处理权限问题不会因为软件免费就消失 |
我的判断
StemDeck 的意义不在于能不能替代 Moises 或 LALAL.AI——它自己都没打算替代。官方对照表列得很坦荡:速度、质量、移动端、进阶功能,云服务目前更占优势。它换来的是免费、隐私和可自托管,这是一笔明确的取舍,不是营销话术。
它真正做的一件事,是把"要不要把音频交给别人处理"的选择权,重新交回用户手里。云端分轨服务的生意模式很简单:算力在他们那,数据也在他们那,你交出音频,换来速度和体验。这是过去十年大多数 AI 应用产品的标准配方,StemDeck 提供的是配方之外一个笨一点、慢一点、但完全在自己手里的选项。
它是开源项目,接下来最该盯的不是分离效果,而是维护节奏——批量处理、移动端这些明显的功能缺口,社区能不能慢慢补上,还是发布即巅峰,没人再更新。这个问题现在还看不清,只能等版本迭代说话。
要效率,别为难自己,继续订阅云服务。要控制权和免费,StemDeck 值得装到硬盘里试一次,前提是接受它现在还没打磨到能打的地步。
