GenMusicLab

AI 分轨分离

AI 语音分离

用 AI 把重叠说话者从录音中分开——从两人对话里抽出某一个声音。

关于这个工具

语音分离(即「鸡尾酒会问题」)能在多人同时说话时隔离目标说话人。

对会议、采访,以及法律或医疗转写中「谁说了什么」很关键。

如何用 AI 语音分离

  1. 上传对话. 加入多说话人录音。
  2. 选择语音分离. 选「分离说话人」预设。
  3. 导出每条人声. 按说话人下载音频文件。

语音分离的常见用途

  • 会议纪要. 把每句话归到正确的人。
  • 采访清理. 把主持和嘉宾分开以便剪辑。
  • 转写. 把一条干净人声喂给 STT 引擎。

常见问题

支持几个说话人?
多数工具处理 2–4 个;重叠越多越难、越噪。
需要声音样本吗?
部分 diarization 工具从片段学习目标;其余需要参考样本。
口音和语言呢?
现代模型分离基本与语言无关,但之后的 STT 并非如此。

想分离分轨? 上传音轨,几秒内下载干净、可商用的分轨文件。含免费额度。