音频翻译器能做什么?
音频翻译器把录音中的口语转换成另一种语言的可聆听音轨。UnmarkAI 会先生成源转写,翻译口语含义,再生成目标语言的配音。它不同于语音转文字工具,因为最终交付物是可以听的,而不只是读的。转写保留在工作流中,让编辑能在生成配音前核对人名、产品术语、数字或不清晰片段。这个检查点对授权的访谈、课程、播客、研究录音和解说很有用——源音频里一个小错误就可能改变最终译音的含义。
“你的翻译音频已可审校。”
音频翻译器把录音中的口语转换成另一种语言的可聆听音轨。UnmarkAI 会先生成源转写,翻译口语含义,再生成目标语言的配音。它不同于语音转文字工具,因为最终交付物是可以听的,而不只是读的。转写保留在工作流中,让编辑能在生成配音前核对人名、产品术语、数字或不清晰片段。这个检查点对授权的访谈、课程、播客、研究录音和解说很有用——源音频里一个小错误就可能改变最终译音的含义。
把转写当作编辑检查点,而不是当成看不见的处理过程。每个源片段都有时间范围,选中它即可播放原始音频中对应片段(当源可用时)。这让核对人名、缩写、引语或受背景噪声影响的短语变得可行。修正保存后,工作流继续翻译和配音。请把原始录音与项目放在一起,并确保你拥有所有权、合适许可或明确授权来处理它。这样的交付比一键音频转换更可审校。
主要交付物是翻译后的 M4A 音轨。项目还能提供源语言和翻译字幕导出,包括任务支持的 SRT、VTT 或 ASS。这给团队两个有用的审校面:听翻译音轨检查语气和节奏,查看文本检查措辞或术语。如果你打算把录音复用于视频、播客编辑器或学习系统,请把两种输出与经审定的源文件一起保留。音频翻译器专为口语内容本地化设计,不用于去水印、改动视频画面或发布你没有使用权的源内容。
关于独立音频工作流的输入、审校步骤与可用输出的实用说明。
| 上传 | 最大 2 GB 音频文件支持 MP3、M4A、WAV、AAC、FLAC、OGG、OPUS、WMA 及标准音频 MIME 类型。 |
|---|---|
| 源语言 | 自动识别或手动设置当人名、方言或专业术语重要时,在审校时确认识别到的语言。 |
| 审校 | 带时间轴的转写片段播放对应的源音频片段,在生成译音前校对文本。 |
| 交付物 | M4A 音频加字幕导出下载翻译音频,并按需使用 SRT、VTT 或 ASS 字幕导出。 |
添加你拥有或已获授权本地化的语音备忘、访谈、课程、播客片段或解说。
检查带源时间轴的转写片段;在生成译音前调整不确定的人名或措辞。
生成目标语言的自然配音,下载经审定的音频与可用字幕文件。

口语包含打断、缩略词、说话人重叠,以及只有在录音语境中才说得通的短语。带时间轴的转写让编辑能在批准翻译前回到那个确切时刻。这个小细节能防止高价值的人名、声明和引语被原样带入最终译音。
对于反复出现的术语,请在审校前准备好经审定的拼写与读法清单。团队通常需要为产品名、课程模块、研究者姓名或组织名准备。审校阶段是解决这些决定的合适时机,因为在配音生成后再改源转写会造成不必要的返工。
此页用于独立的音频文件。如果源是视频,且目标交付需要屏幕字幕、画面清理或本地化视频导出,请改用视频翻译工作流。理清这个边界有助于每个项目从正确的源和交付物开始。
这些工作流有重叠,但满足不同的交付需求。请选择你的听众或下游编辑真正需要的格式。
| 工作流 | 它给你什么 | 适合场景 |
|---|---|---|
| 音频翻译 | 翻译音轨加可审校转写 | 你的听众需要用另一种语言聆听。 |
| 音频转写 | 源语言语音的文字版 | 你只需要笔记、记录或可搜索的脚本。 |
| 文字转语音 | 朗读你已有文字的配音 | 文字已定稿,且没有需要解读的源录音。 |

简短的准备清单能让审校阶段更有用,也让最终译音更易通过。
让分布式团队更易聆听并审阅多语言访谈,同时不丢失原始参考。
为课程、讲解和需要目标语言听众的连载音频准备额外的聆听音轨。
在保持术语编辑可控的同时,为已审定的产品音频适配新市场。
音频可能有歧义。审校阶段被有意纳入工作流:它把可编辑的转写片段与源播放配对,而不是把转写藏在一键导出背后。
可以。在生成译音前审校转写片段和说话人标签,尤其是说话人重叠或使用专有名词时。
工作流提供转写审校阶段,并可为完成的任务提供源语言和翻译字幕导出。
独立工作流接受常见音频格式,包括 MP3、M4A、WAV、AAC、FLAC、OGG、OPUS 和 WMA,最大 2 GB。
可以。在你已知源语言时可手动设置,否则从自动识别开始,然后在转写审校时确认。
工作流包含可选的背景音频保留设置(适用于符合条件的会员工作流);请在交付前试听最终混音。
不能。此页用于独立音频。当源或最终交付物包含视频时,请使用视频翻译工作流。