跳到正文
声场
视频与音频翻译

转写、字幕翻译、视频配音有什么区别?先选对要做的工作

录音变文字、字幕换语言和替换视频人声是不同任务。明确原文、译文、说话人、时间与声音资产的关系,避免把字幕成功当成配音完成。

声场编辑部更新于 2026-09-122 分钟阅读
转写、翻译、配音,是三层工作。每层输出不同,也有各自的验收标准。
每层输出不同,也有各自的验收标准。 本图为创作方法示意,不是产品操作截图。

转写:把听到的话变成文字

转写回答的是“原素材说了什么”,通常还需要相应的时间位置。它不应自行换语言,也不应为了句子通顺擅自更改事实。人名、数字、重叠说话和噪音是常见校对点。说话人区分是另一项工作:文字识别正确,不代表人物身份已经正确。

字幕翻译:把意思传给另一种语言的观众

翻译以准确原文为基础,处理语言表达、术语和上下文。SRT 等字幕格式还带有显示时间,但一个时间条里有多少字,不等于这些字配音后的实际长度。已有译文字幕不能直接冒充原文字幕,否则后续对照和重新翻译会失去正确基线。保留两种文本的用途区别非常重要。

配音:文字之外,还要决定声音怎么说

配音需要人物与音色、语速与情绪、实际音频时长,以及在视频上的放置方式。即使翻译完全正确,也可能读错专名、说得太快或超过画面时间。因此配音交付多出了一轮真实声音验收。合成视频只是把已确认的画面和声音编码成文件,不能替代前面的内容判断。

按你的原始材料选择入口

有文字想做声音,走小说、台本或故事导入;有录音想保留原声并整理片段,先做音频导入;有视频要换成另一种语言配音,进入视频流程。声场的视频准备阶段可按能力识别原文,或使用原文 SRT,再到工作台校准译文、声音和时间。音频导入本身不能等同于自动完成音频翻译配音。 希望继续使用录音原声时,可查看录音导入与编辑

每一阶段都有自己的验收结果

先确认原文和人物,再确认译文,随后生成声音并检查时间,最后看最终文件。前一步变化可能让后面的结果失效:原文改了要复核译文,译文改了要检查新配音,时间改了要重新听与画面的关系。把阶段分清,遇到错误才知道应该在哪一步修,不必把整条流程全部重做。 目标是让画面配上中文声音时,继续阅读英文视频转中文。 准备好素材后的操作步骤见视频翻译教程

  • 只要文字记录:验收转写与时间,不必生成新声音。
  • 需要跨语言阅读:验收译文和字幕显示。
  • 需要替换视频声音:增加音色、配音窗口与最终文件验收。
  • 需要保留背景音乐或重建口型:先核对能力边界,当前声场视频流程不包含这两项。