音色选择的三条原则

  • 匹配人设:专业内容用沉稳音色,生活内容用亲切音色
  • 保持一致:同一账号固定 1-2 个音色,形成听觉记忆
  • 考虑人群:面向中老年用户时,语速偏慢、发音更要标准

文稿预处理

配音效果差,八成是文稿问题。发布前做三件事:

文稿 → 配音 → 字幕 → 成片的音频流水线
文稿 → 配音 → 字幕 → 成片的音频流水线
  • 把书面语改成口语短句
  • 数字、英文缩写、专业术语写成易读形式(如"GPT"写成"G-P-T")
  • 标注需要停顿或加重的地方

语速与断句

中文口播建议每分钟 240-280 字。语速过快听起来焦虑,过慢显得拖沓。句间停顿 0.3-0.5 秒,段落间 0.8 秒左右。

字幕与同步

  1. 配音后生成字幕文件并校正专有名词
  2. 按 4-6 字一行拆分,避免一行太长
  3. 检查时间轴与音频对齐,尤其是数字与重点词
  4. 导出时把字幕烧录或作为独立轨道(按平台要求)

真人配音 vs AI 配音

真人配音情感更自然,适合品牌片与情感类内容;AI 配音效率高、成本低,适合批量口播与教程类内容。常见做法是重要视频用真人、日常日更用 AI。

风险提示

使用他人声音做克隆必须获得书面授权;新闻、医疗等专业内容的配音应加人工复核,避免误读。