← 返回笔记列表

口播视频配音怎么做?免费配音工具和去噪流程实测笔记

📅 2026-09-28 📂 🎵 音频处理笔记

口播视频能不能留住人,配音这关很关键。我自己做了几十条口播视频后得出一个结论:不花一分钱也能把配音这一环做利索,关键是把流程固定下来。下面这篇是我实测过的免费配音加去噪笔记,全程没花钱买任何工具。

一、开工之前,先分清你属于哪种情况

做口播半年,我发现新手最容易卡在「不知道该用真人声还是AI声」。与其先纠结设备,不如先想清楚这两条路:

二、我固定用的两条配音流程

流程固定下来之后,一条口播从写好稿到出音,快的话20分钟能跑完:

  1. 真人路线:手机录好原声 → 用剪映自带的降噪把底噪去掉 → 人声音量调到-3dB左右 → 配乐用爱给网找的免费音效 → 导出。剪映的降噪参数我写了篇专门笔记,见剪映工具笔记。
  2. AI路线:文案写好 → 配音秀或讯飞配音生成 → 语速压到0.9倍 → 逐句听一遍,把读错的数字和英文单词手动改掉 → 导出到剪映对字幕。字幕那步我单独写过一篇自动字幕的笔记,这里不展开。

三、我踩过的坑,提前帮你避开

  1. AI配音不调语速:默认语速偏快,听感像在赶火车。我一般压到0.9倍,像「618」「3·15」这种数字词和品牌英文名,必须逐句听一遍手动改,不然全读错。
  2. 环境声没收干净:有一阵我开着风扇录,后期一去噪,人声跟着变闷、像隔了层布。所以收音时先把环境声源关掉,比后期处理省事得多。
  3. BGM盖过人声:我一开始把BGM拉到50%音量,结果人声被压得几乎听不见。后来固定把BGM降到人声的四分之一,也就是音量-15dB上下,人声立刻清晰了。
  4. 整段录、整段废:以前一句话说错就从头重录,录上十遍嗓子先哑了。现在改成一句一句录、最后拼起来,哪句不好只重录那句,效率至少快一倍。

四、几个让声音更耐听的小习惯

一句话总结:配音不拼设备拼流程,先分清真人还是AI,再把收音或生成、去噪、配乐、对字幕这条线固定下来,一句一句地录,比反复整段重录省事得多。

本文为个人学习笔记,内容仅供参考。

📖 相关阅读