电脑视频提取音频教程:剪映导出与命令行两种保姆级步骤 手动创作

书桌抽屉里那台老旧的笔记本电脑里,塞满了过去两年上网课的视频和线上会议的录播文件,粗略一算,至少超过一百个MP4格式的视频。我最近一直在琢磨着,怎样把这些视频里的讲解声音单独提取出来,放进手机里随时听,顺带还能交给语音转文字的工具,生成一些文字记录。视频画面对我来说,真的没什么价值,不仅占地方,还浪费流量,我真正需要的,仅仅只是其中的“声音”这一部分。开始亲自动手操作之后,我才发现,同样是打算把视频转成MP3,用鼠标点击图形界面和输入一行命令行的操作,完全是两种不同的体验:前者非常直观,适合处理一两条文件顺便编辑一下;后者效率很高,特别适合批量处理大量文件。今天,我就把这两种我在电脑上经常使用的操作方法,完完整整地写出来,从第一步到最后一步,把每个按钮在哪儿、每个参数代表什么意思,全都说明白,你照着操作就能轻松完成。

我先大致说明一下这两种方法的使用场景:如果只是偶尔处理一两条视频,并且还想顺手剪掉视频的开头和结尾,那么使用剪映的导出功能就足够了;如果手头有一个文件夹,里面有几十上百个视频需要一次性转换,那么命令行工具ffmpeg就是最佳选择。至于手机端的应急方案,我会把它放到文章后面单独说明。在开始之前,有一点需要特别说明清楚——本文介绍的这两种方法,做的都是“整轨抽取”,也就是视频里原本包含的人声、周围环境的声音、背景音乐等所有音频信息,都会被原封不动地保留在生成的MP3文件里,不会进行人声和伴奏的分离处理。如果你想要的是“去掉背景音乐,只保留人声”,那属于另一种基于人工智能的音频分离工具的工作范畴,就不要在导出的设置里浪费时间了。

方法一:使用剪映导出音频(图形界面操作,保姆级八步详解)

剪映

剪映提供了桌面客户端,操作界面很直观,完全不需要接触命令行,其免费版就能完成基础的音频导出功能(具体的使用额度,请以你当前使用的版本为准)。这种方法非常适合单条视频的处理,或者你本来就打算在剪映里对视频进行一些编辑和修剪。

步骤 1:安装并启动剪映客户端

先去剪映的官方网站,下载对应你电脑系统(Windows 或 macOS)的桌面版软件。安装完成后,启动软件,在首页点击“开始创作”按钮,就能进入编辑界面。手机版的剪映也能完成类似操作,但电脑版的屏幕更大,导出时的设置选项也更全面,所以本文以桌面版为例进行介绍。

步骤 2:将视频导入到时间线

把你想要转换的MP4视频文件,直接用鼠标拖拽到软件界面左上角的媒体素材区域,然后再从这个区域,将视频文件拖到下方的主轨道上。因为我们只需要提取音频,所以一条视频轨道就足够了,完全不需要添加字幕、贴纸或者特效轨道。

步骤 3:裁剪掉不需要的开头和结尾

播放视频,确定需要保留的有效内容范围。如果视频的开头有一些无关紧要的寒暄,或者结尾有长时间的静音,你可以将播放指针移动到需要裁剪的位置,点击“分割”按钮,将视频切开,然后选中多余的片段,将其删除。这一步做扎实了,最后导出的MP3文件里就不会有几十秒的空白,省得以后再花时间去裁剪。

步骤 4:点击右上角的“导出”按钮

在时间线上确认好需要保留的视频内容后,点击软件界面右上角的“导出”按钮,这时会弹出一个导出设置的窗口。注意,不要急着直接按默认的视频导出设置。

步骤 5:切换导出格式为音频

在弹出的设置窗口中,找到一个叫做“音频导出”或者“导出音频”的开关选项(不同版本的剪映,这个选项的位置可能略有不同,通常是在视频设置的下方,或者一个叫“更多格式”的菜单里)。把这个开关勾选上,然后在格式选项里选择MP3。

步骤 6:设置音频码率与文件保存位置

码率的高低,要根据你的使用目的来定:对于像纯口播、讲座这类以语音为主的素材,128kbps 的码率已经能有很清晰的效果;如果你希望保留更多的音乐细节,可以选择 192kbps 或者更高的码率。修改好你想要的文件名,然后选择一个方便日后查找的文件夹来保存,比如在桌面上新建一个名为“音频输出”的文件夹。

步骤 7:点击导出按钮并等待

确认所有参数设置无误后,点击“导出”按钮,等待进度条走完,MP3文件就生成好了。视频文件越长,等待的时间就越长,几分钟的口播视频通常很快就能完成。

步骤 8:回听校验导出文件

用你电脑上自带的播放器,把刚生成的MP3文件打开,分别听一下开头和结尾几秒钟的内容,确认音频没有被意外截断,也没有出现不该有的静音。剪映通常会自动跟随原始视频的声道设置,如果原片是立体声,导出的MP3就是双声道,如果原片是单声道,导出的也是单声道,不需要你额外去设置。

剪映最大的优势就是操作直观,并且还能顺手对视频进行简单的剪辑。但它的局限性也很明显:需要安装客户端软件,如果一次有几十个视频要处理,一个个去点击操作,会让人感到非常繁琐。这种批量处理的工作,用剪映就不太划算——这时候,就该轮到下面的命令行工具登场了。

方法二:使用 ffmpeg 命令行(一行命令,批量处理最省心)

如果你的电脑上已经安装了 ffmpeg,那么当需要一次性转换几十上百个视频文件时,使用命令行工具会比一个个点击鼠标要省时省力得多。ffmpeg 是一个开源免费的强大工具,没有图形界面,但只要学会几条固定的命令,就足以应对日常的使用需求。

安装 ffmpeg

在 macOS 系统上,可以使用 Homebrew 包管理器,用一行命令就能完成安装:brew install ffmpeg。在 Windows 系统上,需要去 ffmpeg 的官方网站下载压缩包,解压后,把里面的 bin 文件夹的路径添加到系统的环境变量 PATH 中,然后重新打开命令提示符或 PowerShell,就可以使用 ffmpeg 命令了。安装完成后,在终端或命令提示符中输入 ffmpeg -version,如果能打印出版本号,就说明安装成功了;如果提示找不到这个命令,多半是环境变量 PATH 没有设置正确,先把这一步问题解决掉再进行下面的操作,不要急着去转换文件。

查看源文件的音频信息

在开始转换之前,先查看一下源视频文件的音频信息,做到心中有数。在终端中输入命令:ffmpeg -i input.mp4。在输出的信息中,找到类似 Stream #0:1: Audio 的那一行,从这里可以了解到音频的编码格式(例如 aac)、采样率(常见的是 44100 或 48000)以及声道数(立体声或单声道)。确认视频文件中包含音频流之后,再进行下面的转换操作。

单个文件转换为 MP3

将单个视频文件转换为 MP3 格式,最常用的是下面这条命令:ffmpeg -i input.mp4 -vn -c:a libmp3lame -q:a 2 output.mp3。其中,-vn 参数表示丢弃视频轨道;-c:a libmp3lame 指定使用 libmp3lame 编码器来编码音频;-q:a 2 用于控制音频质量,数值越小,音质越高,2 大约对应可变比特率(VBR)190kbps 的档位,对于日常使用来说已经足够。如果处理的是一些语音素材,想要进一步缩小文件体积,可以使用固定比特率并强制转换为单声道:-b:a 128k -ac 1。

整个文件夹批量转换

如果需要处理整个文件夹里的所有 MP4 文件,可以用一行循环命令来遍历所有文件:for f in *.mp4; do ffmpeg -i "$f" -vn -c:a libmp3lame -q:a 2 "${f%.mp4}.mp3"; done。在 Windows 的 PowerShell 中,逻辑也是类似的:遍历当前目录下的所有 MP4 文件 -> 提取音频 -> 以相同的文件名输出为 MP3 格式。运行这条命令后,你甚至可以去泡杯茶,等回来的时候,整个文件夹里的视频就全都转换好了。需要再次强调的是,ffmpeg 同样只是进行整轨抽取,不会做任何的人声分离处理,这一点和剪映是一致的。

补充方案:喵喵工具助手小程序(不在电脑前时的备用选择)

喵喵工具助手

有时候,你可能人不在电脑旁边,手头只有一两段视频素材,又不想为了这一点事情专门打开电脑并启动客户端软件。在这种时候,我会使用喵喵工具助手小程序里的“视频转 MP3”功能来处理。具体入口是,打开喵喵工具助手小程序,在首页找到“视频转 MP3”这个功能,然后上传本地的视频文件,由云端服务器完成转码,最后再把转换好的 MP3 文件保存回手机。

关于喵喵工具助手的局限性,我需要提前说清楚,免得你的预期和实际效果不符:这个功能需要联网使用(因为是在云端进行转码);每次使用需要消耗积分,大概是 2 积分一次,具体费用请以页面上的实时显示为准;它只接受从手机本地相册或文件管理中上传的视频,不支持粘贴链接进行解析;最终生成的仍然是整轨的 MP3 文件,同样不会进行基于人工智能的人声分离。所以,如果原始视频里带有背景音乐,转换后背景音乐依然会保留,这是完全正常的现象。

操作 1:从首页进入“视频转 MP3”功能

打开喵喵工具助手小程序的首页,点击“视频转 MP3”功能的入口按钮,进入页面后,最好先看一眼这个功能所支持的视频格式和文件大小上限,避免后面操作失败。

操作 2:上传视频、等待转换、在结果页保存文件

点击上传按钮,从手机相册中选择你想要转换的视频,然后耐心等待转换队列处理。当进度条走完,你会进入一个结果页面,可以先试听一下转换效果,确认没问题后,就点击保存按钮,把 MP3 文件保存到手机本地。之后,你可以再把它转发给朋友,或者传输到电脑上。我个人习惯在保存之后,立刻再另外保存一份,以防手机清理缓存文件时不小心把它删掉了。

喵喵工具助手这类小程序,最大的优点就是方便、随时能用,对于应急情况来说速度足够快。但是,如果碰到要批量处理大量长视频的情况,它就不太划算了——因为既要联网,又按次消耗积分,无论是成本还是处理速度,都远远比不上电脑上的 ffmpeg 工具。所以,我把喵喵工具助手的定位,牢牢固定在“人在外面、身边只有手机”这个特定的场景里。

失败情况排查(电脑端最常见的问题)

导出的 MP3 文件只有几 KB 大小,或者播放时全程没有声音: 这种情况,多半是因为原始视频文件本身就没有音频轨道,或者音频采用了一种特殊的编码格式。你可以先用 ffmpeg -i input.mp4 这条命令查看一下视频中是否包含 Audio 流。如果没有,那就需要换一个带声音的源文件,因为转码操作是没法凭空创造出声音来的。

在剪映里找不到“导出音频”这个选项: 不同版本的剪映,可能会将这个功能入口放在“导出”的子菜单里,或者一个叫“更多格式”的选项中。你可以尝试把软件升级到最新版本,再仔细找找。如果还是找不到,那就退而求其次,使用 ffmpeg 或者喵喵工具助手来解决问题,别在界面设置上钻牛角尖。

生成的文件体积大得离谱: 这通常是因为你设置的码率太高了,或者一不小心设置成了无损的 WAV 格式。对于语音听写、听课笔记这类用途,128kbps 到 192kbps 的码率已经足够了,不要盲目地把码率拉到最高。

ffmpeg 提示“command not found”错误: 这表示 ffmpeg 没有正确安装,或者它的可执行文件路径没有被添加到系统的环境变量 PATH 中。在 macOS 上,可以尝试重新执行 brew install ffmpeg 命令;在 Windows 上,请检查一下 bin 文件夹的路径是否真的被添加到了环境变量中,并且确保修改环境变量后,你重新打开了命令提示符或 PowerShell 窗口。

播放转换后的音频,发现变调了,或者语速变快/变慢: 这通常是音频的采样率不匹配导致的。最好不要手动指定采样率,让 ffmpeg 自动跟随源文件的设置。如果确实需要重新采样,那就要写清楚 -ar 48000 之类的参数,确保转换后的采样率和源文件保持一致。

使用喵喵工具助手时,上传过程卡住不动: 可以先检查一下文件大小是否超过了小程序支持的上限,以及视频格式是否在它所支持的范围之内。同时,也要检查一下网络环境,如果网络信号不好,可以切换到 Wi-Fi 网络,或者先把视频压缩一下再上传。不要反复点击“重新上传”按钮。

总结:我的固定操作流程

让我回到最初那一百多个录屏文件上:如果我能坐到电脑前,我会全部使用 ffmpeg 的那行循环命令,一次性把几十个视频跑完,然后直接把生成的 MP3 文件交给语音转文字工具,非常省心;偶尔遇到单独一个视频,同时需要顺手裁剪一下开头,我就会打开剪映,按照那八步操作导出音频;如果人不在电脑前,身边只有手机,又急着要某一段视频里的声音,我就会用喵喵工具助手来上传视频,转换完成后保存到手机本地。这三种方法之间,并不是谁要取代谁的关系,而是根据“文件数量多少、是否需要剪辑画面、人是否在电脑前”这三个条件来各自发挥作用:ffmpeg 负责批量处理、剪映负责精细修剪、喵喵工具助手负责手机端的应急处理。只要你明确自己需要的是整轨的 MP3 文件,按照上面的步骤选择一种方法去操作就可以了;如果你的最终目标其实是进行人声分离,那需要换用专门的分离工具,在这些转码的步骤里,无论怎么调整参数都是得不到你想要的结果的。

💡 更多精彩内容

微信搜索"小青去水印",一键免费去水印

🎬 去水印 返回首页