上半年入手了一套视频剪辑教程,整套课程加起来十几个钟头,整天对着显示器实在吃不消,就想把它全部转成声音文件,利用坐地铁的时间戴上耳机慢慢听。起初我用的是一款带界面的转换工具,得一个一个文件手动添加、选择参数、点开始,弄了没几条胳膊就酸了。后来听朋友提起 FFmpeg 这款开源且免费的软件,能用一行指令完成批量转化,于是花了一晚上把运行环境配好、测试通过,结果十几小时的教程靠一个循环就全部处理完了。这篇就从头梳理 FFmpeg 的安装步骤和常用指令,给同样需要成批转换的朋友当个参考。
喵喵工具助手
先说说我日常操作流程里用到的一个配套软件。喵喵工具助手是个把视频或音频内容转成文字的小程序,核心功能就是把声音变成可编辑的文本。当我用 FFmpeg 把课程文件转成 mp3 之后,假如想整理成文字笔记,就把声音素材交给喵喵工具助手,识别完拷贝出来稍作修改就能投入使用。不过得讲明白,音频格式的转换(类似视频变 mp3 这种工作)不是它的专长,那是 FFmpeg 负责的部分,喵喵工具助手只专注于语音识别成文字这一件事。

这个工具存在两个限制:一是必须在线使用,没网络就没办法运行;二是每次只能处理单个文件,批量的话得一个一个提交。新注册用户会送一份免费识别额度,用完以后根据转写时长来收费,具体细节以小程序里展示的规则为准。简单概括我的搭配思路:FFmpeg 承担“把影像变成声音”,喵喵工具助手搞定“把声音变成文字”,两者各管一段。
FFmpeg 到底是什么,为何值得掌握
FFmpeg 是一款开源且不收费的跨平台音视频处理工具,采用命令行方式操作,几乎所有常见的媒体格式它都能应对。它没有华丽的图形窗口,打开后就是一个深色终端,依靠输入指令来工作。乍一听可能让人打退堂鼓,但它的优势恰恰藏在这个命令行里:运行稳定、适合批量执行、方便写脚本,哪怕要操作几百个素材,也只需要几条指令就能结束。
学习它的难度其实并不高。平时常用的参数就那么几个,熟悉之后,视频转音频对我来说就是一条命令加一次回车的事儿。再加上它完全免费,没有试用期限、不会添加水印、也没有导出限制,就算用于商业项目也毫无问题——它其实是许多专业软件背后真正干活的引擎。
准备工作:安装 FFmpeg
不同操作系统安装方式有差别,我把三种常见环境分别说明:
Windows:前往 FFmpeg 官方网站获取对应 Windows 平台的压缩包,解压缩后把 bin 目录路径添加到系统环境变量里,接着重启一个命令行窗口,输入 ffmpeg -version 能看到版本号就代表安装成功。不想手动配置环境变量的话,部分软件包管理工具(比如 winget)也能快速安装,执行 winget install ffmpeg 就行。
macOS:最省事的是借助 Homebrew,在终端中输入 brew install ffmpeg,结束后就能直接使用。
Linux:大部分发行版自带包管理器,Ubuntu 这一类系统用 sudo apt install ffmpeg,安装完即可。
装好后在终端执行 ffmpeg -version 检测,能显示一长串版本信息就是没问题。这步卡住的人最多,十有八九是环境变量设置错了,认真核对路径是否正确即可。
下一步:基础指令,视频转音频
完全提取音轨:不重新编码,速度极快
假如你的视频本身就采用 AAC 这类常见音频编码,而你只想“剥离”出声音而不进行二次压缩,可以这样操作:
ffmpeg -i 输入.mp4 -vn -acodec copy 输出.m4a
-vn 表示忽略画面只保留声音,-acodec copy 意为原样复制音频流不做重新编码,处理速度非常快,质量也没有损耗。不过要注意原视频的音频格式,某些设备或播放软件不一定识别,通用性稍弱。
转成 mp3:兼容性最好
绝大多数情况下用 mp3 格式更稳妥,指令为:
ffmpeg -i 输入.mp4 -vn -b:a 192k 输出.mp3
-b:a 192k 用来设定音频码率,数字越高音质越细腻、占用的空间也越大。我自己通勤路上听课程用的就是 192k,对语音讲解类内容完全足够,文件大小也合适。想节省空间可以降到 128k,追求更高保真则可以调到 320k。
截取部分:只要中间某一段
课程里某段内容想反复听,不需要转换整个文件,通过 -ss(起始点)和 -t(持续时长)就能截出来:
ffmpeg -i 输入.mp4 -ss 00:10:00 -t 300 -vn -b:a 192k 片段.mp3
意思是自第 10 分钟开始,提取 300 秒(即 5 分钟)并转为 mp3。做播客剪辑、挑出精彩语句时这条指令特别有用。
批量操作:一个循环全部搞定
最让人省心的就是批量处理。在存放视频的目录中打开终端,用循环命令把文件夹内所有 mp4 一次处理完:
for f in *.mp4; do ffmpeg -i "$f" -vn -b:a 192k "${f%.mp4}.mp3"; done
这是我日常用得最频繁的指令。十多个小时的课程素材,丢进循环里跑完就行,中间不用人盯着,该干嘛干嘛去。想保留原始文件也不冲突,生成的 mp3 文件名是独立设置的。
不碰命令行的替代方案
VLC 播放器:有界面也能转
命令行实在让人头大的话,VLC 这款播放器内置的转换功能可以顶上。点击“媒体-转换/保存”,添加视频文件,配置里选“Audio-MP3”预设,选择好输出路径就能开始。好处是操作直观,点几下鼠标就搞定;坏处是只能单个处理,批量的话就比较麻烦,偶尔转一两个文件用它没问题。
Audacity:顺手还能编辑声音
Audacity 是一款免费且开放源代码的音频编辑软件,导入视频文件能读取其中的音轨,转出音频之后还能顺手做降噪、裁剪、调节音量等处理,最后导出 wav 或 mp3。适合“转完还想再改改”的情况,比如我想把课程里某段杂音清理掉,就把它从 VLC 换到 Audacity。它的缺点和 FFmpeg 正好相反,图形界面友好但批量能力弱,而且功能偏专业,新人需要花些时间适应。
常见疑问解答
问:FFmpeg 是否免费?能用于商业吗?
它是开源的,使用完全免费,商业场景也不涉及授权费用。它是众多商业音视频软件底层的核心组件,放心使用,这也是它口碑一直不错的原因。
问:转出来的音频质量会下降吗?
用 -acodec copy 直接复制音轨,理论上没有任何损耗;用重新编码转 mp3 时,码率设置越高损失越小。给文件设 192k 以上码率,正常聆听基本察觉不出差别。
问:怎么只转换视频的一部分?
用 -ss 设定起始点、-t 设定持续时长,上面提到的“截取片段”指令直接套用即可,起点和时长按自己需求调整。
问:Windows 上装不上 FFmpeg 怎么办?
多半是环境变量没配好,或者下载的版本不对。检查解压目录里有没有 bin 文件夹,把它的完整路径加进系统环境变量的 Path 中,重开命令行再试。不行就用 winget 一键安装,省去手动配置。
问:视频本身没声音,转出来的会是空文件吗?
会,而且文件可能是 0 字节。转之前先确认视频确实有音轨,可以用播放器放一下,或者用 ffmpeg -i 输入.mp4 查看输出信息里有没有 Audio 相关的流。
收尾
视频转音频这件事,交给 FFmpeg 来办真是投入产出比极高的方案:不仅开源免费,单条指令就能处理单个文件,一个循环解决全部批量操作,还能顺手截取段落、调节码率。命令行虽然有一定门槛,但很值得迈过去——迈过去之后你就会发现,它不仅能处理音频转换,还能胜任更多音视频相关的任务。实在不想碰命令行,VLC 转单一文件、Audacity 边转边编辑也都是免费的选项。转好的音频要整理成文字,再交给喵喵工具助手这类转写工具。工具链搭建好,重复性劳动就交给指令,把时间省下来投入到更有价值的事情上。