ARTICLE DETAIL

建站实战干货

来自一线的建站与推广经验沉淀,每一条都经过真实交付验证。

Buzz 音频转录实战教程:5 步跑通离线语音转文字

2026/9/7 8:04:28 拓冰建站 浏览量
Buzz 音频转录实战教程:5 步跑通离线语音转文字 Buzz 音频转录实战教程5 步跑通离线语音转文字【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款基于 OpenAI Whisper 的本地音频转录工具录音、会议、长视频都能在不联网的情况下转成带时间戳的文本。这篇教程面向第一次想把录音变文字的新手带你看装、跑通、调参以及卡住时怎么自救。它到底能替你做什么做字幕的人手里有一段一小时的访谈视频要 SRT 字幕。把文件导入 Buzz它按句切段、生成时间轴导出即可用。播客制作者长录音转出来不只是文字。打开说话人识别能看出每句话是谁说的也可以挂上插件自动生成摘要。会议记录员实时录音功能在对方说话时就把文字滚出来还能打开演示窗口当场投到大屏幕上。所有计算都在你自己的电脑里完成音频不上传任何服务器。只要模型提前下好断网环境也完全能用。从零跑通第一个转录任务安装。需要 Python 3.12 和系统里的 ffmpegpip install buzz-captions python -m buzzWindows 和 macOS 也可以直接装官方预编译安装包不用碰命令行细节见 安装指南。添加文件。点主界面顶部的 号或按 CtrlO选一个音频或视频文件。选模型和语言。新任务行默认是 Whisper Tiny中文材料建议改成 Medium语言选中文点 Run。等完成。状态列从 In Progress 变成 Completed音频越长等得越久。查看和导出。双击那一行打开带时间戳的转录窗口点顶部 Export 选 TXT、SRT 或 VTT。想批量处理或写进脚本用命令行加任务也一样buzz add -m whispercpp -s medium -l zh meeting.mp4 --srt把效果调到最舒服模型是速度和质量之间影响最大的一个参数按目标来选目标怎么配预期效果快速批量初稿Whisper.cpp Tiny/Base快核显笔记本也跑得动日常平衡Whisper.cpp Medium中文准确度好等待时间可接受求准NVIDIA 显卡Faster Whisper Medium/Large显存要 6GB 以上明显快于纯 CPU正式文稿Whisper Large-V3精度最高但最慢偶尔会编词还有几个容易忽略的点语言值得手动指定。自动检测偶尔会判错中英混杂的会议不如分段转录。专有名词会拼错。点 Advanced 按钮把人名、术语填进 Initial prompt错拼会明显减少。词级时间戳。建任务时勾上 Word-Level Timings每条字幕行只含一个词后期改起来更细。硬件方面NVIDIA 显卡默认启用 CUDA 加速Mac 上选 Whisper.cpp 即可。名字带 .En 的模型只认英语别用来转中文。批量处理。在 Preferences → Folder Watch 设一个监控文件夹新文件丢进去自动转录。卡住了按这个顺序自救转录太慢电脑跑不动现象10 分钟音频转了半小时还没完。原因模型太大或者后端没用上 GPU。解法把模型降到 Base 或 Tiny换 Whisper.cpp 后端任意品牌的 GPU 甚至核显都能跑NVIDIA 显卡且显存 6GB 以上就换 Faster Whisper。另外确认 CPU 支持 AVX2过老的机器带不动。下完模型后应用崩溃、转录中断现象启动任务时 Buzz 闪退或卡死。原因模型文件没下完整或损坏了。解法在 Preferences → Models 里删掉这个模型重新下载。模型存放位置Linux 是~/.cache/BuzzMac 是~/Library/Caches/Buzz。还不行就走 Help → About Buzz → Show logs把日志带上看 FAQ 里的说明。录音时一点声音都录不到现象录音界面无波形或报 PaErrorCode-9999。原因系统隐私设置挡掉了应用对麦克风的访问。解法Windows 去设置 → 隐私 → 麦克风里允许 Buzz再把杀毒软件临时关掉试试。想录系统声音则要先装虚拟音频设备Mac 用 BlackHoleWindows 用 VB-Cable再选它做输入源。继续深入的路文件导入用法导出格式、初始提示等每个选项的详细解释模型下载脚本提前把整套模型下好供完全离线的机器用转录器源码目录Whisper.cpp、Faster Whisper 等后端实现现在就可以去 Preferences → Models 里下好一个模型把手头最长的那段录音转一遍。第一份 SRT 出来后上面这些调参你就有上下文了。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考