Buzz 离线语音转文字实战指南:免费本地转录的完整操作路径
Buzz 离线语音转文字实战指南免费本地转录的完整操作路径【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款基于 OpenAI Whisper 的免费开源离线语音转文字工具音频全程不出你的电脑Buzz 转录能识别 99 种以上语言。本文按安装 → 第一次转录 → 录音 → 字幕 → 批量 → 提速的完整路径带你走通适合会议记录人和视频制作者。为什么选本地处理而不是云端转录云端服务方便但代价是录音要上传到别人的服务器且按量计费whisper 这类纯命令行工具虽然本地免费但门槛高、没法边播边改。Buzz 正好落在中间音频识别全在本地完成离线也能跑同时给了图形界面导入文件、点按钮就能出结果。方案音频数据去向是否需要联网费用边录边出字Buzz完全留在本机离线可用免费开源可以云端转写服务上传到服务商必须联网按量收费可以纯命令行工具本机离线免费不行按你的系统选一条 Buzz 安装路径先判断你属于哪类用户再走对应分支Windows去 SourceForge 下载官方安装包运行即可。⚠️ 安装包没有数字签名系统弹出警告时点更多信息再选仍要运行。macOS下载 .dmg 文件把图标拖进应用程序文件夹就装好了。Linux走系统包渠道最省事Flatpak 和 Snap 任选其一flatpak install flathub io.github.chidiwilliams.Buzzsudo snap install buzz想用最新版源码建议 Python 3.12 并先装好 ffmpeg两种方式二选一pip install buzz-captions python -m buzz或直接克隆源码体验最新功能git clone https://gitcode.com/GitHub_Trending/buz/buzz第一次转录四步拿到文字用文件菜单或工具栏上的号把音频拖进来。任务类型选转录。手动指定语言——这一步比让程序自动检测更准值得花两秒选一下。选好模型后点运行等状态变成已完成双击这一行打开查看器可以边播放边核对最后导出为 TXT、SRT 或 VTT。会议实时录音边说话边出文字把任务类型切到录音指定麦克风后点录音Buzz 会一边录一边吐字。显示方式有三种可选新句子追加在下方、追加在上方或者追加并校正——最后这种会持续回头修正上一句的识别错误效果最接近人工记录。两个实用的延伸玩法识别结果能实时写入 TXT 文件OBS 等直播软件可以直接读它做字幕层打开演示窗口后文字可以投到大屏上给现场观众看。多人访谈的场景里还能在结果中区分并标注不同说话人。视频转标准字幕的三步走导入 MP4、MKV 这类视频文件后Buzz 会自动提取音轨不用你手动转格式。做字幕时建议走这条路在高级设置里打开词级时间戳每个词都会带独立的时间点。用调整大小功能Buzz 按静音间隔和标点把零散的词组合成长度合适的字幕行。导出 SRT 或 VTT直接挂进播放器或剪辑软件。批量转录让 Buzz 替你盯着文件夹在偏好设置里指定一个监视文件夹之后凡是丢进去的新音频Buzz 会自动建转录任务适合把会议录音固定归档到某个目录的工作流。再启用跳过已转录文件插件同一批文件重复导入时会自动复用已有结果不再白白跑一遍模型。更喜欢命令行的话批量操作一条命令就能下发buzz add --task transcribe --model-size small \ --srt --vtt /path/to/audio.mp3本地转录提速设置四个影响速度和准确率的开关1. 换计算后端让 GPU 干活后端切到 Whisper.cpp 后Nvidia 显卡自动走 CUDAAMD 和 Intel 显卡走 Vulkan。显存不够时可以选量化版模型比如 q_5——量化就是用更小的模型文件牺牲一点点精度来省显存也可以在偏好设置里开降低 GPU 内存占用走 8 位量化。2. 模型大小跟着场景走日常出草稿用 base 或 small 压住耗时终稿校对再上 medium 或 large 换准确率实时录音建议用较小模型否则跟不上说话的速度。3. 语言和初始提示是免费的准确率自动检测只参考开头几秒音频语言已知时手动指定能明显减少误识别。另外在高级设置的初始提示里填人名、产品名这类易错词能纠正专有名词的拼写。4. 噪声大的录音先处理再转对嘈杂录音开启语音提取或者用 DeepFilterNet 插件先降噪再转录识别质量差别很大。卡住时的三个环境变量识别太慢换更小的模型或设置BUZZ_WHISPERCPP_N_THREADS调整 CPU 线程数。模型下载慢设置HF_ENDPOINT指向 hf-mirror.com 镜像。旧显卡上 GPU 反而比 CPU 慢设置BUZZ_FORCE_CPUtrue强制用 CPU。更多参数细节可以看官方文档转录核心逻辑都在 buzz/transcriber/ 里降噪、AI 摘要、导出 DOCX 这些扩展能力则是 buzz/plugins/ 下的插件按需启用即可。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考