
Buzz 离线语音转文字完整指南从一段会议录音到批量自动化【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款在个人电脑上离线转录和翻译音频的工具核心由 OpenAI Whisper 驱动。你的录音不需要上传到任何云端转出的文字直接落在本地。这份指南以整理一段会议录音为主线带你从导入、首次转录、字幕导出一直走到实时录音与批量自动化每一步都对应一个具体动作。导入音频并完成第一次转录从工具栏起步打开 Buzz你会看到一条任务列表。第一次转录按这个顺序点击File菜单的Import Media File或工具栏的图标也可以用快捷键CtrlOmacOS 用CmdO。选中一个音频或视频文件任务默认是Transcribe。明确指定Language别依赖自动检测选错语言会拉低准确率。选一个模型点击Run。状态变成Completed后双击这一行就打开了转录结果。减少错拼的提示词专业名词、人名容易转错。点任务里的Advanced...在Initial prompt里写几个常被拼错的词模型会照着写。这是官方文档明确推荐的做法。逐字时间戳开关导入选项里还有Word-Level Timings和Extract speech两个开关。前者给每个词单独打时间戳方便之后合并成字幕后者先把人声分离出来再转录嘈杂环境更准。选对后端与模型让本机跑得动转录全靠算力选错后端会明显变慢。Buzz 内置多种 Whisper 后端差别不小。后端特点适合你WhisperOpenAI 原版准但慢、吃内存追求最高精度Faster Whisper优化版比原版快数倍、省内存有 6GB 以上显存的 Nvidia 卡Whisper.cppC 实现能吃各种 GPU纯 CPU 也能跑无独显的机器、Mac 首选HuggingFaceTransformers 实现支持上千种语言的 MMS 等自定义模型想试语言专用模型GPU 加速怎么选Nvidia 卡走CUDAMac 走Apple Silicon没有独显就用Whisper.cpp的Vulkan甚至纯 CPU。想用 Faster Whisper显存至少 6GB。线程数能换来多少速度Whisper.cpp 默认用一半 CPU 核心。在 16 线程的笔记本上把线程数设成 8官方实测转录能快约 15%再往上加线程反而更慢。实时录音与演示窗口不只是处理文件Buzz 也能对着麦克风边说边出字。开启实时转录选好录音任务、语言和麦克风点Record。默认 Whisper 模型比较吃资源实时场景建议用Whisper.cpp并选小一点的模型。三种拼接模式Append below / Append above新句子依次往下或往上排。Append and correct会回改上一句末尾的错误最准但最费机器。演示窗口开始录音后会出现Presentation window选项适合开会、演讲时把实时字幕投到大屏。编辑字幕、缩放与说话人识别转录只是第一步Buzz 的查看器能接着编辑。搜索与播放双击转录打开查看器CtrlF出搜索框CtrlP播放/暂停播放速度可在0.5x 到 2.0x之间调。勾选Follow Audio文字会自动跟到当前播放位置。缩放字幕点Resize把逐字时间戳合并成一句句字幕。可以设最大长度、按标点断句原始音频还在的话它会分析静音来对齐还能给每条字幕统一延长停留时间。区分说话人点Identify speakersBuzz 会给每句话打标可以试听某位说话人 10 秒、把自动标签改成真实姓名还能把同一人的连续句子合并成一段。注意Intel Mac不支持该功能。批量、命令行与插件监听文件夹在偏好里指定一个文件夹Buzz 会自动转录新放进来的文件适合持续归档录音。命令行批量处理Buzz 提供完整的 CLI适合写脚本buzz add --task transcribe --model-type whispercpp --model-size small --srt --vtt /path/to/audio.mp4内置插件打开Help → Plugins管理1.4.5 起提供AI Summary接 OpenAI 兼容接口把长转录压成摘要。DeepFilterNet转录前先降噪。Export to DOCX一键导出 Word可带时间戳。Skip Already Transcribed重复导入时自动跳过已有结果。离线部署与常见坑真的能断网用吗能。先在联网机器上把模型下好再把模型文件夹拷到离线机器。Linux 默认在~/.cache/BuzzMac 在~/Library/Caches/BuzzWindows 在%USERPROFILE%\AppData\Local\Buzz\Buzz\Cache。也可以看scripts/download-models.py提前准备模型缓存。转得太慢先查什么换更小的模型或改用Whisper.cpp有 6GB 显存就上Faster Whisper。别踩的硬件红线Buzz 要求 CPU 支持AVX2太老的电脑带不动。Windows 安装包未签名安装时选More info → Run anyway即可。模型下坏会导致崩溃删掉重下一般就好。你现在就可以从一段会议录音开始导入、选 Whisper.cpp、导出 SRT。想批量跑就开监听文件夹加一条命令行离线归档、实时字幕、说话人识别都能一站搞定。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考