
Buzz离线转录教程不联网也能把音频变文字【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款用于离线转录的桌面应用基于 OpenAI 的 Whisper 模型所有转录过程都在你自己的电脑上完成音频不会上传到任何服务器。它适合手上有会议录音、访谈素材或需要给视频加字幕、又不希望数据离开设备的用户。最直接的卖点是全程不需要联网就能完成转写和字幕导出结果自带每一句的时间戳。一、它替你省掉的是什么如果你经常要把会议录音或采访音频整理成文字稿原来的做法大概是这样的播放录音听一句、敲一句暂停再听下一句一小时的录音可能要敲两三个小时而且手写的稿子没有时间标记之后很难再对应回原文。用 Buzz 之后把音频文件拖进任务列表选一个模型点 Run几分钟后就得到一份带时间戳的文字初稿你只需要对照着把错漏的几处改过来。给视频做字幕也是类似的过程。老办法是打开字幕软件一边回放视频一边逐行补字、手填起止时间。现在在 Buzz 里选中一个 MP4 或 MKV 文件勾选“Word-Level Timings”任务完成后在结果页点导出选 SRT就会得到一份带时间码的字幕文件可以直接拖进剪辑软件。还有一种更即时的用法实时转录。讲座或会议上你过去只能边听边记速记散场后再补录一遍。在 Buzz 里选中麦克风点 Record语音会边听边变成文字打开演示窗口还可以把实时文稿投到屏幕上给现场的人看。二、功能速览功能适合谁怎么用文件转录有音视频文件要整理的人把文件拖进列表选模型和语言点 Run实时录音会议、讲座、采访场景选中麦克风点 Record文字实时出现字幕导出做视频字幕的人在结果页点导出选 SRT 或 VTT翻译成英文有外语素材的人新建任务时把 Task 选为 Translate to English文件夹监视录音量大、要批量处理的人在偏好里设监视文件夹新文件自动转录三、三步上手拿到软件Windows 从发布页下载安装包运行如果看到未签名应用的提示选“更多信息”再点“仍要运行”。macOS 下载 .dmg 后拖进应用程序文件夹。Linux 有两个包格式可选flatpak install flathub io.github.chidiwilliams.Buzzsudo snap install buzz如果习惯自己搭环境也可以用 pip 从 PyPI 安装 buzz-captions再用python -m buzz启动需要 Python 3.12。跑通第一次打开主界面点工具栏的 图标或按 Ctrl/Cmd O选择一个音频或视频文件在弹出的设置里选任务转写或翻译成英文、语言、模型。首次选择模型会下载模型文件这一步需要联网一次。下载完成后点 Run列表里该任务的状态会在处理结束后变为完成。导出结果状态显示完成后双击该行打开结果页。点上方的导出按钮可以把全文存成 TXT、SRT、VTT 等格式文件名会按偏好里设置的导出模板生成。四、界面带你看偏好设置页偏好设置页负责定义默认行为按 Ctrl/Cmd , 打开。你可以在这里做三件事设置默认导出文件名模板、选择实时转录的模式追加在下方、追加在上方、追加并纠错、以及配置之后要用到的翻译接口地址和密钥。模型管理偏好里的 Models 标签页用来下载和删除模型。先在列表里查看已有哪些模型选一个版本点下载再点“Show file location”可以打开模型目录。想把 Buzz 用到一台完全离线的电脑上时把这个目录复制到那台机器的相同位置即可。结果页结果页用来核对和修改文稿。双击任务进入后可以直接在表格里改任意一段的文字点某个时间戳能让音频跳到对应位置按 CtrlF 还能在全文里搜索关键词。底部播放区支持 0.5 倍到 2 倍变速方便逐句核对细节觉得某条字幕太长或太短时点 Resize 按钮可以按最长长度重新合并分句。五、进阶技巧手动指定语言知道音频语言时直接选它而不是用自动检测识别准确率通常会更高。按场景选模型tiny、base 快适合粗听和低配机器medium 更准large 准确率最高但耗时留给重要素材。有 6GB 以上显存的 Nvidia 显卡可以选 Faster Whisper 引擎否则 Whisper.cpp 最稳集显笔记本也能跑实时转录。加初始提示在任务高级设置里填入容易写错的专有名词或术语能减少人名、术语被听错的情况。挂上文件夹监视偏好里设好监视文件夹后新丢进去的文件会自动转录再配合“跳过已转录”插件可以避免重复处理。启用插件Help → Plugins 里打开 AI 摘要、DOCX 导出等插件转录完成后可自动出摘要或存成 Word 文档。录系统声音要转录电脑里播放的视频或音频先装一个虚拟音频设备macOS 用 BlackHoleWindows 用 VB-CABLE再把它选为 Buzz 的麦克风输入。六、给开发者的路标buzz/transcriber/各转录引擎的实现代码覆盖 Whisper、Whisper.cpp、Faster Whisper 与 OpenAI API。buzz/widgets/主窗口、偏好对话框、转录查看器等界面代码。buzz/db/基于 SQLite 的任务与结果存储含表结构和迁移逻辑。buzz/plugins/插件基类与内置插件写自定义插件可以从这里参考。docs/官方文档源码包含安装、使用与常见问题。七、常见问题问Buzz 不联网能用吗 答可以。模型只需在有网时下载一次之后全程离线转录。若目标是完全离线的电脑在偏好 Models 页点“Show file location”把模型缓存目录复制到那台机器相同位置即可。问我该选哪个模型 答日常先用 base准确率不够再上 medium 或 large。嫌慢就降一档或换 Whisper.cpp 引擎。没有放之四海的答案拿自己的一段素材实测最可靠。问支持哪些格式 答MP3、WAV、FLAC、M4A、OGG 等常见音频以及 MP4、MKV、AVI、MOV 等视频都可以导入视频会自动提取音轨也支持粘贴 YouTube 链接直接转录。问转录结果怎么导出成字幕 答双击任务进入结果页点导出选 SRT 或 VTT。想调整单条字幕长度的话转录前勾选 Word-Level Timings完成后再用 Resize 对话框按最长长度重新合并。问转录太慢怎么办 答换小一号的模型或把引擎换成 Whisper.cpp、Faster Whisper。也可以参考 docs/docs/preferences.md 里的环境变量说明调整线程数或强制指定 CPU/GPU。Buzz 的价值在于把转录留在你自己的电脑上配合字幕导出和文件夹监视一套离线工作流就能搭起来。下一步打开应用把你的第一个音频文件丢进去看看结果如何。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考