ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Buzz 完整指南:免费离线语音转文字,音频不出本地的 Whisper 转录工具

Buzz 完整指南:免费离线语音转文字,音频不出本地的 Whisper 转录工具 Buzz 完整指南免费离线语音转文字音频不出本地的 Whisper 转录工具【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz30 秒速览Buzz 是一款免费开源MIT 协议的离线语音转文字桌面工具它在你的电脑上本地运行 OpenAI Whisper 模型支持转录与翻译两种任务音频文件全程不出设备适合会议录音、采访素材等隐私敏感场景。关键信息运行平台Windows、macOS、LinuxFlatpak / Snap 均可安装语言支持99 种以上含中文、英文、日文等模型档位tiny 到 large 多档可选应用内一键下载导出格式TXT、SRT、VTT、JSON 等费用完全免费转录过程无需联网适合谁 / 什么时候不必装适合你如果经常处理会议录音、采访、访谈等敏感音频不希望上传云端工作环境是内网或无网环境需要离线语音识别需要批量给视频、播客生成离线字幕不必装如果只是偶尔转一段公开音频不在意隐私云端转录服务就够用设备配置很低且无 GPU无法接受 CPU 跑大模型的速度安装与首次转录Buzz 本地 Whisper 转录最短路径各平台最短安装命令# macOS brew install --cask buzz # Linux二选一 flatpak install flathub io.github.chidiwilliams.Buzz sudo snap install buzz # Python 3.12 pip install buzz-captions python -m buzzWindows 用户从发布页下载安装包双击运行即可应用未签名首次启动时确认“更多信息”→“仍要运行”。第一次转录的完整流程把音频或视频文件拖进主界面支持 MP3、WAV、FLAC、M4A、OGG、MP4、MKV 等格式在任务行选择 Whisper 模型与语言首次使用需先下载模型可在偏好设置的模型页提前下载点击运行进度和预计剩余时间实时显示完成后双击任务打开查看器核对并编辑文本从导出菜单选择格式保存按任务讲能力转一份会议录音并区分说话人在任务选项中开启说话人识别Buzz 会自动区分不同发言人并打标签。完成后在查看器里逐段核对文本与标签把时间轴和分段边界调到合理再导出文本版作为纪要底稿。技巧多人对话建议用 medium 档模型说话人切分更稳定。给视频 / 播客批量生成字幕文件夹监视在偏好设置中开启文件夹监视指定监视目录与输出目录之后把音频文件丢进该文件夹即可Buzz 自动排队逐个转录。字幕可用内置的 resize 功能限制每行字数控制单条字幕长度最后导出 SRT 或 VTT。技巧给输出文件设置独立的命名模板方便批量归档和复用。边录音边出稿实时转录的两种模式Buzz 的实时录音转录支持两种工作模式实时模式边录音边持续追加文本适合会议记录、采访现场追加校正模式录音结束后对整段音频重新转录并修正准确性更高可以绑定全局快捷键控制开始/停止录音。技巧实时模式先用小模型保证跟得上语速重要内容录完后切到追加校正模式重跑一遍。Whisper 模型怎么选 怎么提速模型档位选择tiny速度最快低配置设备跑草稿用base日常默认速度与准确率的平衡点small / medium长录音精度与速度折中中文内容常用档large识别准确率最高重要素材使用对硬件要求更高提速要点有 NVIDIA 显卡就启用 CUDA 加速AMD / Intel 显卡可走 Vulkan音频长、内容不关键时降一档模型收益大于其他所有调优转录时关闭其他占用 CPU / GPU 的程序提高准确率手动指定语言不要依赖自动检测专业术语、人名先写进“初始提示”录音环境越安静识别结果越干净高频问题速查问转录速度太慢怎么办答换更小模型并开启 GPU 加速这两项收益最大。问专业术语识别不准答在“初始提示”里填入相关词汇并手动确认语言正确。问能批量处理多个文件吗答可以一次拖入多个文件或开启文件夹监视全自动处理。问支持视频文件吗答支持 MP4、MKV、AVI、MOV 等会自动提取音轨。问中文必须用 large 模型吗答不一定medium 通常够用准确率不够时再升级。离线 vs 云端怎么选音频涉及商业、医疗、法律等敏感内容、不允许上传时选 Buzz 这类本地 Whisper 转录。环境无网、或需要批量处理长文件省 API 费用时离线方案同样合适。只有当你偶尔转写少量公开内容、不想等本地计算时云端服务更划算按量付费即可。一句话音频内容不能出设备就用离线只求快和省事就用云端。开发者入口文件转录核心逻辑在 file_transcriber.py实时录音转录在 recording_transcriber.py插件系统位于 plugins/说话人识别、DOCX 导出等能力都以插件形式扩展使用文档见 docs/结尾Buzz 的定位可以概括为免费、离线、可批量处理本地音频。如果你的场景命中敏感音频、无网环境、批量字幕三项中的任意一项就值得装上试一次。行动清单克隆源码了解实现git clone https://gitcode.com/GitHub_Trending/buz/buzz按平台选择一种方式安装拖入第一段录音完成第一次本地转录【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表