
Buzz 上手指南本地离线语音转文字从安装到批量转录【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz周五下午桌面上躺着一段 40 分钟的会议录音你需要一份带时间戳的文字稿但这份音频不能离开本机。打开 Buzz导入文件、选个模型、点运行几分钟后 SRT 字幕文件就出现在音频旁边。Buzz是一款桌面应用把 OpenAI Whisper 模型装在你自己的电脑上做语音转文字和翻译音频文件、视频文件、麦克风实时录音都在本地处理结果可导出为 TXT、SRT、VTT 三种格式。它的核心场景是音频不出机器——没有稳定的网络、不想把敏感内容交给在线服务或者只是觉得批量处理文件上传太麻烦都适合用它。支持从 PyPI 安装的命令行方式也提供 macOS、Windows、Linux 三种平台的安装包模型侧覆盖 Whisper 多个后端和 tiny 到 large 五档尺寸。装好 Buzz按系统选一条路 每个平台都给你最短路径选一个即可装完都能跑起同一个界面。macOS下载 dmg拖进应用程序从发行渠道SourceForge 的 buzz-captions 项目下载.dmg文件打开后把图标拖到应用程序文件夹。Buzz 对 Apple Silicon 原生支持M 系列芯片上可直接使用 GPU 加速。Windows运行安装包绕过签名提示从同一渠道下载安装程序并运行。应用未做数字签名安装时系统会弹出警告点更多信息再选仍要运行即可继续。Linux一行命令装 Flatpakflatpak install flathub io.github.chidiwilliams.Buzz # 或者改用 Snapsudo snap install buzz从 PyPI 安装适合想直接用命令行的人确认系统是 Python 3.12 并已装好 ffmpeg然后pip install buzz-captions python -m buzzPyPI 版本在 Linux/Windows 上默认带 CUDA 构建的 torchNvidia 显卡开箱可用Intel Mac 的依赖版本在 pyproject.toml 里单独锁定照装即可。第一次转录把 MP3 变成文字稿首次运行后主界面是一张任务列表顶部工具栏放着全部常用入口。导入文件有三种方式File 菜单的 Import Media File、工具栏的图标、快捷键Command/Ctrl O支持直接把文件拖进窗口。导入文件后Buzz 会在任务行里让你确认三项设置任务Transcribe转成说话语言的文字或 Translate to English译成英文语言可以留空让它自动检测但官方文档明确建议已知语言就手动指定检测可能给出意外结果模型类型加尺寸第一次选小模型跑通流程最稳妥。点 Run进度条走到 Completed 后双击该行或选中后点⤢图标打开转录查看器。每个片段都有独立的时间戳点时间戳会跳转到音频对应位置顶部的搜索框和播放控制让长稿校对不必反复拖进度条。用命令行批量转录并导出 SRT不想逐条点界面时Buzz 自带 CLIdocs/docs/cli.md 有完整选项说明。buzz add一条命令可以同时处理多个文件常用参数-m选模型类型、-s选尺寸、-l指定语言、--srt/--vtt/--txt决定导出格式。buzz add -m whispercpp -s small -l zh --srt --txt meeting-01.mp3 meeting-02.mp3这条命令用 Whisper.cpp 的 small 模型把两个会议录音转成中文并各生成一份 SRT 和 TXT。加--hide-gui可以隐藏主窗口适合放进脚本无人值守跑。选模型速度、显存和准确率的取舍模型设置藏在偏好设置docs/docs/preferences.md里分两层模型类型和模型尺寸。类型决定用哪个后端跑Whisper原版、Whisper.cpp、Faster Whisper、Hugging Face可填任意 whisper 系模型 ID、OpenAI API走云端仅作对照。日常离线转录推荐 Whisper.cpp支持 Vulkan 加速多数独显和核显都能用还允许填Custom下载社区量化模型如 q5 版本进一步省显存。尺寸直接决定速度和效果的平衡点尺寸体量适合场景tiny最小实时录音、低配置设备先跑通流程base小日常快速转录small中CLI 批量处理的常用档medium大对准确率要求高的正式转录large最大关键内容机器配置充足时再用偏好里还有两个实用开关Reduce GPU RAM 用 8bit 量化压缩模型换显存环境变量BUZZ_WHISPERCPP_N_THREADS可指定 Whisper.cpp 的线程数默认取一半 CPU 核心。让新文件自动转录文件夹监视偏好设置里的 Folder Watch 让 Buzz 盯住一个目录里面的新音频文件出现后自动按预设模型开始转录不用人工导入。它和Skip Already Transcribed插件搭配最好用插件会检查同名.txt/.srt/.vtt是否已存在或 Buzz 数据库里已有结果有就标记 Skipped避免重复跑模型。这套组合适合每天把录音丢进一个文件夹的工作流。插件把转录流水线接得更长插件系统在Help → Plugins里管理可开关、拖拽排序、逐个配置还能通过 Add by URL 装社区插件buzz/plugins/ 目录下有全部内置插件源码写新插件时照着结构改即可。内置的六个里最常用的Resize Transcript把带词级时间戳的转录自动重组成适合字幕的片段支持按静音间隙合并、按标点分割、限制单条最大长度导出字幕前想调节奏时用它AI Summary调 OpenAI 兼容接口OpenAI 或本地 Ollama给转录生成摘要存进备注或存成文本文件DeepFilterNet转录前先降噪处理嘈杂录音效果好去噪结果默认转完即删。其余的 DOCX 导出、本地语言检测都是单步开关用到再开。速查表模型、格式与常用参数 选项取值默认说明任务-ttranscribe / translatetranscribe转录或翻译成英文模型类型-mwhisper / whispercpp / fasterwhisper / huggingface / openaiapiwhisper离线推荐 whispercpp模型尺寸-stiny / base / small / medium / largetiny仅 whisper 系三种类型可用语言-len、zh、fr 等数十种空自动检测已知语言建议手动指定导出格式--txt/--srt/--vttTXT可多格式同时输出初始提示-p自由文本空塞入专有名词可减少拼错词级时间戳-w开 / 关关开启后才能用重组字幕收尾前的三条避坑提示首次使用每个模型时 Buzz 会联网下载一次模型文件之后完全离线运行断网环境下先把模型下齐。实时录音对机器负载敏感默认 Whisper 模型较重直播场景建议切到 Whisper.cpp 配小模型录音中留意队列长度积压就调大转录步长。导出字幕若单条过长勾选 Word-Level Timings 重新转录再用 Resize 功能按标点重组比手工剪切快得多。下一步建议先拿一段自己语言清晰、两三分钟的录音依次试一遍 tiny 和 small感受速度差异再决定日常档位完整文档见 docs/。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考