
5 分钟上手 Buzz 离线音频转录本地 Whisper 转录完整教程【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz把一段长录音转成文字多数工具要求你先把文件传到云端录音离开你的电脑按分钟计费断网就用不了。Buzz 把这几点一次绕开——它是一款基于 OpenAI Whisper一个开源语音识别模型的离线音频转录桌面工具。你把录音丢进任务列表它就在本地完成识别、打时间戳、导出字幕全程不联网音频不离开磁盘。Buzz 项目定位本地、离线、后端可换Buzz 是一个跨平台的桌面端语音识别应用Windows、macOS、Linux 都有音频解码、模型推理、结果保存全在你自己的电脑上完成适合数据不出机器的需求。对很多人来说它就是能直接上手的音频转字幕工具。它不绑死在某一个引擎上内置了多种 Whisper 后端原生 Whisper、用 C 重写、依赖更轻的 Whisper.cpp以及 GPU 上跑得更快的 Faster Whisper按你的硬件在设置里切换就行。典型用户大致三类播客和视频创作者录音转字幕SRT 直接导出会议和访谈记录者实时转录还能区分说话人多语言研究者支持约 99 种语言还能把外语音频译成中文文本Buzz 主界面文件在列表里排队每项显示模型、任务类型和进度 Buzz 安装步骤从下载到第一次转录选获取方式Mac 和 Windows 下官方安装器Linux 用 Flatpak 或 Snap 包开发者也可以走 PyPI命令是pip install buzz-captions。走 Python 路线需要 3.12 环境并装好 FFmpegBuzz 靠它解码音视频文件。启动双击安装器或在命令行运行python -m buzz。首次启动进设置 → 模型挑一个模型类型Whisper、Whisper.cpp 等和模型大小。设定音频语言留空则自动检测。按硬件配加速器N 卡装 CUDA核显选 Whisper.cpp 的 VulkanMac 无需额外设置。做完这几步主界面就是任务列表可以开始干活了。设置的 Models 页在这里选后端、模型大小和加速器一次完整的离线语音转文字流程Buzz 把离线音频转录做成了队列任务主线四步导入音频拖文件进窗口或点顶部工具栏的加号YouTube 链接也能加。设置任务给每个任务配模型和类型转录或翻译。开始转录列表实时显示进度多个文件排队依次处理。查看与导出双击完成的任务打开转录查看器。查看器里每段文字带开始、结束时间戳点击段落音频就跳到对应位置搜索、播放、调速一应俱全。导出支持 TXT、SRT、VTT 三种格式做字幕的人可以直接丢进剪辑软件。除了文件还有三个功能值得试️实时转录点麦克风按钮边录边转按间隔缓冲兼顾速度和准确率还有专门的演示窗口适合活动现场出字幕说话人区分多人对话自动标注谁在说话提前告诉它有几位说话人会更准段落合并字幕切得太碎时在 Resize 菜单里一键合并成合适长度转录查看器每行文字对应一个时间区间点击定位、直接播放Whisper 模型怎么选Tiny 到 Large模型速度精度适合干什么Tiny最快最低实时字幕、快速校对、配置有限的电脑Base快够用日常对话、大批量初筛Medium中等较高学术材料、专业术语、要求准确的内容Large最慢最高法律、医疗等对质量要求高的场景拿不准就从 Medium 起步看结果再往上调或往下调。模型越大耗时越长同一个文件用 Large 可能是 Tiny 的数倍离线音频转录的等待成本主要就花在这一步。⚡ 硬件加速配置与常见排坑三种加速器各有受众CUDANVIDIA 显卡用1.4.6 起需单独安装检测到显卡会弹提示也可以从帮助 → 关于 Buzz 里手动装Vulkan通过 Whisper.cpp 实现覆盖大多数现代显卡包括集成显卡Apple SiliconMac 的 M 系列芯片是一等公民开箱即用高频问题和一句话解法转录太慢模型选大了或加速器没生效——换小一号模型或检查加速器配置内存占用高长音频对内存压力大——把文件切开或用小模型分段处理多语言识别错语言留空时自动检测会抽风——转录前手动指定语言嘈杂录音识别乱背景音乐和噪音干扰识别——开启先提取人声预处理Windows 安装时提示未签名正常现象——点更多信息再选仍要运行和云端转录服务差在哪维度云端转录服务Buzz 本地处理隐私音频要上传存在服务商那边文件不出电脑全程离线成本按时长计费或订阅装一次没有持续费用网络依赖连接断网停摆完全离线可跑定制功能由服务商定列表固定开源可换后端、装插件、换模型速度体验受上传带宽和服务器负载影响只取决于你的硬件可预期对多数人第一行才是决定性理由有些录音就是不能传上云。 进阶玩法批处理与扩展Buzz 也能当自动化管道里的一环命令行可以完成界面里所有操作——添加任务、指定模型、导出 SRT细节见 CLI 文档。配合文件夹监听把新文件丢进目录就会自动转录不用手动点。想扩展就找插件系统AI 摘要、自动字幕合并这类社区插件直接安装照着源码里对应接口写还能接新的模型后端或输出格式。部署细节可以看 安装文档 和 中文 README。Buzz 代表的方向很清楚把 AI 能力搬回自己的电脑把数据主权还给你。如果你经常要转音频、又不想让文件出机器这款离线音频转录工具现在就能用——装好包、选好模型直接开工。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考