ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Buzz 本地离线语音转文字完整指南:免费的 Whisper 音频转录工具

Buzz 本地离线语音转文字完整指南:免费的 Whisper 音频转录工具 Buzz 本地离线语音转文字完整指南免费的 Whisper 音频转录工具【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz会议录音堆在硬盘里手动打字整理到崩溃Buzz 是一款免费开源的本地音频转录工具基于 OpenAI Whisper 在离线环境下把音频变成可编辑文字与字幕数据全程不出你的电脑。先跑起来不用配环境也能用按你的系统选一条最短路径macOS从项目发布页下载.dmg安装包双击安装。Windows下载安装文件程序未签名弹窗时点「更多信息 → 仍然运行」。LinuxFlatpakflatpak install flathub io.github.chidiwilliams.BuzzPython 用户需先装好 ffmpeg并准备Python 3.12环境pip install buzz-captions python -m buzz首次启动后你会看到任务列表主界面空的任务表格、顶部的「导入」按钮和录音按钮。第一次转录前 Buzz 会下载一个基础 Whisper 模型到本地缓存Linux 是~/.cache/Buzz之后断网也能用。项目速览一张表先搞清楚它是什么项目说明是什么离线音频/视频转录与翻译桌面应用GUI 命令行核心技术OpenAI Whisper可切换 Whisper.cpp、Faster Whisper、Hugging Face 等后端支持平台macOSIntel / Apple Silicon、Windows、Linux许可证MIT免费开源关键亮点实时麦克风转录、说话人识别、TXT/SRT/VTT 导出、监听文件夹自动转录、插件系统功能拆解从最核心的批量转录开始按由浅到深的顺序过一遍。批量导入音视频转录点工具栏「」或按CtrlOmacOS 为CmdO导入音频、视频文件也支持 YouTube 链接。选择任务转录 / 翻译、语言和模型。点「运行」任务进入队列可一次添加多个文件。 官方建议手动指定语言自动检测偶尔会判错。状态显示「Completed」后双击该行即可打开转录结果。转录查看器边听边改打开转录后顶栏支持时间戳、纯文本、译文三种视图切换。CtrlF搜索关键词CtrlG跳转到当前播放位置。每行文字可直接编辑方向键配合Ctrl以 0.5 秒步进调整时间轴。支持 0.5x 到 2.0x 倍速播放方便校对长音频。实时麦克风转录点录音按钮选麦克风开始实时转录。开启「演示窗口」演讲或活动时把字幕投到大屏。录音结束即可导出完整文本。字幕重排Resize转录完成后点顶栏「Resize」。设置每条字幕的最大字符数和合并间隔。自动把零碎片段合并成可读字幕再导出 SRT / VTT。进阶说话人识别与语音分离开启「说话人识别」Buzz 会在转录中标注不同说话人。开启「语音分离」转录前先分离人声嘈杂多人对话的准确率更高。这两项计算量大建议在有 GPU 的机器上使用。选型与调优模型和后端选错了速度能差出几倍。先看模型模型速度特点Tiny / Base快快速草稿低配机器首选Small / Medium中速度与精度均衡Large-V3慢精度最高偶发「幻觉」凭空造词Turbo快速度精度平衡值得优先尝试再看后端Whisper 类型后端适用场景Whisper原版内存充足、求稳但慢且吃内存Faster WhisperNvidia 显卡且显存 ≥6GB快一个量级Whisper.cpp无独显 / 集显 / MacVulkan 加速甚至纯 CPUHugging Face需要 MMS1000 语言、Parakeet 等自定义模型经验法则有 Nvidia 独显选 Faster WhisperMac 选 Whisper.cpp跑不动就换小一档模型。场景实战场景一会议录音 → 文字纪要CtrlO导入会议录音语言选中文模型选 Medium。转录完成后双击打开用查看器逐段校对错字。导出 TXT粘贴进文档整理成纪要。场景二视频做字幕导入视频文件导出格式勾选 SRT 和 VTT。打开 Resize把字幕长度压到一行能读完。导出字幕文件直接拖进剪辑软件。场景三讲座实时字幕选麦克风开启实时转录。打开演示窗口把实时字幕投屏。结束后导出全文存档。避坑手册QWindows 安装时弹出「Windows 已保护你的电脑」程序未签名属正常现象点「更多信息 → 仍然运行」即可。Q转录太慢怎么办换小模型或切到 Whisper.cpp 后端有 ≥6GB 显存的 Nvidia 显卡就直接用 Faster Whisper。Q启动崩溃或模型下载失败到「偏好设置 → 模型」删除模型重新下载模型缓存在 Linux 的~/.cache/Buzz、macOS 的~/Library/Caches/Buzz。Q完全断网的电脑能用吗能。在有网电脑上下载好模型把整个模型文件夹拷到离线机器的相同位置即可。Q录音时报 PaErrorCode-9999检查系统麦克风权限Windows设置 → 隐私 → 麦克风或暂时关闭杀毒软件。另外 CPU 需要支持AVX2过老的机器不支持。资源导航官方文档入口安装指南 与 常见问题 FAQ脚本党另有一份 CLI 手册。源码关键目录buzz/transcriber/ 是各类转录后端的核心实现buzz/plugins/ 是插件系统AI 摘要、自动重排等。Buzz 把 Whisper 的全部能力装进了一个本地 GUI批量转录、实时字幕、说话人识别、字幕导出一条流水线全在离线环境完成敏感内容不出机器。MIT 许可证意味着你可以放心把它用在任何项目里。现在就去项目仓库下载对应平台的安装包导入你的第一段录音跑通你的第一条转录。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表