ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Buzz 免费离线音频转录:3 步把会议录音变成可导出的字幕

Buzz 免费离线音频转录:3 步把会议录音变成可导出的字幕 Buzz 免费离线音频转录3 步把会议录音变成可导出的字幕【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款开源的本地语音转录工具用 OpenAI Whisper 模型在你自己的电脑上完成音频转文字全程不需要联网也不上传任何文件。它能处理音频和视频文件、麦克风实时录音支持导出 TXT、SRT、VTT 等格式。如果你的会议录音、课程讲义或外语播客需要变成可检索的文字或视频字幕这套工具链可以在一台普通电脑上跑通。先说一个场景3 小时的会议录音怎么处理以前遇到这种文件要么自己听写要么把音频传到在线服务——前者费时间后者既按分钟收费又意味着录音内容离开你的电脑。换一种方式把文件拖进 Buzz 的任务列表选好语言和模型等状态变成 Completed双击那一行就能看到带时间戳的全文。想核实某句话时直接在文本里搜索关键词点击结果就会跳到对应音频位置播放、调速、循环某一段都可以。安装 Buzz 并跑起第一个任务最短路径是走 PyPI需要 ffmpeg 和 Python 3.12 环境pip install buzz-captions python -m buzz其他安装方式按需选择macOS下载官方.dmg安装包拖进 Applications 即可Windows运行安装程序因为是未签名的程序会弹安全警告选更多信息 → 仍要运行Linuxflatpak install flathub io.github.chidiwilliams.Buzz或sudo snap install buzz首次使用某个模型时会自动下载权重这一步需要联网下载完成后之后的转录可以完全离线。任务一把会议录音变成可检索的纪要通过菜单 File → Import Media File或 CtrlO、工具栏的 号导入音频或视频视频会自动提取音轨给每个任务选择三样东西任务Transcribe 转写 / Translate to English 翻译成英文、语言、模型然后点 Run语言建议手动选定而不是用自动检测官方文档明确提示自动检测可能给出意外结果如果录音里人名、专业词总被写错在 Advanced 里填一段 Initial prompt把正确写法列进去转录完成后进查看器双击任务行。查看器有 Timestamps、Text、Translation 三种视图CtrlF 打开搜索框实时高亮并逐个跳转勾选 Follow Audio 后文本会跟着播放进度滚动长录音不用来回拖动进度条播放速度支持 0.5x 到 2.0x。多人会议还能点Identify speakersBuzz 会把每句话标记到不同说话人你可以试听 10 秒的样例句确认身份再把自动生成的标签改成真名保存时可选合并同一说话人的连续句子。这样纪要里的对话结构就清晰了。装过 AI Summary 插件需配置 OpenAI 兼容 API后还能自动把摘要写进转录备注。任务二给视频生成 SRT 字幕并导出字幕场景多两个动作导入时勾选Word-Level Timings生成词级时间戳转录完成后点Resize把词级段落重新组合成字幕行可以设每行最大长度、按标点断句如果源音频文件还在它还会分析静音间隙来校准对齐Resize 面板里还能给每条字幕的结束时间统一加几秒让字幕在画面上多停留导出在查看器顶部的 Export 菜单里支持 TXT、SRT、VTT 以及更多格式想要 Word 文档的话Export to DOCX 插件可以直接产出.docx。任务三开着麦克风实时转录会议进行中、或者做现场速记时用选好录音任务、语言、模型和麦克风点 Record 就开始出字。录音界面还有两个进阶选项Presentation window单独的投屏窗口活动演示时把实时文字投到大屏上很方便实时翻译Whisper 自带翻译成英文要翻成其他语言在 Preferences 配置一个 OpenAI 兼容的 API云端或本机 Ollama 之类并在高级设置里写清翻译指令遇到卡顿怎么选模型与后端默认 Whisper 后端准确但慢、吃内存。四种后端对号入座后端适合的情况Whisper精度优先、资源充裕的机器Whisper.cpp核显、无独显或 Mac支持 Vulkan 加速CPU 也能跑实时转录可行Faster WhisperNvidia 独显且显存 ≥ 6GB速度最快、占内存少Hugging Face想用社区模型如支持 1000 语言的 MMS 系列几条实操对策转录太慢先降模型档位tiny/base或换成 Whisper.cpp有合格独显再上 Faster Whisper实时转录跟不上换 Whisper.cpp 小模型官方文档特别提示默认 Whisper 做实时转录资源消耗很大large-v3 偶尔编出音频里没有的词换 large-v2 或 turbo最稳妥的办法是在自己的语言上逐个试名字带 .En 的模型只能识别英文其他语言别选完全无网的机器先在有网电脑上把模型下全在 Help → Preferences → Models 里点 Show file location 找到模型目录整体拷到离线机器的同位置Linux 为~/.cache/Buzz仓库里还有 scripts/download-models.py 可以批量准备离线模型程序崩溃多数是模型下载不完整删掉重新下载另外 Buzz 要求 CPU 支持 AVX2很老的机器跑不起来常见问题支持哪些语言随 Whisper 模型支持近百种语言含中文、日文、韩文等完整清单见 CLI 文档走 Hugging Face 后端还能用 MMS 模型覆盖更多语言。安装 Windows 版时弹出安全警告正常现象程序未做签名选择更多信息 → 仍要运行。麦克风报错 PaErrorCode-9999检查系统麦克风权限Windows 在 设置 → 隐私 → 麦克风 里给 Buzz 放行杀毒软件也可能拦截可临时关闭测试。能批量自动化吗可以。Buzz 带命令行接口buzz add支持指定模型、语言、--srt/--vtt等参数直接出字幕文件界面侧还有监控文件夹功能新文件放进去自动转录。详见 CLI 文档。Buzz 的价值点很单纯文件不出本地、功能完整、界面不复杂。从导入文件到拿到第一份 SRT熟练后不超过几分钟。想深入查看器、说话人分离和插件的细节可以看仓库内的 官方文档 和 使用指南目录。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表