ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Buzz 免费离线语音转文字完整指南:三步从录音到字幕

Buzz 免费离线语音转文字完整指南:三步从录音到字幕 Buzz 免费离线语音转文字完整指南三步从录音到字幕【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz做会议记录的人最怕录音、网课视频没法转成文字传云端又不放心。Buzz 是一款免费开源的离线转录工具在本机用 Whisper 直接把语音变文字音频一步不出机器。为什么是它一句话定位Buzz 是一款免费开源的本地桌面工具用 OpenAI Whisper 在离线环境里完成音频转录与翻译。跟同类工具比它的差别在于这几点全程离线音频、视频、录音都不用上传敏感会议、客户访谈、内部课程放心转不依赖网络也不调云端 API。多后端随机器挑Whisper、Whisper.cpp、Faster Whisper、Hugging Face 任选还能接 OpenAI API。有显卡就吃满——Nvidia 走 CUDA通用显卡和集显走 VulkanApple Silicon 原生支持。不止转写转录完接着翻译、分离说话人、导出字幕一条龙不用换工具。可扩展内置插件和命令行接口能接 AI 摘要、DOCX 导出也能写进脚本批量跑。维度说明技术底座Python PyQt6 桌面应用转录历史与设置存本地 SQLite 数据库语言支持近百种语言可自动检测或手动指定许可证MIT适用人群会议记录者、字幕创作者、语言学习者、要写自动化脚本的开发者它能替你解决哪些问题手头有录音和视频想直接变文字文件转录导入音频或视频Buzz 自动抽出音轨再转写不用手动转格式。批量 监听文件夹一次丢多个文件排队处理或开启文件夹监听目录里一有新文件就自动建任务转写适合批量流水线。贴链接就转直接丢个 YouTube 视频链接不用先下载。现场边说边要出字实时录音从麦克风边录边转底部面板实时出字。演示窗口活动现场开一个投屏窗口观众直接看到实时字幕。嘈杂、多人也能救转写前先做语音分离再把不同发言人区分开多人对话准确率更高。转完还想继续用翻译把转写结果译成目标语言跨语言整理一步到位。导出字幕结果导出成 TXT、SRT、VTT直接进剪辑软件。插件加持AI 摘要、DOCX 导出、自动调字幕时长等插件转录后自动加工。装好三步跑起来图形界面最省事Windows / macOS下载对应平台的安装包。Windows 包未签名安装时弹安全警告选「更多信息」→「仍要运行」即可。LinuxFlatpak 一行装好Snap、Appimage 也可选。flatpak install flathub io.github.chidiwilliams.Buzz开发者PyPI 安装前提先装好 ffmpeg并确保是 Python 3.12 环境。pip install buzz-captions python -m buzz命令行一条命令转写后端、模型、语言、格式全在一条命令里指定buzz add -m whispercpp -s small -l zh --srt --vtt meeting.mp4实战给视频出一份字幕挑最典型的场景走一遍——给一段会议视频出字幕。第 1 步导入视频。点「打开」选中文件Buzz 自动抽音轨不用你转格式。想省事也可以用命令行buzz add meeting.mp4直接建任务。第 2 步设好参数再跑。任务选「转写」语言指定中文模型按机器性能选 small 或 medium点运行。安静环境下 accuracy 足够省去大部分人工校对。第 3 步核对并微调。打开转录查看器按时间戳逐段定位、播放哪段对不上就拖动调整起止时间。第 4 步导出。选 SRT 或 VTT 导出。产出物一个能直接拖进剪辑软件的字幕文件时间戳对齐、语言准确。排错问答问离线转录太慢怎么提速多半是模型对机器太大或后端没吃到 GPU。先换 tiny / base 小模型跑通有显卡就改用 Whisper.cpp 后端并开 GPU 加速——Nvidia 用 CUDA通用显卡和集显走 Vulkan。问专有名词、术语总被识别错模型缺领域上下文。在高级设置里填「初始提示initial prompt」把术语喂给它已知音频语言时手动指定别用自动检测。问Windows 安装时弹安全警告安装包没做代码签名属正常现象不用紧张。选「更多信息」→「仍要运行」就行。问PyPI 装的版本 GPU 不生效默认装的是 CPU 版 torch。Windows 上按 README 说明改装 CUDA 版 torch 及对应运行库GPU 才会被用上。进阶二次开发与插件接新转录后端多后端抽象都在 buzz/transcriber/ 下Whisper、Whisper.cpp、Faster Whisper 等每个后端各占一个文件想加新后端从这里入手最清晰。写插件插件机制在 buzz/plugins/已内置ai_summary、export_docx、transcript_resizer、skip_already_transcribed、enhanced_language_detection照着现有结构抄一份就能接自己的后处理逻辑。查全部命令参数buzz add的所有选项与示例见 docs/docs/cli.md。尝鲜最新开发版clone 仓库https://gitcode.com/GitHub_Trending/buz/buzz自行构建能拿到最新特性和修复。速查 下一步目标怎么做图形界面跑起来Windows/macOS 下载对应安装包Linux 用flatpak install flathub io.github.chidiwilliams.Buzz命令行批量转写buzz add --srt 文件1 文件2查全部命令参数docs/docs/cli.md接新转录后端buzz/transcriber/写插件buzz/plugins/想跑批量任务或深入后端先看 docs/docs/ 里的使用文档和 CLI 说明遇到 bug 或有改进想法直接到项目的 Issues 反馈维护者更新很勤。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表