
离线语音转文字 3 分钟出字幕Buzz 让数据不出本地【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款离线语音转文字工具把 MP3、MP4 这类音频视频丢进去得到 TXT 文稿或 SRT 字幕。转录全程在本地完成基于 OpenAI 的 Whisper 模型录音不上传任何服务器。适合不想把会议录音、采访素材交给云端的个人和小团队本地音频转录、不上传数据的转字幕都靠它。离线安装 Buzz三种路径Windows / macOS从发布渠道下载安装包直接装。Windows 上应用未签名弹出安全提示时选更多信息 → 仍要运行即可。Linux一条命令装 Flatpak 版也有 Snap 版可装装完直接打开flatpak install flathub io.github.chidiwilliams.Buzz跟最新代码克隆仓库用 Python 3.12 环境装好依赖后运行python -m buzz启动不想碰源码也可以从 PyPI 装pip install buzz-captions。git clone https://gitcode.com/GitHub_Trending/buz/buzz打开应用后是一个任务列表界面所有录音的转录任务都排在这里状态、进度一目了然。一条录音转成带时间戳的字幕工具栏点 或按 Ctrl/Cmd O选一个音频或视频文件MP3、WAV、MP4 都能直接丢进去。导入后为它定三样东西任务转录原文 / 翻译成英文、语言知道就说具体语言别用自动检测开头几秒听不清就会猜错、模型。点 Run等状态变成 Completed双击这一行就打开转录查看器每行文字带开始/结束时间戳可以搜索CtrlF、按 0.5 倍到 2 倍速播放、在时间戳 / 纯文本视图间切换。人名、专有名词容易被听错把它们写进高级 → Initial prompt识别时会照着这个拼法来。导出格式按需选格式适合TXT纯文稿归档、二次编辑SRT视频字幕导入剪辑软件VTT网页字幕整个文件夹丢进去自动批量转一次可以添加多个文件它们进同一个队列按顺序跑你可以继续干别的进度在任务列表里实时刷新。想彻底不管它开偏好设置里的Folder Watch文件夹监控指定一个目录往里丢什么音频就自动转什么。再启用Skip Already Transcribed插件重扫文件夹时已生成过 .srt/.txt/.vtt 的文件会被直接跳过不重复跑模型。 需要脚本化、一次挂一堆参数时用命令行buzz add --srt 文件即可静默跑任务参数细节见 CLI 用法。开会现场录音实时出字Live Recording 面板选好任务、语言和麦克风点 Record话音落下就实时出字。实时模式建议用whisper.cpp后端加小模型——默认 Whisper 模型吃资源实时容易卡。演示、分享场景有现成的Presentation window演示窗口把大字实时字幕投到副屏。要录电脑里放出来的声音网课、电话会议先装一个虚拟声卡把系统声音导出来macOS 用 BlackHole、Windows 用 VB CABLE再把它选成 Buzz 的麦克风即可。识别错的字怎么救改字打开转录查看器直接编辑错误的文字。对齐时间戳选中某一行Ctrl/Cmd ←/→ 以 0.5 秒为单位挪开始时间加 Shift 挪结束时间边听边挪。合并字幕转录时勾上 Word-Level Timings每个字都有时间点之后点 Resize就能按标点、静音间隙把碎片重新拼成一行行字幕还能设单行最大长度、给每条字幕加停留时间。分说话人开启 Speaker identification自动把不同人的话标成 Speaker 1、Speaker 2。再翻译默认任务可把语音直接转成英文文本要译成其他语言配一个 OpenAI 兼容的 API本地 Ollama 也行点 Translate 即可。模型怎么选速度、准确率、离线机器模型大小取舍tiny / base最快准确率一般适合试跑和实时small / medium日常够用large-v3准确率最高偶发加戏编词turbo速度与准确率的折中后端whisper type决定跑在哪whisperOpenAI 原始实现准但慢、吃内存faster-whisper有 6GB 以上显存的 NVIDIA 显卡首选快一个量级whisper.cpp任何显卡、纯 CPU 都能跑Mac 首选集显也能实时huggingface跑自定义模型还支持 1000 语言的 MMS 系列带.En的模型只认英文。NVIDIA 显卡需要 CUDA 12Windows 安装包已内置。 完全离线的电脑内网、涉密环境先在联网机器上下载模型帮助 → 偏好设置 → Models → Show file location 找到目录Linux 是~/.cache/Buzz把整个 models 文件夹拷到离线机器同一位置Buzz 就能脱网工作。几个常见卡点跑得慢换更小的模型或切到 whisper.cpp显存够≥6GB就上 faster-whisper麦克风报错 PaErrorCode-9999系统权限没给到 BuzzWindows 去设置 → 隐私 → 麦克风放行启动崩溃多半是模型下载不完整在 Models 页删掉重下另外 CPU 需支持 AVX2太老的机器跑不了还想看更多FAQ 全文打开终端装好 Buzz把第一段录音拖进任务列表——3 分钟后你的第一份带时间戳的字幕就躺在旁边。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考