ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Buzz 离线语音转文字:Whisper 本地音频转录,4 步导出字幕

Buzz 离线语音转文字:Whisper 本地音频转录,4 步导出字幕 Buzz 离线语音转文字Whisper 本地音频转录4 步导出字幕【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz会议结束后录音文件躺在硬盘里你要的不是逐句听写而是带时间戳的文字稿最好能直接导出成 SRT 字幕。Buzz 是一款离线音频转录工具基于 OpenAI Whisper转写与翻译全部在本地电脑完成音频不上传到任何服务器。它适合处理会议录音、给个人视频配字幕、转录外语播客的人免费开源无按量计费。4 种方式安装 BuzzWindows从官方发布页下载安装程序。程序未签名安装时若弹出安全警告选择更多信息→仍要运行即可。macOS下载 .dmg 镜像安装Apple Silicon 芯片可获得原生加速。LinuxFlatpak 方式最省事flatpak install flathub io.github.chidiwilliams.Buzz也可通过 Snap 安装sudo snap install buzz。从 PyPI 安装适合开发者先装好 ffmpeg 并准备 Python 3.12 环境然后执行pip install buzz-captions用python -m buzz启动。首次使用4 步完成一次离线转录点击导入媒体文件快捷键 Ctrl/CmdO支持音频文件也支持视频文件自动提取音轨。为任务选择类型转写或转写后翻译再选择音频语言。语言可自动检测手动指定通常更准。在任务里选择模型大小点运行开始处理。完成后双击任务行打开转录查看器核对文本与时间戳。三条主要用法批量转写已有录音。可以一次导入多个文件每个文件生成独立任务并行排队Buzz 还内置监听文件夹功能把目录放进监听列表后新放入的录音会自动开始转写适合持续产出内容的场景。需要脚本化时可以改用命令行接口。️边说边转的实时录音。选择麦克风后点击录音按钮Buzz 按固定延迟默认 20 秒滚动处理音频块文字在界面中实时累积。演示或授课时可以切换到独立的演示窗口把实时字幕投到大屏上。转成文字后再翻译。任务类型选择转写并翻译Buzz 先转写出原文再翻译为目标语言查看器里可以在原文和译文之间切换对照适合外语学习材料。若需要更高质量的翻译还可以接入 OpenAI 兼容的 API 服务。 导出结果与编辑时间码转写完成后可以从菜单导出 TXT、SRT、VTT 三种格式。SRT 和 VTT 可直接导入视频剪辑软件或播放器作为字幕TXT 适合做纪要底稿。转录查看器承担校对工作左侧文本列表按时间码组织点击任意一条即可跳转到对应音频位置播放控制条支持变速、循环播放片段。对不齐的地方可以直接修改某一段的开始/结束时间也可以拆分或合并相邻片段。多人对话场景下可以开启说话人识别为不同声音标注发言人。⚙️ 影响质量与速度的 3 个设置模型档位。Buzz 提供 Whisper、Whisper.cpp、Faster Whisper、Hugging Face 四种后端模型大小从 Tiny 到 Large 五档。Tiny/Base 速度快、占用小适合批量处理Medium/Large 准确率更高但需要更大内存。有 NVIDIA 显卡可启用 CUDA 加速Whisper.cpp 后端支持 Vulkan集成显卡也能加速。指定语言。知道音频语言时手动选择可避免自动检测出错带来的识别偏差Whisper 共支持 99 种语言。初始提示。内容里出现大量专有名词、术语时在高级设置中填一段包含这些词的初始提示能明显降低错拼。环境侧同样重要安静环境、离嘴近的麦克风、清晰的发音对准确率的影响不亚于模型大小。排障速查转写太慢换 Tiny 或 Base 模型NVIDIA 显卡确认 CUDA 已启用或改用 Whisper.cpp 后端。准确率不够换更大模型手动指定语言为术语添加初始提示录音环境降噪。支持哪些格式MP3、WAV、FLAC、OGG 等常见音频以及 MP4、AVI、MKV 等视频自动取音轨。能否批量处理可以。多文件同时导入、监听文件夹自动处理、命令行三种方式都支持。技术背景与参与方式Buzz 用 Python 和 PyQt6 编写MIT 许可代码按模块划分buzz/transcriber/ 实现各后端的转写与录音逻辑buzz/widgets/ 承载界面组件buzz/db/ 管理转写历史的本地数据库。项目还有插件系统AI 摘要、自动字幕切分等想加新功能或修 bug可以从 Issues 入手按贡献指南提 PR。收尾Buzz 把本地、免费、可离线三件事同时做到音频不出机器模型随便切换导出格式覆盖字幕工作流。如果你不想把录音交给云服务从安装到第一条字幕整个过程不超过十分钟。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表