ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Buzz 本地语音转文字完整指南:离线转写、字幕编辑与调优技巧

Buzz 本地语音转文字完整指南:离线转写、字幕编辑与调优技巧 Buzz 本地语音转文字完整指南离线转写、字幕编辑与调优技巧【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款完全离线的本地语音转文字工具它基于 WhisperOpenAI 开源的语音识别模型在你自己的电脑上把音频、视频转成文字还能翻译成英语。从导入录音到导出字幕全程不需要把文件上传到任何云端。本文带你完成安装、跑通第一次转写并讲清楚模型该怎么挑。 三步装好 Buzz 并跑通最快的路径是官方安装包Windows 和 macOS 用户从发布页下载对应系统的安装包直接运行即可Windows 安装时若提示程序未签名点更多信息选仍要运行。Linux 用户只需一条命令sudo snap install buzz如果你习惯 Python 环境要求 3.12先装好 ffmpeg再执行pip install buzz-captions安装完成后按提示在终端启动即可。首次启动时 Buzz 会自动下载语音识别模型到本地缓存目录保持网络畅通、等它下载完就能用了。✅ 第一次转写从导入到导出 SRT 的完整闭环第一次使用按这条最小路径走读完即可复现导入文件点工具栏按钮或按 CtrlO选中任意 mp3、wav、m4a 文件mp4 等视频文件同样有效。设置三个参数任务转写或翻译成英语、语言建议直接指定比自动检测更稳、模型第一次用默认即可。运行点 Run 后任务进入队列进度在任务表中实时刷新。打开结果状态变为Completed后双击该行进入转录查看器文字与音频联动可点击任意位置试听。导出选择 TXT、SRT 或 VTT 格式保存到磁盘。如果录音里出现人名、品牌名等容易错拼的词在导入时的高级设置里填入初始提示Buzz 会倾向于把这些词拼对能明显减少错别字。 三个真实需求批量文件、边录边转、可交付字幕一次转多个文件Buzz 的任务表就是一个队列按住 Ctrl 多选文件批量导入任务依次执行单个任务可以暂停、恢复或删除。文件很多的话在偏好设置里配置监控文件夹新放进来的音频自动排队转写——睡前把一天的录音丢进文件夹起床看结果即可。边录音边转写会议和讲座场景点主界面的 Record 按钮即可开始事前选好任务、语言和麦克风。文字随说话实时生成Buzz 还提供一个演示窗口演讲时把实时字幕投到副屏很方便。实时输出有三种模式新句追加在下方、追加在上方、追加并纠错会回头修正上一句更准但对机器要求更高。如果你想转写的是播放器里放出来的声音需要先装一个虚拟音频设备例如 macOS 上的 BlackHole再把 Buzz 的麦克风选成该虚拟设备操作细节可看实时录音文档。产出可交付的字幕文件转写完双击进入查看器可直接修改文字、调整每行的起止时间。Resize 功能专门处理字幕导入时勾选了词级时间戳的转写能按最大长度或标点拆合成为标准字幕行还可以给每行统一延长显示时长如果原始音频还在本机它甚至会分析静音段来校准时间轴。需要 Word 文档、AI 摘要、录音降噪的话见插件文档内置插件覆盖 DOCX 导出、AI 摘要、背景噪声去除等在 Help → Plugins 里开关和排序即可。⚙️ 模型怎么选转得太慢怎么办默认建议日常用base对准确性有要求换medium专业级需求再上large系列。模型规格速度体验内存需求准确度水平适合情况Tiny极快1GB 以内基础级快速草稿、实时录音Base快约 1GB良好日常会话、初次体验Medium中等约 3GB优秀重要内容、正式字幕Large 系列慢8GB 以上最高专业转录、科研用途出现以下情况再切换太慢→ 换更小的模型或改用 Whisper.cpp 引擎——它是 C 优化实现能利用任意品牌的显卡集显笔记本上也能跑实时转写也是 Mac 上的首选Nvidia 显卡显存 6GB 以上时Faster Whisper 比原版实现快一个数量级且更省内存。不准→ 换大模型 保证录音清晰 用初始提示补充上下文。显存/内存吃紧→ 选大模型的量化版本如 q5模型下载与删除都在 Help → Preferences → Models 页面操作。另外注意 Large 家族有多个版本V2 更稳定V3 准确度最高但偶尔会编造音频里不存在的词Turbo 则主打速度与精度的平衡——最可靠的做法是拿自己的语言各测一遍。老机器用户留意一点Buzz 要求 CPU 支持 AVX2太旧的电脑带不动。❓ 常见问题Q装好后无法启动或提示麦克风不可用检查系统是否给了 Buzz 麦克风权限Windows 看 设置 → 隐私 → 麦克风杀毒软件也可能拦截临时关掉试试。Q模型下载失败或者电脑根本不上网在联网机器上把模型下载好再整个模型文件夹拷到离线机器的相同位置Linux 主目录下的 .cache/Buzz/models或用偏好设置里 Models 页的显示文件位置按钮确认目录。Q转写速度太慢怎么提速先换小模型或 Whisper.cpp 引擎再确认 GPU 是否真正参与运算Nvidia 显卡需 CUDA 12。仍慢的话减少同时运行的任务数关掉其他吃资源的程序。Q错别字、误识别太多两招最见效手动指定语言代替自动检测把专有名词写进初始提示。噪音大的录音可以开启转写前的语音分离把说话人从背景音里单独抠出来。Q转写结果和模型都存在哪里模型在系统缓存目录偏好设置 → Models 页可一键打开结果文件存到你选择导出时指定的位置文件名规则可以在偏好设置里自定义详见偏好设置文档。Buzz 适合需要经常把音频变成文字、又希望数据始终留在自己机器上的人访谈者、字幕制作者、会议记录者。装好之后整个工作流免费且可离线运行模型一次下载长期使用。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表