ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Buzz 离线语音转文字:把录音变成带时间轴字幕,全部在自己电脑上跑

Buzz 离线语音转文字:把录音变成带时间轴字幕,全部在自己电脑上跑 Buzz 离线语音转文字把录音变成带时间轴字幕全部在自己电脑上跑【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款基于 OpenAI Whisper 模型的本地语音转文字工具音频、视频甚至在线视频链接都在你自己的机器上离线处理不上传、不按分钟计费。读完这篇你会装好它、跑出第一条转写并导出一份可用的 SRT 字幕或 TXT 文稿。️ 按系统挑装法macOSbrew install --cask buzz不想用 Homebrew 的话下载 .dmg 拖进「应用程序」即可。LinuxSnapsudo snap install buzz装完再执行sudo snap connect buzz:password-manager-service给 Buzz 授权密码存储权限。Windows下载安装程序双击安装。应用未签名弹出安全警告时先选「更多信息」再点「仍要运行」。Python 环境pip install buzz-captions之后python -m buzz启动要求 Python 3.12。 把第一条离线转写跑出来把 MP3 或 MP4 文件拖进主界面或者直接粘贴在线视频链接文件会出现在任务队列里。给这条任务选一个模型任务类型选 Transcribe语言保持自动检测。首次运行会自动下载模型下载完任务开始处理队列里能看到实时进度。关掉窗口任务也不停继续后台跑状态变为已完成后双击该行打开转录详情。详情页里每段都有开始和结束时间点任意一行音频直接跳到对应位置。在右上角菜单里选 TXT、SRT 或 VTT 导出第一份文字稿就到手了。命令行用法和实时录音的完整说明分别看 docs/docs/cli.md 与 docs/docs/usage/2_live_recording.md。⚙️ 30 秒选对模型决定转写质量的四个参数参数常见取值怎么选模型tiny / base / small / medium / large越大越准也越慢快速试听 Tiny日常笔记 Base交付级字幕 Large-v3任务Transcribe / Translate要原文选 Transcribe外语内容选 Translate先转写再翻译一步完成语言自动检测 / 手动指定短音频、混合语言场景手动指定语言代码更稳输出格式TXT / SRT / VTT做字幕选 SRT纯文字笔记选 TXT速选建议首次跑通直接用 Base 自动检测 SRT嫌慢就降一档模型。Models 设置页的模型列表支持填自定义下载地址需要时可以换成第三方优化过的 Whisper 变体。 三种真实用法两小时采访录音变成品可用的文字稿适用时机长录音人工听写要两三倍时长你只想校对不想敲字。录音拖进队列模型选 Small 或 Medium。等处理完成开 GPU 会快很多。打开详情边播放边校对人名、术语改动自动保存。导出 TXT 发给对方。最终产出一份带时间轴、术语已修正的文字稿。给英文视频配上中文字幕拖入视频任务类型选 Translate目标语言选中文。完成后导出 SRT。某行字幕太长就在详情里打开字幕调整Resize。设好目标长度长句按标点自动拆短碎片自动合并。最终产出一套能直接挂到播放器里的中文 SRT。团队共享文件夹无人值守转写适用时机同事只管往共享目录丢文件没人盯着处理。在偏好设置里开启文件夹监控指向共享目录。同事丢进新音频Buzz 自动排队处理。转写完成后文字稿落在输出目录。想跳过已有文稿的文件启用 skip already transcribed 插件。最终产出文件进来、文稿出去全程无需人工盯守。 提速与调优四个最该动的开关模型档位日常笔记用 Base交付级字幕上 Large-v3快速试听用 Tiny。不动它速度和准确率就不一定匹配你的场景。CUDA GPU 加速有 NVIDIA 显卡就开Large 模型转写提速数倍没有就关着改用小一号的模型。Deep Filter Net 降噪插件会议室、街头等嘈杂录音开了识别更干净录音本身干净时不开也不影响。输出目录与文件名模板在 Preferences 里一次配好批量导出都落在同一目录、命名统一文字稿不会散落各处。❓ 常见问题现象、原因、解法转写比预期慢模型偏大或没开加速。先降一档模型再确认 CUDA 是否开启同时别并行跑多个大任务。任务一直排队不动多半是模型还没下载完。回 Models 设置页确认模型就位再重新排队。识别结果错漏太多模型能力不够或录音太噪。换 Large 重跑录音嘈杂就先开降噪或者换一段干净录音。超大文件内存吃紧一次性处理太大。分批处理或先切段也可以降一档模型。自动检测语言不准音频太短或语言混杂。手动指定语言代码短音频和混合语言尤其需要。Buzz 已经装好你也导出过第一份 SRT 或 TXT参数、提速开关和排错路径都摸清了。下次再拿到一段不想逐句敲的录音把它拖进队列去做别的事回来时文字稿已经在那儿了。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表