
TMSpeechWindows 免费离线语音转文字工具实时字幕完整指南【免费下载链接】TMSpeech腾讯会议摸鱼工具项目地址: https://gitcode.com/gh_mirrors/tm/TMSpeechTMSpeech 是一款完全免费、开源的 Windows 离线语音转文字工具它实时捕获电脑正在播放的声音并转成屏幕上滚动的字幕识别全程在本地完成不经过任何云端服务器。即使你把音量彻底关掉它依然能听到系统声音。一、会议上被点名时如何快速回神线上会议开到二十分钟你恰好走神领导突然点名刚才小明提的方案你觉得怎么样——脑子里一片空白。如果字幕窗口一直在屏幕上滚动扫一眼就能接上话。这个场景正是项目被戏称为腾讯会议摸鱼工具的由来。TMSpeech 的定位非常纯粹不搞云服务、不注册账号、不弹广告。声音从你的电脑里来文字显示在你的屏幕上识别的每一步都没有离开这台机器。二、三个词定义它凭什么值得装免费、全程离线、低占用——在普通笔记本上实测 CPU 占用普遍低于 5%内存占用在几百 MB 量级老机器边跑边办公也没压力。把这三个词放在一起市面上同类工具屈指可数。三、能力总览一张表看懂它能做什么能力维度TMSpeech 的表现对普通用户的意义音频来源系统内录、麦克风等 3 种音源会议、网课、录音全覆盖识别方式本地流式识别全程离线隐私安全断网也能用资源占用CPU 普遍 5%内存几百 MB老电脑也能边用边干别的字幕展示无边框悬浮窗可拖动缩放像歌词一样跟读不挡视野历史记录按日期自动存到 TMSpeechLogs 目录会后一键整理纪要识别引擎CPU / GPU / 外部命令三套可切换按性能需求自由选扩展能力插件化架构模型可在线安装换语言、换模型都不难四、三步快速上手从下载到第一句字幕 第一步获取软件从项目的 Release 页面下载最新版本解压后双击TMSpeech.exe即可运行。想折腾源码的也可以直接克隆仓库git clone https://gitcode.com/gh_mirrors/tm/TMSpeech主界面源码在 src/TMSpeech.GUI/Views/MainWindow.axaml想了解字幕窗口怎么实现的打开看看就懂了。第二步安装语言模型首次运行后进入设置界面在左侧导航找到「资源」页。语音识别依赖语言模型这里列出了全部可安装的资源点「中文模型」旁边的「安装」按钮等下载完成状态就会变成「已安装」。内置资源放在应用目录的plugins/文件夹你自己装的资源则存放在%AppData%/TMSpeech/plugins/。第三步开始识别看字幕实时滚动回到主界面点开始按钮红色计时开始跳动字幕窗口就会跟着电脑里的声音实时更新。识别结果按日期自动保存到「我的文档」下的TMSpeechLogs文件夹随时打开回顾。五、原理拆解耳朵、大脑和字典是怎么配合的 把 TMSpeech 想象成一支三人小队。耳朵是音频源它用 WASAPI 环回捕获技术把电脑正在播放的声音像录内音一样抓下来——即使你完全关闭电脑音量也照样能识别因为捕获发生在系统内部不经过扬声器。大脑是识别引擎负责把音频流翻成文字一共三套可选Sherpa-Onnx基于 CPU资源占用最低日常首选、Sherpa-Ncnn可调用 GPU追求极限速度、命令行识别器接入你自己的任何识别程序。字典是语言模型决定大脑的知识水平中文、英文、中英双语按需安装装哪个用哪个。为什么本地识别又快又安全云端识别像把纸条寄到外地请人翻译再寄回来路上有延迟、有被拆看的风险本地识别像翻译官就住隔壁纸条递过去回答瞬间就回来了。再叠加流式识别——边采集边出结果一句还没说完上一句的字幕已经滚上屏幕。六、三个真实场景感受它的实际价值会议纪要自动生成痛点是会中记笔记累会后整理成文档更累。解法很简单——开会时开着 TMSpeech 就行散会后打开历史记录右键全选、复制一份完整纪要到手。老板让你总结、同事问刚才说了啥瞟一眼字幕就能从容应答。网课复习提速录播课或直播课时把字幕窗口拖到屏幕下方老师讲的重点同步变成文字。跟不上手写速度没关系课后打开TMSpeechLogs文件夹一整节课的文字笔记已经自动整理好外语课同样适用边看视频边看字幕相当于白送一个万能字幕组。隐私敏感场合的安心之选涉及商业机密、未公开项目或私人对话时很多人第一反应是不敢用云端识别。TMSpeech 的全程离线恰好解决这个顾虑语音数据在本地完成识别不经过任何第三方服务器。聊什么、录什么只有你和你的电脑知道。七、进阶玩法三套引擎与插件化生态 引擎怎么选日常办公选Sherpa-Onnx最省资源直播、游戏等追求速度的场景换Sherpa-Ncnn开启 GPU 加速想换更强的模型它基于 sherpa-onnx 框架支持其全部流式模型在设置里指定模型路径即可升级识别精度。命令行识别器是技术玩家的后花园选用它之后程序会启动你指定的外部命令读取标准输出作为字幕结果——单个换行更新当前句子多个换行表示句子完成。仓库的 external_recognizer/ 目录提供了完整的 Python 示例脚本接入 Whisper、SenseVoice 等任意引擎都很方便。所有插件的实现集中在 src/Plugins/ 目录音频源的具体实现可以看 src/Plugins/TMSpeech.AudioSource.Windows/。外观与日常管理同样省心字幕窗口支持无边框悬浮、任意拖动缩放锁定后鼠标点击可穿透窗口看视频完全不挡操作字体、颜色、阴影、对齐方式都能在「显示」设置里微调全部配置项定义在 src/TMSpeech.Core/ConfigTypes.cs。程序常驻系统托盘开始/停止、锁定/退出都能右键一键完成。八、常见问题速查 ❓问题快速解决方案识别准确率一般选对语言模型尽量在安静环境使用无法捕获系统音频音源选「系统音频」必要时启用立体声混音CPU 占用偏高切到 Sherpa-Onnx或换更轻量的模型历史记录找不到默认在「我的文档/TMSpeechLogs」可在设置改路径配置乱了想重置运行安装包里的重置配置脚本想用自己的识别程序切「命令行识别器」参考官方示例脚本想换更强的识别模型下载 sherpa-onnx 流式模型在设置里填路径九、行动清单现在就开始用 ✅下载 TMSpeech双击运行在「资源」页安装中文语言模型点开始让字幕跟着你的网课/会议动起来会后打开TMSpeechLogs带走现成的文字纪要如果你符合下面任意一条它就该放进你的工具箱开会、上课时总担心漏掉重点担心语音数据被上传到云端电脑配置一般需要轻量级方案想要完全免费、无广告的开源工具免费、离线、隐私安全、低占用——这四个词就是 TMSpeech 的全部承诺。装上模型然后安心走神让字幕替你记住一切。【免费下载链接】TMSpeech腾讯会议摸鱼工具项目地址: https://gitcode.com/gh_mirrors/tm/TMSpeech创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考