ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

声云录音卡离线语音转文字教程:SenseVoiceSmall本地识别中文、英文、粤语,告别云服务依赖

声云录音卡离线语音转文字教程:SenseVoiceSmall本地识别中文、英文、粤语,告别云服务依赖 声云录音卡离线语音转文字教程SenseVoiceSmall本地识别中文、英文、粤语告别云服务依赖【免费下载链接】sonicloud_opensdk声云录音卡 Recorder 是一套面向开发者和行业客户的智能录音硬件接入方案。 项目以录音卡片硬件为核心开放 BLE 协议 SDK 及 Android、iOS、鸿蒙、Flutter 接入示例同时提供 Windows/macOS 桌面端 Demo支持设备连接、录音控制、实时音频、文件传输、OTA 升级和语音转写等能力帮助开发者快速将录音硬件接入自己的 App、桌面软件或行业系统。 如需获取硬件规格、样机、完整协议、SDK 资料或定制服务请联系安徽声云项目地址: https://gitcode.com/gh_mirrors/recorder24/sonicloud_opensdk声云录音卡 Recorder 是一套开源的智能录音硬件接入方案其 Windows/macOS 桌面 Demo 集成了 FunASR SenseVoiceSmall 模型可在本地完成离线语音转文字识别中文、英文、粤语等语言结果直接保存为同名 txt 文件。全程不需要上传录音到任何云端首次下载模型后即可断网使用适合会议、采访、课堂等对隐私敏感的场景。为什么选择离线语音转文字把录音发给云端识别服务意味着音频要离开本机。而声云录音卡桌面 Demo 的离线转写方案有三大好处数据不出门录音文件与文本全程在本地生成无需担心内容外泄不依赖网络模型缓存完成后飞行模式也能转写无按量费用SenseVoiceSmall 是轻量级模型CPU 即可运行转写多少条都不花钱。硬件与 Python 环境准备你需要的硬件就是一张声云录音卡广播名 CB08BLE 连接环境要求很简单项目要求操作系统Windows / macOS / LinuxPython3.10 及以上硬件可用 BLE 适配器 一张录音卡进入 Demo 目录后安装转写依赖核心功能只需requirements.txt转文字是可选能力pip install -r requirements-asr.txt⚠️ 一个常见坑torchaudio 的大版本必须与已安装的 torch 一致例如 torch 2.9.x 配 torchaudio 2.9.x否则在 Windows 上导入时会报WinError 127。依赖清单见 requirements-asr.txt。模型下载一次 900MB之后完全离线首次执行转写命令时程序会从 ModelScope 自动下载 SenseVoiceSmall 模型约 900MB缓存于~/.cache/modelscope目录。下载一次之后此后运行完全离线识别过程不会访问任何网络服务。模型的核心特性在 recorder/asr.py 中配置识别在devicecpu下运行无需 GPU内置 fsmn-vad 语音活动检测自动把长音频切成最长 30 秒的片段再识别任意时长的录音都能处理开启 ITN数字/标点正规化识别出的二零二六年会规范为2026年录音卡下载的 WAV 为 16000Hz / 16bit / 单声道正是 SenseVoice 的标准输入无需重采样。三步快速上手录音变文字第 1 步连接录音卡启动命令行 REPL入口 main.pypython main.py然后扫描并连接设备record scan # 扫描附近的录音卡 record connect 0 # 连接扫描结果中的第 0 台设备 record list # 查看设备里的录音文件第 2 步下载录音文件record download 0 # 下载第 0 个文件自动保存为 WAV 并校验第 3 步一键转文字record transcribe 0如果文件尚未下载命令会自动先下载再转写。转写完成后文本保存在音频文件同名的.txt中内容同时在控制台输出。也可以直接转写本地已有的音频文件record transcribe downloads/录音001.wav整个过程对应实现见 recorder/cli.py 中的cmd_transcribe。语言参数用法中文、英文、粤语一键识别transcribe第二个参数指定语言支持以下 6 种取值参数语言auto自动检测默认zh中文en英语yue粤语ja日语ko韩语混合语言会议建议用auto让模型自行判断已知语种时显式指定更稳record transcribe 0 zh # 指定中文识别 record transcribe 0 en # 指定英文识别 record transcribe 0 yue # 指定粤语识别 record transcribe all # 批量转写设备上全部文件无代码玩法浏览器 Web 控制台转写不想敲命令加一个参数就能用浏览器操作pip install -r requirements-web.txt # 可选依赖 python main.py --web # 默认 http://127.0.0.1:8000声云录音卡BLE控制台在浏览器中一键离线语音转文字的界面Web 控制台里可以扫描连接、查看文件列表、在线试听 WAV并在文件列表上方选择转写语言下拉框auto/zh/en/yue/ja/ko后点每个文件旁的「转写」按钮结果实时显示在转写输出区并保存为同名 txt后端接口见 recorder/web.py。常见问题扫不到录音卡确认设备没有被手机 App 占用找不到时试scan compat列出全部有名称的设备再手动选择。转写提示未安装 funasr执行pip install -r requirements-asr.txt安装可选依赖即可。torchaudio 报 WinError 127torch 与 torchaudio 版本没配对安装与 torch 同号的 torchaudio如pip install torchaudio2.9.1。首次模型下载很慢或中断等待网络恢复后重新执行transcribe下载完成后缓存于本机不再重复下载。识别结果为空确认音频内确实有人声环境噪音过大的片段可能识别不到有效语音。相关资源与文件桌面 Demo 完整说明pnote-web-winMac-demo/README.md离线转写核心实现recorder/asr.py命令行 REPLrecorder/cli.pyWeb 控制台后端recorder/web.py转写依赖清单requirements-asr.txtCB08 通讯协议文档docs/协议.md移动端Android/iOS/鸿蒙/FlutterSDK 与示例位于仓库根目录配合 SDK 集成引导.docx 使用需要样机、完整协议资料或定制服务如云端转写对接可扫描下方二维码联系安徽声云【免费下载链接】sonicloud_opensdk声云录音卡 Recorder 是一套面向开发者和行业客户的智能录音硬件接入方案。 项目以录音卡片硬件为核心开放 BLE 协议 SDK 及 Android、iOS、鸿蒙、Flutter 接入示例同时提供 Windows/macOS 桌面端 Demo支持设备连接、录音控制、实时音频、文件传输、OTA 升级和语音转写等能力帮助开发者快速将录音硬件接入自己的 App、桌面软件或行业系统。 如需获取硬件规格、样机、完整协议、SDK 资料或定制服务请联系安徽声云项目地址: https://gitcode.com/gh_mirrors/recorder24/sonicloud_opensdk创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表