影刀RPA 电话录音自动整理:语音转文字与关键信息提取 title: “影刀RPA 电话录音自动整理语音转文字与关键信息提取”date: 2026-07-01author: 林焱影刀RPA 电话录音自动整理语音转文字与关键信息提取客服部门每天有几百通电话录音要人工听录音、整理问题类型、提取客户诉求这是典型的重复信息处理工作。影刀配合语音识别API可以自动转录和分类大幅降低人工复听成本。什么情况用什么适合自动化处理的场景客服电话录音大量积压需要快速整理需要统计客户问题类型分布从录音中提取订单号、投诉内容等关键信息质检抽查自动检测服务用语规范性不适合的场景拼多多店群自动化上架方案录音音质太差嘈杂环境、多人同时说话识别率会很低语言是方言或小语种通用识别API支持不好怎么做方法1阿里云语音识别API转录推荐阿里云一句话识别和录音文件识别价格低精度高支持中文普通话。【影刀操作】先开通阿里云智能语音服务获取AccessKey ID和AccessKey Secret添加【Python】指令安装SDKimportsubprocess subprocess.run([pip,install,alibabacloud-nls-python-sdk],capture_outputTrue)添加【Python】指令批量转录录音importosimporttimeimportjsonimportrequests# 使用阿里云录音文件识别适合60秒的录音# API文档https://help.aliyun.com/document_detail/90727.htmlACCESS_KEY_IDyour_keyACCESS_KEY_SECRETyour_secretAPP_KEYyour_app_keydefget_token():获取访问Tokenfromaliyun_python_sdk_core.clientimportAcsClientfromaliyun_python_sdk_core.requestimportCommonRequest clientAcsClient(ACCESS_KEY_ID,ACCESS_KEY_SECRET,cn-shanghai)requestCommonRequest()request.set_method(POST)request.set_domain(nls-meta.cn-shanghai.aliyuncs.com)request.set_version(2019-02-28)request.set_action_name(CreateToken)responseclient.do_action_with_exception(request)token_infojson.loads(response)returntoken_info[Token][Id]defsubmit_transcription_task(file_url,token):提交录音转写任务headers{Content-Type:application/json,X-NLS-Token:token}data{app_key:APP_KEY,file_link:file_url,# 录音文件的公网URLversion:4.0,enable_words:False,enable_sample_rate_adaptive:True}resprequests.post(https://filetrans.cn-shanghai.aliyuncs.com/api/submit,headersheaders,jsondata)resultresp.json()ifresult[StatusCode]21050000:returnresult[TaskId]raiseException(f任务提交失败{result})defquery_transcription_result(task_id,token):查询转写结果headers{Content-Type:application/json,X-NLS-Token:token}for_inrange(60):# 最多等10分钟resprequests.post(https://filetrans.cn-shanghai.aliyuncs.com/api/query,headersheaders,json{app_key:APP_KEY,task_id:task_id})resultresp.json()statusresult.get(StatusCode)ifstatus21050000:# 成功# 提取文本sentencesresult.get(Result,{}).get(Sentences,[])text.join([s[Text]forsinsentences])returntextelifstatus21050002:# 处理中time.sleep(10)continueelse:raiseException(f转写失败{result})raiseTimeoutError(转写超时)# 批量处理录音文件audio_dirrC:\录音文件output_dirrC:\转录文本os.makedirs(output_dir,exist_okTrue)# 注意阿里云API需要公网可访问的URL需要先把文件上传到OSS# 这里演示处理已有公网URL列表的情况audio_urlsyda.get_variable(audio_url_list)# 从前一步获取tokenget_token()results[]foridx,audio_urlinenumerate(audio_urls):print(f处理第{idx1}个文件{audio_url})try:task_idsubmit_transcription_task(audio_url,token)textquery_transcription_result(task_id,token)results.append({url:audio_url,text:text,status:success})print(f 转录成功{text[:50]}...)exceptExceptionase:results.append({url:audio_url,text:,status:ffailed:{e}})print(f 转录失败{e})yda.set_variable(transcription_results,json.dumps(results,ensure_asciiFalse))方法2从转录文本提取关键信息【影刀操作】添加【Python】指令importreimportjson resultsjson.loads(yda.get_variable(transcription_results))defextract_info(text):从对话文本提取关键信息info{}# 提取订单号数字序列order_patternr订单[号码]?[是为:\s]*([A-Z0-9]{8,20})order_matchre.search(order_pattern,text)info[order_id]order_match.group(1)iforder_matchelse# 提取手机号phone_patternr1[3-9]\d{9}phone_matchre.search(phone_pattern,text)info[phone]phone_match.group(0)ifphone_matchelse# 问题分类关键词匹配complaint_keywords[投诉,质量差,没收到,破损,假货,退款]inquiry_keywords[怎么,如何,什么时候,查询,咨询]ifany(kintextforkincomplaint_keywords):info[category]投诉elifany(kintextforkininquiry_keywords):info[category]咨询else:info[category]其他# 情感判断简单版negative_words[不满意,太差,骗人,坑,差评,无语,垃圾]positive_words[谢谢,很好,满意,不错,感谢]neg_countsum(1forwinnegative_wordsifwintext)pos_countsum(1forwinpositive_wordsifwintext)ifneg_countpos_count:info[sentiment]负面elifpos_countneg_count:info[sentiment]正面else:info[sentiment]中性returninfo# 处理所有转录结果enriched_results[]foriteminresults:ifitem[status]success:extractedextract_info(item[text])enriched_results.append({**item,**extracted})else:enriched_results.append(item)# 保存到Excelimportpandasaspd dfpd.DataFrame(enriched_results)df.to_excel(rC:\转录文本\分析结果.xlsx,indexFalse)# 统计category_countsdf[category].value_counts()sentiment_countsdf[sentiment].value_counts()print(f问题分类{category_counts.to_dict()})print(f情感分布{sentiment_counts.to_dict()})有什么坑坑1录音文件格式不支持阿里云只支持mp3、wav、aac、m4a等格式某些系统录音格式是.amr或.silk。解决方法先用ffmpeg统一转换格式importsubprocess subprocess.run([ffmpeg,-i,input.amr,-ar,16000,output.wav])坑2录音需要公网URLTEMU店群如何管理运营本地文件不能直接传给阿里云API要先上传到OSS。解决方法在流程里加上传OSS的步骤获取临时URL再调用转录API。坑3多人说话识别混乱双通道录音客服和客户各一个麦克风转录后混在一起分不清谁说的什么。解决方法使用阿里云的说话人分离功能enable_speaker_diarization: True会给每句话标注说话人ID。坑4转录准确率不高专业名词、地名、产品型号识别错误率高。解决方法使用阿里云的热词功能上传企业专有词汇提高识别准确率。总结录音自动化处理的价值被很多人忽视。从文件上传、转录提交、结果查询到关键信息提取全链路自动化后一天的电话录音几分钟就能分析完质检效率提升10倍以上。关键是选好语音识别服务阿里云、腾讯云、讯飞都可以对比一下价格和准确率选最适合的。

本月热点