-
智能会议记录系统
适用行业
适用于会议纪要,自动笔录、录音。
功能特点
支持多个语种语音识别能力:根据需要提供中文语音识别能力。
支持实时语音识别能力:通过调音台、声卡等设备采集实时音频流,并实时转写成文字。
支持16kHz采样率,16bit位深,单通道音频。
支持一句话语音识别能力:支持不超过一分钟的音频流转成文本。
支持录音文件转写能力:要能够实现对中文普通话音频文件转写文字功能,支持MP3、WAV、PCM、M4A、WMA、MP4、OPUS、AMR、3GP、AAC、FLAC等音频文件格式。
录音文件转写支持文稿模式和字幕模式两种输出格式。
支持命令词识别的能力,基于语法规则和结果置信度,准确识别指令转写结果,可用于语音控制。
支持语音检出(VAD)能力:系统要能够对输入的录音文件进行分析,能够确定音频的起始和终止的处理过程。
语音增强:系统要具备高效的语音增强能力,以满足在多种环境中应用,引擎要内置降噪模块,要能够降低一定范围内噪音对识别的干扰。
支持开启词级别的对齐结果,可以用于音字同步精确到毫秒(ms)级别。
支持逆文本标准化,将语音识别结果中的日期、数字等对象以标准化格式展示。
支持自动智能标点,智能判断对识别的文本添加标点。
识别热词管理:支持中文热词导入及编辑,例如涉及到人名、地名、公司名等特殊易错的词汇,可以作为热词直接替换并提供热词接口。
敏感词过滤:可手动配置敏感词,可用于敏感词进行屏蔽、标注或删除等功能开发。
语气词过滤:可手动添加语气词过滤规则,开启语气词过滤后在识别结果中自动删去匹配的语气词。
实时识别支持自定义说话人,可配置说话人信息用于角色分离功能开发。
转写支持自动关键词提取:对中文普通话语种,上传录音文件时指定关键词数量上限,系统将自动提取不超过该数量的关键词,并可根据相关性和词频进行排序。
转写支持语速计算:系统可以自动计算平均语速。
中文语音识别(标准普通话)正确率:标准测试集≥98%;
识别结果响应时间:标准测试集≤500毫秒;系统响应指标:常规页面操作的响应时间≤2秒。
详细功能参数请联系业务咨询..................................
