当前位置:首页 > 工业控制 > 工业控制
[导读]语音识别技术在智能设计方面的应用广泛。AP7003型IC是一款性能优良和价格低廉的语音识别电路

    摘要:语音识别技术在智能设计方面的应用广泛。AP7003型IC是一款性能优良和价格低廉的语音识别电路,文中介绍它的基本电路及其在机器人设计中的一些应用友及主意识别系统的基本原理,为智能机器人的设计提供了一种思路。

    关键词:AP7003 语音识别 智能机器人 目标词

语音识别技术以语言为研究对象,涉及生理学、语言学、计算机及信号处理等多个领域,是语言信号处理的一个重要研究方向,在智能控制、多媒体、人机对话等方面有着极其广泛的应用前景。

1 语音识别技术

语音识别技术首先要提取语音特征参量,也就是从语言信号中提取语音识别的有用信息。语音特征参量的提取要考虑单词选定位置的基音、鼻辅音的频谱、元音的频谱、擦音的频谱等要素。语音识别技术也必须有模式匹配及模型训练技术,其中主要包括动态时间规整技术、HMM模型和人工神经网络。时间规整是把一个单词内的时变特征变为一致的过程,在时间规整过程中,作为单词的时间轴要不均匀的扭曲或弯曲,使其行征为模型特征对正,该技术是一种有力的矫正措施,对提高系统的识别精度极为有效。人工神经网络是一个自适应非线性动力学系统,模拟人体大脑活动的基本原理,具有学习、技艺、判断、对比和概括等能力。另外,语音识别单元的选取也是语音识别的重要一步,语言识别单元有单词、音节和音素。对于汉语而言,主要选取音节单元,因为汉语是单音节结构的语言,而英语是多音节的语言,汉语约有400个音节,数量相对较少,便于识别。

2 AP7003型语音识别电路

AP7003是一款低成本语音识别专用集成电路,内置麦克风放大器、A/D转换器、语音处理器和I/O控制器,经预处理后可识别12组不同的字词,每组1.5s时长,可连词或单词识别。可广泛应用于玩具、识别转控和自动答录等领域。

AP7003的功能框图如图1所示。表1给出AP7003的引脚功能。

表1 AP7003的引脚功能

引脚名称 功    能
GNDD 数字地
LED1 电平存放LED驱动脚,能设计成语音输入指示,适合于标准应用
DLED2 低电平存放LED驱动脚,在标准应用线路中设计成语音输入验证结果的标志
DPOB1-POB4 输出口,作为键盘扫描用,标准应用
DPIT1-PIT4 低电平有效输入口,内部有上拉电阻器,能设计成输入口或键盘的输入标准应用
DVDDD 数字电源VDD
DCAPV 去耦电容器,电容器必须接在此引脚到地之间,用于内部的电压基准
DOSCI 频率振荡器控制脚,接一个56k电阻器到地
DPIM1PIM2 普通输入脚,能设计成模式控制输入,用于标准电路
DTEST 测试引脚,用于生产测试
DPOSL 输出模式选择,用于输出A口,若ProtA是高电平有效,则以POSL接高电平;若低电平有效则接地
GNDA 模拟地
TREF 语音输入阀电压控制
A2OUT 输出第二放大器
AIIN 第一(前级)放大器反相输入
A1OUT 前级放大输出
MICP 麦克风的正电源脚
VDDA 模拟电路正电源
POA-POA12 输出口
PORES 高电平有效输入,清除输出口A状态

AP7003的主要特征如下:

·内置麦克风放大器

·内置A/D转换器

·采用DIP40双列直插式封装

·能识别12组1.5s时长字词

·I/O:2个普通输入,4个触发输入,2个输出口分别有4个、12个输出,2个LED驱动

AP7003具有二种工作模式,即录音模式和识别模式,在进入识别模式之前,应先将目标词录入电路内。在AP7003内有12个存贮体用于存贮12组不同的字句,每个存贮体可存贮1.5s时长的字句,可通过键盘或按程序编制的顺序选择存贮体来录入及存放目标词。语音可通过外部麦克风或其他媒体录入电路内,经内部处理后以不同的数字特征信号保存在存贮体中。

图2

    目标词录入电路内后即可将工作模式转换到识别模式,工作时电路将当前语音与事先录入存贮体的目标词语音相比较,如果语音特征相匹配,则在电路的相应输出端输出高电平或低电平

3 声控机器人设计

语音识别电路广泛应用在智能控制中,把这种电路应用在智能机器人设计中,使机器人初步具有与人对话的能力,且机器人的操作具有普遍性,极大地提高了操作者的兴趣,图2是机器人电路的主要原理框图。

图2中按键的定义如表2所示。上电后12个存贮器在录入目标词之前必须清空,开始录入目标词时使LED1有效,录入后电路将进入识别模式。

表2 按键的定义

Key NO. 12Key (PIM1=1)
1 Store Word1
2 Store Word2
3 Stroe Word3
4 Store Word4
5 Store Word5
6 Store Word6
7 Sotre Word7
8 Store Word8
9 Set R_Leve1
10 Set Level2
11 Clear Output
12 Shut Down
PIT4 Clesr Word

如果由麦克风录入的单词与存储器原有单词相匹配,对应的POA输出口有效,并驱动断电器器,电机运动。在本设计中,机器人主要有“前进”(J1)、“后退”(J2)、“左转”(J3)、“右转”(J4)、“举起”(J5)、“放下”(J6)、“停止”等几种动作。其中,“停止”定义为clearOutput,其他依次定义为POA3、POA4、POA5、POA6、POA7和POA8。以“前进”(J1)和“后退”(J2)为例,如图3所示。

当“停止”时,清除POA所有状态,机器人停止。

当然,语音识别电路对外部麦克风(MIC)的分贝值有一定的要求,经验表明在本语音识别电路中选用56dB的麦克风较好。另外,AP7003的工作电压为2.4~4.5V,如果您的应用系统是5V工作电压,那么,通过一个二极管给AP7003供电,可以保证系统能长期稳定、可靠的工作,也有利于降低系统功耗。

4 结束语

在实际应用的过程中,麦克风的分贝值、Set R_Level匹配度的设置对于语音识别的效果影响较大。如果这二个参数设置合理,该电路可具有较高的识别率,一般可达80%以上,不失为一种效好的语音识别电路。

本站声明: 本文章由作者或相关机构授权发布,目的在于传递更多信息,并不代表本站赞同其观点,本站亦不保证或承诺内容真实性等。需要转载请联系该专栏作者,如若文章内容侵犯您的权益,请及时联系本站删除。
换一批
延伸阅读

9月2日消息,不造车的华为或将催生出更大的独角兽公司,随着阿维塔和赛力斯的入局,华为引望愈发显得引人瞩目。

关键字: 阿维塔 塞力斯 华为

加利福尼亚州圣克拉拉县2024年8月30日 /美通社/ -- 数字化转型技术解决方案公司Trianz今天宣布,该公司与Amazon Web Services (AWS)签订了...

关键字: AWS AN BSP 数字化

伦敦2024年8月29日 /美通社/ -- 英国汽车技术公司SODA.Auto推出其旗舰产品SODA V,这是全球首款涵盖汽车工程师从创意到认证的所有需求的工具,可用于创建软件定义汽车。 SODA V工具的开发耗时1.5...

关键字: 汽车 人工智能 智能驱动 BSP

北京2024年8月28日 /美通社/ -- 越来越多用户希望企业业务能7×24不间断运行,同时企业却面临越来越多业务中断的风险,如企业系统复杂性的增加,频繁的功能更新和发布等。如何确保业务连续性,提升韧性,成...

关键字: 亚马逊 解密 控制平面 BSP

8月30日消息,据媒体报道,腾讯和网易近期正在缩减他们对日本游戏市场的投资。

关键字: 腾讯 编码器 CPU

8月28日消息,今天上午,2024中国国际大数据产业博览会开幕式在贵阳举行,华为董事、质量流程IT总裁陶景文发表了演讲。

关键字: 华为 12nm EDA 半导体

8月28日消息,在2024中国国际大数据产业博览会上,华为常务董事、华为云CEO张平安发表演讲称,数字世界的话语权最终是由生态的繁荣决定的。

关键字: 华为 12nm 手机 卫星通信

要点: 有效应对环境变化,经营业绩稳中有升 落实提质增效举措,毛利润率延续升势 战略布局成效显著,战新业务引领增长 以科技创新为引领,提升企业核心竞争力 坚持高质量发展策略,塑强核心竞争优势...

关键字: 通信 BSP 电信运营商 数字经济

北京2024年8月27日 /美通社/ -- 8月21日,由中央广播电视总台与中国电影电视技术学会联合牵头组建的NVI技术创新联盟在BIRTV2024超高清全产业链发展研讨会上宣布正式成立。 活动现场 NVI技术创新联...

关键字: VI 传输协议 音频 BSP

北京2024年8月27日 /美通社/ -- 在8月23日举办的2024年长三角生态绿色一体化发展示范区联合招商会上,软通动力信息技术(集团)股份有限公司(以下简称"软通动力")与长三角投资(上海)有限...

关键字: BSP 信息技术
关闭
关闭