当前位置:首页 > 智能硬件 > 人工智能AI
[导读] 人工智能芯片智能吗? 人工智能芯片这个词,很有神秘感,似乎这个芯片会十分智能。人工智能芯片,确切地应该被称为“实现智能算法的芯片”,而不是“具有智能的芯片”。事实上,如果真的去看芯片的“

人工智能芯片智能吗?

人工智能芯片这个词,很有神秘感,似乎这个芯片会十分智能。人工智能芯片,确切地应该被称为“实现智能算法的芯片”,而不是“具有智能的芯片”。事实上,如果真的去看芯片的“智能性”和复杂性,那这些人工智能芯片大概比不上CPU。因为人工智能芯片能够运行的算法是比较单一的(如TPU的核心是矩阵乘法)、控制流是比较简单的。

人工智能芯片为什么能更“快“--胜在专注

首先,“快”这个词在计算机科学里可以有两个含义,一个是说低延迟(low latency),一个是说高吞吐量(high throughput)。我们说“更快”,可能指的是完成一项任务延迟更低,或者是单位时间内可以完成更多的任务。这两者不是相互蕴含的,但是是相关的。其关联被Little‘s Law所定义。而人工智能芯片的“快”,也可以是延迟低和/或吞吐量高。

然后,人工智能芯片为什么快?一句话就可以回答:同一个算法,用接近硬件的编程语言(如C)实现起来通常比Java等快,而直接用硬件实现则应该更快。下面具体讨论延迟和吞吐量。

延迟低:很多芯片做机器学习算法的推理(inference)比用CPU或者GPU更快。这通过专用电路、片上存储等实现。专用电路消除了CPU的指令加载、解码等时间,片上存储极大减少了数据(包括样本数据和模型数据)从内存加载的时间。吞吐高:当大家说“GPU比CPU快”,指的是其吞吐量。事实上GPU运行的时钟频率比CPU低不少,延迟也就更高。GPU吞吐量高,是通过移除CPU上大量的复杂控制逻辑(分支预测等)和具有一致性的缓存(cache),取代之以大量运算单元和不具有一致性的片上存储(用于寄存器和共享内存)来实现的。TPU吞吐量更高,因为它可以进一步移除GPU必须的图形计算单元(光栅raster或者光线跟踪ray tracing)、双精度(double precision)单元、单精度(single

precision)单元等,取而代之以大量的半精度(FP16)和1/4精度(INT8)单元。

从此可以看出,从延迟和吞吐两个角度来看,专用芯片都是胜在专注--能做种类更少的事情,但是做得更延迟低,或者单位时间内完成的任务更多。

专用芯片的缺点也很明显,一次性投入大,编程难,产品化耗时长,风险大(算法改变了怎么办?)。

摩尔定律和Dennard scaling

摩尔定律说,每18个月,晶体管的面积变成一半,即相同面积芯片上晶体管数量翻倍。这从几个方面能让计算更“快”:

晶体管变小,则其门电路变化状态的速度更快,CPU单核的频率可以更高(lantency)。这一点由下面将介绍的Dennard scaling定量描述。晶体管变多,则可以加入更复杂的控制逻辑(分支预测等)和缓存,让单线程的执行更快(latency)。晶体管变多,可以增加并行的单元,让吞吐量增大(throughput)。

Dennard scaling说,晶体管变小以后,所需电压和电流同比例变小,可以大幅度增加频率而维持总功率不变。这样CPU单核的频率可以变得更高。

现在这两个定律已经都部分失效。从摩尔定律来说,主流芯片晶体管的feature size目前在7-14nm,5nm和3nm可能可以达到但是会过程缓慢,而且工艺及其复杂和造价昂贵(近期GLOBALFOUNDRIES放弃7nm的生产即是证明)。再往后,由于漏电造成的发热,晶体管大概不能再继续缩小了。从Dennard scaling来说,由于漏电发热和晶体管维持工作需要的一个基本电压,芯片的频率也不能再继续增加。

这两个定律都失效以后,从某种意义上说,芯片发展的路线已经从做加法(更复杂的芯片、更多的功能,频率更高,更多核)发展到做减法(更专注某个/某类应用,用更简单的数字格式)了。今年图灵奖两位获得者讲的domain specific architecture,就是类似的思想。另外,还可以堆叠大量的芯片,让其高速互联(通过专用的交换电路例如NVLink,而不是更慢的PCIe总线)来达到高性能。

本站声明: 本文章由作者或相关机构授权发布,目的在于传递更多信息,并不代表本站赞同其观点,本站亦不保证或承诺内容真实性等。需要转载请联系该专栏作者,如若文章内容侵犯您的权益,请及时联系本站删除。
换一批
延伸阅读

9月2日消息,不造车的华为或将催生出更大的独角兽公司,随着阿维塔和赛力斯的入局,华为引望愈发显得引人瞩目。

关键字: 阿维塔 塞力斯 华为

加利福尼亚州圣克拉拉县2024年8月30日 /美通社/ -- 数字化转型技术解决方案公司Trianz今天宣布,该公司与Amazon Web Services (AWS)签订了...

关键字: AWS AN BSP 数字化

伦敦2024年8月29日 /美通社/ -- 英国汽车技术公司SODA.Auto推出其旗舰产品SODA V,这是全球首款涵盖汽车工程师从创意到认证的所有需求的工具,可用于创建软件定义汽车。 SODA V工具的开发耗时1.5...

关键字: 汽车 人工智能 智能驱动 BSP

北京2024年8月28日 /美通社/ -- 越来越多用户希望企业业务能7×24不间断运行,同时企业却面临越来越多业务中断的风险,如企业系统复杂性的增加,频繁的功能更新和发布等。如何确保业务连续性,提升韧性,成...

关键字: 亚马逊 解密 控制平面 BSP

8月30日消息,据媒体报道,腾讯和网易近期正在缩减他们对日本游戏市场的投资。

关键字: 腾讯 编码器 CPU

8月28日消息,今天上午,2024中国国际大数据产业博览会开幕式在贵阳举行,华为董事、质量流程IT总裁陶景文发表了演讲。

关键字: 华为 12nm EDA 半导体

8月28日消息,在2024中国国际大数据产业博览会上,华为常务董事、华为云CEO张平安发表演讲称,数字世界的话语权最终是由生态的繁荣决定的。

关键字: 华为 12nm 手机 卫星通信

要点: 有效应对环境变化,经营业绩稳中有升 落实提质增效举措,毛利润率延续升势 战略布局成效显著,战新业务引领增长 以科技创新为引领,提升企业核心竞争力 坚持高质量发展策略,塑强核心竞争优势...

关键字: 通信 BSP 电信运营商 数字经济

北京2024年8月27日 /美通社/ -- 8月21日,由中央广播电视总台与中国电影电视技术学会联合牵头组建的NVI技术创新联盟在BIRTV2024超高清全产业链发展研讨会上宣布正式成立。 活动现场 NVI技术创新联...

关键字: VI 传输协议 音频 BSP

北京2024年8月27日 /美通社/ -- 在8月23日举办的2024年长三角生态绿色一体化发展示范区联合招商会上,软通动力信息技术(集团)股份有限公司(以下简称"软通动力")与长三角投资(上海)有限...

关键字: BSP 信息技术
关闭
关闭