首富从AI浪潮开始 第437节
韩路一看向赵文渊,说道:“赵总,麻烦你了。”
赵文渊起身,面向冰芯的众人,淡淡一笑:“各位同仁,做芯片我是外行,但是做训练,源智自信走在这个世界的最前面。”
他把电脑接到投影上,然后指着画面说道:“大家请看,这是源智内部的训练效率模拟器,是专门为了比较将现在的训练任务运行在不同的芯片上,能够达成的效率而写的。”
然后他打开一个预设的参数组合。
画面上显示出对应的算力、效率和预估花费时间。
“这是英伟达的旗舰卡所能达到的水平。”赵文渊说道,然后他又点了另一个加了星标的参数组合,“这是L100现在所能达到的水平。”
画面切换,L100的算力和效率大概能做到刚才英伟达旗舰的百分之六十多。
差距很大,但作为国产卡,在制程和生态都落后的情况下,实际上成绩已经很惊人了。
最后赵文渊用手指了指可以自由输入的界面,说道:“冰芯现在的工艺可以做到什么水平我不知道,但是只要把参数按照新架构输进去,我们现在就可以有一个预估值。”
? 第三百七十二章 且听龙吟
赵文渊这一番操作之后,丁耀先面色不变。
但他的心里多少有点儿怀疑。
芯片的架构模拟是一个很复杂的工作,而且具体细分下来,从芯片计算架构、模型工作负载、集群和网络通信模拟到实际硬件测量,每一个细分领域都有软件厂商在深耕,比如Timeloop、Chakra、ASTRA-sim这些。
怎么能让这个模拟结果尽量准确,能够给实际工作的安排产生指导意义,靠的是企业积累的海量数据,那都是各个软件厂商的核心机密。
现在源智突然端上来一个效率模拟器,说是能预测芯片架构对效率的影响,虽然界面看起来像是那么回事,但是这件事本身就让人不那么信服。
丁耀先是个没什么城府的技术人,有什么就说什么,他直接问道:“赵总,我问个问题,你们这个模拟结果,怎么能保证有效?”
“我们自然是验证过。”赵文渊微微一笑,说道,“我们之前使用的英伟达集群,实验室里的旗舰卡,还有正在使用的L100集群,都校准过。”
当然只有这些数据是不够的,预测最重要的是发现规律。
还好汤圆在这方面很擅长。
但这个就没必要在这里说了。
丁耀先并没有被说服,他摇了摇头,说道:“赵总,说到底都是源智一家的数据,用这个来做预测——虽然我是相信的,但是恐怕不能服众。”
赵文渊用手把笔记本电脑往前轻轻推了推:“要不丁总自己来试试?”
丁耀先先是回头看了看廖伯韬,见他没有反对的意思,就几步走到了赵文渊身边,开始操作了起来。
界面倒是写的很简洁,上手就能用,但是操作到一半的丁耀先突然停了下来。
冰芯的每一代工艺正式开放给客户之前,都会先试生产各种验证芯片。
从晶体管性能到高速接口,只有各个地方都测试完善了才能把工艺开放出来。
这些验证芯片不一定会对外销售,但相关数据非常完整,所以冰芯这里积攒了很多外面没有的数据。
只是这些参数涉及冰芯的工艺机密。
廖伯韬看丁耀先停下来不动,自然知道是为什么,他发话道:“用B7平台的测试数据吧。”
丁耀先抬头惊讶地看了廖伯韬一眼,但没说什么。
既然得到了首肯,他就继续输入。
B7是冰芯最近测试的平台,数字都在丁耀先的脑子里,他连查资料都不用。
最后他输入了一个冰芯内部用的测量计算任务。
输完之后,他点了一下运行键。
屏幕上出现一个进度条。
模拟器先把计算任务拆开成基础运算算子,然后尝试将这些算子分配到不同的计算单元,再根据刚才提供的各个参数,模拟数据从内存读入缓存、进入计算阵列,最后把计算结果写回内存的整个过程。
这个过程没有可视化,倒是有日志输出,但是要专门进入开发模式才能看见。
所以现场十几双眼睛就一起盯着屏幕上的进度条。
模拟运算的时间倒是不长,只是在全场安静的环境下让人觉得过的很慢。
一分多钟后,结果出来了。
任务预计完成时间,六点四二秒。
计算单元平均利用率,百分之六十一点八。
内存等待占比,百分之二十一点三。
赵文渊转头看向丁耀先,正好看到他的眼睛睁大的样子。
另外一边,验证负责人在自己的电脑上打开了最近一次的测试报告。
真实完成时间,六点六七秒。
计算单元平均利用率,百分之六十点四。
内存等待占比,百分之二十二点七。
模拟软件的预测值和他们的真实数据差距在百分之五以内。
即使源智接触过B7这款芯片的历史数据,能在现场完成这种精度的预测也非常惊人,但这可是内部实验芯片,从来没有对外公开过,甚至都不是一款产品。
他们是怎么做到的?
就这一下,屋子里的人对源智的这款不知名的模拟软件都重视起来。
丁耀先更是吞咽了一口口水,看向韩路一。
他说话的声音都有点儿沙哑。
“韩总,你们这款模拟器,卖吗?”
韩路一笑了一下:“丁总,既然源智和冰芯两家合作,这些当然都是共享资源,说什么买卖的就太生分了。”
然后他用手一指屏幕,说道:“不知道丁总对这个数据的可信度还认可吗?要不要试一试别的?”
赵文渊在旁边略微无语。
这个模拟软件可是我们研究院主导开发的,怎么一开口就问韩总,这个逼就不能让我装吗?
虽然这种级别的软件是不是能对外开放,确实不是他一个研究院院长能决定的,还真得韩总拍板,但你哪怕先问问我呢?
丁耀先也反应了过来,现在最重要的事情还是把技术路线确定下来。
于是他低下头,在L100的现有架构的基础上,把现在成品的一些参数替换成了冰芯七纳米工艺的对应参数,再次点了运行。
结果很快出来,效率大概是原先的百分之七十多。
和冰芯这边做出的预测差不多。
丁耀先看到这个结果,连心里的最后一点疑虑也消失了。
能猜中一次可以说是巧合,但对L100的迁移结果的现场预测和冰芯内部的测算结果也几乎一样,说明源智的模拟器确实有东西。
甚至可能比冰芯内部正在使用的工具还要先进得多。
想到这,丁耀先的心里有点儿热。
源智的这个项目能不能成先不说,如果冰芯之后的芯片验证和生产流程能用上这套工具,效率能提升多少?
他强行把这个念头压下来,把电脑转回给赵文渊,开口说道:“赵总,试试你们的新方案?”
冰芯这边的工艺参数都不用改,赵文渊直接在模拟软件里导入了薛兆恒刚才展示的L200异构芯片的架构,四块计算芯粒、输入输出芯粒和封装内互联的设计展示在软件的预览界面上。
参数都设计好了,赵文渊向丁耀先确认道:“丁总,你看看这个参数都对吗?”
丁耀先尴尬地开口:“赵总,刚才输入的参数是我们理论上能达到的最优值,既然是第一轮测算,还是保守一点儿吧。”
然后他提出了几个参数改动,基本把各项工艺的数字都往更保守的方向挪了百分之十到百分之二十。
薛兆恒在旁边看得欲言又止。
我们内部跑的时候都没压的这么狠,冰芯能不能行啊?
赵文渊倒是没在意,丁耀先让改哪儿,他就改哪儿,让改多少,他就改多少。
等所有数字都确认完,赵文渊载入汤圆最近一次训练的单轮计算任务,按下运行键。
又是一分多钟。
屏幕上的结果跳了出来。
理论算力,只相当于英伟达旗舰卡的百分之八十左右。
这个结果比L100的迁移方案强了不少——L100的现货能达到百分之六十,迁移之后再打个八折,单卡就只有英伟达旗舰的一半算力了。
这个结果让冰芯这边的人都有点儿意外,看来这个新架构确实有可取之处,以冰芯的制程限制和工艺水平,能做到这个程度已经很惊人了。
丁耀先这个时候已经有点儿认同薛兆恒的设计了,看来人家不是信口胡说,是带着数据来的。
模拟的结果除了综合效率之外,还有【任务预计完成时间】和【内存等待占比】等几个详细选项。
任务预计完成时间是一点七七秒。
丁耀先扫了过去,没太在意。
然后继续看内存等待占比,百分之六点五。
他突然意识到有点儿不对。
上一篇:这个导演不讲规矩
下一篇:我在中东造军火,被全球通缉?
