首页 > 都市言情> 首富从AI浪潮开始

首富从AI浪潮开始 第300节

  薛兆恒整个人僵在了原地。

? 第二百六十八章 得一可安天下

  “不可能。”薛兆恒脱口而出。

  L100是他设计的,各项数据他了如指掌。

  汤圆闭源模型,他没见过,也没用过。

  但是能做到榜单第一,至少不会比开源的那些模型小。

  传言说OpenAI的最新模型GPT-V有万亿级的参数,汤圆能至少也是千亿的量级。

  而L100,隔壁的实验室里就有一个L100的小集群在跑着,里面最多只流畅运行过7B(七十亿参数)大小的开源模型,连21B(两百一十亿参数)放上去都卡得不行。

  这离能运行汤圆这个级别的闭源模型还差着两个量级的参数量。

  现在你说汤圆跑在L100的集群上?

  那通信效率怎么解决的?L100的算子库,他手底下的软件团队攻坚了一年多,才覆盖了不到百分之五的使用场景,剩下的怎么补齐?

  一瞬间,薛兆恒想了很多,然后他沉下脸来,缓缓开口道:

  “韩总,我不知道你说这话是什么意思。”

  办公室里只有韩路一和薛兆恒两个人,他抬头看了下门口,接着说:“如果你是想用这套口径出去骗人,说硅明已经突破了英伟达的生态封锁,再借着你源智的名头,把硅明包装出来,那恕我不能配合你。”

  韩路一知道薛兆恒对他有戒备,但是对他做出这个猜测还是始料未及。

  难道就没有一种可能,算子适配的工程量是挺大,但是你硅明的团队写不出来的,我带着源码的团队已经写完了?

  这个可能性显然从头到尾没出现在薛兆恒的脑子里。

  谁信,他都不会信。

  无论是陆正平,还是周涵,他们都是外行人。听说国产适配之后,只是认为韩路一做了一个技术突破,中国这些年各种各样的技术突破可不在少数。

  但是薛兆恒太清楚写这些算子适配和通讯协议所需要的工程量了。

  你说花了四五年的时间打磨,终于出了成果,那还可信一点。

  可是L100从量产到现在也就一年,那五百张卡交付给源智才两个多月。

  两个多月的时间,写个毛线啊?

  韩路一本来打算把“源智已经完成了L100的推理适配,汤圆就运行在L100集群上”这件事当做收服薛兆恒和硅明技术团队的筹码。

  但是他却没想到,薛兆恒完全不相信。

  没办法,韩路一掏出手机,当着薛兆恒打开了云垠数据中心汤圆推理集群的后台面板,直接给他看后台。

  他把手机放在桌子中间,转了一下,让它正对着薛兆恒。

  “薛总,这是实时数据,你看一下。”

  薛兆恒身体前倾,在后台面板上扫了一眼,然后伸出手滑动了一下。

  上面是集群负载的各种数据,实时调用量、平均延迟、显存利用率、吞吐、错误率和任务分布等等。

  薛兆恒的眼睛盯着其中的几个关键指标,一边看一边和他脑子里的数据进行对比。

  很快,他就得出了结论。

  假的。

  L100的效率没有这么高。

  “既然是这样,韩总,那我们没有谈的必要了。”

  这次薛兆恒说话的语气已经没有了开始的客气,甚至压抑着怒气。

  他已经认定了韩路一是个要借着硅明招摇撞骗的野心家,已经盘算着要怎么破坏这次交易了——虽然说实话,作为一个小股东,他能做的不多。

  但他宁愿硅明破产,也不能眼睁睁看着硅明成为别人骗钱的工具。

  证明自己没造假是一件很难的事情,因为一旦别人怀疑你造假,任何证据在他们看来都有可能是伪造的。

  韩路一已经经历过很多次这种事了,但他没料到的是,这个薛兆恒这么固执,面板摆在面前了也不信。

  他也不在意薛兆恒话里的冒犯,提出了最后一个方法。

  “薛总,硅明有现成的测试环境吗?”

  薛兆恒听了这话,明显一愣。

  现在还不放弃吗?

  “有。”

  “什么规模?”

  “隔壁的机房里有一个小集群,三十二张,是我们做内部验证的。”

  韩路一点了点头,说:“三十二张够了,薛总,不介意带我去机房看看吧?”

  薛兆恒知道韩路一还是要坚持刚才那套说辞。

  他没有拒绝的理由,而且,到这个时候,他心底也有了一丝松动。

  L100,真有这么厉害?

  两人站起来,一起出了办公室。

  ……

  硅明的机房就在隔壁,严格来说,那也算不上是标准意义上的机房。

  只是办公楼里一个房间改造的。

  既没有冷暖风通道,也没有湿度控制,更没有静电屏蔽。

  几台服务器机柜就那么立在房间的中间,风扇发出嗡嗡的响声。

  机房里没人。

  这个时间,团队都下班了,薛兆恒是为了见韩路一特意等在这的。

  但是他有机房和服务器集群的全部权限。

  “韩总,您打算怎么验证?”薛兆恒问。

  “你自己也说了,L100集群想要运行千亿级的大模型至少要解决两个难题。”

  “是的,通信效率,和算子库。”薛兆恒点点头。

  虽然从大类上说只有两个,可这里面的技术挑战可太多了。

  就拿算子库来说,英伟达的生态是一点儿一点儿磨出来的水磨功夫,不只是算子全,他们还一直在调优。同一个运算给模型,在英伟达的显卡上用CUDA,就是快;换了别的生态,就快不起来。

  L100要想做到同样的事情,得软件硬件架构等多个团队的工程师通力合作,找到最高效率的参数。

  可以说,CUDA生态的根基就在这里。

  “这两个难题,我们解决了。”韩路一说这话的时候显得轻描淡写,熟悉他的人肯定知道他是故意的。

  薛兆恒对韩路一的风格还不熟悉,但是他也觉得自己被嘲讽了。

  你知道自己在说什么吗?

  韩路一没理会薛兆恒的反应,从兜里拿出一个U盘。

  这U盘是他刚才在外面找刘彧要的,里面是空的,说话的功夫他已经把源智私有代码库里的适配文件用视界写了进去。

  薛兆恒还以为这是韩路一提前准备好的。

  “这是源智的团队重写的运行时和算子适配,你可以试着用一下,再去部署一个开源模型。”

  听了这句话,薛兆恒脸上露出将信将疑的表情:“你是说,源智抛开硅明提供的软件层,完全重写了?还能达到运行接近CUDA的水平?”

  韩路一没说话,把手里的U盘又往前递了递。

  薛兆恒接了过来,插进了机房里连着服务器集群的一台电脑。

  整个机房里的服务器都是内部局域网,他倒不太担心U盘里是病毒。

  但他实在不太相信源智有能力做到韩路一刚才说的那些事。

  那不真成中国英伟达了吗?

  U盘里是几个编译后的文件,文件命名很规范,恰好可以替换掉现在L100的软件栈中算子库和运行时的部分。

  甚至都不需要韩路一指导,薛兆恒就知道该把文件复制到哪,然后重新启动了服务器。

  重启的过程中,这些新存入硬盘的二进制文件就会被加载到内存中,被服务器集群使用。

  控制台的终端开始滚动日志。

  L100 backend detected.(检测到L100后台)

  runtime initialized.(运行时已初始化)

  kernel fusion enabled.(算子融合已启用)

  memory planner initialized.(显存规划已初始化)

  multi-card scheduler ready.(多卡调度准备就绪)

首节 上一节 300/448下一节 尾节 目录txt下载

上一篇:这个导演不讲规矩

下一篇:我在中东造军火,被全球通缉?

推荐阅读