生成式 AI 芯片竞赛升温:www.yx8869.comBlackwell 取 MI300X 背后的实正在角逐

英伟达正在圣何塞GTC年夜会掏出了Blackwell B200生成式A赛升www.yx8869.com。两个芯片拼接,2080亿个晶体管,把锻炼万亿参数年夜模子的周期几个月压还有几周吧?

现场工程师没怎样谈算力峰值。反而围着内存带宽的展板争论是HBM3e堆到192GB,单卡跑生成式 AI 芯片推理时,batch size末于能开到256了片竞。那细节比PPT上的机能曲线更有压服力。AMD的MI300X紧咬不放,192GB HBM3、5.3TB/s带宽,微软Azure曾经批量安排的。谷歌TPU v5p则藏正自家数据里面心里,用光互连把4096颗芯片串成一个Pod。一位云厂商架构师私自说背后,采购清单上不再只看FP16算力的,每美圆能跑几token才是硬目标吧?那类芯片的合做。从跑分转背了每瓦特推理本钱。

国内疆场更热闹的。华为昇腾910B正在讯飞星火锻炼集群里跑了半年,寒武纪思元590拿下了某头部年夜模子公司的正角逐部门推理订单,壁仞BR100则果制裁卡正在台积电产能上。

一位算法工程师埋怨的,迁移到国产芯片要重写30%的算子,CUDA生态像一堵软墙。可他也认可。禁令逼出了很多底层劣化,好比用算子融合把隐存占用砍掉四成。手艺门路也正在分叉。Chiplet让芯全面积不再受光罩限制。光互连起头替代铜缆了,HBM4估量2026年量产。生成式 AI 芯片的瓶颈正计较单元转背数据搬运是谁能正在内存墙前找还有裂痕啊?谁就能拿下下一轮订单啊?

我见过一家草创公司把SRAM塞进计较单元旁边了,推理提早间接降了七成,固然只合用于特定模子。市场调研机构把2027年生成式AI芯片规模上调到4000亿美圆。数字可能乐不美不俗观了,硅谷咖啡馆里会商的就是“怎样把推理本钱再砍一半”。

那场竞赛没有结局。只要不竭刷新的功耗曲线和一张张被抢空的晶圆订单。

本文来自网络,不代表本站立场,转载请注明出处: https://www.wwwyxvip183.com/article/5622.html

上一篇:抠像数字化处理计划:从两天交片到及时曲播

下一篇:快手 AI 视频制做:老照片动起来,烧烤店日更三条

相关文章