小米也正计划建设一座GPU万卡集群。据悉,小米在其大模型团队成立时已经拥有6500张GPU资源。
字节在2023年就已建立起超过1万张卡的Ampere架构GPU (A100/A800) 集群,此后还在建设大规模Hopper架构(H100/H800)集群。
如今,“万卡集群”被业界视作是这一轮大模型竞赛的“入场券”,甚至还有不少厂商已经开始布局“十万卡集群”。
百度的百舸 4.0 通过一系列产品技术创新,已经能够实现十万卡集群的高效管理。
阿里巴巴的阿里云可实现芯片、服务器、数据中心之间的高效协同,支持 10 万卡量级的集群可扩展规模,已服务全国一半的人工智能大模型企业。
腾讯已宣布自研星脉高性能计算网络全面升级,星脉网络 2.0 搭载全自研的网络设备与 AI 算力网卡,能够支持超 10 万卡大规模组网,网络通信效率比上一代提升 60%,让大模型训练效率提升 20%。
页码:上一页