推出全新架构昇腾 AI 计算集群,支持超万亿参数大模型训练
创始人
2025-07-02 01:51:17
0

9 月 20 日消息,在今日举行的华为全联接大会 2023 期间,华为常务董事、ICT 基础设施业务管理委员会主任、企业 BG 总裁汪涛正式发布全新架构的昇腾 AI 计算集群 ——Atlas 900 SuperCluster,可支持超万亿参数的大模型训练。

据介绍,新集群采用了全新的华为星河 AI 智算交换机 CloudEngine XH16800,借助其高密的 800GE 端口能力,两层交换网络即可实现 2250 节点(等效于 18000 张卡)超大规模无收敛集群组网。

新集群同时使用了创新的超节点架构,大大提升了大模型训练能力。此外,发挥华为在计算、网络、存储、能源等领域的综合优势,从器件级、节点级、集群级和业务级全面提升系统可靠性,将大模型训练稳定性从天级提升到月级。

此外,华为发布了更开放、更易用的 CANN 7.0 异构计算架构,不仅全面兼容业界的 AI 框架、加速库和主流大模型,还深度开放底层能力,让 AI 框架和加速库可以更直接地调用和管理计算资源,使能开发者自定义高性能算子,让大模型具备差异化的竞争力。

华为还升级了 Ascend C 编程语言,以更高效的编程方式,简化算子实现逻辑,大幅缩短融合算子的开发周期,为 AI 模型与应用的快速开发赋能。

面向全球企业和开发者,华为云官网今日正式上线昇腾 AI 云服务“百模千态”专区,专区收录了业界主流开源大模型,并全面基于昇腾 AI 云服务进行适配和优化;提供应用开发的工具链,开发工具已经全部实现了云化,免去繁琐的配置流程,实现一键接入,即开即用。

▲ 昇腾 AI 云服务百模千态专区▲ 昇腾 AI 云服务百模千态专区


IT之家查询获悉,截至今年 7 月,昇腾 AI 集群已支撑全国 25 个城市的人工智能计算中心建设,其中 7 个城市公共算力平台入选首批国家“新一代人工智能公共算力开放创新平台”。

同时,昇腾 AI 已发展 30 多家硬件伙伴、1200 多家 ISV,联合推出了 2500 多个行业 AI 解决方案,规模服务于运营商、互联网、金融等行业。

相关内容

热门资讯

如何允许远程连接到MySQL数... [[277004]]【51CTO.com快译】默认情况下,MySQL服务器仅侦听来自localhos...
如何利用交换机和端口设置来管理... 在网络管理中,总是有些人让管理员头疼。下面我们就将介绍一下一个网管员利用交换机以及端口设置等来进行D...
施耐德电气数据中心整体解决方案... 近日,全球能效管理专家施耐德电气正式启动大型体验活动“能效中国行——2012卡车巡展”,作为该活动的...
20个非常棒的扁平设计免费资源 Apple设备的平面图标PSD免费平板UI 平板UI套件24平图标Freen平板UI套件PSD径向平...
德国电信门户网站可实时显示全球... 德国电信周三推出一个门户网站,直观地实时提供其安装在全球各地的传感器网络检测到的网络攻击状况。该网站...
为啥国人偏爱 Mybatis,... 关于 SQL 和 ORM 的争论,永远都不会终止,我也一直在思考这个问题。昨天又跟群里的小伙伴进行...
《非诚勿扰》红人闫凤娇被曝厕所... 【51CTO.com 综合消息360安全专家提醒说,“闫凤娇”、“非诚勿扰”已经被黑客盯上成为了“木...
2012年第四季度互联网状况报... [[71653]]  北京时间4月25日消息,据国外媒体报道,全球知名的云平台公司Akamai Te...