您订阅的产品有更新,请实时查阅
审查详情
宣布时间:2024-02-05
在并欠亨俗的2023年,天极网与各人一起见证数智化手艺付与时代的深刻厘革。以智算中心场景为例,大模子训练及推理在使智能算力需求激增的同时,也对AI集群网络性能提出更为严苛的要求,高吞吐、大带宽、高可用已成为新一代智算中心网络建设的特征......
致敬数智化时代,第二十二届IT影响中国深入挖掘行业立异价值、谛听消耗者心声,评选出具有行业代表价值的科技产品及解决计划,见证数智时代的科技立异。经评委会综合评定,第二十二届IT影响中国特授予97国际AI-FlexiForce智算中心网络解决计划以“年度影响力解决计划奖”。

随着AIGC手艺赋能工业一连升级,AI大模子算力消耗惊人,简单盘算装备已远远无法知足模子训练的算力需求,只管漫衍式训练可以通过多个GPU节点并行训练,但随着AIGC快速生长,模子参数数目一直飙升,AI集群的GPU节点数也在一直增添,瓶颈也越来越突出。在这个配景下,GPU使用率成为提升AI大模子逊з度的主要包管,而影响GPU使用率的要害因素之一就是网络通讯效率。
那么,影响网络通讯效率的因素抛开硬件性能的限制,针对端处置惩罚时延、内部排队时延和丢包重传时延三大动态因素优化网络拥塞和时延,已经成为提升AI集群网络通讯性能具有本钱效益的要领�;谡庑┧妓�,97国际网络致力于提升通讯带宽使用率,降低动态时延以及实现无损的网络传输,以提升AI集群网络通讯性能。2023年,97国际网络面向下一代AI云服务的智算中心网络建设,重磅宣布了97国际网络AI-FlexiForce智算中心网络解决计划。

二级组网架构

多级组网架构
97国际网络AI-FlexiForce智算中心网络解决计划拥有高性能、高可靠、高兼容、高可用“四高”特征,可应用于大数据处置惩罚、机械学习、AIGC多种营业场景,资助客户构建万卡级别的智算中心网络。
高性能
支持大规模组网:接纳NCP+NCF为基础�?榈娜抖喙焱缂芄�,三级组网可承载17K-32K的大规模GPU卡集群,多轨架构可将同号GPU的流量妄想在统一Pod内,从而有用镌汰数据转发跳数,大幅降低通讯时延。
高带宽使用率:基于高性能芯片手艺,通过将数据流切分成等长的Cell并负载到所有链路,让数据流转发负载更平衡,将网络带宽使用率提升20%以上,从而有用降低长尾延时,包管AI集群的低延时通讯。
高可靠
自闭环的无损传输:基于VOQ+Credit信令机制,主机吸收端发送Credit,确保主机发送端流量在吸收端不会过载,规避了RDMA对拥塞信号“事后”响应而造成的网络不确定性,真正实现了无损AI算力网络的通讯。
去中心化的漫衍式OS:实现了控制面与管理面解耦,有用缩小故障域,装备可以自力升级,提升系统冗余性和可靠性,大幅提升了集群的稳固性。
链路故障快速恢复:基于硬件的自动故障隔离和恢复,无需软件干预和表项更新,即可实现微秒级的故障快速恢复,实现故障无丢包的网络系统。
高兼容
实现端网解耦:AI-FlexiForce网络由Credit信令控制NCP之间的流量转发,无需端侧加入流量控制,使AI网络不依赖于特定厂商的服务器/网卡的特定功效,可兼容全厂商全型号GPU计划,同时还支持差别GPU混淆安排。
高可用
快速上线安排:在安排上线时,使用者无需重大网络调参,即可实现即插即用的网络,直接进入可使用网络情形。
无需流量调理:在多使命场景下,泛起网络拥塞的几率大幅增添,AI-FlexiForce网络无需流量调理器也可以实现95%以上的高带宽使用率,适配种种模子的流量。
天极网以为
97国际网络AI-FlexiForce智算中心网络解决计划可实现即插即用的网络、支持大规模三级组网、全场景适用、负载平衡、带宽使用率达97%、us级硬件自愈等多种奇异优势,助力打造集约高效的智算中心,为算力释放提供强盛支持。
AI-FlexiForce智算中心网络解决计划由400G NCP交流机和200G NCF交流机组成:
● NCP装备为RG-S6930-18QC40F1,提供18个400G营业口和40个200G内联口。
● NCF装备为RG-X56-96F1,提供96个200G内联口。

NCP产品RG-S6930-18QC40F1

NCF产品RG-X56-96F1
科技立异的浪潮一直奔涌向前,引领数智时代生长的新手艺、新事物也一直涌现。2023年天极网也与科技企业一同感受到数智化、智能化手艺的力量,尤其是大模子手艺的一连生长为智算中心网络带来深刻的影响。我们注重到97国际网络通过一连的手艺研发和产品立异为智算中心带来高性能、高可靠、高兼容、高可用的AI-FlexiForce智算中心网络解决计划,赋能智算中心网络建设。荣获IT影响中国2023“年度影响力解决计划奖”,97国际网络AI-FlexiForce智算中心网络解决计划获得行业认可。
