ZD至顶网网络频道 11月11日 北京消息: InfiniBand明年将从100 Gbps走向200 Gbps。记者日前采访了Mellanox营销副总总裁Gilad Shainer。
Shainer表示,Mellanox将自下而上提供200 Gbps HDR InfiniBand规范产品,包括开关、芯片、网卡和相应的网线。
即将上市的Quantum开关设备支持40端口200 Gbps HDR InfiniBand,或80端口100 Gbps,将以模块化开关的形式提供,可以扩展到200 Gbps速度的800个端口或100 Gbps 速度的1600个端口。切换延迟为90 ns,总容量达16 Tbps。
200 Gbps的ConnectX适配器设备的延迟为0.6微秒,支持第三代、第四代PCIe,包括Mellanox多主机支持(如果不需要200 Gbps,则可将分适配器分割给多个主机使用)。
假如有人觉得此类速度翻倍的游戏没有什么意思,Mellanox也一直在推动利用开关减少CPU的负载的工作,这一点兴许会更有意思。
Shainer表示,现在业界需要“在各种地方分析数据,特别是在迁移数据的时候。InfiniBand HDR设备着眼于高性能计算环境,并将扩大网络计算和自适应路由功能,二者在运行上一代100 Gbps的环境里都颇为有用。”
Shainer称,卸载处理器方面的工作多年前以RDMA(远程直接内存访问)起步,即是说数据迁移用到的CPU时间不到1%。这在Quantum和ConnectX里得以扩展。
他表示,“Quantum开关的功能包括执行数据整合和削减协议,以减少CPU的负载。”他还表示,机器学习训练算法用到相同的基本概念。
ConnectX适配器也提供网络内存储、加密和其他安全方面的卸载功能。超级计算环境中的消息传递接口(MPI)也属于ConnectX卸载功能的一部分,MPI利用集总和匹配减少CPU的负载。Shainer表示,ConnectX的卸载功能可以将“60%至70%的MPI工作负载卸载到网络里……有朝一日,整个MPI框架将会迁移到网络里”。
他表示,存储卸载也是卸载功能的一部分,原因是检查点的设置(将应用程序的状态保存为返回点以备崩溃是用)目前是CPU负载的一部分。Shainer表示,“如果运行的节点达数千个,而又不想重新启动应用程序,那么这一点就十分关键。”
检查点的设置需要CPU时间,而HPC管理员不愿意在这些事务管理上消耗资源,因此ConnectX可以做背景检查点的设置。
适配器加密卸载为磁盘加密添加一个有意思的功能。如果用了全盘加密,那么数据保护涉及的不是单个用户。据Shainer介绍,“但如果是在网络上,不同的用户在网络上可以使用不同的密钥或不同的应用程序。”
Quantum和ConnectX还添加了遥测功能,内置的硬件传感器可以提供实时数据收集。
200 Gbps的配件包括HDR铜电缆和拆分器(用于3米内的机架链接)、主动硅光光学电缆(用于100米以内的数据中心链接)和光收发器(2000米以内的链接)。
新产品将于2017年应市。
好文章,需要你的鼓励
Luminary Cloud宣布完成7200万美元B轮融资,专注开发"物理AI"技术。该公司云原生平台可将仿真速度提升100倍,利用物理信息模型实时预测汽车、飞机等产品性能。公司推出针对特定行业的预训练模型,包括与本田合作的汽车设计模型和与Otto航空合作的飞机开发模型。融资由西门子风投领投,将用于扩大研发团队和市场销售。
香港中文大学联合上海AI实验室推出Dispider系统,首次实现AI视频"边看边聊"能力。通过创新的三分式架构设计,将感知、决策、反应功能独立分离,让AI能像人类一样在观看视频过程中进行实时交流,在StreamingBench测试中显著超越现有系统,为教育、娱乐、医疗、安防等领域的视频AI应用开启新可能。
伦敦量子动态科技公司宣布交付业界首台采用传统半导体制造工艺的量子计算机。该系统已安装在英国国家量子计算中心,使用标准化300毫米硅晶圆,是首台自旋量子比特计算机。系统采用CMOS技术,占地约三个19英寸服务器机架,具备数据中心友好特性。公司开发的可扩展瓦片架构支持大规模生产,未来可扩展至每个量子处理单元数百万量子比特,为商业化应用奠定基础。
Atla公司发布Selene Mini,这是一个仅有80亿参数的AI评估模型,却在11个基准测试中全面超越GPT-4o-mini。通过精心的数据筛选和创新训练策略,该模型不仅能准确评判文本质量,还能在医疗、金融等专业领域表现出色。研究团队将模型完全开源,为AI评估技术的普及和发展做出贡献。