新闻报道——DeepL在欧洲部署了最大的NVIDIA(也称“英伟达”)DGX H100 SuperPOD集群

DeepL使用NVIDIA的最新技术加强研究以及训练神经网络

2023年8月1日,德国,科隆——全球人工智能通信公司DeepL将使用NVIDIA DGX SuperPOD集群,以扩展其人工智能翻译和通信能力。

DeepL现将安装使用DGX SuperPOD集群,其中包含68套NVIDIA DGX H100系统,由DELTA计算机产品公司提供。由于这是欧洲首次为商业目的部署如此规模的计算集群,对于DeepL而言无疑是重要的里程碑。全新的DGX SuperPOD位于瑞典的一个绿色数据中心,与DeepL的其他服务器一样,由可再生能源供电。 

DeepL和NVIDIA公司利用LINPACK基准测试评估了集群速度。该基准测试结果将列入2023年11月版最快商用计算机系统500强排行榜。基准测试结果表明,该集群的性能为21.85 PFlop/s,在当前的500强榜单(于2023年6月更新)中位居全球第26位,在欧洲位居第8位。

DeepL现在将使用NVIDIA DGX SuperPOD训练大型语言模型(LLM),以生产全世界最先进的人工智能通信工具,从而推动技术进步。各个服务器协同工作,组成一台超级计算机,从而得以优化DeepL对其高级神经网络的训练。

每台DGX服务器包含8个H100图形处理器,通过NVLink连接,实现在服务器内不同图形处理器之间的超快通信。在每台服务器之间,采用网内计算技术的NVIDIA Quantum-2 InfiniBand网络平台可确保集群中的所有图形处理器都能以最高网络速度相互通信。该技术不仅实现性能扩展,还确保了计算集群在各种配置下的高效利用,无论是训练大型模型还是同时进行多个模型的训练。 

DeepL的首席执行官兼创始人雅罗斯瓦夫·库特洛夫斯基(Jaroslaw Kutylowski)说:“自始至终,研究都是DeepL的核心任务,这也使我们能够推进最先进的神经网络,从而实现高质量的翻译。我们需要团队的专业知识和智慧来打造出色的产品,同时,我们也需要强大的计算机来训练模型。自我们在冰岛建立第一个集群以来,强大的计算资源对我们来说一直非常重要。正因如此,新的NVIDIA DGX SuperPOD集群将凭借其速度为我们开发更大型的翻译模型带来颠覆性的优势。因此,能将我们现有的培训能力与新集群相结合令我们喜悦万分,我们也期待着该开发将改善我们用户的体验并为其带来新功能。”

自2017年,在先进的神经网络技术的支持下,DeepL的人工智能通信工具已经改变了全球企业的沟通方式。DeepL翻译器经过专业培训,能够正确解读文本中的细微差别,并毫不费力地破解行业术语。得益于DeepL的高质量翻译,数以千计的公司已经成功地向国际受众提供自己的产品和服务。

NVIDIA DGX SuperPOD使DeepL和其研究团队能够更快地发布大型语言模型。NVIDIA DGX系统副总裁查理·博伊尔(Charlie Boyle)表示:“企业需要专用的高性能基础架构,这些基础架构经过优化,能够高效且大规模地加速大型语言模型和生成式人工智能工作负载。NVIDIA DGX SuperPOD为DeepL提供了统包解决方案——从计算性能、网络到软件,满足其为客户构建并训练现代人工智能应用的需求。”

关于DeepL 

DeepL是一家德国人工智能公司,致力于通过人工智能技术提供地道的翻译,进而打破语言障碍。自2017年以来,基于盲测结果,DeepL翻译器已达到世界一流水平。DeepL同样为企业、组织以及翻译人员提供专业产品。DeepL的机器翻译服务的卓越质量是基于神经网络数学和方法的专有改进。DeepL由首席执行官雅罗斯瓦夫·库特洛夫斯基(Jaroslaw Kutylowski)创建,并得到IVP、Benchmark和b2venture等世界知名投资者的支持。