Pressemitteilung – DeepL nutzt den größten NVIDIA DGX H100 SuperPOD in Europa

DeepL baut mit der neuesten NVIDIA-Technologie seine Forschungskapazitäten weiter aus und intensiviert das Training neuronaler Netze.

KÖLN, 2. August 2023 – Das globale KI-Kommunikationsunternehmen DeepL baut seine KI-Übersetzungs- und Kommunikationskapazitäten durch die Installation eines NVIDIA DGX SuperPOD weiter aus.

DeepL verfügt nun über einen DGX SuperPOD mit 68 NVIDIA DGX H100-Systemen, die von DELTA Computer Products bereitgestellt werden. In dieser Größenordnung ist dies der erste kommerzielle Einsatz dieses Systems in Europa und somit ein bedeutender Schritt für DeepL. Der neue DGX SuperPOD befindet sich zusammen mit anderen Servern von DeepL in einem grünen Rechenzentrum in Schweden, das mit erneuerbarer Energie betrieben wird. 

DeepL und NVIDIA haben ein LINPACK-Benchmarking durchgeführt, um die Geschwindigkeit des Clusters genau einschätzen zu können. Die Ergebnisse dieses Benchmarkings werden für die Novemberausgabe 2023 der Liste der 500 schnellsten im Handel erhältlichen Computersysteme vorgelegt. Das Benchmarking bezifferte die Leistung auf 21,85 PFlop/s, womit der Cluster in der aktuellen Top-500-Liste (Ausgabe Juni 2023) weltweit auf Platz 26 und in Europa auf Platz 8 rangieren würde.

Durch den Einsatz des NVIDIA DGX SuperPOD kommt DeepL seinem Ziel näher, große Sprachmodelle (Large Language Models, LLMs) zu trainieren, um die weltweit fortschrittlichsten KI-Kommunikationstools zu entwickeln und so die Technologielandschaft zu verändern. Die einzelnen Server bilden zusammen einen Supercomputer, mit dem sich die fortschrittlichen neuronalen Netze hinter den Produkten von DeepL optimal trainieren lassen.

Jedes der DGX-Systeme enthält acht NVIDIA H100 Tensor-Core-GPUs, die über NVIDIA NVLink-Verbindungen miteinander vernetzt sind. Dies ermöglicht eine ultraschnelle GPU-zu-GPU-Kommunikation innerhalb des Servers. Zwischen den einzelnen Servern sorgt die NVIDIA Quantum-2 InfiniBand-Netzwerkplattform mit In-Network-Computing-Technologie dafür, dass die GPUs innerhalb des Clusters mit maximaler Netzwerkgeschwindigkeit miteinander kommunizieren können. Dies macht die Leistung flexibel skalierbar und stellt sicher, dass der Rechencluster in einer Vielzahl von Konfigurationen effizient genutzt werden kann. Darunter fallen beispielsweise das Training großer Modelle sowie die gleichzeitige Durchführung mehrerer Trainings.

„Forschung stand von Anfang an im Mittelpunkt von DeepL. Mit diesem Ansatz konnten wir unsere hochmodernen neuronalen Netze entwickeln, die eine so hohe Übersetzungsqualität ermöglichen“, erklärt Jaroslaw Kutylowski, CEO und Gründer von DeepL. „Um großartige Produkte zu entwickeln, brauchen wir zum einen das Know-how und die Innovationskraft unseres Teams und zum anderen leistungsstarke Rechenressourcen für das Training unserer Modelle. Darauf haben wir seit dem Aufbau unserer ersten Cluster in Island geachtet. Der Einsatz des neuen NVIDIA DGX SuperPOD-Clusters ist ein äußerst wichtiger Schritt für uns, weil wir dank der höheren Geschwindigkeit noch größere Modelle bauen können. Wir freuen uns, unsere Trainingskapazitäten mit dem neuen Cluster weiter ausbauen und unseren Nutzern Verbesserungen und neue Funktionen zur Verfügung stellen zu können.“

Seit 2017 haben die KI-Kommunikationstools von DeepL die Art und Weise, wie Unternehmen auf der ganzen Welt kommunizieren, verändert. Der DeepL Übersetzer ist darauf geschult, sprachliche Nuancen und Zusammenhänge zu erkennen und sogar branchenspezifische Terminologie korrekt zu übersetzen. Mit dieser Technologie konnten Tausende von Unternehmen ihre Produkte und Dienstleistungen einem globalen Publikum vorstellen.

Der NVIDIA DGX SuperPOD ermöglicht es DeepL und seinem Forschungsteam, die Markteinführungszeit für umfangreiche Sprachmodelle erheblich zu verkürzen. „Unternehmen benötigen eine speziell entwickelte High-Performance-Infrastruktur, die darauf ausgerichtet ist, Workloads rund um LLMs und generative KI schnell, effizient und in großem Umfang abzuwickeln“, sagt Charlie Boyle, Vice President of DGX Systems bei NVIDIA. „Als sofort einsetzbare Rechenzentrumslösung bietet der NVIDIA DGX SuperPOD die Rechenleistung, Netzwerktechnologie und Software, die DeepL benötigt, um moderne KI-Anwendungen gemäß den Erwartungen seiner Kunden zu entwickeln und zu trainieren.“

Über DeepL 

DeepL ist ein KI-Unternehmen, das sich zum Ziel gesetzt hat, Sprachbarrieren mithilfe von präzisen, natürlich klingenden maschinellen Übersetzungen zu überwinden. Seit 2017 bietet es den DeepL Übersetzer an, der laut Blindtests die weltweit beste Übersetzungsqualität erzielt. Außerdem stellt DeepL professionelle Produkte für Unternehmen, Organisationen und Übersetzer bereit. Die außergewöhnlich hohe Qualität der maschinellen Übersetzungen von DeepL ist das Ergebnis von eigenen, im Unternehmen entwickelten Verbesserungen der Mathematik und Methodik neuronaler Netze. DeepL wurde von CEO Dr. Jaroslaw Kutylowski gegründet und wird von international renommierten Investoren wie IVP, Benchmark und b2venture unterstützt.