Comunicato stampa — DeepL mette il turbo con il più grande NVIDIA DGX H100 SuperPOD d’Europa

DeepL potenzia la ricerca e intensifica l’addestramento delle reti neurali grazie all’ultima tecnologia di casa NVIDIA.

Colonia, Germania, 1° agosto 2023 — DeepL, leader globale della comunicazione basata sull’intelligenza artificiale, rinforza i suoi servizi di traduzione e comunicazione con l’installazione di NVIDIA DGX SuperPOD.

DeepL ha infatti messo in campo il nuovo DGX SuperPOD, composto da sessantotto sistemi NVIDIA DGX H100 forniti da DELTA Computer Products. È stato installato in un data center alimentato con energia rinnovabile in Svezia, dove è andato a rimpolpare le fila dei nostri altri server. Trattandosi del primo utilizzo commerciale di tale portata in tutta Europa, rappresenta un grande passo per DeepL. 

DeepL e NVIDIA hanno valutato la velocità del cluster eseguendo il benchmark LINPACK, i cui risultati verranno presentati nell’edizione di novembre 2023 della Top 500, l’elenco dei cinquecento sistemi informatici più veloci disponibili in commercio. Le prestazioni del benchmark sono infatti risultate pari a 21,85 PFlop/s, abbastanza da far aggiudicare al cluster il ventiseiesimo posto nell’attuale classifica mondiale (edizione di giugno 2023) e l’ottavo in quella europea.

L’installazione di NVIDIA DGX SuperPOD è l’ennesima conferma dell’impegno di DeepL nel progresso tecnologico: puntando all’addestramento dei modelli linguistici di grandi dimensioni (LLM), manterrà saldo il primato sugli strumenti di comunicazione IA più avanzati al mondo. I singoli server collaborano per formare un supercomputer in grado di addestrare in maniera ottimale le avanzate reti neurali alla base dei prodotti di DeepL.

Ciascun server DGX contiene otto GPU NVIDIA H100 Tensor Core, collegate tramite interconnessioni NVIDIA NVLink per assicurare al suo interno una comunicazione GPU-GPU ultra-veloce. Per quanto riguarda la comunicazione tra le GPU a livello di cluster, invece, a garantire la massima velocità ci pensa una piattaforma di networking NVIDIA Quantum-2 InfiniBand stabilita tra i server e dotata di tecnologia di calcolo in rete. Che si tratti di addestramenti in parallelo o di addestramenti rapidi di modelli ampi, quindi, sono svariati i tipi di configurazione in cui il cluster si rivelerà utile, fornendo prestazioni scalabili.  

“Sin dalla sua nascita, il fulcro della missione di DeepL è stata la ricerca, che ci ha permesso di fare progressi con le nostre reti neurali all’avanguardia e di raggiungere così una qualità straordinaria delle traduzioni” afferma Jarek Kutylowski, fondatore e amministratore delegato di DeepL. “Per creare un ottimo prodotto ci vogliono esperienza e inventiva, ma avere a disposizione dei sistemi informatici potenti per l’addestramento dei modelli era la nostra priorità già dai tempi dei nostri primi cluster in Islanda. L’introduzione di NVIDIA DGX SuperPOD rappresenta comunque una svolta perché sarà grazie alla sua velocità che costruiremo dei modelli di dimensioni superiori. Insomma, non vediamo l’ora di combinare le nostre capacità di addestramento con questo nuovo cluster, mettendo a disposizione dei nostri utenti tutta una serie di migliorie e nuove funzioni.”

Dal 2017 gli strumenti di comunicazione alimentati dall’intelligenza artificiale di DeepL stanno cambiando il modo in cui le aziende di tutto il mondo comunicano. Il nostro traduttore è addestrato per cogliere le minime sfumature di significato, per riconoscere il contesto e persino per identificare le terminologie specifiche di ciascun settore, permettendo a migliaia di imprese di raggiungere con i propri prodotti e servizi un pubblico internazionale.

NVIDIA DGX SuperPOD consente a DeepL e al nostro team di ricerca di ridurre notevolmente i tempi di commercializzazione per i modelli linguistici di grandi dimensioni. “Le imprese hanno bisogno di infrastrutture ad alte prestazioni ottimizzate e concepite appositamente per accelerare in modo efficiente e su larga scala i carichi di lavoro dei modelli linguistici di grandi dimensioni e dell’intelligenza artificiale generativa” afferma Charlie Boyle, vicepresidente dei sistemi DGX presso NVIDIA. “Come soluzione per data center chiavi in mano, NVIDIA DGX SuperPOD fornisce le prestazioni di calcolo, il networking e il software che servono a DeepL per costruire e addestrare le moderne applicazioni IA richieste dai suoi clienti”.

Informazioni su DeepL 

DeepL è un’azienda di intelligenza artificiale che si è posta l’obiettivo di eliminare le barriere linguistiche offrendo traduzioni automatiche che suonino naturali. Nel 2017 l’azienda ha sviluppato DeepL Traduttore, un sistema di traduzione automatica che, secondo test alla cieca, raggiunge la migliore qualità di traduzione al mondo. Fornisce inoltre prodotti specifici per aziende, organizzazioni e traduttori professionisti. L’eccezionale qualità dei servizi di traduzione automatica di DeepL si basa sui miglioramenti alla tecnologia di proprietà, che il team ha ottenuto lavorando sulla matematica e sulla metodologia delle reti neurali. L’azienda, guidata dal fondatore e amministratore delegato Jaroslaw Kutylowski, è supportata da investitori di fama mondiale quali IVP, Benchmark e b2venture.