L’intelligenza artificiale in casa: meglio una superworkstation o una scatoletta da 15cm?
Tra i piccoli supercomputer che usano i processori nVidia dedicati all’AI e le workstation con RTX 5090 si gioca una partita che riguarda molto più il controllo dei dati, dei costi e delle competenze interne che non della pura potenza
4' di lettura
4' di lettura
C’è una domanda che negli ultimi mesi sta rimbalzando nelle riunioni IT di molte aziende italiane, dalle software house di medie dimensioni agli studi di ingegneria, passando per i reparti R&D dell’industria manifatturiera: conviene continuare ad affittare potenza di calcolo in cloud per sperimentare con l’intelligenza artificiale oppure è arrivato il momento di comprarsela e tenerla in ufficio?
Chiedilo al Sole
Le bollette del cloud computing che crescono più velocemente di quanto ci si aspettasse, i responsabili della privacy che chiedono dove finiscono davvero i dati aziendali dati in pasto all’AI e i team tecnici che vogliono poter usare un modello senza aspettare che si liberi una GPU sul cloud sono tutti ottimi motivi per rispondere che è meglio fare da sé, ma costruirsi in casa una infrastruttura AI è un compito tutt’altro che triviale e l’hardware per farlo è molto costoso. Per questo molte aziende sono tornate a sperimentare e le strade da seguire sono principalmente due: preparare delle workstation con schede grafiche Nvidia di ultima generazione (le famose RTX5090 che, però sono costosissime) oppure usare i computer basati sulla piattaforma Spark di Nvidia, piccole scatole con 128GB di RAM e un processore pensato per fornire inferenza AI della famiglia Blackwell. Abbiamo provato un Asus Ascent GX10 per qualche settimana e ci siamo resi conto di quanto siano diverse tra di loro queste scelte e che non esiste una soluzione sempre migliore dell’altra.
L’elefante e il ghepardo
Per capire la differenza tra i due approcci, un’immagine aiuta più di una tabella di specifiche tecniche: l’ASUS GX10 ricorda un elefante con la memoria di ferro, capace di tenere in testa contemporaneamente la mappa di tutte le pozze d’acqua della savana, ma non particolarmente scattante quando deve andare da una all’altra; la workstation con RTX 5090 è il ghepardo che brucia la pista, ma solo sulla breve distanza. La differenza principale la fa la memoria RAM che viene montata. Per far girare bene i modelli AI, infatti, questi devono stare tutti nella stessa memoria, quanto più vicina possibile all’unità di elaborazione. L’architettura del SoC Nvidia GB10, che è alla base dell’Asus Ascent GX10 (ma anche di molte altre scatolette simili di altri produttori), vanta ben 128GB di RAM che possono essere usati per ospitare i modelli AI. I sistemi basati sulla RTX5090, invece, possono sfruttare solo i 32GB della velocissima RAM DDR7 a bordo della scheda. Se il modello è più grande, non ci sta e la gara non inizia neanche.
Addirittura, l’ASUS Ascent GX10 è progettato per poter collegare in cascata due box uguali tramite la rete NVIDIA ConnectX-7 e gestire modelli ancora più grandi, come Llama 3.1 a 405 miliardi di parametri, una cosa impossibile per una singola workstation consumer, per quanto ben equipaggiata. Dall’altro lato, con i suoi 32 GB la RTX 5090 riesce comunque a far girare bene modelli come Llama 3 da 70miliardi di parametri in quantizzazione Q4-Q6, DeepSeek R1 in Q4, e modelli di generazione video come Wan 14B, purché si accettino alcuni compromessi per farceli stare.
In termini pratici, per le aziende questo significa che se il progetto è costruire un assistente virtuale interno basato su un modello open-source di fascia alta, senza scendere a compromessi sulla qualità delle risposte, il GX10 (o un cluster di due unità) offre più margine di manovra. Se invece il progetto riguarda l’addestramento fine di modelli più piccoli, la generazione di immagini o video o compiti che richiedono cicli di calcolo intensi e ripetuti — quindi forza bruta più che capacità — la RTX 5090 si dimostra nettamente più reattiva.



