Alibaba offre noleggi orari di contratti di super IA: in esclusiva per una remota provincia cinese
Alibaba offre servizi di calcolo basati sull'intelligenza artificiale su scala leader di mercato tramite il noleggio orario di supercomputer, con restrizioni geografiche limitate a una remota provincia cinese.
Le cose più importanti che devi sapere
- Alibaba offre un supercomputer locale per l'intelligenza artificiale, basato su chip cinesi e su un cloud locale, per aggirare le limitazioni di accesso ai più recenti chip Nvidia e AMD e fornire bassa latenza alle aziende cinesi.
- Il supernodo di Alibaba si basa sul processore Zhenwu M890, che dispone di 144 GB di memoria HBM e di una banda inter-chip fino a 800 GB/s, e attualmente esegue servizi commerciali per modelli linguistici di grandi dimensioni che superano i 2 trilioni di parametri.
- Alibaba prevede di sviluppare processori ultra-potenti, con lo Zhenwu V900 in arrivo nel terzo trimestre del 2027, che offrirà prestazioni tre volte superiori a quelle dell'M890, seguito dallo Zhenwu J900 nel terzo trimestre del 2028.
Alibaba Cloud ha avviato la vendita commerciale del supernodo Lingjun Zhenwu M890, che consente ai clienti di noleggiare un'unità di elaborazione connessa ad alta velocità con 64 schede, senza dover costruire un proprio data center.

Questo lancio lo rende l'unico supernodo di origine cinese che gli utenti possono effettivamente utilizzare online senza bisogno di un contratto di acquisto o di un modello di intelligenza artificiale preconfigurato , il che rappresenta un grande vantaggio per le aziende.
Tuttavia, c'è un avvertimento per gli appassionati che desiderano provarlo al di fuori della Cina: al momento è limitato agli utenti della Regione Autonoma della Mongolia Interna, nella Cina settentrionale.
Che cosa offre Alibaba ai consumatori da parte delle aziende?
Un supernodo è un gruppo di acceleratori così strettamente interconnessi che il software li tratta come un unico, enorme chip, anziché come una rete di chip separati. Questo approccio è spesso necessario: un modello troppo grande per essere contenuto in una singola scheda dovrà trasmettere i dati su una rete relativamente più lenta, e questi costi aggiuntivi possono determinare se i modelli con trilioni di chip rappresentino un servizio pratico.
Un ottimo esempio è la GB200 NVL72 di Nvidia, che utilizza 72 delle sue GPU Blackwell in un'unica configurazione, oppure la configurazione Helios a 72 GPU di AMD, che offre le sue GPU Instinct MI455X con più memoria per GPU.
L'offerta di Alibaba non è più veloce di nessuno dei due esempi citati, entrambi tra le opzioni più veloci disponibili per i consumatori di tutto il mondo, ma offre ai consumatori cinesi una combinazione di vantaggi che altrimenti non sarebbero disponibili: chip di silicio cinesi, un cloud cinese e tempi di risposta più bassi.
Un super-nodo localizzato costruito su una combinazione di restrizioni e sanzioni governative
Con Pechino che limita l'accesso dei fornitori di servizi cloud cinesi ai più recenti chip Nvidia e AMD che possono acquistare – una mossa vista come una ritorsione per le politiche sempre più restrittive della Casa Bianca – le migliori opzioni per le aziende e le startup di intelligenza artificiale stanno diventando sempre più locali. I chip prodotti in Cina da Alibaba Cloud sono un esempio lampante di come questa politica stia plasmando la sua offerta, evidenziando la minaccia alla resilienza rappresentata dalla crescente dipendenza dai fornitori di intelligenza artificiale.
Il processore core Zhenwu M890 ha fatto il suo debutto all'Alibaba Cloud Summit nel maggio 2026, dove l'azienda ha anche svelato una roadmap dettagliata per i chipset fino al 2028. Questo processore, sviluppato da T-Head, l'unità di progettazione di chipset del gruppo, è dotato di 144 GB di memoria HBM con una larghezza di banda inter-chip fino a 800 GB/s. La sua interconnessione utilizza un chip ICNSwitch 1.0 interno, aumentando la capacità di espansione da 16 schede della precedente generazione Zhenwu 810E a 64 e incrementando la larghezza di banda da 700 GB/s.
L'azienda afferma che questa configurazione è, in teoria, in grado di gestire una configurazione AI Mixture of Experts (MoE) fino a 10 trilioni di parametri, sottolineando che si tratta della prima architettura di supernodo in Cina a eseguire con successo modelli linguistici di grandi dimensioni che superano i 2 trilioni di parametri; Alibaba osserva inoltre che la versione attuale esegue già servizi commerciali per Kimi K3 e Qwen3.8-Max.
La roadmap di Alibaba per i processori successivi all'M890 prosegue. T-Head ha annunciato che il processore Zhenwu V900 arriverà nel terzo trimestre del 2027, offrendo prestazioni tre volte superiori a quelle dell'M890, con 216 GB di memoria e una larghezza di banda inter-chip di 1200 GB/s. Il Zhenwu J900 seguirà nel terzo trimestre del 2028.
Non sono disponibili informazioni pubbliche sui prezzi di questo supernodo, né sul suo consumo energetico; i confronti con le soluzioni più diffuse sono, nella migliore delle ipotesi, scarsi. Nonostante le informazioni limitate e i vincoli geografici, questa mossa sottolinea la crescente autosufficienza della Cina nel settore dell'intelligenza artificiale e le sue ambizioni, che potrebbero portare a rendere il supernodo disponibile a una gamma più ampia di consumatori, sia a livello nazionale che internazionale, nel prossimo futuro.
I commenti sono chiusi.