CorporateAI
Visione di progetto
Infrastruttura AIcome utilitycondivisa.
Un'infrastruttura di calcolo locale, proposta per l'ecosistema Salvitelle: le aziende residenti attingono a capacità condivisa invece di costruirsi ognuna il proprio stack.
- 05Spazi di lavoro
- 04Piattaforma AI
- 03Archiviazione e rete
- 02Calcolo
- 01Energia
Hardware di riferimento
Che cosa può fare un nodo.
Per ragionare su numeri concreti serve una piattaforma di riferimento. Le cifre qui sotto descrivono un nodo di calcolo disponibile sul mercato: servono a dare un ordine di grandezza, non descrivono hardware di Salvitelle.
Specifica di riferimento. La configurazione finale di CorporateAI è da definire.
- Valore teorico FP4, ottenuto sfruttando la sparsity.
Prestazioni misurate
Due misurazioni pubblicate sulla stessa piattaforma. Usano precisioni e backend diversi: sono due punti indipendenti, non una gara fra modelli.
Elaborazione del prompt
- Qwen3 14B5928,95token/s
NVFP4 · TRT-LLM
- GPT-OSS-20B3670,42token/s
MXFP4 · llama.cpp
Generazione dei token
- Qwen3 14B22,71token/s
NVFP4 · TRT-LLM
- GPT-OSS-20B82,74token/s
MXFP4 · llama.cpp
Condizioni: ISL|OSL = 2048|128 · BS=1
I risultati variano con modello, backend, precisione e carico di lavoro.
E con più nodi?
La capacità aggregata è una moltiplicazione — ed è proprio questo a renderla teorica.
- PFLOP FP4 aggregati
- 1
- GB di memoria aggregata
- 128
Capacità aggregata teorica. Le prestazioni reali dipendono da carico di lavoro, rete, software, utilizzo e modello, e non crescono in modo lineare.
Dai modelli piccoli alla scala di frontiera.
Quanto spazio occupa un modello, e a che cosa serve una taglia rispetto a un'altra.
7B
Sperimentazione locale
Peso dei parametri a 4 bit
4GB
sui 128 GB di memoria unificata di un nodo
Visualizzazione didattica. Il valore indica i soli pesi: la memoria realmente occupata aggiunge cache KV, attivazioni e runtime. Non implica che ogni modello di ogni taglia giri in modo efficiente sulla piattaforma di riferimento.
Quante macchine servono davvero
Sposta i cursori. Il modello è aritmetica su due ipotesi dichiarate, e non produce euro: nessun documento di progetto indica un prezzo per nodo, quindi una cifra in denaro qui sarebbe inventata. Produce macchine — quante ne servono da soli, quante condividendo, e quante non serve comprare.
5
110
Leggero
4 GB di pesi residenti per azienda
Risultato dello scenario
- Nodi, ognuno per sé
- 5
- Nodi, condividendo
- 1
- Nodi non acquistati
- 4
3% della memoria usata
16% della memoria usata
Macchine, non risparmio: il prezzo di un nodo non è dichiarato da nessuna fonte.
5 aziende tengono in memoria 20 GB di pesi in tutto. Un nodo di riferimento ne ha 128.
Ipotesi
- A · Un nodo è l'unità che si compra. Un'azienda che si attrezza da sola compra almeno un nodo, anche se non riesce a riempirlo. È questa indivisibilità l'argomento della pagina: non che l'hardware condiviso costi meno, ma che l'unità minima acquistabile è più grande di quello che serve alla maggior parte delle aziende.
- B · Il carico di lavoro è espresso come pesi del modello residenti in memoria, nelle taglie a 4 bit che questa pagina pubblica poco sopra. La memoria è il vincolo che si può ragionare senza inventare una cifra di throughput.
Solo i pesi: cache KV, attivazioni e runtime stanno sopra questi numeri, quindi sono un pavimento e non un requisito. Condividere memoria non è condividere tempo: questo dice che i modelli del gruppo ci stanno, non che girino tutti insieme a piena velocità. Il nodo è la piattaforma di riferimento descritta sopra, non una configurazione CorporateAI progettata: tutte le capacità lato Salvitelle restano da determinare.
Lato Salvitelle
Quello che non è ancora deciso.
I numeri qui sopra descrivono una piattaforma di riferimento. Questi invece riguardano CorporateAI, e nessuno di essi è determinato: dimensionamento, capacità e modello economico dipendono dallo studio di fattibilità.
Numero di acceleratori
n.
Da determinareCapacità di calcolo aggregata
Dimensione del cluster
Potenza elettrica dedicata
kW
Da determinareModello economico
- Da determinare
- Non ancora determinato: sarà definito dal modello economico.
Una infrastruttura.Molte imprese.
CorporateAI è pensata come uno strato di infrastruttura AI condivisa dentro Salvitelle Corporate Hub. Non un altro prodotto SaaS: un'infrastruttura fisica e digitale pensata perché le aziende costruiscano.
Allocazione
Da determinareIl modello prevede che le startup residenti selezionate possano accedere a una quota definita dell'infrastruttura senza addebiti diretti di infrastruttura, subordinatamente al modello operativo finale e alla capacità disponibile.
Entità dell'allocazione e modello operativo non sono determinati.
Da dove si comincia