SERVIZI: Componenti AI

Fastweb AI Factory

FastwebAI Factory è l’infrastruttura di calcolo Fastweb dedicata all’Intelligenza Artificiale, interamente situata in Italia. È pensata per rispondere alle esigenze più impegnative in ambito AI: addestramento e utilizzo di modelli linguistici di grandi dimensioni (LLM), calcolo ad alte prestazioni (HPC) e realizzazione di soluzioni RAG per interrogare in linguaggio naturale i documenti aziendali.

Il cuore dell’infrastruttura è il SuperPod NVIDIA, ospitato in un Data Center di classe Tier IV nel Nord Italia: 31 nodi NVIDIA DGX H100, tra le configurazioni di calcolo più potenti oggi disponibili, collegati da reti ad altissima velocità per garantire il massimo delle prestazioni nell’addestramento dei modelli. Il SuperPod è affiancato da FASTedge, l’infrastruttura distribuita sul territorio italiano che ospita i carichi di lavoro tradizionali e di Machine Learning non generativo, oltre al backup dei dati — mantenendo così ogni componente nel posto più adatto, per le migliori prestazioni al minor costo.

Sicurezza e riservatezza al centro del progetto

L’infrastruttura è stata progettata insieme a NVIDIA per garantire la completa segregazione dei dati e dei processi di ogni cliente, con ambienti isolati e protetti — una caratteristica fondamentale per i settori più regolamentati o per la gestione di informazioni sensibili. La sicurezza dell’intera infrastruttura è inoltre verificata periodicamente da 7Layers, la società di cybersecurity del gruppo Fastweb.

I servizi disponibili

Ogni azienda viene accompagnata da un percorso di consulenza dedicato, che parte dall’ascolto delle esigenze reali per arrivare a una soluzione dimensionata su misura. I principali servizi disponibili:

  • Node as a Service — Uno o più nodi di calcolo dedicati ed esclusivi, riservati per tutta la durata del contratto, per addestrare modelli linguistici propri o eseguire simulazioni complesse (dalla modellazione climatica alla ricerca medica), con un ambiente software già pronto all’uso.
  • FASTedge — La piattaforma per ospitare le applicazioni tradizionali e i progetti di Machine Learning non generativo, sempre collegata alla FastwebAI Factory per integrare facilmente componenti di AI Generativa quando servono.
  • Inference on Reserved GPU — Un servizio interamente gestito da Fastweb per mettere in produzione modelli linguistici (pubblici o sviluppati dal cliente), con risorse di calcolo dedicate e garanzie precise su velocità di risposta e capacità di gestire più utenti contemporaneamente.

I vantaggi:

  • Dati e infrastruttura in Italia, per la massima sicurezza e la piena conformità alle normative nazionali ed europee.
  • Massima potenza di calcolo, tra le infrastrutture di questo tipo più performanti disponibili oggi in Italia.
  • Risorse dedicate ed esclusive, non condivise con altri clienti, per la massima riservatezza dei propri modelli e dati.
  • Soluzione su misura, dimensionata sulle reali esigenze dell’azienda, evitando sprechi di risorse e di budget.
  • Sicurezza verificata da specialisti, grazie al controllo periodico di 7Layers.