Skip to content IA
  • Panoramica

    • Novità sull'IA
    • Blog tecnico
    • Eventi live sull'IA
    • L’importanza dell’inferenza
    • Il nostro approccio
  • Prodotti

    • Lightwell
    • Red Hat AI Enterprise
    • Red Hat AI Inference
    • Red Hat Enterprise Linux AI
    • Red Hat OpenShift AI
    • Scopri Red Hat AI
  • Partecipazione e formazione

    • Hub per l’apprendimento
    • Argomenti relativi all'IA
    • Partner IA
    • Servizi per l'IA
Cloud ibrido
  • Piattaforme

    • Intelligenza artificiale

      Crea, distribuisci e monitora i modelli e le app di IA.

    • Standardizzazione di Linux

      Ottieni coerenza tra gli ambienti operativi.

    • Sviluppo di applicazioni

      Semplifica creazione, deployment e gestione delle app.

    • Automazione

      Estendi l'automazione e unisci tecnologia, team e ambienti.

  • Scenari di utilizzo

    • Virtualizzazione

      Rinnova le operazioni per carichi di lavoro virtualizzati e containerizzati.

    • Sovranità digitale

      Controlla e proteggi le infrastrutture critiche.

    • Sicurezza

      Sviluppa, crea, distribuisci e monitora il software di sicurezza.

    • Edge computing

      Distribuisci i carichi di lavoro vicino alla sorgente con l'edge.

  • Esplora le soluzioni
  • Soluzioni per settore

    • Automotive
    • Servizi finanziari
    • Sanità
    • Settore industriale
    • Media e intrattenimento
    • Settore pubblico (globale)
    • Settore pubblico (USA)
    • Telecomunicazioni

Scopri le tecnologie cloud

Scopri come utilizzare i prodotti e le soluzioni cloud secondo i tuoi ritmi nella Red Hat® Hybrid Cloud Console.

Prodotti
  • Piattaforme

    • Red Hat AI icon artificial intelligence, Red Hat Enterprise Linux AI, Red Hat OpenShift AI, RHEL AI, machine learning Red Hat AI

      Sviluppa e distribuisci soluzioni di IA nel cloud ibrido.

    • Red Hat Enterprise Linux icon RHEL, Linux platforms, CentOS Red Hat Enterprise Linux

      Supporta l'innovazione hybrid cloud con un sistema operativo adattabile.

    • Red Hat OpenShift icon Cloud, Containers, Kubernetes Red Hat OpenShift

      Crea, modernizza e distribuisci app in modo scalabile.

    • Red Hat Ansible Automation Platform icon Management, edge Red Hat Ansible Automation Platform

      Estendi l'automazione a tutta l'azienda.

  • In primo piano

    • Lightwell
    • Red Hat AI Enterprise
    • Red Hat OpenShift Virtualization Engine
    • Red Hat Desktop
    • Vedi tutti i prodotti
  • Prova e acquista

    • Inizia il periodo di prova
    • Acquista online
    • Scopri i provider cloud certificati
  • Servizi e supporto

    • Consulenza
    • Supporto per i prodotti
    • Servizi per l'IA
    • Technical Account Management
    • Esplora servizi e supporto
Formazione
  • Formazione & certificazione

    • Corsi ed esami
    • Certificazioni
    • Valutazione delle competenze
    • Red Hat Academy
    • Learning subscription
    • Vedi le offerte formative
  • In primo piano

    • Red Hat Certified System Administrator Exam
    • Red Hat System Administration I
    • Prova Red Hat Learning Subscription (Nessun costo)
    • Red Hat Certified Engineer Exam
    • Red Hat Certified OpenShift Administrator Exam
  • Servizi

    • Consulenza
    • Formazione per i partner
    • Supporto per i prodotti
    • Servizi per l'IA
    • Technical Account Management
Apprendimento
  • Sviluppa competenze

    • Documentazione
    • Laboratori pratici
    • Hub di Red Hat per la formazione
    • Demo interattive
    • Formazione e certificazioni
  • Contenuti per l'apprendimento

    • Blog
    • Eventi e webinar
    • Serie podcast e video
    • Red Hat TV
    • Libreria delle risorse

Per sviluppatori

Scopri le risorse e gli strumenti per creare, distribuire e gestire applicazioni e servizi cloud native.

Partner
  • Per i clienti

    • I nostri partner
    • Red Hat Ecosystem Catalog
    • Trova un partner
  • Per i partner

    • Partner Connect
    • Diventa partner
    • Training
    • Supporto
    • Accedi al portale dedicato ai partner

Crea soluzioni supportate da partner affidabili

Trova le soluzioni della nostra community collaborativa di esperti e tecnologie nel Red Hat® Ecosystem Catalog.

ConsoleDocumentazioneSupporto Cerca

Vorrei:

  • Inizia il periodo di prova
  • Acquista Red Hat Learning Subscription
  • Gestire sottoscrizioni
  • Contatta l'ufficio vendite
  • Contatta l'assistenza clienti
  • Vedere le offerte di lavoro

Aiutami a trovare:

  • Documentazione
  • Risorse per sviluppatori
  • Articoli sulle tecnologie
  • Architecture center
  • Aggiornamenti di sicurezza
  • Assistenza clienti

Desidero informazioni su:

  • Intelligenza artificiale
  • Modernizzazione delle applicazioni
  • Automazione
  • Applicazioni cloud native
  • Linux
  • Virtualizzazione
Nuovo Per te

Consigliati

Ti consiglieremo le risorse scelte per te durante la navigazione. Prova subito questi suggerimenti:

  • Prova i prodotti
  • Corsi ed esami
  • Tutti i prodotti
  • Articoli sulle tecnologie
  • Libreria delle risorse
Accedi

Ottieni di più con un account Red Hat

  • Accesso alla console
  • Registrazione all'evento
  • Corsi e prove prodotti
  • Supporto di prim'ordine
Scopri altri vantaggi dell'accountAccedi o registrati

Alcuni servizi potrebbero richiedere una sottoscrizione.

Contattaci
Red Hat logo
  1. Home
  2. Risorse
  3. Una guida per Models-as-a-Service

Una guida per Models-as-a-Service

25 marzo 2026•
Risorsa: Panoramica
Salva PDF

L'adozione dell'IA è in crescita, ma i problemi legati all'infrastruttura e agli accessi la ostacolano

L'interesse per l'IA è in rapida espansione: le organizzazioni desiderano generare valore aziendale utilizzando i modelli linguistici di grandi dimensioni (LLM), l'analisi predittiva, le capacità di visione e altri strumenti avanzati. Tuttavia, il passaggio dell'IA dalla sperimentazione isolata all'adozione su larga scala comporta notevoli sfide infrastrutturali e operative.

Molte organizzazioni iniziano il percorso di adozione dell'IA con le interfacce di programmazione delle applicazioni (API) degli LLM commerciali, come quelle di OpenAI o Anthropic, partendo dal presupposto che sia la modalità più rapida per passare alla fase di produzione. Tuttavia, con l'aumento dell'utilizzo, i costi crescono e i team devono fronteggiare limitazioni in termini di osservabilità, personalizzazione e privacy dei dati. In alcuni casi, i provider di IA commerciali apportano modifiche ai modelli con poco preavviso, interrompendo l'utilizzo aziendale.

Di conseguenza, alcune organizzazioni adottano la soluzione opposta, creando i propri modelli da zero. Questo approccio fai da te spesso porta i team a distribuire in modo indipendente modelli open source come Llama o Mistral con scarso coordinamento. Il risultato è un ambiente frammentato in cui ciascun gruppo gestisce il proprio stack, che ha come conseguenze un'infrastruttura ridondante, la presenza di unità di elaborazione grafica (GPU) inattive e un sovraccarico operativo significativo. La sicurezza e la governance ne risentono e i costi aumentano senza offrire molto valore aziendale.

Queste sfide sono state ulteriormente esacerbate dalle dimensioni crescenti dei recenti LLM come Llama, DeepSeek, Mistral o Qwen. A differenza dei modelli di IA su scala relativamente piccola di pochi anni fa, i modelli di grandi dimensioni odierni possono richiedere terabyte di vRAM. E le GPU sono molto costose. Un utilizzo inefficiente di queste risorse può portare rapidamente a un aumento vertiginoso dei costi. La situazione peggiora quando più team all'interno della stessa organizzazione tentano di distribuire questi modelli in modo indipendente. Questo approccio frammentario aumenta i costi operativi e gonfia le spese.

Le organizzazioni hanno bisogno di un approccio interno che semplifichi e consolidi l'utilizzo dei modelli, ottimizzi le risorse hardware e consenta un accesso controllato e scalabile per diversi gruppi di utenti interni. Senza un approccio di questo tipo, le iniziative di IA rischiano che l'adozione sia ridotta e le spese operative aumentino, gli investimenti nell'infrastruttura rimangano sottoutilizzati e i risultati misurabili, come l'aumento della produttività, la riduzione dei costi operativi o l'accelerazione dei tempi di rilascio delle informazioni, rimangano difficili da ottenere.

Cos'è Models-as-a-Service?

 Models-as-a-Service (MaaS) è un approccio alla distribuzione dei modelli di IA come risorse condivise, che consente agli utenti di un'organizzazione di accedere a tali modelli on demand. MaaS offre una base interamente predisposta per l'IA, attraverso endpoint delle API (interfacce di programmazione delle applicazioni), che promuove un utilizzo scalabile ed efficiente dell'intelligenza artificiale, preservandone la riservatezza.

L'approccio Models-as-a-Service a questa sfida

Models-as-a-Service (MaaS) è un approccio che consente alle organizzazioni di distribuire i modelli di IA una sola volta e distribuirli come risorse condivise e incentrate sulla sicurezza in tutta l'azienda. Invece di gestire deployment isolati per i singoli team, con un approccio MaaS le aziende possono centralizzare l'infrastruttura e le operazioni di IA, semplificandone l'adozione interna.

Il flusso di lavoro per una configurazione Models-as-a-Service.

Figura 1. Il flusso di lavoro per una configurazione Models-as-a-Service.

Garantisci l'accesso condiviso all'IA con operazioni centralizzate sui modelli

  • Agli ingegneri dell'IA, MaaS offre un accesso più rapido ai modelli ad alte prestazioni tramite le API, eliminando la necessità di scaricare i modelli, gestire le dipendenze o richiedere allocazioni di GPU tramite lunghi ticket IT.

MaaS funziona impostando un team operativo di IA come proprietario centrale delle risorse di IA condivise. I modelli vengono distribuiti su una piattaforma scalabile (come Red Hat® OpenShift® AI o altre piattaforme simili) e quindi esposti tramite un gateway API. Questa configurazione consente a più utenti, sviluppatori e business unit di offrire un accesso semplificato agli utenti finali, soddisfacendo al contempo le priorità di sicurezza e governance per i team IT e finanziari. Questa definizione delle priorità può includere funzionalità di chargeback, con la possibilità di usare i modelli senza la necessità di accedere direttamente all'hardware o di avere competenze tecniche approfondite. L'obiettivo è fornire un accesso intuitivo ai modelli di IA e non alle risorse necessarie per eseguirli, come GPU e unità di elaborazione tensoriale (TPU). Tutto questo nel rispetto dei requisiti di conformità e prestazioni aziendali e senza complicare l'accesso per gli utenti finali.

In pratica, gli utenti interagiscono solo con le API che forniscono risposte generate dal modello. Così come i provider di IA pubblici astraggono le complessità hardware dagli utenti finali, i deployment MaaS interni offrono la stessa semplicità. Gli utenti non gestiscono direttamente l'infrastruttura hardware o software, non aspettano che un ticket IT venga risolto per loro conto né restano in attesa mentre un ambiente viene configurato su loro richiesta. Al contrario, i team dedicati alle operazioni IT e all'IA gestiscono centralmente il ciclo di vita dei modelli, la sicurezza, gli aggiornamenti e la scalabilità dell'infrastruttura, offrendo agli utenti un accesso semplificato ma controllato.

Questa centralizzazione non solo semplifica le operazioni interne di IA, ma migliora anche la sicurezza e la governance. L'accesso ai modelli di IA è strettamente controllato con la gestione delle credenziali tramite un gateway API. Le organizzazioni possono monitorare tempestivamente l'utilizzo, impostare meccanismi interni di chargeback, assicurarsi che le linee guida di conformità alla privacy vengano seguite e stabilire limiti operativi chiari, il che rende l'IA per le aziende gestibile e pratica. Il monitoraggio dell'utilizzo a livello di token (in entrata e in uscita) è il metodo più accurato e granulare, e molto più preciso di qualsiasi metrica a livello di GPU.

Controlla l'utilizzo, limita gli accessi e gestisci i costi

  • Gli ingegneri IT e della piattaforma beneficiano di una supervisione centralizzata, che impedisce il deployment non autorizzato dei modelli, applica gli standard di sicurezza e conformità e semplifica la gestione del ciclo di vita e dell'infrastruttura.
  • Per i team finanziari, il tracciamento centralizzato dell'utilizzo e i meccanismi interni di chargeback riducono gli sprechi e rendono l'utilizzo della GPU più prevedibile e responsabile, evitando spese eccessive dovute ad allocazioni hardware sottoutilizzate e specifiche per team.

Con un approccio MaaS il controllo si ottiene principalmente integrando un gateway API con l'infrastruttura di IA, che consente ai team di gestire e monitorare l'utilizzo dell'IA a un livello molto granulare.

I deployment tradizionali dell'IA spesso non sono gestiti o non sono efficienti, perché gli utenti o i team distribuiscono i modelli in modo indipendente e senza supervisione centralizzata. Questo approccio frammentato può portare a costose inefficienze, con risorse GPU inattive o sottoutilizzate. Collocare un gateway API al centro dell'infrastruttura di IA crea un punto di accesso controllato tra utenti e modelli.

Questa configurazione facilita il tracciamento preciso dell'utilizzo, fino al livello del singolo token. I team possono identificare chiaramente il consumo di ciascun utente, team o applicazione, attribuendo in modo accurato i costi di GPU e infrastruttura. Ad esempio, le organizzazioni possono determinare se un utente o un'applicazione particolare sta utilizzando le risorse in modo eccessivo e intraprendere azioni correttive, ad esempio limitando l'utilizzo o allocando i costi tramite meccanismi di chargeback interni.

Le funzionalità di throttling fornite dal gateway API garantiscono prestazioni coerenti e prevengono l'esaurimento delle risorse. La limitazione dell'uso consente ai team IT di gestire l'intensità degli accessi, impedendo ai singoli utenti di monopolizzare le risorse GPU o di compromettere le prestazioni di altri utenti.

Inoltre, i gateway API offrono una gestione granulare delle credenziali e il controllo degli accessi. Gli utenti interni possono generare le credenziali per accedere ai modelli di IA in modo indipendente, semplificando il carico amministrativo. Le credenziali possono anche essere revocate o modificate in meno tempo per rispondere ai cambiamenti dei requisiti di sicurezza o dei modelli di utilizzo.

Tutto questo significa che la gestione dei costi diventa più trasparente e responsabile. I team IT possono assegnare con precisione le spese relative a GPU e infrastruttura ai team o alle business unit che le utilizzano.

Supporta tutti i modelli, gli acceleratori e i cloud

Un principio cardine dell'approccio MaaS è il controllo. Consente alle organizzazioni di selezionare e distribuire un'ampia gamma di modelli di IA, scegliere gli acceleratori hardware preferiti e operare all'interno degli ambienti cloud o on premise esistenti. Questo approccio offre alle organizzazioni la libertà di implementare l'IA con precisione in base alle proprie esigenze tecniche, ai requisiti di sicurezza e alle preferenze operative.

  • L'adozione dell'IA è soggetta a rigidi limiti. Spesso le aziende sono:
    • Limitate da servizi cloud specifici.
    • Bloccate in ecosistemi di modelli proprietari.
    • Vincolate da infrastrutture hardware fisse.
  • MaaS risolve queste limitazioni in diversi modi, tra cui:
    • Supporto di modelli proprietari o open source, modelli con addestramento personalizzato e LLM più diffusi, come Llama e Mistral.
    • Espansione oltre ai modelli testuali, a includere l'analisi predittiva, la visione artificiale, gli strumenti di trascrizione dell'audio e altri scenari di utilizzo dell'IA generativa multimodale, come la generazione di immagini o video.
  • MaaS rimane indipendente dagli acceleratori hardware, quindi:
    • Le organizzazioni possono scegliere GPU o altri acceleratori in linea con i carichi di lavoro, le strutture dei costi e le esigenze prestazionali.
    • I team di IA centralizzata possono prendere decisioni critiche su dimensionamento e deployment, migliorando l'efficienza e riducendo gli errori da parte degli utenti meno tecnici.
  • La gestione centralizzata consente:
    • Allocazione e utilizzo ottimali dell'infrastruttura.
    • Riduzione dei costi operativi e prevenzione degli errori di configurazione delle risorse.
  • MaaS supporta il deployment in qualsiasi ambiente, inclusi:
    • Ambienti on premise, di cloud ibrido, isolati e di cloud pubblico, che si rivela particolarmente utile per i settori altamente regolamentati che richiedono la sovranità dei dati, la conformità normativa o controlli di sicurezza rigorosi.

In che modo Red Hat implementa l'approccio MaaS

Red Hat ha adottato MaaS internamente centralizzando il deployment e l'accesso ai modelli di IA. Il nostro team IA interno gestisce centralmente le risorse di IA e le operazioni sui modelli, utilizzando Red Hat OpenShift e Red Hat OpenShift AI come piattaforma alla base. Questo modello di deployment centralizzato semplifica l'utilizzo dell'IA da parte degli utenti dell'organizzazione, consentendo ai nostri sviluppatori e ai team aziendali di integrare in modo efficiente le funzionalità di IA nei flussi di lavoro senza bisogno di hardware dedicato o competenze tecniche approfondite.

La nostra implementazione prevede un'architettura di distribuzione scalabile che utilizza le GPU all'interno di OpenShift AI e connette gli utenti tramite un gateway API centralizzato. In questo modo è possibile accedere ai modelli di IA in modo controllato, incentrato sulla sicurezza e tracciabile. L'utilizzo è gestito accuratamente tramite il monitoraggio basato su token, che facilita il tracciamento preciso di chi utilizza i modelli, con quale frequenza e in quale quantità. Il risultato è un utilizzo dell'hardware ottimizzato, che riduce il consumo non necessario delle risorse GPU e offre informazioni dettagliate per ripartire con precisione i costi tra i diversi team o progetti interni.

La nostra implementazione MaaS utilizza flussi di lavoro GitOps, che garantiscono alta disponibilità e affidabilità. Questo approccio operativo riduce gli interventi manuali e i potenziali errori, stabilendo un controllo chiaro sui deployment dell'IA.

Uno dei principali vantaggi dell'implementazione MaaS interna è stato un netto miglioramento dell'efficienza delle risorse e dell'esperienza dell'utente. Invece di far eseguire il provisioning delle GPU e distribuire i modelli in modo indipendente a più team, MaaS ha eliminato le duplicazioni, semplificato le operazioni interne e accelerato notevolmente il time to value. Quando i nuovi modelli vengono testati e verificati, i team Red Hat possono integrarli e utilizzarli immediatamente, invece di essere ritardati dall'allocazione dell'hardware o dalle attività di provisioning.

Inizia subito a realizzare la tua piattaforma di IA interna

Vuoi semplificare la distribuzione dell'IA e ottenere un valore reale dagli investimenti nell'infrastruttura? Inizia leggendo il nostro approfondimento sull'approccio MaaS per sapere di più sul suo funzionamento. Quindi, consulta la pagina del prodotto OpenShift AI per valutare le funzionalità della piattaforma e le linee guida per l'utilizzo della GPU.

Per i team che creano modelli MaaS internamente, Red Hat Consulting aiuta le organizzazioni a progettare e rendere operativi ambienti di model serving su misura per le loro esigenze. Scopri di più sulla pagina di Red Hat Consulting per l'IA.

Vuoi una panoramica più completa di esempi reali? Dai un'occhiata alla nostra serie di webinar on demand, inclusa la sessione dedicata all'approccio MaaS.

Tag:Intelligenza artificiale

Red Hat logo

About Red Hat

Red Hat is the open hybrid cloud technology leader, delivering a trusted, consistent and comprehensive foundation for transformative IT innovation and AI applications. Its portfolio of cloud, developer, AI, Linux, automation and application platform technologies enables any application, anywhere—from the datacenter to the edge. As the world's leading provider of enterprise open source software solutions, Red Hat invests in open ecosystems and communities to solve tomorrow's IT challenges. Collaborating with partners and customers, Red Hat helps them build, connect, automate, secure, and manage their IT environments, supported by consulting services and award-winning training and certification offerings.

  • North America
  • Asia Pacific
  • Latin America
  • Europe, Middle East, and Africa
  • 888-REDHAT1
  • +6564904200
  • +5443297300
  • +0080073342835
  • www.redhat.com
  • apace@redhat.com
  • info-latam@redhat.com
  • europe@redhat.com
  • @red-hat
  • @redhat
  • @redhat
  • @red_hat

Copyright © 2026 Red Hat. Red Hat, the Red Hat logo, Ansible, and OpenShift are trademarks or registered trademarks of Red Hat, LLC or its subsidiaries in the United States and other countries. Linux® is the registered trademark of Linus Torvalds in the U.S. and other countries. The OPENSTACK logo and word mark are trademarks or registered trademarks of OpenInfra Foundation, used under license. All other trademarks are the property of their respective owners.

Red Hat logo

Piattaforme

  • Red Hat AI
  • Red Hat Enterprise Linux
  • Red Hat OpenShift
  • Red Hat Ansible Automation Platform
  • Scopri tutti i prodotti

Strumenti

  • Formazione e certificazioni
  • Il mio account
  • Supporto clienti
  • Risorse per sviluppatori
  • Trova un partner
  • Red Hat Ecosystem Catalog
  • Documentazione

Prova, acquista, vendi

  • Prova i prodotti
  • Red Hat Store
  • Acquista online (Giappone)
  • Console

Comunica

  • Contatta l'ufficio vendite
  • Contatta l'assistenza clienti
  • Contatta un esperto della formazione
  • Social media

Informazioni su Red Hat

Red Hat, tra i leader delle tecnologie hybrid cloud open source, offre alle aziende una base coerente e completa per applicazioni IT trasformative e app di intelligenza artificiale (IA). Consulente di fiducia inserito nella classifica Fortune 500, Red Hat offre tecnologie cloud, Linux, per lo sviluppo, per l’automazione, piattaforme applicative e servizi pluripremiati.

  • La nostra azienda
  • Il nostro modello di business
  • Storie di successo
  • Relazioni con gli analisti
  • Comunicati stampa
  • L'impegno nell'open source
  • L’impegno nel sociale
  • Offerte di lavoro

Red Hat legal and privacy links

  • Informazioni su Red Hat
  • Opportunità di lavoro
  • Eventi
  • Sedi
  • Contattaci
  • Blog di Red Hat
  • Red Hat come ambiente inclusivo
  • Cool Stuff Store
  • Red Hat Summit

Red Hat legal and privacy links

  • Informativa sulla privacy
  • Termini di utilizzo
  • Tutte le informative e le linee guida
  • Accessibilità digitale
© 2026 Red Hat