Chapitre 3 : Une technologie ouverte et flexible équilibre l'innovation de l'IA et la stabilité opérationnelle
La gamme Red Hat® AI accélère le développement et le déploiement de solutions d'IA pour les entreprises dans des environnements de cloud hybride. Il s'agit d'une plateforme complète qui répond aux besoins des clients là où ils se trouvent (qu'il s'agisse de débuter ou de passer à une architecture d'entreprise complète) tout en prenant en charge le déploiement de n'importe quel modèle sur n'importe quel accélérateur matériel. En associant la puissance des technologies open source à des modèles de pointe, Red Hat AI aide les entreprises à accélérer le rythme de leurs découvertes et à démocratiser l'accès aux derniers outils d'IA.
Red Hat AI inclut Red Hat AI Enterprise, pour les entreprises qui cherchent à déployer et mettre à l'échelle efficacement et n'importe où, Red Hat AI Inference Server, pour optimiser l'inférence des grands modèles de langage (LLM), Red Hat OpenShift® AI, pour les environnements de plateforme Kubernetes distribués, Red Hat Enterprise Linux AI, pour les environnements de serveurs Linux individuels, et Red Hat AI Accelerator, pour la prise en charge des capacités d'accélération matérielle dans Red Hat OpenShift. Ces solutions combinent la puissance des technologies open source aux modèles open source les plus performants, aidant les entreprises à accélérer le rythme des découvertes et à démocratiser l'accès aux outils et technologies de pointe. L'accès aux dernières innovations est complété par l'écosystème de partenaires de Red Hat, qui propose un éventail de produits et de services de partenaires testés, pris en charge et certifiés pour fonctionner avec nos technologies et aider les clients à relever leurs défis métier et techniques.
Ensemble, ces produits, services et technologies offrent :
Inférence flexible et efficace
Red Hat AI optimise l'inférence des modèles dans les environnements de cloud hybride pour aider les entreprises à déployer leurs modèles préférés de manière plus rentable et plus rapide. Son environnement d'exécution, vLLM, maximise le débit et minimise la latence, et la fonctionnalité LLM Compressor utilise des techniques de quantification avancées pour améliorer les vitesses d'inférence sans sacrifier la précision des prédictions. Le résultat est un environnement hautes performances pour la mise en service de modèles dans un large éventail d'applications.
Connecter les modèles aux données
Red Hat AI simplifie l'integration des données d'entreprise privées aux modèles d'IA, fournissant des outils standardisés pour préparer et ingérer des informations afin d'ancrer les résultats de l'IA dans des connaissances métier spécifiques et pertinentes. Les entreprises peuvent améliorer les performances des modèles grâce à des techniques de personnalisation, notamment le réglage fin, la génération augmentée de récupération (RAG) et le réglage des prompts. Cette approche garantit que les modèles d'IA s'alignent sur les scénarios de l'entreprise pour offrir des résultats métier mesurables.
Innovation de l'IA agentique
Red Hat AI fournit aux responsables une base fiable qui met l'accent sur la sécurité sur l'ensemble de la plateforme, du matériel jusqu'aux agents, afin de garantir l'application des politiques et la maîtrise des risques. La plateforme offre une inférence hautes performances, un accès à des modèles précis et une expérience simplifiée pour connecter les données aux agents. Grâce aux capacités AgentOps, Red Hat AI offre une gouvernance axée sur la sécurité et un contrôle d'accès basé sur l'identité, tout en offrant aux équipes la flexibilité d'utiliser leurs propres frameworks d'agents. Cela garantit qu'à mesure que les déploiements d'IA mûrissent, ils restent protégés, observables et entièrement gouvernés.