-
Produits et documentation Red Hat AI
Plateforme de produits et de services pour le développement et le déploiement de l'IA dans le cloud hybride.
Red Hat AI Enterprise
Assemblez, développez et déployez des applications basées sur l'IA dans le cloud hybride.
Red Hat AI Inference
Optimisez les performances des modèles à l'aide d'une pile intégrée pour des opérations d'inférence rapides, cohérentes et économiques à grande échelle.
Red Hat Enterprise Linux AI
Développez, testez et exécutez des modèles d'IA générative pour alimenter les applications d'entreprise.
Red Hat OpenShift AI
Assemblez et déployez des applications et modèles basés sur l'IA à grande échelle dans des environnements hybrides.
-
Se former Notions de base
- Nouveautés de Red Hat AI
- Comprendre l'importance de l'inférence d'IA
- Le framework vLLM, qu'est-ce que c'est ?
- L'inférence d'IA, qu'est-ce que c'est ?
- L'IA agentique, qu'est-ce que c'est ?
- L'AgentOps, qu'est-ce que c'est ?
- Le framework llm-d, qu'est-ce que c'est ?
- Voir tous les thèmes liés à l'IA
- Voir tous les articles de blog sur l'IA
Avantages de Red Hat AI
Ressources techniques
-
Partenaires pour l'IA
Red Hat Enterprise Linux AI
Red Hat Enterprise Linux® AI est une plateforme conçue pour l'exécution de grands modèles de langage (LLM) sur des serveurs individuels. Elle inclut Red Hat AI Inference pour exécuter des opérations d'inférence rapides, cohérentes et économiques dans le cloud hybride.
Liens rapides
Présentation
Red Hat Enterprise Linux AI rassemble deux composants qui évoluent indépendamment :
- La solution Red Hat AI Inference, qui offre le niveau de maîtrise de l'exploitation nécessaire pour exécuter tous les modèles sur tous les accélérateurs, dans tous les environnements
- Une image de démarrage de Red Hat Enterprise Linux, qui comprend des modèles d'inférence optimisés pour le matériel et des bibliothèques d'IA fréquemment utilisées, comme PyTorch
Inférence rapide et flexible
La solution Red Hat AI Inference repose sur les frameworks vLLM et llm-d, qui permettent à cette pile d'inférence de bout en bout d'optimiser le coût par jeton textuel et la capacité du matériel pour réduire les délais de réponse.
La mise en paquet du système d'exploitation avec le serveur d'inférence facilite les opérations de déploiement. Vous pouvez ainsi mettre à disposition les modèles de votre choix et les faire évoluer dans l'environnement qui vous convient le mieux.
Avantages
Modèles d'IA générative Open Source
Accédez à des modèles Open Source de la famille Granite, qui sont adaptés aux entreprises.
Opérations d'inférence économiques
Optimisez l'utilisation des processeurs graphiques (GPU) avec vLLM pour renforcer l'efficacité sans dégrader les performances.
Déploiement flexible et cohérent
Exécutez vos modèles là où vous en avez besoin (datacenters, clouds ou périphérie du réseau), sur du matériel et des systèmes d'exploitation variés.
233 % de ROI avec Red Hat AI
Nous avons chargé Forrester Consulting de réaliser une étude Total Economic Impact™ (TEI) pour déterminer le potentiel retour sur investissement (ROI) que les entreprises peuvent réaliser en déployant Red Hat AI.
L'enquête menée auprès de clients qui utilisent Red Hat AI a révélé qu'une entreprise typique avait obtenu un ROI de 233 % sur trois ans, ce qui représente une valeur totale de plus du triple de l'investissement initial1.
Points forts du produit
| Fonction | Détails | Avantage |
|---|---|---|
LLM pour les entreprises | Réglez des modèles spécifiques de plus petite taille sur la base de vos propres données. | Avec des options flexibles pour le réglage et le déploiement des modèles, vos équipes peuvent travailler plus rapidement selon vos conditions. |
Instances de démarrage optimisées pour l'exécution des modèles | Gérez votre plateforme d'IA comme une image de conteneur. Les modèles Granite sont mis en paquet sous forme d'images de démarrage de Red Hat Enterprise Linux au moyen du mode image. Ces images incluent PyTorch, les bibliothèques d'exécution requises et les accélérateurs matériels pour NVIDIA. | Le mode image offre une approche simple et cohérente pour assembler, déployer et gérer le système d'exploitation à l'aide de technologies de conteneurisation. |
vLLM | Maximisez le débit et réduisez la latence en optimisant l'utilisation des GPU. | Exécutez des opérations d'inférence efficaces à un coût par jeton textuel plus faible. |
LLM Compressor | Compressez les modèles de fondation et les modèles entraînés de toutes tailles pour réduire l'utilisation des ressources de calcul et les coûts associés. | Accélérez l'inférence des modèles sans altérer la qualité des données ni la précision des réponses. |
Portabilité dans le cloud hybride | Utilisez une plateforme unifiée et hautement efficace qui répond à vos besoins métier, quel que soit l'emplacement des données. | Exécutez les modèles de votre choix sur différents accélérateurs ainsi que dans des environnements Kubernetes et Linux. Intégrez des outils d'observabilité afin d'améliorer la surveillance et de prendre en charge les API de LLM, comme celles d'OpenAI, pour un déploiement flexible. |
Référentiel de modèles optimisé | Accédez à une collection de modèles préoptimisés et compatibles avec vLLM et les microservices NVIDIA NIM. | Déployez des modèles prêts à l'emploi pour des opérations d'inférence plus rapides qui répondent aux besoins de votre entreprise. |
Assistance technique adaptée aux entreprises | Bénéficiez d'une assistance pratique et d'une protection juridique dans le cadre de l'assurance Open Source. | Posez des questions aux spécialistes et aux consultants de Red Hat AI pour éviter les suppositions et les pertes de temps. |
Avantages de la gamme Red Hat AI
Appuyez-vous sur une base fiable qui prend en charge tous les modèles et tous les agents dans le cloud hybride, sur tout type d'accélérateur matériel. L'offre Red Hat AI permet aux entreprises de déployer des applications en fonction des exigences en matière de données, de conformité et de coûts.
Inférence
Gérez la complexité des modèles grâce à des opérations d'inférence rapides et efficaces optimisées par vLLM, ainsi qu'à la possibilité d'exécuter tous les modèles sur tous les accélérateurs dans le cloud hybride.
Données
Personnalisez des cas d'utilisation de l'IA agentique propres à un domaine à l'aide de modèles connectés aux données privées de votre entreprise.
Agents
Simplifiez et accélérez l'adoption de l'IA agentique en maintenant un niveau élevé de contrôle et de gouvernance.
Plateforme
Déployez des solutions d'IA fiables et résilientes qui reposent sur la transparence Open Source et l'évolutivité du cloud hybride.
Déployez votre solution avec l'aide de nos partenaires
Nos clients bénéficient à la fois des connaissances de spécialistes et de technologies pour en faire plus avec l'IA. Découvrez tous les partenaires qui s'efforcent d'obtenir une certification de compatibilité avec nos solutions.
Foire aux questions
Quelle est la différence entre Red Hat Enterprise Linux AI et Red Hat Enterprise Linux ?
Red Hat Enterprise Linux AI est une plateforme de modèles de fondation conçue pour l'exécution des LLM sur des serveurs individuels. Cette solution inclut Red Hat AI Inference, qui optimise le débit et réduit la latence pour assurer des opérations d'inférence rapides et économiques dans le cloud hybride, avec à la clé une diminution des coûts de calcul.
Red Hat Enterprise Linux est une distribution Linux Open Source développée par Red Hat pour le marché commercial. Elle fournit une base stable et flexible pour prendre en charge l'innovation dans le cloud hybride.
La plateforme Red Hat Enterprise Linux AI est fournie en tant qu'image de démarrage de Red Hat Enterprise Linux qui inclut des bibliothèques d'IA et des modèles Granite.
Faut-il acheter Red Hat Enterprise Linux pour utiliser Red Hat Enterprise Linux AI ?
Non, une licence Red Hat Enterprise Linux AI suffit et inclut tous les composants nécessaires.
Que contient la solution Red Hat Enterprise Linux AI ?
Red Hat Enterprise Linux AI inclut une image de démarrage d'une image de conteneur de Red Hat Enterprise Linux qui comprend les composants suivants :
- Red Hat AI Inference
- Modèles Granite Open Source
- Bibliothèques PyTorch et d'environnements d'exécution
- Pilotes pour accélérateurs (NVIDIA, Intel, AMD)
Quelle est la différence entre Red Hat Enterprise Linux AI et Red Hat OpenShift AI ?
Red Hat Enterprise Linux AI fournit des grands modèles de langage prêts à l'emploi sur un serveur individuel. Cette solution inclut Red Hat AI Inference, une appliance immuable spécialement conçue pour l'inférence. Grâce à la mise en paquet du système d'exploitation avec l'application, Red Hat Enterprise Linux AI simplifie les opérations de déploiement pour l'inférence d'IA dans le cloud hybride en optimisant la latence et en réduisant les coûts de calcul.
Red Hat OpenShift® AI fournit tous les outils nécessaires pour aider les clients à créer des applications basées sur l'IA à grande échelle. Red Hat OpenShift AI offre une plateforme MLOps complète et intégrée pour gérer le cycle de vie des modèles et ainsi garantir la prise en charge du calcul distribué, des workflows de collaboration, de la surveillance et des applications de cloud hybride.
Red Hat OpenShift AI inclut l'accès à Red Hat Enterprise Linux AI pour que les équipes puissent utiliser les mêmes modèles et outils d'alignement au sein de leur architecture OpenShift AI, et profiter de fonctionnalités MLOps d'entreprise supplémentaires.
Quel est le prix de la solution Red Hat Enterprise Linux AI ?
Le prix de la licence Red Hat Enterprise Linux AI est calculé en fonction du nombre d'accélérateurs.
Autres ressources sur l'IA
Cas d'utilisation pour une inférence rapide et efficace
Des modèles Open Source pour innover efficacement avec l'IA
Importance de l'inférence
Unlock generative AI innovation with Red Hat AI (webinar)
Parlez de Red Hat AI avec un représentant Red Hat
1 Étude de Forrester Consulting, commissionnée par Red Hat, « Forrester Total Economic Impact™ of Red Hat AI », février 2026