SAP AI Core
À jour au 2026-09-27
Qu'est-ce que SAP AI Core ?
SAP AI Core est le runtime SAP BTP qui exécute les charges d'IA — entraînements et traitements batch orchestrés par Argo, mise à disposition de modèles via KServe — et qui héberge, avec le plan extended, le generative AI hub. Tout part d'un tenant par sous-compte, découpé en resource groups ; la clé de service est le ticket d'entrée ; la consommation se facture en capacity units.
Ce que c'est
SAP AI Core est un service de SAP Business Technology Platform qui gère l'exécution et l'exploitation d'actifs d'IA « de manière standardisée, évolutive et indépendante de l'hyperscaler » (guide de service SAP AI Core, septembre 2026). Il est disponible dans les environnements Cloud Foundry, Kyma et Kubernetes et fonctionne avec deux compagnons : SAP AI Launchpad, console SaaS multitenant qui pilote les scénarios d'IA sur un ou plusieurs runtimes et donne accès au generative AI hub, et l'AI API, la spécification ouverte de cycle de vie que les deux parlent. Sous le capot, AI Core fait tourner Kubernetes, s'appuie sur Argo Workflows pour les pipelines et sur KServe pour le serving, synchronise les modèles de workflow depuis votre dépôt Git, tire les images de votre registre Docker et lit et écrit les artefacts dans votre object store. Le generative AI hub n'est pas un produit à part : SAP le décrit comme une capacité d'AI Core et d'AI Launchpad qui « étend » AI Core, et il n'existe qu'avec le plan de service extended.
Pourquoi c'est important
- La conception des resource groups décide de la ventilation des coûts et de la séparation des accès pour tout le programme — et les objets d'exécution ne se déplacent pas d'un resource group à l'autre après coup.
- Le choix du plan est à sens unique : standard peut passer en extended mais jamais l'inverse, et sans extended il n'y a pas de generative AI hub.
- Le journal d'audit d'AI Core couvre les événements de gestion, pas les prompts — prouver ce qu'un modèle a vu exige l'inference observability, activée requête par requête.
Points clés
- AI Core = runtime BTP des charges d'IA sur Kubernetes : Argo Workflows pour les exécutions d'entraînement et batch, KServe pour le serving, Git + ArgoCD pour les modèles.
- Un tenant AI Core par sous-compte ; plusieurs instances de service dans le même sous-compte partagent ce tenant.
- Les resource groups isolent les objets d'exécution (configurations, exécutions, déploiements, artefacts) ; executables, scénarios et secrets Docker sont communs au tenant. Limite par défaut : 50 resource groups.
- Scénario → executable → configuration → exécution (run) ou déploiement (URL d'inférence) : le vocabulaire de base de l'AI API.
- Plans : standard (IA sur mesure, sans IA générative) et extended (ajoute le generative AI hub). Montée seulement ; le plan gratuit a pris fin le 22 mai 2026, un essai de 30 jours subsiste.
- Clé de service = clientid/clientsecret (ou x.509) + url XSUAA + AI_API_URL ; la rotation des identifiants revient au client.
- Facturation en capacity units : heures-nœud, stockage et socle plafonné à 730 h/mois pour l'IA sur mesure ; mesure au token pour les modèles de fondation et le grounding.
- ISO/IEC 42001 couvre Joule, AI Core et AI Launchpad ; le journal d'audit trace les événements de gestion, les prompts uniquement via l'inference observability, sur option.
Termes employés sur cette page
- AI API
- Spécification ouverte de gestion des artefacts et workflows d'IA sur plusieurs runtimes ; SAP AI Core en est une implémentation, SAP AI Launchpad un client.
- Resource group
- Unité d'isolement d'un tenant AI Core, associée à un namespace Kubernetes ; détient configurations, exécutions, déploiements, artefacts et ses secrets.
- Scénario
- Regroupement des executables d'un cas d'usage ; les scénarios globaux gérés par SAP incluent foundation-models et orchestration.
- Executable
- Modèle réutilisable de workflow ou de serving avec emplacements ; non déployable il produit des exécutions, déployable des déploiements.
- Configuration
- Liaison de valeurs de paramètres et de versions d'artefacts concrètes à un executable ; indispensable pour lancer une exécution ou un déploiement.
- Exécution
- Un passage d'un executable de workflow — entraînement ou inférence batch — qui produit des artefacts de sortie, modèles ou jeux de résultats.
- Déploiement
- Instance d'un executable de serving qui crée un serveur de modèle doté d'une URL d'inférence HTTPS.
- Capacity unit (CU)
- Unité de facturation SAP BTP ; AI Core convertit heures-nœud, stockage, heures-tenant de socle et GenAI tokens en CU.
Sources
- SAP AI Core service guide (PDF, 4 Sep 2026)
- SAP AI Core — Resource Groups (SAP-docs)
- SAP AI Core — Service Plans (SAP-docs)
- SAP AI Core — Metering and Pricing for Generative AI (SAP-docs)
- SAP AI Core — Multitenancy (SAP-docs)
- SAP AI Core — What's New (SAP-docs)
- SAP News — TabPFN-3.5 Plus now available in SAP AI Core (15 Sep 2026)
- SAP Community — SAP Business AI earns ISO/IEC 42001 certification
- SAP Learning — Describing SAP AI Foundation
- SAP Help Portal — Orchestration service overview (generative AI hub, SAP AI Core)
- SAP Help Portal — Metering and pricing for generative AI (SAP AI Core service guide)
- SAP Help Portal — Generative AI hub overview (SAP AI Core)
Fiche complète réservée aux abonnés. Ce que la fiche complète ajoute : le cadre de décision complet · la comparaison SAP · Snowflake · Databricks · Fabric · les pièges courants et leur correctif · l'aide-mémoire · les schémas d'architecture · les blocs de code · les chiffres à citer.