AI & Analytics Legends La plateforme de connaissance SAP Analytics
Fiche concept

Accès aux modèles dans le generative AI hub (la question du « SAP Model Gateway »)

Accès aux modèles dans le generative AI hub (la question du « SAP Model Gateway ») — illustration de section Analytics Legends pour la base de connaissances SAP Analytics (concepts, études, Academy)

À jour au 2026-09-27

Qu'est-ce que Accès aux modèles dans le generative AI hub (la question du « SAP Model Gateway ») ?

SAP ne commercialise aucun produit appelé « SAP Model Gateway ». Les fonctions de passerelle que cherchent les architectes — point d'entrée unique, changement de modèle sans toucher au code, politique de modèles approuvés, bascule, quotas et suivi de consommation — sont assurées par le service d'orchestration du generative AI hub et par les limites de débit et la mesure de SAP AI Core, chacun avec des limites précises à connaître.

Pourquoi cette fiche a été recentrée

Les versions précédentes de cette fiche décrivaient un « SAP Model Gateway » doté de niveaux de qualité, de centres de coûts par skill et d'un routage automatique, annoncé au Sapphire 2026. Aucun produit de ce nom n'apparaît dans la documentation de SAP AI Core et du generative AI hub (septembre 2026), dans l'annonce plateforme du Sapphire 2026 ni sur SAP Learning. Le besoin derrière le nom est bien réel : toute entreprise qui exploite plusieurs LLM veut un chemin unique et maîtrisé vers eux. Dans la pile SAP, ce chemin est le generative AI hub, et l'exercice utile consiste à rapprocher chaque attente de passerelle du mécanisme que SAP livre réellement — et de ses limites.

Pourquoi c'est important

  • Vendre ou budgéter une référence « Model Gateway » que SAP ne vend pas ruine la crédibilité dès la première revue d'architecture.
  • Sans liste d'autorisation au niveau du déploiement, la politique de modèles approuvés reste indicative ; n'importe quel développeur peut appeler n'importe quel modèle du tenant.
  • Les limites se comptent en requêtes par minute et par modèle, pas en tokens par utilisateur — les plafonds de dépense par application se construisent, ils ne se paramètrent pas.

Points clés

  • « SAP Model Gateway » n'est pas un produit SAP ; le rôle de passerelle est tenu par le service d'orchestration du generative AI hub plus les limites de débit et la mesure d'AI Core.
  • Point d'entrée unique : un déploiement d'orchestration par resource group, POST /v2/completion, API harmonisée de type OpenAI.
  • Changer de modèle = modifier model.name/version dans prompt_templating ou dans une configuration d'orchestration stockée — pas de nouvelle intégration.
  • Politique de modèles approuvés : modelFilterList + modelFilterListType (allow/deny) sur le déploiement d'orchestration.
  • Bascule : configurations de repli ordonnées ; déclencheurs = indisponibilité régionale et, hors streaming, 408, 429 et 5xx.
  • Quotas : requêtes par minute par modèle et tenant, limites dédiées par resource group en option via l'API de quotas ; 429 + Retry-After.
  • Imputation native jusqu'au modèle, à l'orchestration et au resource group dans l'export d'usage BTP ; plus fin, il faut étiquettes et journaux.
  • Les appels LLM propres à Joule passent par AI Core sous gestion SAP, sans conservation ni entraînement ; vos contrôles portent sur ce que vous construisez.

Termes employés sur cette page

API harmonisée
Interface d'orchestration qui ramène les fournisseurs aux conventions de l'API OpenAI pour messages, paramètres et réponses.
modelFilterList / modelFilterListType
Paramètres d'un déploiement d'orchestration qui autorisent ou excluent des modèles et versions.
Configuration de repli
Liste ordonnée de configurations de modules essayées tour à tour sur erreurs définies ou indisponibilité régionale.
intermediate_failures
Champ de réponse indiquant pourquoi les configurations prioritaires ont été écartées.
Limite RPM
Nombre maximal de requêtes par minute par modèle dans un tenant, partagé par toutes les versions du modèle.
API de gestion des quotas
Points d'accès AI Core pour lire et modifier les limites de débit, y compris par resource group.
GenAI token
Unité virtuelle convertissant les tokens d'entrée et de sortie d'un modèle à des taux propres avant conversion en capacity units.

Sources

  1. SAP AI Core — Orchestration (SAP-docs)
  2. SAP AI Core — Harmonized API (SAP-docs)
  3. SAP AI Core — Model Restriction (SAP-docs)
  4. SAP AI Core — Orchestration with Fallbacks (SAP-docs)
  5. SAP AI Core — Rate Limit Management (SAP-docs)
  6. SAP AI Core — Batch Consumption (SAP-docs)
  7. SAP AI Core service guide — metering and pricing (PDF, 4 Sep 2026)
  8. SAP News — SAP Unveils Business AI Platform (Sapphire, May 2026)
  9. SAP Community — Trust by Design: Security, Guardrails & Governance in Joule (Aug 2026)
  10. SAP Help — Generative AI hub overview (model access)
  11. SAP Help — Metering and pricing for generative AI (SAP AI Core service guide)
  12. SAP Help — Prompt Registry (generative AI hub)
  13. SAP Developers — Tutorial: generative AI hub prompt registry

Fiche complète réservée aux abonnés. Ce que la fiche complète ajoute : le cadre de décision complet · la comparaison SAP · Snowflake · Databricks · Fabric · les pièges courants et leur correctif · l'aide-mémoire · les schémas d'architecture · les blocs de code · les chiffres à citer.

Ouvrir dans l'application →