Tableau de bord Gouvernance : utilisation et coûts
Lisez les dépenses, appels, tokens et estimations CO₂ des capacités d'IA dans un seul registre, gardez chaque plafond de dépenses à côté de sa consommation réelle et contrôlez la tarification indicative — depuis la page Gouvernance des paramètres.
Les administrateurs d'organisation peuvent lire en temps réel un registre des coûts et de l'utilisation pour chaque appel aux capacités d'IA effectué par leur organisation — ventilé par équipe, espace de travail, utilisateur, fonctionnalité, modèle ou, pour l’AI Gateway, par développeur et par outil — directement depuis Paramètres → Gouvernance → Analyse des coûts.
La section Gouvernance dans son ensemble (Général, DLP, Habilitations et Analyse des coûts) est visible uniquement par les administrateurs d'organisation. Les membres qui accèdent à /settings/governance/cost-insights sont redirigés vers les paramètres de leur compte.
Accéder au tableau de bord
- Connectez-vous en tant qu'administrateur d'organisation.
- Ouvrez Paramètres et sélectionnez Analyse des coûts sous la section Gouvernance de la barre latérale.
La page s'ouvre sur l'onglet Utilisation pour le mois en cours, regroupé par équipe. Trois onglets couvrent la page :
| Onglet | Ce à quoi il répond |
|---|---|
| Utilisation | Qu'a coûté l'utilisation de l'IA, et qui l'a engagée ? |
| Limites | Où est-elle bornée, et à quelle distance chaque périmètre se trouve-t-il de son plafond ? |
| Tarification | Quel tarif a servi à chaque appel, et quels modèles n'en ont toujours pas ? |
Tout ce que vous sélectionnez est porté par l'URL (?tab=…&range=…&source=…&measure=…&by=…) : une vue filtrée peut être partagée ou mise en favori.
La ligne de budget
Sous le titre de la page, sur chaque onglet, un bandeau montre le plafond de dépenses de l'organisation pour la période de plafonnement en cours (le mois, ou la journée lorsque les plafonds sont quotidiens) : les dépenses à ce jour, le plafond, un repère en pointillé là où le rythme actuel aboutira en fin de période, la part du plafond consommée et les jours restants. Il décrit toujours la période du plafond — changer la plage en dessous ne le déplace pas.
| État | Ce que montre le bandeau |
|---|---|
| Plafond défini, dans le budget | ~$1,204.18 dépensés · jour 28 sur 31, le plafond, en rythme ~$1,330, 60 % du plafond et un lien Modifier dans Limites. Le remplissage passe à l'ambre à partir des deux tiers du plafond. |
| Plafond atteint | Un bandeau rouge. Si l'application est réglée sur le refus, Les appels sont refusés ; en mode audit, Au-dessus du plafond · les appels passent encore. Les deux renvoient vers Limites. |
| Aucun plafond | Une piste en pointillé où la projection reste tracée, pour voir sur quoi un plafond serait mesuré avant d'en fixer un, et un lien Définir un plafond mensuel. |
| Politique issue d'une version plus récente | Un plafond est en vigueur que cette console ne peut pas lire. Le plafond reste appliqué ; le formulaire de l'onglet Limites est masqué plutôt qu'affiché vide. |
Plage et source
Deux contrôles dans l'en-tête de la page s'appliquent aux onglets Utilisation et Tarification :
| Contrôle | Options | Par défaut |
|---|---|---|
| Plage | Ce mois-ci · Le mois dernier · 7 derniers jours · 30 derniers jours | Ce mois-ci |
| Source | Toutes les sources · Workflows · Automatisations · Analytique · Copilot · Chat · Wand · Ingestion de connaissances · API · AI Gateway | Toutes les sources |
Changer l'un ou l'autre relit le registre côté serveur avant que la page ne se réaffiche. Choisir AI Gateway comme source restreint chaque chiffre au trafic des développeurs (voir AI Gateway) et bascule les dimensions de la ventilation vers Développeur et Modèle.
Utilisation
Les quatre mesures
La rangée de chiffres clés est aussi le sélecteur : cliquez sur Dépenses, Appels, Tokens ou CO₂ et le graphique comme la ventilation se reprojettent dans cette unité.
- Dépenses —
~$1,204.18. Le tilde marque une estimation ; l'indication ouvre l'explication de la tarification. - Appels — compte exact, avec le taux de réussite et le nombre d'appels en échec.
- Tokens — compte exact, réparti entre entrée et sortie.
- CO₂ —
~6.10 kg, avec la distance équivalente parcourue en voiture.
Les chiffres estimés (dépenses, CO₂) portent un ~ initial partout sur la page ; les comptes exacts (appels, tokens) jamais.
Dépenses par jour
Une colonne par jour dans la mesure sélectionnée. Les jours de week-end sont dessinés plus clairs ; le jour du pic de la plage est nommé dans l'en-tête du graphique. Survolez une colonne pour la valeur exacte.
Ventilation
Un tableau-registre avec une ligne par groupe, classé et partagé sur la mesure sélectionnée, avec les colonnes Dépenses · Part · Appels · Tokens · CO₂ · vs précédent. La comparaison porte sur la fenêtre de même longueur qui précède immédiatement la plage. Les lignes affichent des noms (équipe, espace de travail, membre), jamais des identifiants.
Le contrôle de dimension sur le tableau bascule entre Équipe · Espace de travail · Utilisateur · Fonctionnalité, ou Développeur · Modèle lorsque la source est l’AI Gateway.
Exporter en CSV télécharge le tableau sous usage-by-<dimension>.csv avec les colonnes group, cost_usd, share_pct, calls, tokens, co2_kg. Le bouton est désactivé tant que le tableau est vide.
Par capacité, modèle et workflow
Trois listes compactes sous la ventilation : la consommation par capacité (les capacités facturées au token rapportent des comptes de tokens ; celles facturées à l'unité — voix, OCR, image, vidéo — sont comptées en unités), les principaux modèles par dépenses et les principaux workflows par exécutions. Avec l’AI Gateway comme source, la première liste devient les outils atteints via le point de terminaison MCP, avec leur nombre d'appels et leur part.
Quand la plage est vide
La page le dit — Aucune utilisation du 1 au 7 août — explique que chaque tour de modèle, appel d'outil et exécution de workflow arrive ici au fil de l'eau, et propose Afficher ce mois-ci.
Les montants de dépenses sont des estimations indicatives, pas des factures. Les comptes de tokens sont les valeurs exactes rapportées par chaque fournisseur de modèle ; le coût est dérivé d'un tarif résolu à chaque appel (voir Tarification ci-dessous), et le CO₂ est modélisé — énergie par token × PUE du centre de données × intensité carbone du réseau régional. Les deux sont destinés à la gouvernance interne, à la refacturation et au reporting de durabilité, pas au rapprochement de facturation ni à une déclaration environnementale certifiée.
Limites
Plafonds de dépenses
Les plafonds sont évalués contre le registre d'utilisation au moment de l'admission ; ils tiennent donc sur chaque réplica. Le formulaire édite trois périmètres :
| Périmètre | Mesuré comme |
|---|---|
| Toute l'organisation | Toutes les sources, tous les espaces de travail |
| Par équipe | Chaque équipe pour elle-même |
| Par développeur | Trafic AI Gateway, par personne |
Chaque périmètre accepte un plafond de dépenses (USD) et un plafond d'appels ; vide signifie sans plafond. Au-dessus des lignes, Période (mensuelle, remise à zéro le 1er ; ou quotidienne, remise à zéro à minuit UTC) et Quand un plafond est atteint (refuser les appels suivants, ou l'enregistrer et laisser passer l'appel) s'appliquent à tous les périmètres.
À côté de chaque périmètre, une jauge montre la consommation de la période en cours par rapport au plafond — les dépenses propres de l'organisation, ou le plus gros consommateur pour un plafond par équipe ou par développeur — avec le même repère de rythme en pointillé que la ligne de budget. La jauge mesure exactement ce que mesure l'admission : chaque appel compté depuis le début de la période, sur la dépense indicative. Ambre à partir des deux tiers du plafond, rouge une fois atteint.
Lorsqu'un appel est refusé, l'outil du développeur reçoit une erreur de limitation qui nomme le plafond, et Retry-After est le temps réel jusqu'à la remise à zéro de la période. Un administrateur relève le plafond ici.
Si une politique de plafond stockée a été écrite par une version plus récente que cette console, les champs sont masqués et Enregistrer les plafonds est désactivé. Enregistrer un formulaire vide remplacerait le plafond en vigueur par rien ; le plafond lui-même reste appliqué. Mettez à jour la console ou modifiez la politique depuis la version qui l'a écrite.
Garde-fous du router
Le sélecteur Posture DLP sur le trafic du router applique la prévention des fuites de données au trafic des développeurs uniquement : hériter de la politique de l'organisation (par défaut), appliquer (bloquer un tour qui déclenche une règle) ou auditer (enregistrer la détection, laisser passer le tour). Le chat, les workflows et chaque surface applicative conservent la politique de l'organisation. Voir AI Gateway pour comprendre pourquoi le code source a besoin de sa propre posture.
Tarification
D'où vient le tarif des dépenses
Une barre empilée répartit les dépenses de la plage selon la source du tarif qui a servi à chaque appel — tarif du catalogue, votre surcharge ou tarif par défaut (et sans tarif lorsqu'un appel n'en portait aucun). En dessous, Facturés au tarif par défaut sur cette période liste les modèles retombés sur le tarif par défaut, avec les dépenses qu'ils portent et le tarif appliqué ; Définir le prix ajoute une ligne préremplie aux surcharges ci-dessous. Lorsque chaque appel a été facturé depuis le catalogue ou une surcharge, la liste le dit.
Surcharges de prix par modèle
Choisissez un modèle installé dans la liste déroulante (regroupée par capacité) et fixez son prix. Les modèles facturés au token (LLM, embeddings) prennent un tarif d'entrée en $ / 1M tokens (le LLM prend aussi un tarif de sortie) ; les modèles facturés à l'unité prennent un tarif en $ / unité. Un déploiement daté tel que gpt-5.4-2026-03-05 réutilise automatiquement le tarif de base gpt-5.4. Une cellule qui ne s'applique pas à la capacité affiche un — en pointillé.
Tarifs par défaut par capacité
Un tarif de repli par capacité (LLM, embeddings, reconnaissance vocale, synthèse vocale, OCR, image, vidéo, recherche web, modération), utilisé lorsque ni le catalogue d'intégration ni une surcharge par modèle ne tarifie un appel. Laissez un champ vide pour conserver le tarif indicatif intégré, affiché en texte indicatif. C'est ainsi que les capacités sans liste de modèles énumérable — OCR, image, vidéo — sont tarifées.
Une intégration qui fournit sa propre tarification l'emporte toujours. Les tarifs de l'onglet Tarification ne sont qu'un repli. L'ordre de résolution est : (1) tarification exacte du catalogue/de l'intégration, (2) tarif catalogue du modèle de base pour un déploiement daté, (3) surcharge par modèle depuis cet onglet, (4) tarif par défaut de la capacité (configuré ici, sinon intégré). Le coût reste indicatif et s'applique à l'utilisation future — les lignes déjà enregistrées conservent le prix figé à leur écriture, ce qui explique que la barre de couverture puisse encore montrer une part au tarif par défaut après l'enregistrement d'une surcharge.
Permissions
| Rôle | Accès |
|---|---|
| Propriétaire de l'organisation | Accès en lecture complète à tous les onglets, export CSV, modification des plafonds et de la tarification |
| Administrateur de l'organisation | Accès en lecture complète à tous les onglets, export CSV, modification des plafonds et de la tarification |
| Membre | Redirigé vers les paramètres du compte |
L'API client.billing.* sous-jacente nécessite une session administrateur. Consultez Facturation et comptage d'utilisation pour la référence API complète, y compris les lectures period-usage et pricing-sources que cette page utilise.
Fraîcheur des données
Les événements d'utilisation sont écrits par le runtime des capacités au moment de l'appel. Les requêtes du tableau de bord sont en temps réel — il n'y a pas de délai d'agrégation planifié. Les événements issus d'appels aux capacités survenus dans la plage de dates sélectionnée sont inclus immédiatement.
Un échec d'écriture de facturation ne bloque jamais l'appel à la capacité lui-même. En cas de brève panne d'écriture, une légère lacune dans les séries temporelles est attendue et n'indique pas une défaillance du produit.