Les administrateurs pourront suivre les coûts, définir des quotas et attribuer la consommation des applications et des agents à différents centres de coûts.
La généralisation des agents et des applications d’intelligence artificielle rend les dépenses plus difficiles à anticiper. La consommation ne dépend plus seulement du nombre d’utilisateurs, mais aussi du volume de requêtes, des modèles sollicités et du nombre de tokens traités. Sans mécanisme commun de suivi, une organisation peut identifier sa facture globale sans savoir précisément quels usages ou quelles équipes en sont à l’origine.
Snowflake complète Cortex AI Gateway avec des fonctions destinées à suivre l’utilisation des tokens et les coûts associés. Les administrateurs pourront définir des limites de dépenses pour les applications et les agents d’IA. Snowflake CoCo s’appuiera également sur les mécanismes existants de gestion des rôles et de tagging pour rattacher la consommation à une équipe ou à un centre de coûts.
Des quotas jusqu’au niveau de l’utilisateur
Les entreprises pourront définir un modèle utilisé par défaut, établir des quotas individuels et recevoir une notification lorsque la consommation approche d’une limite prédéfinie. Ces informations doivent faciliter le rapprochement entre le coût d’un service d’IA et l’usage métier qui le génère. Le routage dynamique des modèles complète ces garde-fous. Cortex AI Gateway pourra orienter une demande simple vers un modèle moins coûteux et réserver les modèles avancés aux tâches pour lesquelles ils améliorent réellement le résultat. Cette logique doit s’appliquer à Snowflake CoCo, Snowflake CoWork et aux agents tiers reliés à la passerelle.
Les administrateurs conserveront le contrôle des fournisseurs et des modèles disponibles. Ce point peut intéresser les groupes internationaux confrontés à des différences régionales de disponibilité, ainsi que les secteurs soumis à des règles particulières de conformité.
Snowflake cherche ainsi à intégrer le pilotage financier directement dans l’environnement où les applications et les agents sont exécutés. Les gains dépendront toutefois de la manière dont les quotas, les modèles par défaut et les règles de routage seront configurés. La plateforme fournit les mécanismes de mesure et d’arbitrage, mais les entreprises devront encore déterminer les niveaux de qualité et de dépense acceptables pour chaque usage.


