Cloud Intelligence™Cloud Intelligence™

Announcement

Cette page est également disponible en English, Deutsch, Español, Italiano, 日本語 et Português.

Suivez vos dépenses Fireworks AI dans Cloud Intelligence™

Connectez votre compte Fireworks AI et bénéficiez d'analyses de coûts et d'utilisation, de budgets et d'une attribution par modèle, type de déploiement et GPU, aux côtés du reste de vos factures cloud et IA.

Les dépenses d'inférence IA ont la fâcheuse habitude d'échapper à votre facture cloud. Si vous exécutez des modèles sur Fireworks AI, vous payez au token pour l'inférence serverless, à l'heure GPU pour les déploiements dédiés, et séparément pour le fine-tuning — et rien de tout cela n'apparaît là où se fait votre travail FinOps. Consulter le dashboard Fireworks reste une tâche manuelle, et la question quel modèle explique la hausse de ce mois-ci n'a pas de bonne réponse dès que plusieurs équipes détiennent une clé API.

Cette lacune est désormais comblée : Cloud Intelligence™ importe maintenant les données de coûts et d'utilisation de Fireworks AI.

Ce que vous obtenez

Une fois la connexion établie, Fireworks AI apparaît comme fournisseur dans les rapports Cost & Usage. Les coûts sont fournis avec une granularité quotidienne, regroupés par ligne de produit (Serverless Inference, Dedicated Deployments, Fine-tuning) et par modèle, avec une utilisation mesurée en tokens pour l'inférence et le fine-tuning, et en heures GPU pour les déploiements dédiés. L'inférence par lots est elle aussi ventilée, y compris l'indication des tokens d'entrée servis depuis le cache.

Les labels générés automatiquement font le gros du travail : Model, Deployment Type, Usage Type, Cached et Accelerator (le type de GPU derrière un déploiement dédié). Si votre déploiement dédié tourne à vide sur un nœud à 8 GPU tout le week-end, le rapport vous le dit en heures GPU, plutôt qu'en mauvaise surprise en fin de mois.

Lors de la première connexion, nous importons jusqu'à 180 jours d'historique, puis actualisons les données toutes les six heures. Les dépenses Fireworks AI apparaissent aussi dans le dashboard AI Intelligence aux côtés de vos coûts Anthropic, OpenAI, Cursor et autres fournisseurs d'IA : vos dépenses IA totales tiennent en une seule vue, pas en cinq onglets.

La configuration est volontairement sans surprise. Il vous faut votre identifiant de compte Fireworks (Account ID) et une clé API admin ; le test de connexion vous indique immédiatement s'ils fonctionnent. Le guide de connexion Fireworks AI détaille chaque étape.

Pour commencer

  1. Connectez votre compte Fireworks AI depuis le catalogue d'intégrations.
  2. Attendez la fin de l'import initial (vous recevrez un e-mail une fois l'opération terminée, généralement sous 30 minutes).
  3. Ouvrez le dashboard AI Intelligence pour visualiser vos dépenses Fireworks AI aux côtés de vos autres fournisseurs d'IA.

Si vous exécutez de véritables workloads d'inférence sur Fireworks AI, nous aimerions savoir à quelles questions les rapports répondent — et lesquelles restent sans réponse. Ces retours orientent nos prochains imports.

PerfectScale™ for Kubernetes

Ready to optimize?

Get your free Kubernetes savings analysis