Cloud Intelligence™Cloud Intelligence™

Announcement

Esta página também está disponível em English, Deutsch, Español, Français, Italiano e 日本語.

Acompanhe os gastos com Fireworks AI no Cloud Intelligence™

Conecte sua conta do Fireworks AI e tenha análises de custo e uso, orçamentos e atribuição por modelo, tipo de deployment e GPU, junto com o restante das suas faturas de nuvem e IA.

Gastos com inferência de IA costumam ficar de fora da sua fatura de nuvem. Se você roda modelos no Fireworks AI, está pagando por token na inferência serverless, por GPU-hora nos deployments dedicados e, à parte, pelo fine-tuning — e nada disso aparece onde o seu trabalho de FinOps acontece. Conferir o dashboard do Fireworks é tarefa manual, e a pergunta "qual modelo está puxando o aumento deste mês" fica sem uma boa resposta quando mais de um time tem chave de API.

Essa lacuna acabou de ser fechada. O Cloud Intelligence™ agora importa dados de custo e uso do Fireworks AI.

O que você ganha

Depois de conectado, o Fireworks AI aparece como provedor nos relatórios de Custo e Uso. Os custos chegam com granularidade diária, agrupados por linha de produto (Serverless Inference, Dedicated Deployments, Fine-tuning) e por modelo, com o uso medido em tokens para inferência e fine-tuning e em GPU-horas para deployments dedicados. A inferência em lote também é discriminada, incluindo se os tokens de entrada vieram do cache.

Os labels gerados automaticamente fazem o trabalho pesado: Model, Deployment Type, Usage Type, Cached e Accelerator (o tipo de GPU por trás de um deployment dedicado). Se o seu deployment dedicado passa o fim de semana inteiro ocioso em um nó de 8 GPUs, o relatório mostra isso em GPU-horas — e não como uma surpresa no fechamento do mês.

Na primeira conexão, importamos até 180 dias de histórico e, a partir daí, atualizamos os dados a cada seis horas. Os gastos com Fireworks AI também aparecem no dashboard AI Intelligence junto com seus custos de Anthropic, OpenAI, Cursor e outros provedores de IA — ou seja, o gasto total com IA em uma única visão, e não em cinco abas.

A configuração é simples de propósito. Você só precisa do seu Account ID do Fireworks e de uma chave de API de administrador, e o teste de conexão informa na hora se estão funcionando. O guia de conexão do Fireworks AI traz o passo a passo exato.

Comece agora

  1. Conecte sua conta do Fireworks AI a partir do catálogo de integrações.
  2. Aguarde a importação inicial (você receberá um e-mail quando ela terminar, geralmente em até 30 minutos).
  3. Acesse o dashboard AI Intelligence para ver seus gastos com Fireworks AI ao lado dos demais provedores de IA.

Se você roda workloads reais de inferência no Fireworks AI, queremos saber o que os relatórios respondem — e o que ainda não respondem — para você. É esse feedback que define o que vamos importar em seguida.

PerfectScale™ for Kubernetes

Ready to optimize?

Get your free Kubernetes savings analysis