Cloud Intelligence™Cloud Intelligence™

Announcement

Questa pagina è disponibile anche in English, Deutsch, Español, Français, 日本語 e Português.

Tenga traccia della spesa Fireworks AI in Cloud Intelligence™

Colleghi il suo account Fireworks AI e ottenga analisi di costi e utilizzo, budget e attribuzione per modello, tipo di deployment e GPU, accanto al resto delle sue fatture cloud e AI.

La spesa per l'inferenza AI ha la brutta abitudine di restare fuori dalla fattura cloud. Se esegue modelli su Fireworks AI, paga per token per l'inferenza serverless, per GPU-ora per i deployment dedicati e separatamente per il fine-tuning — e nulla di tutto questo compare dove si svolge il suo lavoro FinOps. Controllare la dashboard di Fireworks è un'operazione manuale, e alla domanda "quale modello sta causando l'aumento di questo mese" non c'è una buona risposta quando la chiave API è in mano a più di un team.

Quel divario ora è colmato. Cloud Intelligence™ importa i dati di costo e utilizzo di Fireworks AI.

Cosa ottiene

Una volta effettuata la connessione, Fireworks AI compare come provider nei report Cost & Usage. I costi arrivano con granularità giornaliera, raggruppati per linea di prodotto (Serverless Inference, Dedicated Deployments, Fine-tuning) e per modello, con l'utilizzo misurato in token per inferenza e fine-tuning e in GPU-ora per i deployment dedicati. Anche l'inferenza batch viene scorporata, con l'indicazione se i token di input sono stati serviti dalla cache.

Le etichette generate automaticamente fanno il grosso del lavoro: Model, Deployment Type, Usage Type, Cached e Accelerator (il tipo di GPU alla base di un deployment dedicato). Se il suo deployment dedicato resta inattivo su un nodo a 8 GPU per tutto il weekend, il report glielo dice in GPU-ora, non con una sorpresa a fine mese.

Alla prima connessione recuperiamo fino a 180 giorni di storico, dopodiché i dati vengono aggiornati ogni sei ore. La spesa Fireworks AI compare anche nella dashboard AI Intelligence, insieme ai costi di Anthropic, OpenAI, Cursor e degli altri provider AI: la spesa AI complessiva diventa così un'unica vista, non cinque schede.

La configurazione è volutamente noiosa. Le servono l'Account ID di Fireworks e una chiave API admin, e il test di connessione le dice subito se funzionano. La guida alla connessione di Fireworks AI contiene i passaggi esatti.

Per iniziare

  1. Colleghi il suo account Fireworks AI dal catalogo delle integrazioni.
  2. Attenda il completamento dell'importazione iniziale (riceverà un'email al termine, in genere entro 30 minuti).
  3. Apra la dashboard AI Intelligence per vedere la spesa Fireworks AI accanto a quella degli altri provider AI.

Se esegue veri workloads di inferenza su Fireworks AI, ci piacerebbe sapere a quali domande i report rispondono e a quali no: è proprio questo feedback a orientare cosa importeremo in futuro.

PerfectScale™ for Kubernetes

Ready to optimize?

Get your free Kubernetes savings analysis