Announcement
Questa pagina è disponibile anche in English, Deutsch, Español, Français, 日本語 e Português.
Tenga traccia della spesa Fireworks AI in Cloud Intelligence™
Colleghi il suo account Fireworks AI e ottenga analisi di costi e utilizzo, budget e attribuzione per modello, tipo di deployment e GPU, accanto al resto delle sue fatture cloud e AI.
La spesa per l'inferenza AI ha la brutta abitudine di restare fuori dalla fattura cloud. Se esegue modelli su Fireworks AI, paga per token per l'inferenza serverless, per GPU-ora per i deployment dedicati e separatamente per il fine-tuning — e nulla di tutto questo compare dove si svolge il suo lavoro FinOps. Controllare la dashboard di Fireworks è un'operazione manuale, e alla domanda "quale modello sta causando l'aumento di questo mese" non c'è una buona risposta quando la chiave API è in mano a più di un team.
Quel divario ora è colmato. Cloud Intelligence™ importa i dati di costo e utilizzo di Fireworks AI.
Cosa ottiene
Una volta effettuata la connessione, Fireworks AI compare come provider nei report Cost & Usage. I costi arrivano con granularità giornaliera, raggruppati per linea di prodotto (Serverless Inference, Dedicated Deployments, Fine-tuning) e per modello, con l'utilizzo misurato in token per inferenza e fine-tuning e in GPU-ora per i deployment dedicati. Anche l'inferenza batch viene scorporata, con l'indicazione se i token di input sono stati serviti dalla cache.
Le etichette generate automaticamente fanno il grosso del lavoro: Model, Deployment Type, Usage Type, Cached e Accelerator (il tipo di GPU alla base di un deployment dedicato). Se il suo deployment dedicato resta inattivo su un nodo a 8 GPU per tutto il weekend, il report glielo dice in GPU-ora, non con una sorpresa a fine mese.
Alla prima connessione recuperiamo fino a 180 giorni di storico, dopodiché i dati vengono aggiornati ogni sei ore. La spesa Fireworks AI compare anche nella dashboard AI Intelligence, insieme ai costi di Anthropic, OpenAI, Cursor e degli altri provider AI: la spesa AI complessiva diventa così un'unica vista, non cinque schede.
La configurazione è volutamente noiosa. Le servono l'Account ID di Fireworks e una chiave API admin, e il test di connessione le dice subito se funzionano. La guida alla connessione di Fireworks AI contiene i passaggi esatti.
Per iniziare
- Colleghi il suo account Fireworks AI dal catalogo delle integrazioni.
- Attenda il completamento dell'importazione iniziale (riceverà un'email al termine, in genere entro 30 minuti).
- Apra la dashboard AI Intelligence per vedere la spesa Fireworks AI accanto a quella degli altri provider AI.
Se esegue veri workloads di inferenza su Fireworks AI, ci piacerebbe sapere a quali domande i report rispondono e a quali no: è proprio questo feedback a orientare cosa importeremo in futuro.
