Cloud Intelligence™Cloud Intelligence™

Announcement

Diese Seite ist auch in English, Español, Français, Italiano, 日本語 und Português verfügbar.

Fireworks AI-Ausgaben in Cloud Intelligence™ im Blick behalten

Verbinden Sie Ihr Fireworks AI-Konto und erhalten Sie Kosten- und Nutzungsanalysen, Budgets und Kostenzuordnung nach Modell, Deployment-Typ und GPU – direkt neben Ihren übrigen Cloud- und AI-Rechnungen.

Ausgaben für AI-Inferenz haben die Angewohnheit, außerhalb Ihrer Cloud-Rechnung zu landen. Wenn Sie Modelle auf Fireworks AI betreiben, zahlen Sie pro Token für Serverless Inference, pro GPU-Stunde für Dedicated Deployments und separat für Fine-Tuning – und nichts davon taucht dort auf, wo Ihre FinOps-Arbeit stattfindet. Das Fireworks-Dashboard zu prüfen ist Handarbeit, und auf die Frage "Welches Modell treibt die Kosten diesen Monat in die Höhe?" gibt es keine gute Antwort, sobald mehr als ein Team einen API-Key besitzt.

Diese Lücke ist jetzt geschlossen. Cloud Intelligence™ importiert ab sofort Kosten- und Nutzungsdaten von Fireworks AI.

Das erhalten Sie

Nach der Verbindung erscheint Fireworks AI als Anbieter in Ihren Cost & Usage Reports. Die Kosten liegen in täglicher Granularität vor, gruppiert nach Produktlinie (Serverless Inference, Dedicated Deployments, Fine-Tuning) und nach Modell – die Nutzung wird für Inferenz und Fine-Tuning in Tokens gemessen, für Dedicated Deployments in GPU-Stunden. Auch Batch-Inferenz wird separat ausgewiesen, inklusive der Information, ob Input-Tokens aus dem Cache bedient wurden.

Die automatisch generierten Labels übernehmen die Schwerstarbeit: Model, Deployment Type, Usage Type, Cached und Accelerator (der GPU-Typ hinter einem Dedicated Deployment). Wenn Ihr Dedicated Deployment das ganze Wochenende auf einem 8-GPU-Knoten im Leerlauf verbringt, zeigt der Report das in GPU-Stunden – statt als böse Überraschung am Monatsende.

Bei der ersten Verbindung importieren wir bis zu 180 Tage Historie, danach werden die Daten alle sechs Stunden aktualisiert. Fireworks AI-Ausgaben erscheinen außerdem im AI Intelligence-Dashboard neben Ihren Kosten für Anthropic, OpenAI, Cursor und andere AI-Anbieter – Ihre gesamten AI-Ausgaben in einer Ansicht statt in fünf Tabs.

Die Einrichtung ist bewusst unspektakulär. Sie benötigen Ihre Fireworks Account ID und einen Admin-API-Key, und der Verbindungstest zeigt Ihnen sofort, ob beides funktioniert. Die genauen Schritte finden Sie in der Anleitung zur Fireworks AI-Verbindung.

So starten Sie

  1. Verbinden Sie Ihr Fireworks AI-Konto über den Integrationskatalog.
  2. Warten Sie auf den ersten Import (Sie erhalten eine E-Mail, sobald er abgeschlossen ist – in der Regel innerhalb von 30 Minuten).
  3. Öffnen Sie das AI Intelligence-Dashboard, um Ihre Fireworks AI-Ausgaben neben denen anderer AI-Anbieter zu sehen.

Wenn Sie echte Inferenz-Workloads auf Fireworks AI betreiben, würden wir gerne hören, welche Fragen die Reports für Sie beantworten – und welche nicht. Dieses Feedback bestimmt, was wir als Nächstes importieren.

PerfectScale™ for Kubernetes

Ready to optimize?

Get your free Kubernetes savings analysis