Cloud Intelligence™Cloud Intelligence™

Announcement

Esta página también está disponible en English, Deutsch, Français, Italiano, 日本語 y Português.

Monitorea el gasto de Fireworks AI en Cloud Intelligence™

Conecta tu cuenta de Fireworks AI y obtén análisis de costos y uso, presupuestos y atribución por modelo, tipo de despliegue y GPU, junto al resto de tus facturas de nube e IA.

El gasto en inferencia de IA suele quedar fuera de tu factura de la nube. Si ejecutas modelos en Fireworks AI, pagas la inferencia serverless por token, los despliegues dedicados por GPU-hora y el fine-tuning por separado; y nada de eso aparece donde se hace el trabajo de FinOps. Revisar el dashboard de Fireworks es una tarea manual, y la pregunta "¿qué modelo está detrás del aumento de este mes?" no tiene buena respuesta cuando más de un equipo tiene una API key.

Esa brecha ya quedó cerrada: Cloud Intelligence™ ahora importa los datos de costos y uso de Fireworks AI.

Qué obtienes

Una vez conectada la cuenta, Fireworks AI aparece como proveedor en los reportes de Cost & Usage. Los costos llegan con granularidad diaria, agrupados por línea de producto (Serverless Inference, Dedicated Deployments, Fine-tuning) y por modelo, con el uso medido en tokens para la inferencia y el fine-tuning, y en GPU-horas para los despliegues dedicados. La inferencia por lotes también se desglosa, incluyendo si los tokens de entrada se sirvieron desde caché.

Las etiquetas generadas automáticamente hacen el trabajo pesado: Model, Deployment Type, Usage Type, Cached y Accelerator (el tipo de GPU detrás de un despliegue dedicado). Si tu despliegue dedicado se queda inactivo en un nodo de 8 GPU todo el fin de semana, el reporte lo muestra en GPU-horas, no como una sorpresa a fin de mes.

En la primera conexión se importan hasta 180 días de historial y, a partir de ahí, los datos se actualizan cada seis horas. El gasto de Fireworks AI también aparece en el dashboard de AI Intelligence junto a tus costos de Anthropic, OpenAI, Cursor y otros proveedores de IA, para que el gasto total en IA se vea en una sola vista, no en cinco pestañas.

La configuración es deliberadamente aburrida. Solo necesitas tu Account ID de Fireworks y una API key de administrador; la prueba de conexión te dice de inmediato si funcionan. La guía de conexión de Fireworks AI tiene los pasos exactos.

Primeros pasos

  1. Conecta tu cuenta de Fireworks AI desde el catálogo de integraciones.
  2. Espera a que termine la importación inicial (recibirás un correo cuando esté lista, normalmente en menos de 30 minutos).
  3. Ve al dashboard de AI Intelligence para ver tu gasto de Fireworks AI junto al de otros proveedores de IA.

Si ejecutas workloads reales de inferencia en Fireworks AI, nos encantaría saber qué preguntas te responden los reportes y cuáles no: ese feedback define qué importamos después.

PerfectScale™ for Kubernetes

Ready to optimize?

Get your free Kubernetes savings analysis