Cloud Intelligence™Cloud Intelligence™
Integrations

Controla el costo de cada clúster de Ray

Vista en vivo del consumo de Anyscale, el uso de clústeres de Ray y las oportunidades de rightsizing en cada workspace y nube.

Mockup de dashboard de gasto por job para Anyscale

La confianza de los equipos que escalan workloads de IA y Ray en producción

Akamai
Blumira
Chess.com
Current
OneFootball
Promptly
Recurly
Lusha
Mux

Configuración

Un token de API. Visibilidad total de tus clústeres de Ray.

Conecta tu organización de Anyscale con un token de API de solo lectura. DoiT recopila automáticamente las métricas de consumo, el uso de clústeres y el gasto de nube subyacente de AWS o GCP, sin agentes ni cambios de código en tus jobs de Ray. Los reportes unificados quedan disponibles a las pocas horas de conectarte.

Lo que obtienes

Diseñado para la realidad de ejecutar Ray en Anyscale

Lo que los líderes de FinOps y plataformas de ML realmente nos piden cuando conectan su organización de Anyscale.

Reportes de consumo unificados

Segmenta el gasto de Anyscale por workspace, proyecto, clúster o equipo, junto con los costos de nube subyacentes.

Anomalías en tiempo real

Recibe alertas sobre jobs de Ray fuera de control y picos de gasto en GPU en cuestión de minutos.

Rightsizing de clústeres

Detecta nodos head y worker sobredimensionados, con recomendaciones accionables de CPU, GPU y memoria.

Detección de clústeres inactivos

Identifica los clústeres de Ray que quedan encendidos después de que terminan los jobs y recupera ese gasto.

Visibilidad de GPU y aceleradores

Distingue el uso de GPU, CPU y xPU en workloads de entrenamiento, tuning y serving que se esconden en las facturas agregadas.

Gobernanza y presupuestos

Define presupuestos por equipo de ML o proyecto y detecta los sobrecostos antes del próximo entrenamiento.

El dashboard de uso de Anyscale muestra lo que consumiste. Cloud Intelligence™ te ayuda a hacer algo al respecto.

Más allá del dashboard de uso de Anyscale

  • Consolidación multinube

    Vistas consolidadas del gasto de Anyscale en AWS, GCP o Kubernetes, con desglose hasta cualquier clúster.

  • Alertas de anomalías en tiempo real

    Detección con machine learning en las dimensiones de workspace, clúster y job, con alertas por Slack o correo.

  • Planificación de commitments de GPU

    Simula Savings Plans, CUDs y reservas frente al uso real de Ray antes de comprometer un solo dólar.

  • Higiene de proyectos y asignaciones

    Encuentra workloads de Ray sin etiquetar, aplica reglas de asignación y divide los costos compartidos como lo espera el equipo de finanzas.

  • Asignación de costos en Kubernetes

    Desglosa el gasto de Anyscale sobre Kubernetes por namespace, workload y etiqueta, sin exporters adicionales.

  • Forward Deployed Engineers

    Arquitectos de nube al máximo nivel que trabajan como una extensión de tu equipo para implementar optimizaciones.


Las empresas en rápido crecimiento operan con Cloud Intelligence™

21%

Ahorro promedio en los primeros 90 días

28 días

Tiempo promedio de implementación

Oren Ashkenazy

El enfoque de DoiT en la confiabilidad, combinado con la flexibilidad del sistema, nos ayuda a optimizar de forma segura nuestros workloads de Amazon EKS sin que nuestros ingenieros tengan que intervenir.

Oren Ashkenazy

Director de DevOps y Cloud en Fiverr

¿Listo para conectar tu organización de Anyscale?

Pon el gasto de tus clústeres de Ray bajo la lupa.

Frequently asked
questions

¿Existe una vista única de los costos de Anyscale en todos los workspaces y proyectos?

Conecta tu organización de Anyscale una sola vez. Cloud Intelligence™ recopila los datos de consumo de cada workspace y proyecto, para que puedas segmentar los costos por clúster, job, equipo o nube subyacente desde una sola vista, sin consolidaciones manuales.

¿Qué implica conectar los datos de uso de Anyscale a Cloud Intelligence™?

Usa un token de API de solo lectura de tu organización de Anyscale junto con tu conexión de facturación de AWS o GCP. DoiT se encarga de la ingesta, la normalización y los reportes con granularidad horaria. La mayoría de los equipos quedan operativos en menos de un día.

¿Qué clústeres o jobs de Ray concentran la mayor parte de mi gasto?

Los reportes de costo y uso te permiten profundizar desde el gasto total de Anyscale hasta un clúster, job o tipo de nodo específico. Filtra por workspace, proyecto, región o familia de instancias sin escribir SQL.

¿Recibiré alertas de anomalías en los costos de Anyscale en el momento en que ocurran?

La detección de anomalías se ejecuta de forma continua en workspaces, clústeres y dimensiones de jobs. Cuando algo no cuadra (como un entrenamiento consumiendo horas de GPU durante la noche), recibes una alerta por Slack o correo con la causa probable.

¿Cómo puedo reducir la pérdida por clústeres de Ray inactivos o sobredimensionados?

Cloud Intelligence™ señala los clústeres que operan por debajo de los objetivos de utilización, los nodos head sobredimensionados para su workload y los clústeres que quedan inactivos después de completar los jobs. Cada recomendación muestra el ahorro estimado.

¿Cómo puedo asignar el gasto de Anyscale a los equipos de ML y a los modelos?

Asocia los workspaces, proyectos y etiquetas de Anyscale con tus centros de costos internos. Los pools de GPU compartidos se pueden dividir con reglas de asignación, para que finanzas vea el costo por equipo y por modelo sin hojas de cálculo manuales.

Ya uso el dashboard de uso de Anyscale. ¿Qué aporta Cloud Intelligence™?

El dashboard de uso de Anyscale muestra estimaciones de consumo dentro de Anyscale. Cloud Intelligence™ lo conecta con el gasto real en la nube y suma visibilidad multinube, recomendaciones proactivas, detección de anomalías, gobernanza y acceso a Forward Deployed Engineers.

¿Qué acceso tiene Cloud Intelligence™ a mi organización de Anyscale y cómo se protege?

Cloud Intelligence™ usa un token de API de solo lectura con permisos de privilegio mínimo. Nunca modificamos clústeres ni jobs sin tu aprobación, y la plataforma cuenta con la certificación SOC 2 Type II.