Configuración
Un token de API. Visibilidad total de tus clústeres de Ray.
Conecta tu organización de Anyscale con un token de API de solo lectura. DoiT recopila automáticamente las métricas de consumo, el uso de clústeres y el gasto de nube subyacente de AWS o GCP, sin agentes ni cambios de código en tus jobs de Ray. Los reportes unificados quedan disponibles a las pocas horas de conectarte.
Lo que obtienes
Diseñado para la realidad de ejecutar Ray en Anyscale
Lo que los líderes de FinOps y plataformas de ML realmente nos piden cuando conectan su organización de Anyscale.
Reportes de consumo unificados
Segmenta el gasto de Anyscale por workspace, proyecto, clúster o equipo, junto con los costos de nube subyacentes.
Anomalías en tiempo real
Recibe alertas sobre jobs de Ray fuera de control y picos de gasto en GPU en cuestión de minutos.
Rightsizing de clústeres
Detecta nodos head y worker sobredimensionados, con recomendaciones accionables de CPU, GPU y memoria.
Detección de clústeres inactivos
Identifica los clústeres de Ray que quedan encendidos después de que terminan los jobs y recupera ese gasto.
Visibilidad de GPU y aceleradores
Distingue el uso de GPU, CPU y xPU en workloads de entrenamiento, tuning y serving que se esconden en las facturas agregadas.
Gobernanza y presupuestos
Define presupuestos por equipo de ML o proyecto y detecta los sobrecostos antes del próximo entrenamiento.
El dashboard de uso de Anyscale muestra lo que consumiste. Cloud Intelligence™ te ayuda a hacer algo al respecto.
Más allá del dashboard de uso de Anyscale
Consolidación multinube
Vistas consolidadas del gasto de Anyscale en AWS, GCP o Kubernetes, con desglose hasta cualquier clúster.
Alertas de anomalías en tiempo real
Detección con machine learning en las dimensiones de workspace, clúster y job, con alertas por Slack o correo.
Planificación de commitments de GPU
Simula Savings Plans, CUDs y reservas frente al uso real de Ray antes de comprometer un solo dólar.
Higiene de proyectos y asignaciones
Encuentra workloads de Ray sin etiquetar, aplica reglas de asignación y divide los costos compartidos como lo espera el equipo de finanzas.
Asignación de costos en Kubernetes
Desglosa el gasto de Anyscale sobre Kubernetes por namespace, workload y etiqueta, sin exporters adicionales.
Forward Deployed Engineers
Arquitectos de nube al máximo nivel que trabajan como una extensión de tu equipo para implementar optimizaciones.
Las empresas en rápido crecimiento operan con Cloud Intelligence™
Ahorro promedio en los primeros 90 días
Tiempo promedio de implementación
“El enfoque de DoiT en la confiabilidad, combinado con la flexibilidad del sistema, nos ayuda a optimizar de forma segura nuestros workloads de Amazon EKS sin que nuestros ingenieros tengan que intervenir.”
Oren Ashkenazy
Director de DevOps y Cloud en Fiverr
¿Listo para conectar tu organización de Anyscale?
Pon el gasto de tus clústeres de Ray bajo la lupa.
Frequently asked
questions
¿Existe una vista única de los costos de Anyscale en todos los workspaces y proyectos?
Conecta tu organización de Anyscale una sola vez. Cloud Intelligence™ recopila los datos de consumo de cada workspace y proyecto, para que puedas segmentar los costos por clúster, job, equipo o nube subyacente desde una sola vista, sin consolidaciones manuales.
¿Qué implica conectar los datos de uso de Anyscale a Cloud Intelligence™?
Usa un token de API de solo lectura de tu organización de Anyscale junto con tu conexión de facturación de AWS o GCP. DoiT se encarga de la ingesta, la normalización y los reportes con granularidad horaria. La mayoría de los equipos quedan operativos en menos de un día.
¿Qué clústeres o jobs de Ray concentran la mayor parte de mi gasto?
Los reportes de costo y uso te permiten profundizar desde el gasto total de Anyscale hasta un clúster, job o tipo de nodo específico. Filtra por workspace, proyecto, región o familia de instancias sin escribir SQL.
¿Recibiré alertas de anomalías en los costos de Anyscale en el momento en que ocurran?
La detección de anomalías se ejecuta de forma continua en workspaces, clústeres y dimensiones de jobs. Cuando algo no cuadra (como un entrenamiento consumiendo horas de GPU durante la noche), recibes una alerta por Slack o correo con la causa probable.
¿Cómo puedo reducir la pérdida por clústeres de Ray inactivos o sobredimensionados?
Cloud Intelligence™ señala los clústeres que operan por debajo de los objetivos de utilización, los nodos head sobredimensionados para su workload y los clústeres que quedan inactivos después de completar los jobs. Cada recomendación muestra el ahorro estimado.
¿Cómo puedo asignar el gasto de Anyscale a los equipos de ML y a los modelos?
Asocia los workspaces, proyectos y etiquetas de Anyscale con tus centros de costos internos. Los pools de GPU compartidos se pueden dividir con reglas de asignación, para que finanzas vea el costo por equipo y por modelo sin hojas de cálculo manuales.
Ya uso el dashboard de uso de Anyscale. ¿Qué aporta Cloud Intelligence™?
El dashboard de uso de Anyscale muestra estimaciones de consumo dentro de Anyscale. Cloud Intelligence™ lo conecta con el gasto real en la nube y suma visibilidad multinube, recomendaciones proactivas, detección de anomalías, gobernanza y acceso a Forward Deployed Engineers.
¿Qué acceso tiene Cloud Intelligence™ a mi organización de Anyscale y cómo se protege?
Cloud Intelligence™ usa un token de API de solo lectura con permisos de privilegio mínimo. Nunca modificamos clústeres ni jobs sin tu aprobación, y la plataforma cuenta con la certificación SOC 2 Type II.
