Cloud Intelligence™Cloud Intelligence™

Read stories from our Forward Deployed Engineers.

Engineering Blog

Trusted by platform engineering teams

Finlex
Hippo
Island
Claroty
Salt Security
PropertyGuru
Accrete AI
Akamai
OneFootball

Latest

More Posts

Deja de sobreaprovisionar por el arranque: llega el CPU startup boost de GKE
By Chimbu ChinnaduraiJul 27, 20267 min read

Deja de sobreaprovisionar por el arranque: llega el CPU startup boost de GKE

El nuevo CPU startup boost de GKE permite dar a los contenedores CPU extra durante la inicialización y luego volver al valor base in-place: se acabó el sobreaprovisionamiento por el warm-up de la JVM.

DynamoDB: lo que la mayoría de los equipos hace mal antes de escribir una sola línea de código
By Joseph AllamJul 20, 20268 min read

DynamoDB: lo que la mayoría de los equipos hace mal antes de escribir una sola línea de código

DynamoDB es una de las bases de datos más potentes de AWS, pero la mayoría de los equipos que batallan con ella comete los mismos errores de diseño de esquema. Esto es lo que debes saber antes de construir.

Monitoreo de Kubernetes Jobs efímeros a gran escala
By Ivan YurochkoJul 17, 20266 min read

Monitoreo de Kubernetes Jobs efímeros a gran escala

¿Tus Kubernetes jobs provocan pérdida de métricas y explosión de cardinalidad? Mira cómo la agregación en streaming de vmagent resuelve la observabilidad de workloads efímeros a gran escala.

¿Qué es Tokenomics?
By Josh PalmerJul 13, 20267 min read

¿Qué es Tokenomics?

Tokenomics es la disciplina de medir y atribuir el consumo de tokens de IA a clientes, features y agentes. Descubre por qué el tagging tradicional de FinOps se queda corto frente al gasto en IA.

Lleva tu base de datos a un Iceberg Data Lake (Parte 2)
By Sayle MatthewsJul 13, 202616 min read

Lleva tu base de datos a un Iceberg Data Lake (Parte 2)

La Parte 2 de nuestra serie sobre Iceberg data lake te lleva por la implementación práctica: desplegar Debezium Server en GKE para replicar Postgres a tablas Iceberg en GCS.

Atribución de costos de IA: por qué los tags, SDKs y cambios de código no funcionan
By Josh PalmerJul 11, 20266 min read

Atribución de costos de IA: por qué los tags, SDKs y cambios de código no funcionan

La infraestructura de IA rompe con el esquema de tags y SDKs que sostenía la asignación tradicional de costos en la nube. La medición eBPF a nivel de kernel ofrece una solución estructural sin tocar el código.

¿Qué es un sensor eBPF?
By Josh PalmerJul 10, 20267 min read

¿Qué es un sensor eBPF?

Los sensores eBPF ejecutan programas aislados dentro del kernel de Linux para observar cada syscall, paquete e interacción con la GPU. Descubre por qué se están convirtiendo en la base de la atribución moderna de costos de IA.

Renovamos Zendesk por última vez
By Vadim SoloveyJul 10, 20265 min read

Renovamos Zendesk por última vez

Redujimos el uso de Zendesk un 35% y la factura solo bajó un 10%. Esto reveló la negociación sobre el pricing por asiento del SaaS en la era de la IA.

Contar tokens es fácil. El contexto, no tanto
By Amit KinhaJul 9, 20264 min read

Contar tokens es fácil. El contexto, no tanto

Los tokens te dicen cuánto cuesta la IA, pero no por qué. Un ex profesional de FinOps explica por qué la atribución —no el tagging— es lo que convierte los números de costo en decisiones reales de negocio.

Your cloud bill shouldn't be a mystery

Optimization, automation, expertise. In one platform.

Cómo medir el ROI de la IA cuando no ves adónde se fueron los tokens
By Josh PalmerJul 9, 20268 min read

Cómo medir el ROI de la IA cuando no ves adónde se fueron los tokens

Solo el 15% de las empresas puede calcular el ROI de la IA sin fricción. El verdadero cuello de botella no es demostrar el valor, sino atribuir los costos de tokens y cómputo a los resultados que producen.

No pierdas tus GPUs en el mantenimiento: usa Capacity Reservations
By Avi KeinanJul 9, 20265 min read

No pierdas tus GPUs en el mantenimiento: usa Capacity Reservations

Detener una instancia GPU para hacerle mantenimiento puede significar perderla en el pool de capacidad compartida. Así es como las On-Demand Capacity Reservations mantienen tus GPUs de EC2 disponibles cuando las necesitas de vuelta.