Latest
More Posts
734 published posts

Deja de sobreaprovisionar por el arranque: llega el CPU startup boost de GKE
El nuevo CPU startup boost de GKE permite dar a los contenedores CPU extra durante la inicialización y luego volver al valor base in-place: se acabó el sobreaprovisionamiento por el warm-up de la JVM.

DynamoDB: lo que la mayoría de los equipos hace mal antes de escribir una sola línea de código
DynamoDB es una de las bases de datos más potentes de AWS, pero la mayoría de los equipos que batallan con ella comete los mismos errores de diseño de esquema. Esto es lo que debes saber antes de construir.

Monitoreo de Kubernetes Jobs efímeros a gran escala
¿Tus Kubernetes jobs provocan pérdida de métricas y explosión de cardinalidad? Mira cómo la agregación en streaming de vmagent resuelve la observabilidad de workloads efímeros a gran escala.

¿Qué es Tokenomics?
Tokenomics es la disciplina de medir y atribuir el consumo de tokens de IA a clientes, features y agentes. Descubre por qué el tagging tradicional de FinOps se queda corto frente al gasto en IA.

Lleva tu base de datos a un Iceberg Data Lake (Parte 2)
La Parte 2 de nuestra serie sobre Iceberg data lake te lleva por la implementación práctica: desplegar Debezium Server en GKE para replicar Postgres a tablas Iceberg en GCS.

Atribución de costos de IA: por qué los tags, SDKs y cambios de código no funcionan
La infraestructura de IA rompe con el esquema de tags y SDKs que sostenía la asignación tradicional de costos en la nube. La medición eBPF a nivel de kernel ofrece una solución estructural sin tocar el código.

¿Qué es un sensor eBPF?
Los sensores eBPF ejecutan programas aislados dentro del kernel de Linux para observar cada syscall, paquete e interacción con la GPU. Descubre por qué se están convirtiendo en la base de la atribución moderna de costos de IA.

Renovamos Zendesk por última vez
Redujimos el uso de Zendesk un 35% y la factura solo bajó un 10%. Esto reveló la negociación sobre el pricing por asiento del SaaS en la era de la IA.

Contar tokens es fácil. El contexto, no tanto
Los tokens te dicen cuánto cuesta la IA, pero no por qué. Un ex profesional de FinOps explica por qué la atribución —no el tagging— es lo que convierte los números de costo en decisiones reales de negocio.
Your cloud bill shouldn't be a mystery
Optimization, automation, expertise. In one platform.

Cómo medir el ROI de la IA cuando no ves adónde se fueron los tokens
Solo el 15% de las empresas puede calcular el ROI de la IA sin fricción. El verdadero cuello de botella no es demostrar el valor, sino atribuir los costos de tokens y cómputo a los resultados que producen.

No pierdas tus GPUs en el mantenimiento: usa Capacity Reservations
Detener una instancia GPU para hacerle mantenimiento puede significar perderla en el pool de capacidad compartida. Así es como las On-Demand Capacity Reservations mantienen tus GPUs de EC2 disponibles cuando las necesitas de vuelta.
