Cloud Intelligence™Cloud Intelligence™

Read stories from our Forward Deployed Engineers.

Engineering Blog

Trusted by platform engineering teams

Finlex
Hippo
Island
Claroty
Salt Security
PropertyGuru
Accrete AI
Akamai
OneFootball

Latest

More Posts

Chega de superprovisionar para a inicialização: conheça o novo CPU Startup Boost do GKE
By Chimbu ChinnaduraiJul 27, 20267 min read

Chega de superprovisionar para a inicialização: conheça o novo CPU Startup Boost do GKE

O novo CPU startup boost do GKE permite dar CPU extra aos containers durante a inicialização e depois voltar ao baseline in-place — sem precisar superprovisionar para o warm-up da JVM.

DynamoDB: o que a maioria dos times erra antes de escrever uma linha de código
By Joseph AllamJul 20, 20268 min read

DynamoDB: o que a maioria dos times erra antes de escrever uma linha de código

O DynamoDB é um dos bancos de dados mais poderosos da AWS — mas a maioria dos times que sofre com ele comete os mesmos erros de design de schema. Veja o que você precisa saber antes de construir.

Monitorando Kubernetes Jobs de Curta Duração em Escala
By Ivan YurochkoJul 17, 20266 min read

Monitorando Kubernetes Jobs de Curta Duração em Escala

Kubernetes jobs gerando perda de métricas e explosão de cardinalidade? Veja como a streaming aggregation do vmagent resolve a observabilidade de workloads efêmeros em escala.

O que é Tokenomics?
By Josh PalmerJul 13, 20267 min read

O que é Tokenomics?

Tokenomics é a disciplina de medir e atribuir o consumo de tokens de IA a clientes, features e agentes. Entenda por que o tagging tradicional de FinOps não dá conta do gasto com IA.

Migrando seu banco de dados para um data lake Iceberg (Parte 2)
By Sayle MatthewsJul 13, 202616 min read

Migrando seu banco de dados para um data lake Iceberg (Parte 2)

A Parte 2 da nossa série sobre data lake Iceberg mostra a implementação na prática: como implantar o Debezium Server no GKE para replicar o Postgres em tabelas Iceberg no GCS.

Atribuição de Custos de IA: por que tags, SDKs e mudanças no código não funcionam
By Josh PalmerJul 11, 20266 min read

Atribuição de Custos de IA: por que tags, SDKs e mudanças no código não funcionam

A infraestrutura de IA quebra o manual de tags e SDKs que sustentava a alocação tradicional de custos de nuvem. A medição em nível de kernel com eBPF oferece uma solução estrutural, sem mexer no código.

O que é um sensor eBPF?
By Josh PalmerJul 10, 20267 min read

O que é um sensor eBPF?

Sensores eBPF executam programas em sandbox dentro do kernel do Linux para observar cada syscall, pacote e interação com a GPU. Veja por que estão virando a base da atribuição moderna de custos de IA.

Vamos renovar o Zendesk pela última vez
By Vadim SoloveyJul 10, 20265 min read

Vamos renovar o Zendesk pela última vez

Reduzimos em 35% o uso do Zendesk e a conta caiu só 10%. Veja o que a negociação de renovação revelou sobre a precificação SaaS por assento na era da IA.

Contar tokens é fácil. O difícil é o contexto
By Amit KinhaJul 9, 20264 min read

Contar tokens é fácil. O difícil é o contexto

Tokens mostram quanto a IA custa, mas não por quê. Um ex-profissional de FinOps explica por que attribution — e não tagging — é o que transforma números de custo em decisões reais de negócio.

Your cloud bill shouldn't be a mystery

Optimization, automation, expertise. In one platform.

Como medir o ROI de IA quando você não faz ideia de para onde foram os tokens
By Josh PalmerJul 9, 20268 min read

Como medir o ROI de IA quando você não faz ideia de para onde foram os tokens

Só 15% das empresas conseguem calcular o ROI de IA sem atrito. O verdadeiro gargalo não é provar o valor, e sim atribuir custos de tokens e compute aos resultados que eles geram.

Não perca suas GPUs na manutenção: use Capacity Reservations
By Avi KeinanJul 9, 20265 min read

Não perca suas GPUs na manutenção: use Capacity Reservations

Parar uma instância GPU para manutenção pode significar perdê-la para o pool de capacidade compartilhado. Veja como as On-Demand Capacity Reservations mantêm suas GPUs no EC2 disponíveis na hora que você precisa.