Cloud Intelligence™Cloud Intelligence™

Read stories from our Forward Deployed Engineers.

Engineering Blog

Trusted by platform engineering teams

Finlex
Hippo
Island
Claroty
Salt Security
PropertyGuru
Accrete AI
Akamai
OneFootball

Latest

More Posts

Basta over-provisioning per l'avvio: il nuovo CPU Startup Boost di GKE
By Chimbu ChinnaduraiJul 27, 20267 min read

Basta over-provisioning per l'avvio: il nuovo CPU Startup Boost di GKE

Il nuovo CPU startup boost di GKE assegna CPU extra ai container durante l'inizializzazione, per poi tornare al valore di base in place: niente più over-provisioning per il warm-up della JVM.

DynamoDB: cosa sbaglia la maggior parte dei team prima ancora di scrivere una riga di codice
By Joseph AllamJul 20, 20268 min read

DynamoDB: cosa sbaglia la maggior parte dei team prima ancora di scrivere una riga di codice

DynamoDB è uno dei database più potenti di AWS, ma la maggior parte dei team che incontra difficoltà commette gli stessi errori di progettazione dello schema. Ecco cosa sapere prima di costruire.

Monitorare job Kubernetes brevi su larga scala
By Ivan YurochkoJul 17, 20266 min read

Monitorare job Kubernetes brevi su larga scala

I job Kubernetes generano perdita di metriche ed esplosioni di cardinalità? Scopra come la streaming aggregation di vmagent risolve l'observability dei workloads effimeri su larga scala.

Cos'è la Tokenomics?
By Josh PalmerJul 13, 20267 min read

Cos'è la Tokenomics?

La Tokenomics è la disciplina che misura e attribuisce il consumo di token AI a clienti, funzionalità e agent. Ecco perché il tagging FinOps tradizionale non regge di fronte alla spesa AI.

Portare il database su un data lake Iceberg (Parte 2)
By Sayle MatthewsJul 13, 202616 min read

Portare il database su un data lake Iceberg (Parte 2)

La seconda parte della serie dedicata ai data lake Iceberg entra nel vivo dell'implementazione: deploy di Debezium Server su GKE per replicare Postgres in tabelle Iceberg su GCS.

Attribuzione dei costi AI: perché tag, SDK e modifiche al codice non funzionano
By Josh PalmerJul 11, 20266 min read

Attribuzione dei costi AI: perché tag, SDK e modifiche al codice non funzionano

L'infrastruttura AI manda in crisi il modello basato su tag e SDK che ha retto per anni l'allocazione dei costi cloud. La misurazione eBPF a livello kernel offre una soluzione strutturale, senza toccare il codice.

Cos'è un sensore eBPF?
By Josh PalmerJul 10, 20267 min read

Cos'è un sensore eBPF?

I sensori eBPF eseguono programmi in sandbox all'interno del kernel Linux per osservare ogni syscall, pacchetto e interazione con la GPU. Ecco perché stanno diventando la base della moderna attribuzione dei costi AI.

Rinnoviamo Zendesk per l'ultima volta
By Vadim SoloveyJul 10, 20265 min read

Rinnoviamo Zendesk per l'ultima volta

Abbiamo ridotto del 35% l'uso di Zendesk, ma la fattura è scesa solo del 10%. Ecco cosa ha rivelato la trattativa sul pricing SaaS a postazione nell'era dell'AI.

Contare i token è facile. Il contesto molto meno
By Amit KinhaJul 9, 20264 min read

Contare i token è facile. Il contesto molto meno

I token dicono quanto costa l'AI, ma non il perché. Un ex professionista FinOps spiega perché è l'attribuzione — non il tagging — a trasformare i numeri in vere decisioni di business.

Your cloud bill shouldn't be a mystery

Optimization, automation, expertise. In one platform.

Come misurare il ROI dell'AI quando non si vede dove sono finiti i token
By Josh PalmerJul 9, 20268 min read

Come misurare il ROI dell'AI quando non si vede dove sono finiti i token

Solo il 15% delle aziende calcola il ROI dell'AI senza attriti. Il vero collo di bottiglia non è dimostrare il valore, ma attribuire i costi di token e compute agli outcome che generano.

Non perda le GPU durante la manutenzione: usi le Capacity Reservations
By Avi KeinanJul 9, 20265 min read

Non perda le GPU durante la manutenzione: usi le Capacity Reservations

Fermare un'istanza GPU per manutenzione può significare perderla nel pool di capacità condivisa. Ecco come le On-Demand Capacity Reservations mantengono le GPU EC2 disponibili quando le servono.