Cloud Intelligence™Cloud Intelligence™

Read stories from our Forward Deployed Engineers.

Engineering Blog

Trusted by platform engineering teams

Finlex
Hippo
Island
Claroty
Salt Security
PropertyGuru
Accrete AI
Akamai
OneFootball

Latest

More Posts

Schluss mit Over-Provisioning für den Start: GKEs neuer CPU Startup Boost
By Chimbu ChinnaduraiJul 27, 20267 min read

Schluss mit Over-Provisioning für den Start: GKEs neuer CPU Startup Boost

Mit dem neuen CPU Startup Boost von GKE erhalten Container während der Initialisierung zusätzliche CPU und kehren danach in-place zur Baseline zurück – kein Over-Provisioning mehr fürs JVM-Warm-up.

DynamoDB: Was die meisten Teams falsch machen, bevor sie die erste Zeile Code schreiben
By Joseph AllamJul 20, 20268 min read

DynamoDB: Was die meisten Teams falsch machen, bevor sie die erste Zeile Code schreiben

DynamoDB ist eine der leistungsstärksten Datenbanken von AWS – doch die meisten Teams, die damit Schwierigkeiten haben, machen dieselben Fehler im Schemadesign. Das sollten Sie wissen, bevor Sie loslegen.

Kurzlebige Kubernetes Jobs at Scale überwachen
By Ivan YurochkoJul 17, 20266 min read

Kurzlebige Kubernetes Jobs at Scale überwachen

Kubernetes Jobs sorgen für Metrikverluste und Cardinality-Explosionen? So löst vmagent Streaming Aggregation die Observability für ephemere Workloads at Scale.

Was ist Tokenomics?
By Josh PalmerJul 13, 20267 min read

Was ist Tokenomics?

Tokenomics ist die Disziplin, den KI-Token-Verbrauch zu messen und Kunden, Features und Agents zuzuordnen. Warum klassisches FinOps-Tagging bei KI-Ausgaben scheitert.

Von der Datenbank zum Iceberg Data Lake (Teil 2)
By Sayle MatthewsJul 13, 202616 min read

Von der Datenbank zum Iceberg Data Lake (Teil 2)

Teil 2 unserer Iceberg-Data-Lake-Serie zeigt die praktische Umsetzung: Debezium Server auf GKE ausrollen und Postgres in Iceberg-Tabellen auf GCS replizieren.

AI-Kostenattribution: Warum Tags, SDKs und Code-Änderungen nicht greifen
By Josh PalmerJul 11, 20266 min read

AI-Kostenattribution: Warum Tags, SDKs und Code-Änderungen nicht greifen

AI-Infrastruktur macht das Tagging- und SDK-Playbook zunichte, das die klassische Cloud-Kostenallokation getragen hat. Messung auf Kernel-Ebene per eBPF liefert eine strukturelle Antwort – ganz ohne Code-Änderungen.

Was ist ein eBPF-Sensor?
By Josh PalmerJul 10, 20267 min read

Was ist ein eBPF-Sensor?

eBPF-Sensoren führen isolierte Programme im Linux-Kernel aus und erfassen jeden Syscall, jedes Paket und jede GPU-Interaktion. Deshalb bilden sie die Grundlage moderner AI-Kostenzuordnung.

Warum wir Zendesk zum letzten Mal verlängern
By Vadim SoloveyJul 10, 20265 min read

Warum wir Zendesk zum letzten Mal verlängern

Wir haben unsere Zendesk-Nutzung um 35 % gesenkt – die Rechnung nur um 10 %. Was die Verhandlung über Seat-basierte SaaS-Preise im KI-Zeitalter verrät.

Tokens zählen ist leicht. Kontext ist schwerer
By Amit KinhaJul 9, 20264 min read

Tokens zählen ist leicht. Kontext ist schwerer

Tokens zeigen, was KI kostet – aber nicht warum. Ein ehemaliger FinOps-Praktiker erklärt, warum erst Attribution – nicht Tagging – aus Kostenzahlen echte Geschäftsentscheidungen macht.

Your cloud bill shouldn't be a mystery

Optimization, automation, expertise. In one platform.

KI-ROI messen, wenn niemand weiß, wohin die Token geflossen sind
By Josh PalmerJul 9, 20268 min read

KI-ROI messen, wenn niemand weiß, wohin die Token geflossen sind

Nur 15 % der Unternehmen können den KI-ROI reibungslos berechnen. Der eigentliche Engpass ist nicht der Nutzennachweis, sondern die Zuordnung von Token- und Compute-Kosten zu den Ergebnissen, die sie erzeugen.

GPUs bei Wartung nicht verlieren: Mit Capacity Reservations absichern
By Avi KeinanJul 9, 20265 min read

GPUs bei Wartung nicht verlieren: Mit Capacity Reservations absichern

Wer eine GPU-Instanz für die Wartung stoppt, riskiert, sie an den gemeinsamen Kapazitätspool zu verlieren. So halten On-Demand Capacity Reservations Ihre EC2-GPUs verfügbar, wenn Sie sie zurückbrauchen.