Latest
More Posts
734 published posts

Schluss mit Over-Provisioning für den Start: GKEs neuer CPU Startup Boost
Mit dem neuen CPU Startup Boost von GKE erhalten Container während der Initialisierung zusätzliche CPU und kehren danach in-place zur Baseline zurück – kein Over-Provisioning mehr fürs JVM-Warm-up.

DynamoDB: Was die meisten Teams falsch machen, bevor sie die erste Zeile Code schreiben
DynamoDB ist eine der leistungsstärksten Datenbanken von AWS – doch die meisten Teams, die damit Schwierigkeiten haben, machen dieselben Fehler im Schemadesign. Das sollten Sie wissen, bevor Sie loslegen.

Kurzlebige Kubernetes Jobs at Scale überwachen
Kubernetes Jobs sorgen für Metrikverluste und Cardinality-Explosionen? So löst vmagent Streaming Aggregation die Observability für ephemere Workloads at Scale.

Was ist Tokenomics?
Tokenomics ist die Disziplin, den KI-Token-Verbrauch zu messen und Kunden, Features und Agents zuzuordnen. Warum klassisches FinOps-Tagging bei KI-Ausgaben scheitert.

Von der Datenbank zum Iceberg Data Lake (Teil 2)
Teil 2 unserer Iceberg-Data-Lake-Serie zeigt die praktische Umsetzung: Debezium Server auf GKE ausrollen und Postgres in Iceberg-Tabellen auf GCS replizieren.

AI-Kostenattribution: Warum Tags, SDKs und Code-Änderungen nicht greifen
AI-Infrastruktur macht das Tagging- und SDK-Playbook zunichte, das die klassische Cloud-Kostenallokation getragen hat. Messung auf Kernel-Ebene per eBPF liefert eine strukturelle Antwort – ganz ohne Code-Änderungen.

Was ist ein eBPF-Sensor?
eBPF-Sensoren führen isolierte Programme im Linux-Kernel aus und erfassen jeden Syscall, jedes Paket und jede GPU-Interaktion. Deshalb bilden sie die Grundlage moderner AI-Kostenzuordnung.

Warum wir Zendesk zum letzten Mal verlängern
Wir haben unsere Zendesk-Nutzung um 35 % gesenkt – die Rechnung nur um 10 %. Was die Verhandlung über Seat-basierte SaaS-Preise im KI-Zeitalter verrät.

Tokens zählen ist leicht. Kontext ist schwerer
Tokens zeigen, was KI kostet – aber nicht warum. Ein ehemaliger FinOps-Praktiker erklärt, warum erst Attribution – nicht Tagging – aus Kostenzahlen echte Geschäftsentscheidungen macht.
Your cloud bill shouldn't be a mystery
Optimization, automation, expertise. In one platform.

KI-ROI messen, wenn niemand weiß, wohin die Token geflossen sind
Nur 15 % der Unternehmen können den KI-ROI reibungslos berechnen. Der eigentliche Engpass ist nicht der Nutzennachweis, sondern die Zuordnung von Token- und Compute-Kosten zu den Ergebnissen, die sie erzeugen.

GPUs bei Wartung nicht verlieren: Mit Capacity Reservations absichern
Wer eine GPU-Instanz für die Wartung stoppt, riskiert, sie an den gemeinsamen Kapazitätspool zu verlieren. So halten On-Demand Capacity Reservations Ihre EC2-GPUs verfügbar, wenn Sie sie zurückbrauchen.
