Latest
More Posts
734 published posts

起動時の過剰プロビジョニングはもう不要:GKEの新機能CPU startup boost
GKEの新機能CPU startup boostなら、コンテナの初期化中だけ追加のCPUを割り当て、その後インプレースでベースラインに戻せます。JVMウォームアップのための過剰プロビジョニングはもう不要です。

DynamoDB:コードを書く前に、多くのチームがつまずく設計の落とし穴
DynamoDBはAWS屈指の強力なデータベースですが、苦戦するチームの多くは同じスキーマ設計のミスを犯しています。構築を始める前に知っておくべきポイントを解説します。

大規模環境での短命Kubernetesジョブ監視
Kubernetesジョブでメトリクス欠損やカーディナリティ爆発に悩んでいませんか?vmagentのストリーミング集約で短命workloadsの可観測性を実現する方法を解説します。

Tokenomicsとは?
Tokenomicsは、AIトークンの消費量を計測し、顧客・機能・エージェント単位で帰属させる規律です。従来のFinOpsのタグ付けがAI支出に通用しない理由を解説します。

データベースをIcebergデータレイクへ移行する(第2回)
Icebergデータレイクシリーズ第2回。GKE上にDebezium Serverをデプロイし、PostgresをGCS上のIcebergテーブルへレプリケートする実装手順を解説します。

AIコスト配賦:タグ・SDK・コード変更では通用しない
AIインフラは、従来のクラウドコスト配賦を支えてきたタグとSDKの定石を通用させません。カーネルレベルのeBPF計測なら、コード変更なしで構造的に解決できます。

eBPFセンサーとは?
eBPFセンサーはLinuxカーネル内でサンドボックス化されたプログラムを実行し、あらゆるsyscall、パケット、GPUのやり取りを観測します。最新のAIコスト按分の基盤として注目される理由を解説します。

Zendeskの更新は、これが最後
Zendeskの利用を35%削減したのに、請求額の減少はわずか10%。AI時代のシート課金型SaaSについて、更新交渉で見えてきたことをお話しします。

トークンは数えられる。難しいのは、文脈
トークンはAIの「コスト」は教えてくれても、「なぜ」までは教えてくれません。元FinOps実務家が、タグ付けではなくアトリビューションこそがコスト数値をビジネスの意思決定に変える理由を解説します。
Your cloud bill shouldn't be a mystery
Optimization, automation, expertise. In one platform.

トークンの行方が見えなくても、AI ROIを測る方法
AI ROIを滞りなく算出できる企業はわずか15%。真のボトルネックは価値の証明ではなく、トークンやコンピュートのコストを成果に紐付ける「配賦」にあります。

メンテナンスでGPUを失わない——Capacity Reservationsという選択
メンテナンスのためにGPUインスタンスを停止すると、共有キャパシティプールに戻ってそのまま戻ってこないことがあります。On-Demand Capacity Reservationsで、必要なときにEC2 GPUを確実に確保する方法を解説します。
