A escolha dos times que colocam IA em produção
Conecte em minutos
Uma chave de API. Visibilidade total da OpenAI.
Conecte sua organização na OpenAI com uma chave de admin somente leitura. A DoiT coleta uso, contagem de tokens por modelo e dados de faturamento automaticamente — sem proxies, sem alterações no SDK e sem exportações manuais em CSV. Em poucas horas após a conexão, você já tem relatórios unificados na tela.
O que você ganha
Feito para a realidade de quem opera na OpenAI
O que líderes de FinOps e engenharia realmente pedem quando conectam a organização da OpenAI.
Relatórios de uso unificados
Fatie o gasto com OpenAI por projeto, chave de API, modelo ou time — sem precisar construir medidores de token personalizados.
Anomalias em tempo real
Receba alertas de picos de tokens e prompts descontrolados em minutos, não em horas.
Otimização do mix de modelos
Identifique prompts direcionados ao GPT-4 que poderiam rodar em um modelo mais barato sem perda de qualidade.
Tokens de input vs. output
Detalhe o custo por tokens de input, cache e output em cada modelo.
Atribuição por feature
Conecte o gasto com tokens à feature de produto ou ao cliente que está gerando esse consumo — não só à chave de API que fez a chamada.
Budgets e guardrails
Defina budgets por projeto e por time para que agentes descontrolados não peguem o financeiro de surpresa no mês seguinte.
O dashboard nativo mostra o que aconteceu. O Cloud Intelligence™ te ajuda a agir sobre isso.
Muito além da página de uso da OpenAI
Consolidação multiprojeto
Visões consolidadas de cada projeto e organização na OpenAI, com drilldown por chave ou modelo.
Alertas de anomalia em tempo real
Detecção com machine learning nas dimensões de modelo, projeto e chave, entregue no Slack ou por e-mail.
Previsão de custo por modelo
Projete o consumo de tokens frente ao crescimento do produto antes que uma nova feature vá para GA.
Higiene de tags e alocação
Mapeie chaves de API para produtos, clientes e centros de custo, e divida o uso compartilhado do jeito que o financeiro espera.
Atribuição de IA multi-cloud
Combine o gasto da OpenAI com Bedrock, Vertex e Azure OpenAI para ver a fatura completa de IA em um só lugar.
Forward Deployed Engineers
Arquitetos de nuvem de altíssimo nível que atuam como extensão do seu time para implementar as otimizações.
Attribute + OpenAI
Decomponha o gasto da OpenAI até cada workload
O Attribute lê as chamadas à API da OpenAI em tempo de execução, captura identificadores de modelo e metadados de requisição, e mapeia o custo para o serviço, cliente ou feature exato que está gerando as requisições. Indicado para: empresas SaaS que rodam OpenAI em produção, especialmente times investigando um crescimento inexplicável nos custos de IA.
Detalhamento por modelo
Separe custos entre GPT-4o, GPT-4, GPT-3.5 e o1.
Custos de prompt e completion
Veja os custos de tokens de input e output separadamente.
Atribuição por serviço e cliente
Mapeie cada chamada ao serviço e ao cliente final responsável.
Decomposição de gateway
Preserve a atribuição em padrões de gateway LLM nativos da OpenAI.
Tendências e anomalias
Acompanhe o gasto ao longo do tempo e destaque crescimentos atípicos no custo da OpenAI.
Empresas em crescimento acelerado rodam no Cloud Intelligence™
Economia média nos primeiros 90 dias
Tempo médio de implementação
“O foco da DoiT em confiabilidade, aliado à flexibilidade do sistema, nos permite otimizar com segurança nossos workloads no Amazon EKS sem que nossos engenheiros precisem colocar a mão.”
Oren Ashkenazy
Director of DevOps and Cloud na Fiverr
Pronto para conectar sua organização na OpenAI?
Coloque o gasto com tokens sob controle.
Frequently asked
questions
Como ter visibilidade dos custos da OpenAI em vários projetos e chaves?
Conecte sua organização da OpenAI uma única vez com uma chave de admin. O Cloud Intelligence™ coleta o uso de cada projeto e chave de API, para você fatiar o gasto com tokens por projeto, modelo, chave ou time em uma visão única — sem medidores personalizados e sem exportações manuais em CSV.
Qual a melhor forma de integrar os dados de uso da OpenAI ao Cloud Intelligence™?
Use uma chave de admin somente leitura com escopo na sua organização da OpenAI. A DoiT cuida da ingestão, normalização e do reporte com granularidade diária dos tokens de input, output e cache por modelo. A maioria dos times está no ar em um dia.
Como saber quais modelos ou features respondem pela maior parte do gasto com tokens?
Os relatórios de uso permitem ir do gasto total até um modelo, projeto ou chave de API específicos. Com as chaves mapeadas, dá para filtrar por feature, cliente ou ambiente — sem precisar escrever SQL.
Como monitorar anomalias de custo da OpenAI em tempo real?
A detecção de anomalias roda continuamente em modelos, projetos e chaves. Quando o uso de tokens sai do baseline (um agente em loop, um prompt ruim, uma nova feature que viralizou), você recebe um alerta no Slack ou por e-mail com a causa provável.
Consigo definir budgets por time ou por feature de produto usando OpenAI?
Sim. Defina budgets e limites por projeto, chave ou feature marcada com tag, e receba alertas progressivos conforme o gasto se aproxima do teto — assim, um agente descontrolado não vira uma surpresa no fim do mês.
Posso combinar o gasto da OpenAI com outros provedores de IA?
O Cloud Intelligence™ unifica OpenAI, Azure OpenAI, Amazon Bedrock, Google Vertex AI e Anthropic em um único relatório, para você comparar a economia por token e o custo total de IA por feature ou cliente.
Qual a diferença entre o Cloud Intelligence™ e o dashboard nativo de uso da OpenAI?
O dashboard da OpenAI é um visualizador de uso. O Cloud Intelligence™ é uma plataforma: visibilidade de IA entre provedores, recomendações proativas, detecção de anomalias em tempo real, budgets e governança, além do acesso aos Forward Deployed Engineers que ajudam a agir sobre o que os dados mostram.
Meus dados ficam seguros quando conecto minha organização da OpenAI?
O Cloud Intelligence™ usa uma chave de admin somente leitura com o menor privilégio possível. Coletamos apenas metadados de uso e faturamento (nunca o conteúdo de prompts ou completions), e a plataforma é certificada SOC 2 Type II.
