Genie Code agora pode bloquear uso de verdade quando o orçamento estoura, não só avisar

A opção Block usage nos controles de orçamento do Genie Code impede o usuário de continuar usando o produto assim que o limite mensal, geral, por time ou por pessoa, é excedido, até o orçamento resetar no início do mês ou um admin liberar mais uso; antes só existia alerta, sem bloqueio efetivo.

setembro 13, 2026 · 2 min · 367 words · Wiliam Rosa

Como a própria Databricks controla o gasto de milhares de engenheiros usando coding agents

A Databricks dividiu o controle de gasto com IA em orçamento diário e mensal, cada um resolvendo um problema diferente. É um case interno pequeno, mas com uma lição de FinOps que qualquer time de engenharia pode copiar hoje.

agosto 18, 2026 · 3 min · 450 words · Wiliam Rosa

Um orçamento só não basta para controlar gasto com IA

Por que dividir o controle de gasto com IA em orçamento diário e mensal resolve dois problemas que um limite único não resolve sozinho.

agosto 18, 2026 · 1 min · 148 words · Wiliam Rosa

Unity AI Gateway chega à disponibilidade geral: governança de IA deixou de ser opcional

Com a GA do Unity AI Gateway e mais de um quatrilhão de tokens já processados, a Databricks formaliza algo que quem trabalha com governança de dados já sentia: administrar agentes de IA é, antes de tudo, um problema de governança.

agosto 11, 2026 · 3 min · 457 words · Wiliam Rosa

Cinco alavancas técnicas pra baixar o custo de coding agent sem cortar acesso do time

Orçamento é só uma parte da conta de coding agent em escala. A Databricks lista cinco alavancas técnicas, roteamento dinâmico por modelo mais barato, meta-harness pra trocar de modelo sem fricção, e redução de token via cache e compressão de contexto, que reduziram custo em até 50% sem baixar qualidade percebida pelo engenheiro.

agosto 8, 2026 · 6 min · 1154 words · Wiliam Rosa

Um agente que responde 'quanto vai custar isso' antes de você rodar em produção

O Databricks MVP Casper Lubbers construiu um agente de FinOps focado em avaliação de custo Azure + Databricks, do tipo de pergunta que hoje normalmente só se responde depois do fato, olhando a fatura.

agosto 2, 2026 · 2 min · 277 words · Wiliam Rosa

Testei três modelos atrás do mesmo Unity AI Gateway, e o custo de token variou cinco vezes pra pergunta idêntica

Um MVP apontou um Unity AI Gateway pra três modelos hospedados no Databricks e mediu guardrail bloqueando prompt injection 3 de 3 vezes, mas com uma diferença de até 5x no custo de token pro mesmo prompt entre modelos.

julho 2, 2026 · 2 min · 314 words · Wiliam Rosa

Rotear pergunta ambígua pra um modelo de reasoning não compensou, e os números provam

Um experimento comparando modelo base e modelo de reasoning em três níveis de complexidade nas Foundation Model APIs do Databricks mostrou que reasoning só compensa em tarefa de lógica multi-etapa, não em classificação ambígua.

junho 2, 2026 · 2 min · 317 words · Wiliam Rosa

Gestão de custo no Databricks é decisão de política de cluster, não corte de orçamento no fim do mês

Controlar gasto no Databricks funciona melhor como restrição estrutural definida em cluster policy, autoscaling e auto-termination, do que como auditoria reativa de fatura no fim do mês. O trade-off central é entre restringir demais e travar produtividade, ou liberar demais e perder controle de custo.

outubro 19, 2022 · 6 min · 1120 words · Wiliam Rosa