Construindo um Watchdog 429 Determinístico para Azure OpenAI

No post anterior eu expliquei o que é MCP e como um agent decide sozinho a sequência de chamadas a partir das tools que tem disponíveis. Agora vamos construir um caso de uso real, pequeno o bastante para terminar em um fim de semana: um MCP server que observa o consumo de tokens do seu deployment de Azure OpenAI / AI Foundry e avisa no Slack ou por email antes do 429 acontecer. Não depois, quando o cliente já engoliu o erro em produção. ...

8 de julho de 2026 · 8 minutos · Ricardo Martins

Infrastructure as Code para AI: automatizando GPU clusters

Quinto post da série. No anterior, entramos no detalhe da GPU. Agora é hora de automatizar o que fica ao redor dela. Entender GPU é metade do trabalho. Provisionar tudo isso de forma consistente, repetível e auditável é a outra metade. tl;dr: IaC em AI não é capricho. É o que evita SKU errado, drift, cluster caro esquecido e pipeline sem trilha de auditoria. O typo de $4.000 Imagina o cenário: você provisiona um cluster GPU manualmente em East US 2 pra um experimento de ML. AKS com node pool Standard_NC6s_v3, accelerated networking, drivers NVIDIA, taints corretos. Leva quase um dia, mas funciona. ...

9 de maio de 2026 · 8 minutos · Ricardo Martins

Conhecendo o Terraform, Packer e Ansible

O movimento DevOps vem ganhando muita força nos últimos anos e ao mesmo tempo centenas de ferramentas relacionadas são lançadas dia após dia. Por outro lado com isto tem se tornado cada vez mais difícil escolher as ferramentas adequadas ainda que para as tarefas mais simples, uma vez que a diversidade de ferramentas é cada vez maior. Então neste artigo eu vou comentar sobre a proposta do Terraform, Packer e o Ansible para implementação e gerenciamento de uma infraestrutura em nuvem. O objetivo será apresentar um método de utilização destas ferramentas de forma integrada. ...

6 de março de 2017 · 4 minutos · Ricardo Martins