Azure AI Foundry: do zero à produção

Azure AI Foundry: do zero à produção O que eu cubro quando um cliente pergunta “queremos construir aplicações com IA no Azure, por onde começamos?” TL;DR: Azure AI Foundry é a plataforma unificada para aplicações de IA no Azure. Comece com Standard PAYGO, use Priority Processing de forma seletiva quando latência importa mas o tráfego é variável, e migre a carga base previsível para PTU quando a utilização passar de 60-70%. Use o ptucalc.com (código no GitHub) para modelar custos antes de comprometer. ...

30 de julho de 2026 · 11 minutos · Ricardo Martins

Azure OpenAI em produção: tokens, throughput e alta disponibilidade

Décimo primeiro post da série. No anterior, a gente montou a plataforma de AI self-service com multi-tenancy e scheduling. Agora vem o serviço que todo mundo quer usar: Azure OpenAI, e como rodar isso sem tomar 429 na cara. tl;dr: Em produção, Azure OpenAI pede conta de TPM e RPM, retry com jitter e rota de escape entre deployments e regiões. Se você trata 429 como azar, o problema volta no próximo pico. ...

2 de junho de 2026 · 7 minutos · Ricardo Martins