<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/">
  <channel>
    <title>Azure-Openai on Ricardo Martins — Cloud Architecture, Azure, Kubernetes e DevOps</title>
    <link>https://ricardomartins.com.br/tags/azure-openai/</link>
    <description>Recent content in Azure-Openai on Ricardo Martins — Cloud Architecture, Azure, Kubernetes e DevOps</description>
    <image>
      <title>Ricardo Martins — Cloud Architecture, Azure, Kubernetes e DevOps</title>
      <url>https://ricardomartins.com.br/images/profile.png</url>
      <link>https://ricardomartins.com.br/images/profile.png</link>
    </image>
    <generator>Hugo</generator>
    <language>pt-BR</language>
    <lastBuildDate>Fri, 17 Jul 2026 11:15:58 -0400</lastBuildDate>
    <atom:link href="https://ricardomartins.com.br/tags/azure-openai/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>De Script a Agente: Dando Autonomia de Decisão ao Watchdog</title>
      <link>https://ricardomartins.com.br/watchdog-agente-autonomia-decisao-guardrails/</link>
      <pubDate>Tue, 14 Jul 2026 10:00:00 -0400</pubDate>
      <guid>https://ricardomartins.com.br/watchdog-agente-autonomia-decisao-guardrails/</guid>
      <description>Adicionando uma camada de raciocínio ao watchdog 429 para distinguir um spike benigno de batch de um agente descontrolado, com guardrails explícitos.</description>
    </item>
    <item>
      <title>Construindo um Watchdog 429 Determinístico para Azure OpenAI</title>
      <link>https://ricardomartins.com.br/watchdog-429-deterministico-azure-openai/</link>
      <pubDate>Wed, 08 Jul 2026 10:00:00 -0400</pubDate>
      <guid>https://ricardomartins.com.br/watchdog-429-deterministico-azure-openai/</guid>
      <description>Um servidor MCP que detecta tendências de consumo de tokens antes do 429 acontecer, sem LLM, só métricas e um cron job.</description>
    </item>
    <item>
      <title>Troubleshooting playbook: os incidentes que vão te acordar às 2AM</title>
      <link>https://ricardomartins.com.br/troubleshooting-playbook-os-incidentes-que-vao-te-acordar-as-2am/</link>
      <pubDate>Sat, 06 Jun 2026 10:00:00 -0400</pubDate>
      <guid>https://ricardomartins.com.br/troubleshooting-playbook-os-incidentes-que-vao-te-acordar-as-2am/</guid>
      <description>NVIDIA driver crash, CUDA OOM, pods stuck em Pending, 429 storm e latency spikes. Sintomas, diagnóstico, root cause e prevenção pra cada cenário real.</description>
    </item>
    <item>
      <title>Azure OpenAI em produção: tokens, throughput e alta disponibilidade</title>
      <link>https://ricardomartins.com.br/azure-openai-em-producao-tokens-throughput-e-alta-disponibilidade/</link>
      <pubDate>Tue, 02 Jun 2026 10:00:00 -0400</pubDate>
      <guid>https://ricardomartins.com.br/azure-openai-em-producao-tokens-throughput-e-alta-disponibilidade/</guid>
      <description>HTTP 429 não é bug, é capacity planning ruim. Deployment types, PTU vs Standard, multi-região, retry patterns e como não derrubar seu chatbot no launch day.</description>
    </item>
    <item>
      <title>Cost engineering para AI: quando GPU idle custa mais que seu carro</title>
      <link>https://ricardomartins.com.br/cost-engineering-para-ai-quando-gpu-idle-custa-mais-que-seu-carro/</link>
      <pubDate>Mon, 25 May 2026 10:00:00 -0400</pubDate>
      <guid>https://ricardomartins.com.br/cost-engineering-para-ai-quando-gpu-idle-custa-mais-que-seu-carro/</guid>
      <description>GPU idle num fim de semana custa R$25.000. Spot VMs, PTU vs pay-per-token, right-sizing, tagging e FinOps pra manter o CFO feliz sem frear inovação.</description>
    </item>
    <item>
      <title>Monitoramento e observabilidade para AI: quando o dashboard verde mente</title>
      <link>https://ricardomartins.com.br/monitoramento-e-observabilidade-para-ai/</link>
      <pubDate>Sun, 17 May 2026 10:00:00 -0400</pubDate>
      <guid>https://ricardomartins.com.br/monitoramento-e-observabilidade-para-ai/</guid>
      <description>Infra saudável não significa modelo funcionando. Model drift, GPU metrics, Azure OpenAI throttling e as 6 dimensões de observabilidade que você precisa cobrir.</description>
    </item>
  </channel>
</rss>
