A trilha· 36
- 1Intermediário 5 minA IDE Virou a Exceção: Como Passei a Construir Loops em Vez de CódigoDepois de 16 anos construindo sistemas financeiros na AWS, percebi que meu trabalho mudou: não projeto mais código linha a linha, projeto loops — triggers, topologias, verificadores e stop-rules. A IDE ainda existe na minha bancada, mas cada vez menos. Este post é o registro honesto dessa transição.
- 2Intermediário 13 minAmazon Connect + AVD/Windows 365: Otimização de Áudio em VDIA AWS anunciou suporte a otimização de áudio do Amazon Connect para Azure Virtual Desktop (AVD) e Windows 365 Cloud PC via Microsoft Multimedia Redirection (MMR), expandindo uma capacidade já existente para WorkSpaces, Citrix e Omnissa. O mecanismo redireciona o processamento de mídia do session host para o dispositivo local do agente, reduzindo latência e melhorando qualidade de voz em ambientes VDI heterogêneos. Neste artigo, avalio o que essa feature entrega de fato, onde ela falha, e como integrá-la em arquiteturas de contact center financeiro-grade.
- 3Avançado 11 minTPU Developer Hub: Revisão Técnica de uma Plataforma de IA de Alto DesempenhoO TPU Developer Hub consolida ferramentas, documentação e stacks de ML de alto desempenho em torno das TPUs do Google Cloud. Para arquitetos que operam em ambientes financeiros com exigências de latência, custo e governança, entender onde essa plataforma entrega valor real — e onde ela impõe fricção operacional — é essencial antes de qualquer migração.
- 4Avançado 8 minAvaliação de Agentes como Disciplina de EngenhariaA avaliação de agentes de IA deixou de ser um exercício ad hoc de prompt engineering e tornou-se uma disciplina de engenharia com datasets versionados, quality gates automatizados e rastreabilidade de regressões. O Bedrock AgentCore materializa esse salto ao trazer infraestrutura gerenciada para o ciclo de vida de testes de agentes. Para arquitetos de sistemas financeiros, isso muda o contrato entre equipes de ML e engenharia de plataforma.
- 5Avançado 12 minAutomação de Documentos com Bedrock: Jornada de ModernizaçãoPipelines legados de extração documental em ambientes financeiros acumulam dívida técnica silenciosa: OCR frágil, regras manuais e ausência de rastreabilidade. Neste artigo, narro a jornada de modernização para Bedrock Data Automation, cobrindo decisões de arquitetura, riscos gerenciados e o que realmente muda em operação. A análise é baseada em padrões reais de sistemas financeiros críticos, não em demos de laboratório.
- 6Avançado 9 minObservabilidade de LLMs em Produção: Do GPU à Qualidade da RespostaColocar um LLM em produção no SageMaker é a parte fácil. O difícil é saber, em tempo real, se ele está respondendo bem, consumindo GPU de forma eficiente e custando o que você planejou. Este artigo detalha a stack de observabilidade que eu construiria hoje para inferência LLM financeira-grade.
- 7Avançado 10 minWeb Search no Bedrock AgentCore: Revisão Técnica AprofundadaO Web Search no Amazon Bedrock AgentCore entrega busca web gerenciada para agentes de IA, com zero egresso de dados fora do ambiente AWS e grounding via MCP. Avalio a capacidade com olhar crítico de arquiteto sênior: trade-offs reais, limites operacionais e quando faz sentido adotar.
- 8Avançado 8 minInvokeGuardrailChecks vs Guardrails Clássicos: Qual Usar em Agentes AI?A AWS lançou a InvokeGuardrailChecks API no Amazon Bedrock Guardrails, uma API sem recurso que permite aplicar salvaguardas individuais em qualquer ponto de um loop agentic sem criar ou versionar recursos de guardrail. Neste artigo, faço uma análise comparativa direta entre essa abordagem e os Guardrails clássicos baseados em recursos, avaliando trade-offs de latência, governança, custo e adequação para sistemas financeiros de missão crítica.
- 9Avançado 11 minAmazon Bedrock AgentCore: Otimização Contínua de Agentes em ProduçãoO Amazon Bedrock AgentCore introduz um loop de melhoria contínua que transforma traces de produção em diagnósticos acionáveis, recomendações fundamentadas em dados e validação estatística via testes A/B. Para arquitetos de sistemas financeiros e plataformas de alto risco, isso representa a primeira tentativa séria da AWS de fechar o gap entre observabilidade de agentes e operação confiável em produção.
- 10Avançado 9 minAmazon Bedrock AgentCore Harness: Da Ideia ao Agente de ProduçãoO AgentCore Harness chegou ao GA em junho de 2026 como uma abstração gerenciada que colapsa o plano de controle de agentes LLM em dois chamadas de API. Neste artigo, analiso como o harness funciona internamente, onde ele falha, e o que arquitetos de sistemas financeiros precisam entender antes de colocá-lo em produção.
- 11Avançado 12 minAWS WAF no AgentCore Gateway: Segurança de Produção para IA AgênticaA disponibilidade geral do AWS WAF para o Amazon Bedrock AgentCore Gateway marca uma inflexão importante: workloads de IA agêntica agora podem receber proteções de borda consistentes sem instrumentação por agente. Analiso o que essa integração realmente entrega, onde ela ainda deixa lacunas e como estruturar uma postura de segurança madura para sistemas agênticos em produção.
- 12Avançado 7 minIaC para Plataformas de IA: Terraform e SageMaker Unified StudioO suporte oficial ao Terraform para o SageMaker Unified Studio fecha uma lacuna crítica: plataformas de IA agora podem ser provisionadas com o mesmo rigor de IaC que redes e bancos de dados. Neste artigo, disseço o padrão, sua anatomia modular, quando ele resolve o problema certo e quando ele esconde dívida técnica perigosa.
- 13Avançado 12 minSageMaker Unified Studio via Terraform: Migrando para IaC em Ambientes FinanceirosO suporte a Terraform no Amazon SageMaker Unified Studio, anunciado em julho de 2026, fecha uma lacuna crítica para plataformas de dados em ambientes regulados: domínios de ML que antes exigiam ClickOps ou automação frágil via SDK agora podem ser versionados, revisados e promovidos como qualquer outro recurso de infraestrutura. Neste artigo, analiso a jornada de migração de um estado inicial baseado em console para um pipeline IaC completo, com atenção especial às armadilhas de IAM, governança de blueprints e observabilidade operacional que fazem a diferença em ambientes financeiros.
- 14Avançado 10 minSageMaker Unified Studio + Terraform: Retro de Incidente em IaC para IAA ausência de infraestrutura-como-código reproduzível para plataformas de IA unificadas não é um problema de conveniência — é um vetor de incidentes de governança, drift de configuração e falhas de auditoria em ambientes financeiros. O suporte ao Terraform no Amazon SageMaker Unified Studio, lançado em julho de 2026, fecha uma lacuna crítica que eu vi causar incidentes reais em múltiplos clientes enterprise. Esta retro analisa o padrão de falha, a linha do tempo típica e as mudanças de resiliência que devem seguir.
- 15Avançado 8 minSageMaker Unified Studio + Terraform: IaC para Plataformas de IA FinanceirasO suporte oficial ao Terraform para o SageMaker Unified Studio, lançado em julho de 2026, fecha uma lacuna crítica para equipes de plataforma que operam em ambientes financeiros regulados: a capacidade de versionar, auditar e promover domínios de IA/dados com o mesmo rigor aplicado a qualquer outro recurso de infraestrutura. Este briefing analisa o que muda na prática, onde estão os riscos reais e como posicionar essa capacidade dentro de uma estratégia de Internal Developer Platform.
- 16Avançado 9 minFinOps para IA Generativa: Dissecando o Padrão de Custo Bedrock no CUR 2.0Com a disponibilização de metadados padronizados do Bedrock no AWS Data Exports, a atribuição de custos de IA generativa deixa de depender de parsing frágil de campos livres e passa a ter estrutura nativa no CUR 2.0. Neste artigo, disseço a anatomia desse padrão, os cenários onde ele resolve o problema de verdade e as armadilhas que ainda persistem quando a governança de IA não está alinhada ao pipeline de FinOps.
- 17Avançado 11 minAmazon Connect + AVD: Otimização de Áudio VDI em Ambientes FinanceirosA suporte nativo de redirecionamento de mídia do Amazon Connect para Azure Virtual Desktop e Windows 365 Cloud PC fecha uma lacuna operacional crítica em contact centers financeiros que já migraram agentes para VDI híbrido. O mecanismo usa Microsoft Multimedia Redirection (MMR) para desviar o processamento de áudio WebRTC do session host para o dispositivo local do agente — reduzindo latência percebida e eliminando a dupla codificação que degrada a qualidade de voz. Este artigo detalha o que muda na arquitetura, os gotchas de implantação e um checklist acionável para equipes de plataforma.
- 18Avançado 9 minMigrando para Git Nativo no SageMaker Unified StudioO SageMaker Unified Studio substituiu o modelo de sync automático por controle de versão Git flexível e granular, cobrindo Query Editor, Visual ETL, Workflows e Notebooks numa experiência unificada. Para equipes em ambientes regulados, essa mudança não é cosmética — ela redefine auditabilidade, rastreabilidade de artefatos e o modelo de governança de código analítico. Neste artigo, percorro a jornada de migração, os riscos reais e as decisões de arquitetura que fazem a diferença em produção.
- 19Avançado 7 minPRM por User Agent: atribuição melhor, governança ainda necessáriaA expansão do Partner Revenue Measurement por User Agent é pequena na implementação e relevante na leitura econômica de soluções SaaS e ISV na AWS. Eu gosto do movimento, mas trataria isso como telemetria de atribuição, não como sistema financeiro primário.
- 20Avançado 10 minClaude Fable 5.1 na AWS: o modelo que exige histórico imutávelO Fable 5.1 chegou ao Bedrock em 1º de setembro de 2026 com o mesmo preço de entrada e saída do Fable 5, mas com leitura de cache a um quarto do custo. O que ninguém colocou no anúncio é que ele troca flexibilidade de orquestração por qualidade de raciocínio: tool_choice forçado morreu e editar o histórico passa a ser erro. Avaliei o que isso significa para quem opera agentes de longa duração dentro do perímetro AWS.
- 21Avançado 9 min3LO no Bedrock Managed KB: 5 minutos de setup, 1 decisão irreversívelEm 4 de setembro de 2026 a AWS liberou o user-managed setup (3LO) para SharePoint, OneDrive e Confluence no Amazon Bedrock Managed Knowledge Base: você faz login com a sua própria conta e o data source sai em minutos. O que a documentação diz em letra miúda é que esse caminho não suporta controle de acesso por documento, e que a flag de ACL não muda depois do CreateDataSource. Este é o relato da migração que isso obriga — do protótipo em 3LO para um knowledge base de produção com ENTRA_ID_APP_ONLY, certificado e userContext.
- 22Avançado 8 minRAG sobre ServiceNow: o conector que apaga o user criteriaO conector nativo de ServiceNow do Amazon Bedrock Managed Knowledge Base chegou em 4 de setembro de 2026 e tira semanas de pipeline artesanal do caminho. Ele também instrui você a usar uma conta de serviço com knowledge_admin, que ignora o user criteria por knowledge base — e o conector não ingere ACL de documento. Este é o retro do piloto em que essas duas linhas de documentação se encontraram.
- 23Avançado 8 minFable 5.1 no Bedrock: retenção de dados virou decisão de arquiteturaClaude Fable 5.1 chegou ao Bedrock em 1º de setembro de 2026 com 1M de contexto e uma condição que nenhum modelo anterior da Anthropic tinha: você precisa autorizar explicitamente a retenção de prompts e saídas por até 30 dias dentro da AWS. Isso não é uma caixinha de consentimento — é uma configuração de conta com raio de alcance organizacional, que colide com o SCP de zero data retention que a maioria dos ambientes regulados já tem escrito.
- 24Avançado 7 minGPT-6 Astra no Bedrock: o endpoint decide o que você auditaA GA do GPT-6 Astra no Amazon Bedrock, em 8 de setembro de 2026, trouxe 1.050.000 tokens de contexto e uma bifurcação de arquitetura: o modelo é servido por `bedrock-runtime` e por `bedrock-mantle`, e cada endpoint recusa algo que o outro entrega. Analiso o que cada caminho custa em dinheiro, em quota e em rastro auditável — e por que, para carga regulada no Brasil, a conversa começa e termina em residência de dados.
- 25Avançado 7 minCold start de LLM no HyperPod: de 27 minutos a segundos com model cachingO SageMaker HyperPod passou a pré-carregar pesos de modelo em NVMe local e imagens de contêiner nos nós, com cerca de 60% de scale-out mais rápido em modelos de 57 a 145 GB. Conto a migração de um endpoint de análise de documentos passo a passo — do baseline de 27 minutos até o primeiro token à reescrita da política de autoscaling que só existia para conviver com o cold start.
- 26Avançado 7 minTreino e inferência na mesma GPU: quatro formas de partilhar 10 mil aceleradoresO China Merchants Bank venceu o CNCF End User Case Study Contest ao colocar treino, fine-tuning e inferência num único plano de controle Kubernetes sobre quase 10 mil aceleradores heterogêneos: utilização média de 35% para mais de 60% e custo por milhão de tokens cortado em mais de 60%. Analiso o que faz esse número acontecer — fila com quota, autoscaling por métrica, virtualização de GPU e cache de dados — e comparo quatro formas de reproduzi-lo na AWS, com a matriz de decisão que eu usaria num banco.
- 27Especialista 7 minGPT-5 vs Claude vs Nova no Bedrock: Bake-off de Governança para ProduçãoCom GPT-5.5 e Codex chegando ao Amazon Bedrock, equipes de plataforma agora enfrentam uma escolha real entre três famílias de modelos frontier dentro do mesmo plano de controle. Esta análise compara GPT-5.5, Claude 3.7 Sonnet e Amazon Nova Pro sob a ótica de quem precisa colocar IA em produção em ambientes regulados.
- 28Especialista 8 minRAG Agêntico com OpenSearch Serverless: Anatomia de um PadrãoO padrão RAG agêntico com OpenSearch Serverless promete escala elástica e recuperação semântica sem gestão de infraestrutura — mas esconde armadilhas sérias de latência, custo e consistência que sistemas financeiros não podem ignorar. Neste artigo, desmonto a anatomia do padrão, mapeio quando ele funciona, quando falha e como configurá-lo com rigor de produção.
- 29Especialista 8 minInteligência de Contratos na AWS: Arquitetura de CampoConstruir inteligência contratual com IA generativa vai muito além de conectar um LLM a PDFs. Este artigo documenta os padrões arquiteturais, armadilhas operacionais e decisões de design que fazem a diferença entre um PoC impressionante e um sistema confiável em produção financeira.
- 30Especialista 8 minAgentic RAG na AWS: Comparativo de Arquiteturas para Ambientes FinanceirosAgentic RAG deixou de ser experimento de laboratório e passou a ser requisito de plataforma em ambientes financeiros que exigem rastreabilidade, controle de custo e latência previsível. Neste artigo, comparo quatro abordagens arquiteturais concretas na AWS, com trade-offs reais, números plausíveis e uma recomendação sem rodeios.
- 31Especialista 10 minAWS FinOps Agent: Arquitetura, Mecanismos e Trade-offs em ProduçãoO AWS FinOps Agent, anunciado em preview no AWS Summit New York 2026, representa uma mudança de paradigma: de dashboards reativos para agentes autônomos que investigam anomalias de custo, geram recomendações e executam ações em sistemas externos como Jira e Slack. Neste artigo, disseço a arquitetura interna do agente, os modos de falha que ninguém menciona, e os trade-offs que qualquer equipe de engenharia financeira precisa entender antes de colocá-lo em produção.
- 32Especialista 8 minAgentes de IA para Segurança e DevOps: Produtividade ou Risco?A AWS lançou agentes frontier para testes de segurança e operações cloud, abrindo um debate real sobre até onde a autonomia de IA pode ir em ambientes regulados. Este artigo compara quatro padrões de implantação — agente totalmente autônomo, semi-autônomo com aprovação humana, assistido (copilot) e pipeline determinístico — usando critérios concretos de risco, custo, latência e conformidade.
- 33Especialista 9 minBedrock Managed Knowledge Base: Anatomia de um Pipeline RAG GerenciadoO Amazon Bedrock Managed Knowledge Base abstrai toda a pilha RAG — conectores, parsing, embeddings, re-ranking e recuperação agêntica — em um único primitivo gerenciado. Neste artigo, desmonto cada camada, exponho os modos de falha que a documentação não menciona e analiso os trade-offs reais para quem projeta sistemas de IA de grau financeiro na AWS.
- 34Especialista 10 minDPD no HyperPod: Prefill e Decode Disagregados em ProduçãoO SageMaker HyperPod agora suporta Disaggregated Prefill and Decode (DPD), separando as duas fases de inferência LLM em pools de GPU dedicados conectados via EFA e GPU-Direct RDMA. Essa mudança resolve um dos problemas mais persistentes em produção: um único request de contexto longo degradando a latência de token de todos os requests concorrentes. Neste artigo, analiso os trade-offs reais, os padrões de falha que você vai encontrar e um playbook para habilitar DPD em workloads financeiros de alta exigência.
- 35Especialista 10 minOAuth no AWS MCP Server: Comparativo de Estratégias de Autenticação para AgentesO suporte OAuth nativo no AWS MCP Server muda o jogo para quem estava improvisando autenticação de agentes com credenciais estáticas ou fluxos Cognito customizados. Mas 'suporte OAuth' não é uma decisão de arquitetura — é um ponto de partida. Neste artigo, faço um bake-off honesto entre quatro estratégias de autenticação para agentes de IA em ambientes financeiros, com trade-offs reais, números plausíveis e uma recomendação direta.
- 36Especialista 9 minGPT-5.6 no Bedrock: Retro de Adoção em Ambientes FinanceirosO lançamento do GPT-5.6 Sol, Terra e Luna no Amazon Bedrock em 13 de julho de 2026 expôs padrões de adoção apressada que vi repetidamente em ambientes financeiros regulados. Este retro examina o que acontece quando equipes de engenharia integram modelos de terceiros via Bedrock sem controles de governança adequados — e como corrigir o curso antes que o próximo incidente aconteça.
Estudos para aprofundar
adrADR: S/4HANA em Hong Kong — X2idn chegou, migrar agora ou esperar X8i?Em 11 de setembro de 2026 a AWS habilitou as instâncias X2idn em Asia Pacific (Hong Kong). Para um core financeiro em S/4HANA que não pode sair da região, é a primeira instância Nitro de 2 TiB certificada para HANA produtivo ali — 49% mais SAPS e 5,7× mais banda de EBS que o x1.32xlarge. Este ADR registra por que eu migro agora, aceitando uma segunda migração para X8i quando ela chegar.adrWeb Search do Bedrock no GovCloud: um ADR sobre grounding reguladoEm 2 de setembro de 2026 a AWS levou o tool server-side Web Search do Amazon Bedrock para o GovCloud (US-West). Escrevi este ADR porque a decisão real não é "usar ou não busca web" — é escolher em que modo de recuperação você opera, e o default do parâmetro `external_web_access` empurra times regulados exatamente para o lado errado, com HTTP 200 e sem erro visível.adrADR: levar agentes governados para o Amazon QuickA integração entre Amazon Quick e AWS Agent Registry muda o ponto de controle: o problema deixa de ser conectar cada MCP manualmente e passa a ser governar um catálogo consumível por usuários de negócio. Eu trataria isso como uma decisão de plataforma, não como uma conveniência de console.adrGPU Fracionada no ECS: Decisão de Arquitetura para Inferência de IAO Amazon ECS agora suporta agendamento de GPU fracionada em instâncias EC2 G6f, permitindo partições de até 1/8 de uma GPU NVIDIA L4 com 3 GB de memória. Para plataformas de inferência de IA em escala financeira, isso muda fundamentalmente o cálculo de custo e densidade de workload. Este ADR documenta o contexto, as opções consideradas, a decisão e as consequências operacionais reais.adrADR: EKS Provisioned Control Plane e HPA Concurrency 40xO EKS Provisioned Control Plane agora processa objetos HPA com até 40x mais concorrência que o padrão Kubernetes, eliminando um gargalo silencioso em clusters com centenas de workloads. Neste registro de decisão arquitetural, analiso o contexto que torna essa mudança relevante, as opções que existiam antes dela, e as consequências operacionais que arquitetos precisam endereçar agora.adrADR: IAM Role Sessions no GameLift Streams — Eliminando Credenciais EstáticasO Amazon GameLift Streams passou a suportar IAM roles por sessão em julho de 2026, eliminando a necessidade de credenciais estáticas em bundles de aplicação. Este artigo analisa a decisão arquitetural por trás dessa mudança, os padrões de segurança envolvidos e as consequências operacionais para times que constroem plataformas de streaming com acesso a recursos AWS. Open source para explorar
solution-architecture-mcp-toolkitFerramentas MCP e templates que encodam disciplina de arquitetura — ADR, threat model, Well-Architected.aws-event-driven-finops-platformMalha de eventos bancária na AWS onde custo é requisito, não relatórioaws-agentic-ai-reference-architectureBlueprint de IA agêntica na AWS que sobrevive a produção: Bedrock, MCP, guardrails, telemetria.diagram-as-codeGere diagramas AWS a partir de YAML — CLI em Go com frontend web hospedado.DeskbuddyPainel inteligente para mesa com ESP32 e touchscreen — firmware, web e instalador em um só repo.dailyfocusUm foco por dia, tarefas, timer e reflexão — sem conta, sem backend para manter.