A trilha· 30
- 1Intermediário 10 minAWS Builder Center Sandboxes: Revisão Técnica e Análise ArquiteturalO AWS Builder Center passou a oferecer ambientes sandbox gratuitos e com tempo limitado diretamente nos workshops, eliminando a necessidade de conta pessoal ou cartão de crédito. A proposta é sólida para onboarding e experimentação controlada, mas há limites operacionais e de governança que times de engenharia precisam entender antes de integrar esse recurso em trilhas de capacitação. Faço aqui uma revisão técnica honesta, com foco em isolamento, ciclo de vida, padrões de adoção e onde a oferta ainda deixa lacunas.
- 2Avançado 7 minCloudWatch para OTel: Desmontando o Padrão de Bridge de ObservabilidadeO padrão de bridge entre CloudWatch e OpenTelemetry resolve um problema real de fragmentação de observabilidade em ambientes multi-plataforma, mas carrega custos operacionais e armadilhas de design que raramente aparecem nos tutoriais. Neste artigo desmonto a anatomia desse padrão, quando ele faz sentido e quando ele cria mais problema do que resolve.
- 3Avançado 9 minECS Auto Scaling: Métricas de Alta Resolução vs. Abordagens TradicionaisO lançamento de métricas de alta resolução (20 segundos) para o Amazon ECS muda o cálculo de auto scaling para cargas financeiras sensíveis à latência. Este artigo compara as quatro abordagens principais de scaling — target tracking com alta resolução, step scaling, scheduled scaling e preditivo — com trade-offs concretos, números reais e uma matriz de decisão para ambientes de produção.
- 4Avançado 10 minAWS Lambda MicroVMs: análise técnica de um novo primitivo serverlessO AWS Lambda MicroVMs preenche uma lacuna real entre funções efêmeras e VMs pesadas, entregando isolamento em nível de hypervisor com latência de retomada quase instantânea e estado preservado por até 8 horas. Como arquiteto que opera ambientes financeiros multi-tenant, vejo potencial genuíno — e armadilhas igualmente reais que precisam ser endereçadas antes de qualquer adoção em produção.
- 5Avançado 9 minIngestão Gerenciada de Syslog no CloudWatch: Anatomia de um PadrãoO CloudWatch Logs agora aceita syslog diretamente via endpoint de VPC — sem agentes, com parsing automático de RFC 5424, RFC 3164 e Cisco FTD/ASA. Isso muda o padrão de coleta de logs para dispositivos de rede e servidores Linux em ambientes regulados. Neste artigo, desmonto a anatomia do padrão, seus limites reais e os anti-padrões que já vi queimar equipes em produção.
- 6Avançado 8 minGraviton4 R8g: Expansão Global e o Que Muda para Arquiteturas de Alta MemóriaA AWS expandiu as instâncias EC2 R8g com Graviton4 para cinco novas regiões — Tailândia, Nova Zelândia, África do Sul, Itália e Canadá Oeste — completando um rollout global que transforma a equação de custo-desempenho para workloads de alta memória fora dos grandes hubs. Com até 1,5 TB de RAM, 48xlarge e ganhos de 40% em bancos de dados relacionais sobre o Graviton3, este não é um upgrade incremental. É um sinal de maturidade de plataforma que muda decisões de arquitetura em regiões onde a escolha de instâncias era até agora limitada.
- 7Avançado 9 minEC2 R8g em Novas Regiões: Guia de Migração para Workloads FinanceirosA expansão das instâncias EC2 R8g para Tailândia, Nova Zelândia, África do Sul, Milão e Calgary representa muito mais do que disponibilidade regional — é uma decisão de arquitetura com implicações diretas em latência, compliance de dados e custo de operação. Neste artigo, documento o que aprendi migrando cargas financeiras memory-intensive de R7g para R8g, incluindo os gotchas que não aparecem na documentação oficial.
- 8Avançado 8 minEC2 R8g e Graviton4: Análise Técnica para Workloads Memory-IntensiveAs instâncias EC2 R8g com Graviton4 chegam a regiões como África (Cape Town), Europa (Milão) e Ásia-Pacífico (Tailândia, Nova Zelândia), trazendo até 1,5 TB de memória e 3x mais vCPUs que a geração anterior. Neste artigo, analiso os mecanismos reais por trás desse salto de performance, os trade-offs de migração e os padrões de design que tornam essas instâncias relevantes para sistemas financeiros críticos.
- 9Avançado 10 minR8i: Anatomia de uma Família de Instâncias para Workloads IntensivosA família R8i chega a Tokyo, Frankfurt e Irlanda com 600 Gbps de banda de rede e 300 Gbps de banda EBS — os maiores números entre instâncias EC2 não aceleradas. Antes de migrar cargas críticas, vale dissecar a anatomia dessas quatro variantes, entender os trade-offs reais e saber exatamente quando essa família resolve o problema e quando ela é a escolha errada.
- 10Avançado 10 minMigrando Workloads de Alta Rede para EC2 R6in/R6idn em Paris e CanadáA disponibilização das instâncias R6in e R6idn na Europa (Paris) e Canadá (Central) em julho de 2026 fecha uma lacuna de residência de dados crítica para workloads financeiros e de analytics em tempo real. Este artigo narra a jornada de migração de instâncias R5n para R6in/R6idn, detalhando decisões de arquitetura, riscos operacionais e os ganhos mensuráveis de rede e IOPS que justificam o movimento.
- 11Avançado 10 minZone-Aware Routing no ECS Service Connect: O Fim do Trade-off Custo vs. ResiliênciaO ECS Service Connect ganhou roteamento zone-aware em julho de 2026, priorizando automaticamente endpoints na mesma AZ de origem sem código adicional. Para arquiteturas financeiras com alta frequência de chamadas serviço-a-serviço, isso muda o cálculo econômico de multi-AZ de forma significativa. Neste artigo, analiso o mecanismo, os trade-offs reais e como posicionar essa feature no contexto de plataformas de pagamento e dados em tempo real.
- 12Avançado 9 minAutoScalingInstanceRefresh no CloudFormation: Dissecando o PadrãoA integração do Instance Refresh como update policy nativa do CloudFormation fecha uma lacuna operacional que forçava equipes a orquestrar deploys de AMI fora do ciclo de IaC. Neste artigo, disseco a anatomia do padrão, seus modos de falha reais e quando ele é — e não é — a escolha certa para ambientes de alta criticidade.
- 13Avançado 10 minAurora DSQL Multi-Region: O Que Muda para Arquiteturas FinanceirasA Amazon expandiu os clusters multi-Region do Aurora DSQL para mais quatro regiões em julho de 2026, totalizando 16 regiões com suporte a escrita ativa em ambos os lados do par. Para arquitetos de sistemas financeiros, isso não é apenas uma expansão geográfica — é uma mudança fundamental no modelo de resiliência disponível sem gerenciar replicação manual ou aceitar consistência eventual. Neste briefing, analiso o que esse sinal significa para o design de plataformas de alta disponibilidade, onde os trade-offs realmente residem e como posicionar essa tecnologia em um portfólio de dados.
- 14Avançado 11 minAWS Network Firewall como Forward Proxy: Análise Técnica do PreviewA AWS reintroduziu o forward proxy como funcionalidade nativa do Network Firewall, unificando políticas de segurança entre os modos transparent e explicit proxy sob um único recurso. Esta análise examina o que mudou em relação ao preview de novembro de 2025, onde a funcionalidade genuinamente agrega valor em ambientes financeiros e onde os riscos operacionais ainda pedem cautela.
- 15Avançado 8 minR8i vs R8i-flex: Anatomia de uma Decisão de Instância Memory-OptimizedA chegada das instâncias R8i e R8i-flex à região Europa (Milão) em agosto de 2026 completa uma expansão europeia iniciada em Paris e continuada em Estocolmo e Zurique. Mais do que um anúncio de disponibilidade regional, esse movimento expõe um padrão arquitetural relevante: a bifurcação entre instâncias de alto desempenho contínuo (R8i) e instâncias otimizadas para cargas com utilização variável (R8i-flex). Entender quando e por que escolher cada caminho é o que separa uma decisão de infraestrutura madura de um superdimensionamento caro.
- 16Avançado 10 minCloudWatch Alarm Warm-Up: Fim do Ruído de Startup em Pipelines CI/CDO CloudWatch agora suporta períodos de warm-up para alarmes, resolvendo um problema clássico de ruído operacional em deploys automatizados. A feature parece simples, mas tem implicações sérias para SLOs, on-call fatigue e design de pipelines em ambientes financeiros. Neste artigo, analiso o mecanismo, os trade-offs reais e como integrar isso de forma responsável em stacks de produção.
- 17Avançado 9 minMWAA com Airflow 3.3.1: estado, linguagem e disciplina operacionalEu vejo o suporte do Amazon MWAA ao Apache Airflow 3.3.1 como uma evolução importante para pipelines que não cabem mais no modelo puramente stateless. O ganho real está em estado durável, particionamento de assets e melhor ergonomia de operação; o risco está em tratar recursos experimentais como plataforma corporativa madura cedo demais.
- 18Avançado 8 minDocumentDB 8.0: MVU direto reduz risco, não elimina migraçãoO suporte a major version upgrade direto para o Amazon DocumentDB 8.0 é uma melhoria importante para quem ainda carrega clusters 3.6 ou 4.0. Eu trataria o recurso como redução de passos e de exposição, não como desculpa para pular ensaio, testes de compatibilidade e plano de rollback.
- 19Avançado 7 minApps no Amazon Quick vs. App Studio vs. build próprioA AWS liberou no dia 1º de setembro de 2026 a construção de aplicações internas por linguagem natural dentro do Amazon Quick. A pergunta de arquitetura não é se funciona — é qual das quatro rotas disponíveis suporta o app depois que ele vira parte do fechamento mensal. Comparo assento vs. hora-usuário, propagação de identidade e custo de saída.
- 20Avançado 8 minSnapStart em container: o bake-off contra concorrência provisionadaA AWS liberou SnapStart para funções empacotadas como imagem de container, prometendo partida sub-segundo em artefatos de até 10 GB. Coloquei a novidade lado a lado com concorrência provisionada, com o .zip e com um serviço sempre ligado no Fargate, usando os preços publicados e os limites da documentação. A conclusão não é sobre latência: é sobre onde o seu pipeline passa a pagar aluguel.
- 21Avançado 7 minDaemon crítico ou não-crítico: o contrato de falha do ECSEm 3 de setembro de 2026 a AWS passou a permitir declarar um ECS Managed Daemon como não-crítico, e com isso transformou uma decisão que antes era implícita em um parâmetro versionado. O que está em jogo não é o daemon: é o contrato de falha entre um agente transversal e a instância que o hospeda. Este teardown dissseca a anatomia do padrão, a regra de decisão que uso para classificar cada agente e o que se paga — em churn, em ponto cego e em conta — ao classificar errado.
- 22Avançado 8 minAMI com contrato: anatomia do novo bloqueio de tipos no EC2Em 4 de setembro de 2026 o EC2 passou a aceitar `InstanceTypeSpecification` no AMI: duas listas, avaliadas no `RunInstances`, que bloqueiam o lançamento em tipo incompatível. O padrão move a compatibilidade do chamador para o artefato — e traz junto uma armadilha que quase ninguém vai ver antes de sangrar: a especificação casa strings, não capacidades de hardware.
- 23Avançado 8 minECS Early Success Criteria: onde termina o rollback do seu deployEm 4 de setembro de 2026 o Amazon ECS passou a deixar você declarar quando um rolling deployment é bem-sucedido, com um healthyPercent sobre o desired count. Isso não é um botão de deploy mais rápido — é a definição de onde o circuit breaker e o rollback por alarme param de proteger. Este briefing mostra a aritmética do parâmetro, os dois modos de limpeza da revisão fonte e o que o seu painel passa a esconder.
- 24Avançado 7 minLoop recursivo no Lambda: quatro guardrails comparados no Sovereign CloudA detecção de loop recursivo do Lambda chegou ao European Sovereign Cloud em 10 de setembro de 2026. Ela corta a cadeia em ~16 invocações, mas só entre Lambda, SQS, SNS e S3, e o aviso pode levar 3,5 horas. Comparo quatro guardrails — detecção nativa, separação estrutural, teto de concorrência e contador de saltos na aplicação — e digo quando cada um basta.
- 25Avançado 7 minBeanstalk Cluster Mode: o postmortem que escrevi antes do incidenteO Elastic Beanstalk ganhou um modo em que ambientes com o mesmo conjunto de subnets compartilham um cluster EKS operado pelo serviço. Isso muda o raio de explosão: um ajuste manual no cluster deixa todos os ambientes dele sem deploy até alguém reverter. Escrevi o postmortem desse incidente antes de ele acontecer, só com comportamento documentado, e listo o que configurar no dia zero.
- 26Especialista 11 minMigração para Plataformas Stateful Cloud Native no AWS EKSMigrar workloads stateful para plataformas cloud native não é apenas uma questão de containerização — é uma série de decisões de isolamento, consistência de dados e automação operacional que determinam se a plataforma sobrevive a produção. Neste artigo, percorro a jornada de uma plataforma financeira que saiu de VMs gerenciadas manualmente para um ambiente EKS multitenant com operadores Kubernetes, armazenamento persistente gerenciado e observabilidade de ponta a ponta.
- 27Especialista 9 minStreaming de Respostas com Lambda: Precificação em Tempo RealLambda response streaming muda fundamentalmente o contrato de execução serverless ao permitir que bytes sejam enviados ao cliente antes que a função termine — o que tem implicações profundas para motores de precificação em tempo real. Nesta análise, desmonto o mecanismo interno, os modos de falha que a documentação não enfatiza, e as decisões de arquitetura que separam um protótipo de um sistema financeiro em produção.
- 28Especialista 9 minEC2 G7 e NVIDIA Blackwell: Arquitetura de Inferência GPU para ProduçãoAs instâncias EC2 G7, aceleradas pelas GPUs NVIDIA RTX PRO 4500 Blackwell Server Edition, representam um salto geracional que vai muito além de números de benchmark. Nesta análise, examino os mecanismos reais de comunicação GPU-to-GPU, os padrões de falha em clusters multi-nó e as decisões de arquitetura que separam um deployment de inferência funcional de um sistema financeiro-grade tolerante a falhas.
- 29Especialista 12 minMigrando Workloads Financeiros para EC2 R8i: Decisões e Trade-offsA disponibilização das instâncias EC2 R8i (R8in, R8ib, R8idn, R8idb) em Tokyo, Frankfurt e Irlanda em julho de 2026 abre uma janela concreta de modernização para plataformas financeiras que ainda operam em R6i/R6in — gerações com limitações reais de banda de rede e throughput de EBS. Este artigo narra a jornada de migração como uma sequência de decisões de arquitetura, com os riscos gerenciados em cada etapa e os números que justificam a movimentação.
- 30Especialista 11 minAurora DSQL Multi-Região: Notas de Campo para Sistemas FinanceirosA expansão do Aurora DSQL para Stockholm, Espanha, Mumbai e Singapura em julho de 2026 coloca consistência forte multi-região ao alcance de arquiteturas financeiras na Europa e Ásia-Pacífico. Neste artigo, analiso os trade-offs reais de adotar active-active SQL distribuído, os padrões que funcionam e os anti-padrões que vão te custar caro em produção.
Estudos para aprofundar
adrADR: S/4HANA em Hong Kong — X2idn chegou, migrar agora ou esperar X8i?Em 11 de setembro de 2026 a AWS habilitou as instâncias X2idn em Asia Pacific (Hong Kong). Para um core financeiro em S/4HANA que não pode sair da região, é a primeira instância Nitro de 2 TiB certificada para HANA produtivo ali — 49% mais SAPS e 5,7× mais banda de EBS que o x1.32xlarge. Este ADR registra por que eu migro agora, aceitando uma segunda migração para X8i quando ela chegar.adrWeb Search do Bedrock no GovCloud: um ADR sobre grounding reguladoEm 2 de setembro de 2026 a AWS levou o tool server-side Web Search do Amazon Bedrock para o GovCloud (US-West). Escrevi este ADR porque a decisão real não é "usar ou não busca web" — é escolher em que modo de recuperação você opera, e o default do parâmetro `external_web_access` empurra times regulados exatamente para o lado errado, com HTTP 200 e sem erro visível.adrADR: levar agentes governados para o Amazon QuickA integração entre Amazon Quick e AWS Agent Registry muda o ponto de controle: o problema deixa de ser conectar cada MCP manualmente e passa a ser governar um catálogo consumível por usuários de negócio. Eu trataria isso como uma decisão de plataforma, não como uma conveniência de console.adrGPU Fracionada no ECS: Decisão de Arquitetura para Inferência de IAO Amazon ECS agora suporta agendamento de GPU fracionada em instâncias EC2 G6f, permitindo partições de até 1/8 de uma GPU NVIDIA L4 com 3 GB de memória. Para plataformas de inferência de IA em escala financeira, isso muda fundamentalmente o cálculo de custo e densidade de workload. Este ADR documenta o contexto, as opções consideradas, a decisão e as consequências operacionais reais.adrADR: EKS Provisioned Control Plane e HPA Concurrency 40xO EKS Provisioned Control Plane agora processa objetos HPA com até 40x mais concorrência que o padrão Kubernetes, eliminando um gargalo silencioso em clusters com centenas de workloads. Neste registro de decisão arquitetural, analiso o contexto que torna essa mudança relevante, as opções que existiam antes dela, e as consequências operacionais que arquitetos precisam endereçar agora.adrADR: IAM Role Sessions no GameLift Streams — Eliminando Credenciais EstáticasO Amazon GameLift Streams passou a suportar IAM roles por sessão em julho de 2026, eliminando a necessidade de credenciais estáticas em bundles de aplicação. Este artigo analisa a decisão arquitetural por trás dessa mudança, os padrões de segurança envolvidos e as consequências operacionais para times que constroem plataformas de streaming com acesso a recursos AWS. Open source para explorar