aws
59 conteúdos publicados sobre este assunto.
Artigos· 24
Dados & PlataformasCapacidade por tipo de trabalho no Amazon Connect: o que muda de fatoO Amazon Connect passou a permitir concorrência por tipo de trabalho dentro dos canais Task e Email, e não mais só por canal. O ganho operacional é concreto em filas de alta variância — disputa, KYC, backoffice regulatório. O preço é uma taxonomia nova para governar e um modo de falha que não grita: contato com workload type sem linha correspondente no routing profile fica na fila para sempre.Abrir AWS & CloudECS Early Success Criteria: onde termina o rollback do seu deployEm 4 de setembro de 2026 o Amazon ECS passou a deixar você declarar quando um rolling deployment é bem-sucedido, com um healthyPercent sobre o desired count. Isso não é um botão de deploy mais rápido — é a definição de onde o circuit breaker e o rollback por alarme param de proteger. Este briefing mostra a aritmética do parâmetro, os dois modos de limpeza da revisão fonte e o que o seu painel passa a esconder.Abrir IA & AgentesClaude Fable 5.1 na AWS: o modelo que exige histórico imutávelO Fable 5.1 chegou ao Bedrock em 1º de setembro de 2026 com o mesmo preço de entrada e saída do Fable 5, mas com leitura de cache a um quarto do custo. O que ninguém colocou no anúncio é que ele troca flexibilidade de orquestração por qualidade de raciocínio: tool_choice forçado morreu e editar o histórico passa a ser erro. Avaliei o que isso significa para quem opera agentes de longa duração dentro do perímetro AWS.Abrir Dados & PlataformasRedshift e Iceberg v3: notas de campo para lakes mutáveisO suporte do Amazon Redshift a Apache Iceberg v3, anunciado em 31 de agosto de 2026, muda a conversa sobre data lakes mutáveis. Eu trataria default values, row lineage e deletion vectors como primitivas operacionais, não apenas como recursos de formato.Abrir Arquitetura de SoluçõesMigrar séries temporais para Timestream for InfluxDBA expansão regional de Amazon Timestream for InfluxDB em 31 de agosto de 2026 muda a conversa de adoção para equipes que precisam manter dados operacionais próximos aos usuários e às regras locais. Eu trataria isso como uma oportunidade de modernização controlada, não como uma simples troca de endpoint.Abrir Dados & PlataformasRedshift SSO privado com EVR: padrão de teardownEu vejo este lançamento como uma correção arquitetural importante: a autenticação passa a seguir o mesmo caminho privado que os dados analíticos. Para ambientes regulados, o ganho não é apenas SSO; é remover uma exceção de rede difícil de defender em auditoria.Abrir Dados & PlataformasMediaTailor Analytics: console, BI ou lakehouse?O dashboard de analytics do AWS Elemental MediaTailor muda a primeira linha de investigação para publishers que operam SSAI em múltiplas regiões. Eu o vejo como uma excelente camada operacional, mas não como substituto automático para BI, reconciliação financeira ou observabilidade de engenharia.Abrir IA & AgentesPRM por User Agent: atribuição melhor, governança ainda necessáriaA expansão do Partner Revenue Measurement por User Agent é pequena na implementação e relevante na leitura econômica de soluções SaaS e ISV na AWS. Eu gosto do movimento, mas trataria isso como telemetria de atribuição, não como sistema financeiro primário.Abrir AWS & CloudDocumentDB 8.0: MVU direto reduz risco, não elimina migraçãoO suporte a major version upgrade direto para o Amazon DocumentDB 8.0 é uma melhoria importante para quem ainda carrega clusters 3.6 ou 4.0. Eu trataria o recurso como redução de passos e de exposição, não como desculpa para pular ensaio, testes de compatibilidade e plano de rollback.Abrir AWS & CloudMWAA com Airflow 3.3.1: estado, linguagem e disciplina operacionalEu vejo o suporte do Amazon MWAA ao Apache Airflow 3.3.1 como uma evolução importante para pipelines que não cabem mais no modelo puramente stateless. O ganho real está em estado durável, particionamento de assets e melhor ergonomia de operação; o risco está em tratar recursos experimentais como plataforma corporativa madura cedo demais.Abrir AWS & CloudCloudWatch Alarm Warm-Up: Fim do Ruído de Startup em Pipelines CI/CDO CloudWatch agora suporta períodos de warm-up para alarmes, resolvendo um problema clássico de ruído operacional em deploys automatizados. A feature parece simples, mas tem implicações sérias para SLOs, on-call fatigue e design de pipelines em ambientes financeiros. Neste artigo, analiso o mecanismo, os trade-offs reais e como integrar isso de forma responsável em stacks de produção.Abrir Segurança & ResiliênciaIAM Roles para Stream Sessions: Comparativo de Estratégias de CredenciaisO suporte a IAM roles em sessões do Amazon GameLift Streams, lançado em julho de 2026, elimina a necessidade de chaves de acesso de longa duração em aplicações de streaming. Neste artigo, comparo as quatro abordagens de credenciais disponíveis — chaves estáticas, variáveis de ambiente, AWS Secrets Manager e IAM roles via RoleArn — usando critérios de segurança, complexidade operacional, custo e rastreabilidade. A conclusão é direta: IAM roles vence em quase todos os eixos relevantes para ambientes de produção.Abrir Segurança & ResiliênciaIAM Roles para GameLift Streams: O Fim das Credenciais EmbutidasO Amazon GameLift Streams passou a suportar IAM roles em sessões de streaming, eliminando a necessidade de credenciais de longa duração embutidas em bundles ou variáveis de ambiente. A mudança alinha o serviço ao mesmo mecanismo de container credential provider já consolidado no ECS e EKS — sem alteração de código na aplicação. Neste artigo, analiso o que essa feature realmente entrega, onde ainda existem limites relevantes e como adotá-la com rigor em ambientes de produção.Abrir IA & AgentesAmazon Bedrock AgentCore Harness: Da Ideia ao Agente de ProduçãoO AgentCore Harness chegou ao GA em junho de 2026 como uma abstração gerenciada que colapsa o plano de controle de agentes LLM em dois chamadas de API. Neste artigo, analiso como o harness funciona internamente, onde ele falha, e o que arquitetos de sistemas financeiros precisam entender antes de colocá-lo em produção.Abrir IA & AgentesAmazon Bedrock AgentCore: Otimização Contínua de Agentes em ProduçãoO Amazon Bedrock AgentCore introduz um loop de melhoria contínua que transforma traces de produção em diagnósticos acionáveis, recomendações fundamentadas em dados e validação estatística via testes A/B. Para arquitetos de sistemas financeiros e plataformas de alto risco, isso representa a primeira tentativa séria da AWS de fechar o gap entre observabilidade de agentes e operação confiável em produção.Abrir IA & AgentesBedrock Managed Knowledge Base: Anatomia de um Pipeline RAG GerenciadoO Amazon Bedrock Managed Knowledge Base abstrai toda a pilha RAG — conectores, parsing, embeddings, re-ranking e recuperação agêntica — em um único primitivo gerenciado. Neste artigo, desmonto cada camada, exponho os modos de falha que a documentação não menciona e analiso os trade-offs reais para quem projeta sistemas de IA de grau financeiro na AWS.Abrir IA & AgentesInvokeGuardrailChecks vs Guardrails Clássicos: Qual Usar em Agentes AI?A AWS lançou a InvokeGuardrailChecks API no Amazon Bedrock Guardrails, uma API sem recurso que permite aplicar salvaguardas individuais em qualquer ponto de um loop agentic sem criar ou versionar recursos de guardrail. Neste artigo, faço uma análise comparativa direta entre essa abordagem e os Guardrails clássicos baseados em recursos, avaliando trade-offs de latência, governança, custo e adequação para sistemas financeiros de missão crítica.Abrir AWS & CloudStreaming de Respostas com Lambda: Precificação em Tempo RealLambda response streaming muda fundamentalmente o contrato de execução serverless ao permitir que bytes sejam enviados ao cliente antes que a função termine — o que tem implicações profundas para motores de precificação em tempo real. Nesta análise, desmonto o mecanismo interno, os modos de falha que a documentação não enfatiza, e as decisões de arquitetura que separam um protótipo de um sistema financeiro em produção.Abrir IA & AgentesAgentic RAG na AWS: Comparativo de Arquiteturas para Ambientes FinanceirosAgentic RAG deixou de ser experimento de laboratório e passou a ser requisito de plataforma em ambientes financeiros que exigem rastreabilidade, controle de custo e latência previsível. Neste artigo, comparo quatro abordagens arquiteturais concretas na AWS, com trade-offs reais, números plausíveis e uma recomendação sem rodeios.Abrir Arquitetura de SoluçõesOracle HA na AWS: FSx for ONTAP como Alavanca de Modernização GradualO sinal mais relevante neste ciclo para arquitetos que ainda carregam workloads Oracle críticos não é abandoná-los — é orquestrá-los com primitivos cloud-native que entregam HA real sem forçar uma reescrita. FSx for NetApp ONTAP muda a equação de armazenamento para Oracle na AWS de forma concreta. Este briefing analisa o que muda na prática, os trade-offs reais e como posicionar essa camada dentro de uma estratégia de modernização gradual.Abrir IA & AgentesRAG Agêntico com OpenSearch Serverless: Anatomia de um PadrãoO padrão RAG agêntico com OpenSearch Serverless promete escala elástica e recuperação semântica sem gestão de infraestrutura — mas esconde armadilhas sérias de latência, custo e consistência que sistemas financeiros não podem ignorar. Neste artigo, desmonto a anatomia do padrão, mapeio quando ele funciona, quando falha e como configurá-lo com rigor de produção.Abrir AWS & CloudCloudWatch para OTel: Desmontando o Padrão de Bridge de ObservabilidadeO padrão de bridge entre CloudWatch e OpenTelemetry resolve um problema real de fragmentação de observabilidade em ambientes multi-plataforma, mas carrega custos operacionais e armadilhas de design que raramente aparecem nos tutoriais. Neste artigo desmonto a anatomia desse padrão, quando ele faz sentido e quando ele cria mais problema do que resolve.Abrir IA & AgentesGPT-5 vs Claude vs Nova no Bedrock: Bake-off de Governança para ProduçãoCom GPT-5.5 e Codex chegando ao Amazon Bedrock, equipes de plataforma agora enfrentam uma escolha real entre três famílias de modelos frontier dentro do mesmo plano de controle. Esta análise compara GPT-5.5, Claude 3.7 Sonnet e Amazon Nova Pro sob a ótica de quem precisa colocar IA em produção em ambientes regulados.Abrir Dados & PlataformasDe Pixels a Planejamento: Plataformas de Dados Geoespaciais em AWSPlataformas de Earth AI estão saindo dos laboratórios de pesquisa e entrando em decisões operacionais reais — de crédito climático a gestão de ativos de infraestrutura. Arquitetar esse pipeline na AWS exige escolhas precisas sobre ingestão de raster/vetor, particionamento geoespacial, latência de inferência e rastreabilidade de dados. Este artigo documenta as decisões que eu tomaria hoje, os antipadrões que já vi em campo e o checklist que você pode executar amanhã.Abrir Architecture Studies· 28
Decisão (ADR)ADR: levar agentes governados para o Amazon QuickA integração entre Amazon Quick e AWS Agent Registry muda o ponto de controle: o problema deixa de ser conectar cada MCP manualmente e passa a ser governar um catálogo consumível por usuários de negócio. Eu trataria isso como uma decisão de plataforma, não como uma conveniência de console.Abrir Guia / Deep DiveLambda vs ECS: o guia de decisão do arquiteto de compute na AWSEscolher entre Lambda e ECS não é sobre preferência — é sobre casar a unidade de escala com o padrão de carga. Este guia cobre todos os tipos de Lambda (incluindo MicroVMs e Managed Instances) e ECS (Fargate, EC2, Managed Instances), o framework de decisão que uso na prática e o impacto real na engenharia, no negócio e na experiência do cliente.Abrir PlaybookPlaybook: 5 Mudanças em Arquitetura de IA — e o que fazer com cada umaO que era avançado em 2025 virou default em 2026: o gargalo saiu do prompt, agentes foram para produção gerenciada, MCP padronizou ferramentas, segurança virou multicamadas e FinOps de token entrou na pauta. Este playbook mapeia cada mudança com o que fazer de concreto — para quem constrói sistemas, não demos.Abrir Guia / Deep DiveAgentes de IA por Dentro (3/3): Agentes em Produção na AWS com Bedrock AgentCoreA terceira e última parte da série desce o elevador até o andar técnico: como colocar um agente de IA em produção na AWS usando o Amazon Bedrock AgentCore. Cobrimos o mapa completo dos componentes (Runtime, Gateway, Memory, Identity, Observability), a escolha de modelo por custo/latência/raciocínio, segurança com guardrails e isolamento de sessão, e FinOps para manter o custo real abaixo de poucos dólares por mês.Abrir Decisão (ADR)ADR: Nextflow Profiles no HealthOmics — Separação de Configuração e LógicaO AWS HealthOmics passou a suportar Nextflow profiles, permitindo ativar configurações predefinidas em tempo de execução sem alterar o código-fonte do workflow. Esta análise examina a decisão arquitetural por trás dessa separação de concerns, seus trade-offs reais e as consequências operacionais para equipes que rodam pipelines bioinformáticos em escala.Abrir Post-mortemAWS us-east-1 (2025): Evento Térmico em Datacenter Derruba EC2 e EBSUma falha no sistema de refrigeração de um datacenter em us-east-1 causou superaquecimento de servidores, acionando desligamentos de proteção térmica que degradaram EC2 e EBS na região. O incidente reacende debates críticos sobre concentração de workloads em us-east-1, o papel do isolamento físico por AZ e a necessidade de graceful degradation em arquiteturas de produção.Abrir TeardownTeardown: Resilient Network Graphs e a Próxima Geração de Rede para IAUma análise arquitetural aprofundada das redes de data center baseadas em grafos resilientes que a AWS está construindo para suportar workloads de IA em escala — cobrindo topologia, controle de congestionamento, eficiência energética e os trade-offs que definem a próxima geração de infraestrutura cloud.Abrir Design Doc / RFCDesign Doc: Suíte de Avaliação Contínua para Agentes com Bedrock AgentCoreAgentes LLM em produção degradam silenciosamente à medida que modelos, ferramentas e prompts evoluem — sem uma disciplina de avaliação contínua, regressões chegam ao usuário antes de serem detectadas. Este documento propõe uma arquitetura completa de avaliação offline e online usando Amazon Bedrock AgentCore, com datasets versionados, quality gates em CI/CD, sinais de runtime e testes adversariais sistemáticos.Abrir Decisão (ADR)ADR: Cognito Multi-Região para Autenticação ResilienteEste ADR analisa quando e como adotar replicação multi-região de User Pools no Amazon Cognito para reduzir indisponibilidade de autenticação em plataformas de identidade com requisitos de alta disponibilidade. São discutidos failover regional, chaves KMS gerenciadas pelo cliente, sincronização de usuários, impacto em sessões e tokens, domínios customizados e experiência do cliente, com raciocínio explícito sobre trade-offs operacionais e de custo.Abrir Decisão (ADR)ADR: OpenSearch Serverless vs Banco Vetorial Dedicado para RAG AgênticoEste ADR avalia as opções de infraestrutura de busca vetorial para uma plataforma RAG agêntica multi-tenant na AWS, comparando OpenSearch Serverless, bancos vetoriais dedicados (Pinecone, pgvector) e busca híbrida própria. A decisão considera custo, latência p99, filtros por permissão, ingestão incremental e integração nativa com Bedrock Knowledge Bases.Abrir Decisão (ADR)ADR: Adotando Amazon Bedrock AgentCore em ProduçãoBedrock AgentCore promete reduzir o atrito operacional de agentes de IA em produção, mas adotar qualquer plataforma gerenciada de orquestração de agentes exige uma decisão arquitetural explícita. Neste ADR, documento as forças que me levaram a avaliar AgentCore, as alternativas consideradas e as consequências reais de cada caminho.Abrir TeardownTeardown: Frontier Agents para Segurança e DevOps na AWSUma análise técnica aprofundada da arquitetura por trás dos agentes autônomos de frontier da AWS para pentest sob demanda e resolução de incidentes em cloud operations. Avaliamos isolamento, escopo de ação, aprovação humana, rollback e os riscos operacionais reais que emergem quando você coloca um LLM no loop de controle de infraestrutura.Abrir PlaybookPlaybook: FinOps de GenAI — cortar o custo de um agente sem perder qualidadeAgentes de GenAI em produção acumulam custo em lugares que os dashboards padrão não mostram: tokens de entrada inflados, loops sem critério de parada, retries silenciosos e modelos caros em tarefas triviais. Este playbook apresenta as seis alavancas de otimização — com ordem de execução, tabela de impacto e os anti-padrões que transformam economia em regressão de qualidade.Abrir Decisão (ADR)ADR: Seleção de Modelo no Amazon Bedrock — Claude vs Nova vs Llama vs Fine-tuneDecisão arquitetural sobre qual modelo de fundação adotar em uma feature GenAI enterprise no Amazon Bedrock, avaliando qualidade, custo por token, latência, governança de dados, suporte a pt-BR e janela de contexto. A conclusão é um roteamento por tipo de tarefa — nenhum modelo único vence em todos os eixos.Abrir Design Doc / RFCDesign Doc: Agentes em Produção com Amazon Bedrock AgentCoreEste documento descreve a arquitetura de uma plataforma de agentes de IA em produção usando Amazon Bedrock AgentCore, cobrindo runtime serverless com isolamento de sessão, governança de ferramentas via Gateway/MCP, memória de curto e longo prazo, identidade federada e observabilidade. O foco está em guardrails operacionais, teto de custo e governança de ferramentas — os problemas que realmente afundam projetos de agentes em ambientes corporativos.Abrir Design Doc / RFCDesign Doc: Zero Trust na AWS para Acesso a Serviços InternosEste documento propõe uma arquitetura Zero Trust na AWS onde identidade, contexto e postura do dispositivo substituem o perímetro de rede como mecanismo primário de controle de acesso. O design cobre segmentação de workloads, acesso adaptativo via IAM Identity Center e Verified Access, e instrumentação de auditoria contínua. O objetivo é eliminar a confiança implícita baseada em localização de rede sem introduzir fricção operacional excessiva.Abrir PlaybookPlaybook: Qual Serviço de IA da AWS Usar — A Árvore de DecisãoBedrock, SageMaker, Amazon Q, AgentCore e self-hosted GPU resolvem problemas diferentes — mas o hype faz todo mundo começar pelo Bedrock por default. Este playbook entrega uma árvore de decisão, uma matriz de trade-offs e regras de bolso para você escolher pelo problema, não pelo modismo.Abrir Design Doc / RFCDesign Doc: Plataforma RAG Enterprise com Avaliação Contínua e Guardrails no BedrockEste documento descreve a arquitetura de uma plataforma RAG enterprise construída sobre Amazon Bedrock, cobrindo recuperação semântica, avaliação contínua de qualidade, guardrails de segurança e controle de custo. O design prioriza rastreabilidade, operabilidade e contenção de risco em ambientes regulados, sem abrir mão de latência aceitável para usuários finais.Abrir Design Doc / RFCDesign Doc: API de Pagamentos Multi-Região Active-ActiveEste documento propõe uma arquitetura active-active multi-região para uma API de pagamentos crítica, endereçando RTO/RPO próximos de zero, replicação de dados com resolução de conflitos determinística e um rollout faseado que minimiza risco operacional. O design parte de princípios reais de engenharia financeira e padrões AWS, com trade-offs explícitos entre consistência, latência e custo.Abrir Decisão (ADR)ADR: EventBridge vs Kafka/MSK para Processamento de PedidosEste ADR avalia EventBridge e Amazon MSK como backbone de eventos para um sistema de processamento de pedidos, considerando throughput, ordenação, replay e carga operacional. A decisão é fundamentada em trade-offs reais entre managed simplicity e controle de plataforma, com consequências diretas em custo, operabilidade e garantias de entrega.Abrir PlaybookPlaybook: Multi-agente — quando 1 basta e quando você precisa orquestrarCada agente adicional dobra custo, latência e superfície de erro. Este playbook oferece critério cirúrgico para decidir entre agente único, supervisor, pipeline e debate — com tabelas de decisão, topologias visuais e as armadilhas que destroem sistemas multi-agente em produção.Abrir PlaybookPlaybook: Um Agente de IA de Produção na AWS em 7 PassosNoventa por cento dos agentes de IA morrem no notebook. Este playbook cobre os 7 passos que separam um protótipo funcional de um agente confiável em produção na AWS — do trigger ao guardrail, passando por topologia de loop, ferramentas com menor privilégio, verifier externo e orçamento de execução. Opinioso, concreto e baseado nas primitivas reais do Amazon Bedrock AgentCore.Abrir PlaybookPlaybook: Onde Rodar IA na AWS — Lambda vs Fargate vs ECS/EKS (GPU)Escolher o compute errado para workloads de IA na AWS é o erro mais caro que equipes cometem ao escalar de protótipo para produção. Este playbook mapeia Lambda, Fargate, ECS/EKS+GPU e Bedrock contra os eixos que realmente importam — duração, GPU, padrão de tráfego e custo por token — e entrega uma árvore de decisão acionável para cada cenário.Abrir PlaybookPlaybook: Vector Store na AWS — OpenSearch Serverless vs Aurora pgvector vs S3 VectorsEscolher o vector store errado é onde a conta de RAG explode — ou onde a latência entrega p99 inaceitável em produção. Este playbook mapeia os três caminhos principais na AWS (OpenSearch Serverless, Aurora pgvector, S3 Vectors) por três eixos reais: latência exigida, modelo de custo e carga operacional. Saia com uma decisão defensável, não com a escolha do tutorial.Abrir PlaybookPlaybook: IA, ML, Deep Learning, LLM e Agentes — o Mapa para Decidir a Ferramenta CertaUm guia prático em camadas para engenheiros e arquitetos que precisam parar de usar 'vamos de LLM' como resposta padrão. O mapa correto é IA → ML → Deep Learning → GenAI/LLM → Agentes, cada camada um subconjunto da anterior — não sinônimos. A pergunta certa nunca é 'qual modelo?', é 'qual a ferramenta mais simples que resolve bem?'.Abrir TeardownNetflix: Chaos Engineering e Resiliência por DesignUma reconstrução arquitetural de como a Netflix transformou falhas inevitáveis em prática deliberada — da Simian Army ao failover regional automatizado. Este teardown examina as decisões técnicas, os trade-offs reais e o que separa resiliência de verdade de alta disponibilidade cosmética.Abrir Post-mortemAWS Kinesis us-east-1 (2020): Quando um Limite de Threads do SO Derrubou Metade da AWSEm novembro de 2020, uma expansão de capacidade no front-end do Amazon Kinesis esgotou o limite de threads por processo do sistema operacional, causando falhas em cascata que afetaram Cognito, CloudWatch, Lambda, ECS e dezenas de outros serviços na região us-east-1 por mais de oito horas. O incidente expôs dependências ocultas entre serviços AWS e os riscos de mudanças operacionais aparentemente seguras em sistemas de larga escala.Abrir Post-mortemAWS S3 us-east-1 (2017): quando um typo derruba a internetEm 28 de fevereiro de 2017, um engenheiro da AWS executou um comando de debug com um parâmetro incorreto e removeu uma quantidade muito maior de servidores do subsistema de indexação do S3 do que o pretendido. O resultado foi quatro horas de degradação severa em us-east-1 que afetou centenas de serviços dependentes — de ferramentas de monitoramento a grandes plataformas SaaS. O incidente expôs fragilidades estruturais em torno de dependências implícitas, ausência de rate limiting em operações destrutivas e a falácia de assumir que uma única região AWS seria suficientemente resiliente.Abrir Open Source· 7
TypeScriptqueue-advisor-pricing-appCompare SQS, Kinesis, EventBridge e MSK por custo e encaixe antes de escolher a filaAbrir HTMLsolution-architecture-mcp-toolkitFerramentas MCP e templates que encodam disciplina de arquitetura — ADR, threat model, Well-Architected.Abrir Pythonmcp-aws-solution-architectServidor MCP que dá ao seu assistente as cinco tarefas repetitivas do arquiteto AWSAbrir Pythonbedrock-agent-starterAgente Bedrock com tools, memória, evals e Terraform — do clone ao chat em 30 minutos.Abrir HCLaws-ai-reference-architecturesSeis arquiteturas de IA na AWS com ADR, custo S/M/L, Well-Architected e TerraformAbrir HTMLaws-event-driven-finops-platformMalha de eventos bancária na AWS onde custo é requisito, não relatórioAbrir HTMLaws-agentic-ai-reference-architectureBlueprint de IA agêntica na AWS que sobrevive a produção: Bedrock, MCP, guardrails, telemetria.Abrir