Projete cargas de trabalho operacionalmente excelentes no Azure
Voltar para a trilha AZ-305
AZ-305Capítulo 22

Estudo para a Certificação Microsoft AZ-305

Projete cargas de trabalho operacionalmente excelentes no Azure

Una desenvolvimento e operações, padronize a entrega, transforme telemetria em decisões, automatize com intenção e publique mudanças com risco controlado.

Tempo de estudo sugerido: 90 minutos • Nível intermediário • Reescrita autoral completa com resumo conciso de cada tópico

Arquitetura neon AZ-305 de Excelência Operacional com DevOps, observabilidade, automação, IaC e implantação segura

1. Torne a Excelência Operacional parte da arquitetura

O pilar de Excelência Operacional do Well-Architected conecta desenvolvimento responsável à operação diária confiável. Fluxos padronizados, coesão de equipe, monitoramento, gerenciamento de lançamentos e automação reduzem variação, erro humano e interrupção para clientes.

A saúde operacional aparece em três perguntas: as operações são disciplinadas e repetíveis, os clientes recebem uma experiência estável e previsível e a equipe aprende com evidências? Sem propriedade clara, surgem correções trabalhosas de pouco impacto que adiam melhorias duradouras.

Resultados do negócio conectados a operações disciplinadas, experiência previsível e aprendizado contínuo.
Excelência Operacional transforma mudança em um sistema controlado e capaz de aprender.

Resumo do tópico

Projete o modelo operacional junto com a carga para que mudanças sejam previsíveis, mensuráveis e tenham responsáveis.

2. Busque os resultados certos da maneira certa

A ambição prática é fazer a coisa certa, executá-la da maneira certa e resolver em equipe os problemas certos. Processos fluidos ajudam a cumprir objetivos de negócio e obrigações internas ou regulatórias. Requisitos operacionais fracos aparecem como lançamentos com falha, experiência irregular, custo evitável e equipes exaustas.

Uma correção rápida pode ser necessária durante um incidente, mas não substitui uma estratégia. Defina a propriedade da carga, examine atritos recorrentes, priorize pelo impacto e converta lições em mudanças deliberadas.

Resumo do tópico

Combine propriedade clara, execução repetível e aprendizado coletivo para proteger resultados de negócio e do cliente.

3. Aplique os cinco princípios de design nomeados

Princípios de Excelência Operacional e seus focos.
PrincípioFoco
Adotar a cultura DevOpsColaboração, responsabilidade compartilhada, propriedade e aprendizado contínuo.
Estabelecer padrões de desenvolvimentoMétodos adequados, gates de qualidade, testes antecipados e entrega mensurável.
Desenvolver operações com observabilidadeTelemetria, modelos de integridade, visões por público e alertas acionáveis.
Automatizar para obter eficiênciaSelecionar fluxos valiosos, projetar para automação e tratá-la como dependência crítica.
Adotar práticas de implantação segurasIaC, consistentes, mudanças pequenas, exposição progressiva e recuperação.

O resumo exportado afirma haver “seis princípios”, porém o módulo nomeia os cinco acima, assim como a documentação atual da Microsoft. Portanto, essa frase é uma inconsistência de contagem, não um sexto princípio ausente.

Resumo do tópico

Estude os cinco princípios explícitos e como cultura, padrões, observabilidade, automação e entrega se reforçam.

4. Adote a cultura DevOps no projeto de RH da Contoso

O RH da Contoso planeja um aplicativo de linha de negócios para uso interno. Antes do design e da implementação, desenvolvimento, testes e operações precisam trabalhar por uma missão comum orientada ao cliente, sem isolar conhecimento, ferramentas ou responsabilidade.

DevOps é uma comunidade de práticas, não apenas um produto. A responsabilidade compartilhada torna a equipe da carga responsável por desempenho e confiabilidade onde quer que o aplicativo execute. Desenvolvimento inclui operações no ciclo de feedback; operações devolve dados de produção e recursos úteis à entrega.

Resumo do tópico

Construa DevOps com propósito comum, propriedade compartilhada, comunicação transparente e responsabilidade pelo ciclo inteiro.

5. Colabore por sistemas comuns e caminhos de escalonamento

As três equipes técnicas antes misturavam Slack, , , Excel e repositórios separados. A fragmentação escondia o estado dos ambientes, o trabalho, documentos e procedimentos de incidente. Líderes e patrocinadores padronizam o para backlog, repositório de código e de implantação e o para comunicação.

Um backlog compartilhado alinha recursos e correções, enquanto um local comum torna os caminhos de escalonamento fáceis de encontrar. Na verificação de conhecimento, a vantagem é a coordenação: ferramentas comuns mantêm as equipes informadas e reduzem falhas de comunicação; elas não eliminam monitoramento, automação ou controles de segurança.

Desenvolvimento, testes e operações compartilhando backlog, repositório, pipeline, comunicação e escalonamento.
Sistemas comuns oferecem uma visão operacional sem apagar as especialidades.

Resumo do tópico

Padronize colaboração e acompanhamento para que todos vejam prioridades, estado dos ambientes e orientação de escalonamento.

6. Crie aprendizado contínuo sem culpabilização

Mantenha especificações, procedimentos, planos de incidente e resultados de retrospectivas em uma wiki acessível do . Após incidentes e ciclos de desenvolvimento, faça revisões sem culpa que examinem condições do sistema e escolhas do processo.

Use experimentos baratos, provas de conceito e testes A/B. A Contoso testa propostas de experiência com usuários reais, documenta resultados, acelera a integração de novos profissionais e celebra o progresso. Na pergunta do módulo, a revisão sem culpa após incidentes é a prática que promove aprendizado e experimentação.

Resumo do tópico

Converta incidentes, experimentos e trabalhos concluídos em conhecimento compartilhado e melhorias concretas.

7. Codifique procedimentos de desenvolvimento e operações

Os padrões devem abranger trabalho rotineiro, processos excepcionais, simulações de emergência e recuperação, escolhas de ferramentas, monitoramento, treinamento, comunicação com stakeholders e divulgação aos clientes. Registre as razões das decisões e valide os padrões regularmente.

A Contoso acorda convenções de formatação, nomenclatura, tratamento de erros, controle de versão e segurança e as aplica em revisões e ferramentas. Operações amplia a documentação diária e de diagnóstico na wiki. Métricas do mostram à liderança o efeito da padronização. Como havia inconsistência de ferramentas e métodos, a resposta verdadeiro ou falso é verdadeira.

Experimentos, incidentes, retrospectivas, padrões, simulações e documentação formando um ciclo.
Procedimentos escalam quando a equipe documenta, pratica, mede e revisa.

Resumo do tópico

Documente e ensaie o trabalho normal e emergencial e use evidências para manter os padrões relevantes.

8. Estabeleça padrões para o desenvolvimento da Contoso Ticketing

Uma startup em crescimento usa para integrações e integração de clientes, mas não possui um método formal. Mais projetos e pessoas trouxeram comunicação obscura, reuniões fracas, ciclos irregulares, atrasos e cobrança da liderança.

Padrões adequados devem acelerar o caminho entre código e teste, e não criar cerimônia inútil. Eles alinham equipe e stakeholders quanto a papéis, expectativas, critérios de conclusão, qualidade e trabalho técnico prioritário.

Resumo do tópico

Escolha estrutura suficiente para melhorar fluxo, qualidade e alinhamento sem sobrecarregar uma equipe pequena.

9. Adote um método do setor e um backlog compartilhado

A Contoso adota Scrum, com papéis, eventos, artefatos, regras, checkpoints frequentes, sprints curtos e um único backlog. mantém esse backlog, dá visibilidade a prioridades e riscos e favorece entrega consistente.

Um método conhecido define cadência e responsabilidades; revisões de marcos detectam problemas cedo. Na pergunta do exame, — não Excel, ou — é a ferramenta indicada para manter o backlog.

Backlog passando por sprints curtos, gates de qualidade, artefatos imutáveis e produção.
Um método compartilhado liga planejamento à entrega controlada.

Resumo do tópico

Use um método adequado, um backlog priorizado, ciclos curtos de feedback e papéis explícitos.

10. Antecipe os testes e preserve a integridade do artefato

Comece a garantia de qualidade cedo e inclua funcionalidade, desempenho, segurança, usabilidade, infraestrutura, configuração e dados no plano de cada recurso. Automatize verificações rotineiras e mantenha o artefato imutável ao atravessar ambientes e gates.

A Contoso registra casos, dados e resultados no e coloca verificações nos antes da promoção. Isso reduz diferenças entre ambientes, falhas, bugs, retrabalho e frustração. A estratégia correta é testar cedo e com frequência, não deixar toda a QA para o fim.

Resumo do tópico

Teste comportamentos funcionais e não funcionais cedo, promova o mesmo artefato e automatize gates de confiança.

11. Meça eficiência e resultados do desenvolvimento

Meça se as mudanças de processo funcionam. Acompanhe tendências de defeitos, atualizações com falha, lead time, duração do feedback, previsibilidade e resultados do cliente. A Contoso usa relatórios do para velocidade, fluxo cumulativo, criação e resolução de bugs e tempo entre código e produção.

do e podem ampliar a análise. A resposta da verificação é que a Contoso usou relatórios do para comparar melhorias no tempo; tempos isolados, pesquisas ou avaliações não mostram o mesmo sistema de entrega.

Resumo do tópico

Use tendências de entrega e qualidade para alocar esforço e provar quais mudanças melhoram o fluxo.

12. Evolua as operações da Contoso Real Estate com observabilidade

O aplicativo interno de realocação usa , , , e . A observabilidade deve apoiar manutenção proativa, qualidade, segurança, planejamento de capacidade e decisões do produto.

A modelagem de integridade combina sinais em um estado compreensível e ajuda a agir antes que a degradação vire incidente. Monitoramento eficiente transfere tempo do combate reativo para a melhoria da experiência.

Resumo do tópico

Projete observabilidade para explicar a integridade e orientar ações técnicas e de negócio.

13. Correlacione telemetria em todas as camadas

Páginas de busca vazias coincidem com de conexão ao banco, mas isolados não provam causalidade. A equipe amplia a instrumentação do aplicativo e dos serviços com horário, contexto da busca, cliente e identidade, respeitando privacidade e controle de acesso.

A correlação revela de consultas não tratados na atualização recente. Em seguida, a equipe projeta rastreamento distribuído completo com OpenTelemetry. Na verificação, o monitoramento aprofundado do aplicativo é o que identifica a causa raiz.

Solicitação correlacionada entre aplicação web, microsserviço, banco, logs, métricas e rastreamento.
A correlação transforma sinais separados em narrativa do incidente.

Resumo do tópico

Instrumente jornadas críticas de modo consistente e correlacione as camadas para ligar sintomas às causas.

14. Crie para públicos específicos

Um do Analytics centraliza os dados, mas não os torna automaticamente úteis. Crie visões situacionais para stakeholders com integridade, usuários, buscas, reservas, metas e tendências. Para operadores, ofereça e pastas de trabalho detalhados com drill-down para diagnóstico, resposta a incidentes e monitoramento diário.

Atualize as visões com frequência e preserve o detalhe adequado. A resposta correta é um específico para cada equipe que precisa dos dados, não um painel universal nem um para cada indivíduo.

Telemetria compartilhada alimentando painéis de negócio, operações e resposta a incidentes.
Uma base de evidências pode sustentar várias visões orientadas a decisões.

Resumo do tópico

Adapte visualizações às decisões e aos públicos sem perder uma base de telemetria comum e governada.

15. Torne alertas acionáveis e proativos

A fadiga surge com notificações redundantes, vagas, pouco prioritárias ou enviadas às pessoas erradas. Mantenha sinais que exijam ação, inclua severidade e contexto, agrupe evidências, alinhe limites a metas do negócio e direcione cada alerta a um responsável.

A Contoso remove ruído e alerta cedo sobre lentidão sustentada nas consultas para agir antes da indisponibilidade. Depois avalia respostas automatizadas. Alertas não devem ser principalmente informativos; portanto, a afirmação da verificação é falsa.

Sinais agrupados em alerta contextual, severidade, roteamento, runbook e resposta automática.
Um alerta útil inicia uma resposta em vez de criar outra fila de investigação.

Resumo do tópico

Notifique quando houver ação esperada, forneça contexto e severidade e detecte degradação antes da falha total.

16. Automatize com intenção na Contoso University

O aplicativo de ensino usa , , , e . Trabalho manual frequente consome tempo, cria variação e amplia risco. A automação deve remover esforço repetitivo e preservar julgamento humano para decisões complexas.

Automatizar poupa tempo, esforço e custo e melhora precisão e confiabilidade. Mas não automatize desperdício: simplifique ou remova o fluxo desnecessário e só então automatize o restante.

Resumo do tópico

Use automação para eliminar trabalho repetitivo e erros, não para perpetuar processos sem valor.

17. Classifique fluxos pelo valor antes de automatizar

Inventarie fluxos e avalie complexidade, esforço, frequência, precisão, pontualidade, vida útil, risco e retorno. Compare comprar uma ferramenta com desenvolver e manter uma solução. Documentação ajuda a execução, mas não é um dos fatores de classificação do cenário e é a resposta de exclusão na pergunta.

A Contoso prioriza provisionamento de contas, redefinição de senhas e desprovisionamento porque são frequentes e baseados em regras. A capacidade recuperada libera melhorias de maior valor.

Inventário de fluxos pontuado por valor, frequência, risco, complexidade e decisão entre comprar ou construir.
começa pela seleção e simplificação.

Resumo do tópico

Automatize trabalho durável, frequente e baseado em regras depois de remover etapas desnecessárias e comparar comprar com construir.

18. Projete componentes que possam ser automatizados

Prontidão para automação é propriedade arquitetural. Uma interface dinâmica com campos instáveis é difícil de testar. A Contoso atribui identificadores únicos, usa semântico e rótulos, oferece navegação por teclado e cria componentes acessíveis que ferramentas conseguem localizar.

Casos automatizados entram na suíte diária para avaliar cada build. O cenário é resolvido modificando os componentes da interface, não abandonando a automação ou apenas reescrevendo testes frágeis.

Resumo do tópico

Exponha interfaces estáveis e semântica acessível para obter automação confiável em vez de frágil.

19. Trate automação como dependência de produção

A automação deve acompanhar o crescimento e cumprir os mesmos padrões de confiabilidade, segurança, desempenho, custo e operação. Scripts sem documentação, tratamento de erro fraco, propriedade dispersa e credenciais ocultas criam dívida e caminhos de falha.

A Contoso substitui um script lento que carrega o banco de testes de desempenho. A nova versão anonimiza e mascara os dados copiados, trata erros, mantém desempenho consistente e segue as práticas da aplicação principal. A resposta correta é que a automação deve atender a todos os pilares do Well-Architected .

Resumo do tópico

Trate automação como código crítico: seguro, observável, testado, documentado, escalável e mantido com a carga.

20. Adote implantação segura para a Contoso Air

O aplicativo de reservas usa , , , e . Uma cadeia automatizada e modular deve implantar código, configuração, infraestrutura e artefatos de modo consistente em todos os ambientes.

Testes, monitoramento, versionamento, rastreabilidade e ações compensatórias reduzem o efeito de condições inesperadas. A entrega segura nasce antes da produção, não depois da falha.

Resumo do tópico

Crie uma cadeia repetível com limites e recuperação para todo tipo de mudança.

21. Implante infraestrutura e configuração por código

Use infraestrutura como código declarativa para o estado repetível e pronto para produção. Prefira camadas modulares alinhadas ao ciclo de vida, sem abstração desnecessária. Ferramentas padronizadas reduzem variação, revelam desvio de configuração e colocam a infraestrutura em revisão, testes e histórico de versão.

A Contoso move configurações por ambiente para arquivos no controle de código, armazena segredos em um cofre por ambiente, registra alterações, testa configuração no e planeja automático. O princípio da pergunta é automatizar todas as implantações por , e não somente produção ou não produção.

Código, IaC, configuração, segredos em cofre, testes, registros de implantação e rollback.
A cadeia torna o estado desejado repetível e cada execução rastreável.

Resumo do tópico

Versione infraestrutura e configuração declarativas, proteja segredos, teste mudanças e automatize a recuperação.

22. Publique atualizações pequenas em cadência regular

Grandes lançamentos trimestrais combinam variáveis demais, ampliam o raio de impacto, dificultam validação e tornam estressante. Mudanças pequenas e relacionadas são mais fáceis de compreender, testar, observar, corrigir ou reverter.

A Contoso troca grandes lançamentos a cada três ou quatro meses por atualizações frequentes, testadas nos ambientes inferiores. Qualidade, confiança, moral e lead time melhoram. A escolha recomendada é implantação pequena e frequente.

Resumo do tópico

Reduza o tamanho do lote para validar, diagnosticar e recuperar cada lançamento com mais facilidade.

23. Use exposição progressiva e testes de compatibilidade

Comece com poucas instâncias ou usuários, observe sinais técnicos e de suporte e expanda somente com evidências aceitáveis. Verifique compatibilidade anterior e posterior para que versões diferentes coexistam durante a implantação.

A Contoso usa sinalizadores de recursos para selecionar o primeiro público, amplia o acesso por etapas e devolve casos de suporte às decisões do produto e FAQs. Essa é a resposta do cenário. Blue-green e canário também controlam exposição, mas o caso usa especificamente sinalizadores.

Sinalizador liberando a versão para usuários internos, coortes e todos os clientes, com telemetria e rollback.
A exposição cresce na mesma velocidade da confiança.

Resumo do tópico

Limite o impacto inicial, observe comportamento real, preserve compatibilidade e mantenha desativação ou rápido.

24. Equilibre os tradeoffs de Excelência Operacional

Padrões, telemetria, ambientes de teste, automação, armazenamentos de sinalizadores e capacidade paralela elevam custo e complexidade. Dados de observabilidade e identidades de automação ampliam a superfície de segurança. Processo excessivo atrasa; processo insuficiente cria variação e heroísmo frágil.

Dimensione controles pelo risco e maturidade. Reutilize modelos aprovados, compartilhe especialistas, governe telemetria sensível, mantenha camadas fundamentais estáveis e meça o efeito sobre clientes e desempenho da entrega.

Resumo do tópico

Invista em controles na proporção do risco e confirme que eles reduzem falhas e custo de recuperação.

25. Revise o ciclo operacional completo

  • Cultura: propósito comum, responsabilidade compartilhada, ferramentas comuns, aprendizado sem culpa e procedimentos explícitos.
  • Desenvolvimento: método adequado, backlog único, testes abrangentes antecipados, artefatos imutáveis e métricas de entrega.
  • Observabilidade: modelagem de integridade, telemetria correlacionada, por público e alertas proativos acionáveis.
  • : seleção de fluxos, interfaces preparadas e engenharia com qualidade de produção.
  • Entrega: IaC declarativa, um método de , mudanças pequenas, exposição progressiva, compatibilidade e recuperação.

Em conjunto, essas práticas ajudam a equipe a escolher o trabalho certo, executá-lo corretamente e resolver coletivamente os problemas certos. Operações fluidas e repetíveis mantêm previsibilidade durante mudanças e apoiam políticas e regulações.

  1. Well-Architected : Excelência Operacional
  2. Princípios de design de Excelência Operacional
  3. Checklist de Excelência Operacional
  4. Estratégias para práticas de implantação seguras

Resumo do tópico

Excelência Operacional é um ciclo contínuo que vai da propriedade compartilhada à melhoria medida, automatizada e entregue com segurança.