Preparación para la Certificación Microsoft AZ-305
Diseña cargas de trabajo operativamente excelentes en Azure
Une desarrollo y operaciones, estandariza la entrega, convierte telemetría en decisiones, automatiza con intención y publica cambios con riesgo controlado.
Tiempo de estudio sugerido: 90 minutos • Nivel intermedio • Reescritura original completa con resumen conciso de cada tema
Por João Ricardo Dutra••Contenido original completo
1. Convierte la Excelencia operativa en parte de la arquitectura
El pilar de Excelencia operativa de Well-Architected conecta el desarrollo responsable con una operación diaria confiable. Flujos estandarizados, cohesión, supervisión, administración de versiones y automatización reducen variación, error humano e interrupción al cliente.
La salud operativa se refleja en tres preguntas: ¿las operaciones son disciplinadas y repetibles, los clientes reciben una experiencia estable y predecible y el equipo aprende de la evidencia? Sin una propiedad clara, aparecen arreglos laboriosos de poco impacto que posponen mejoras duraderas.
La Excelencia operativa transforma el cambio en un sistema controlado que aprende.
Resumen del tema
Diseña el modelo operativo junto con la carga para que los cambios sean predecibles, medibles y tengan responsables.
2. Persigue los resultados correctos de la manera correcta
La ambición práctica es hacer lo correcto, hacerlo de la manera correcta y resolver juntos los problemas correctos. Los procesos fluidos ayudan a cumplir objetivos empresariales y obligaciones internas o regulatorias. Requisitos operativos débiles producen versiones fallidas, experiencia irregular, costos evitables y equipos agotados.
Una corrección rápida puede ser necesaria durante un incidente, pero no sustituye una estrategia. Asigna la propiedad, revisa fricciones recurrentes, prioriza por impacto y convierte las lecciones en cambios deliberados.
Resumen del tema
Combina propiedad clara, ejecución repetible y aprendizaje colectivo para proteger resultados empresariales y del cliente.
3. Aplica los cinco principios de diseño nombrados
Principios de Excelencia operativa y su enfoque.
Principio
Enfoque
Adoptar la cultura de DevOps
Colaboración, responsabilidad compartida, propiedad y aprendizaje continuo.
Establecer estándares de desarrollo
Métodos adecuados, puertas de calidad, pruebas tempranas y entrega medible.
Evolucionar operaciones con observabilidad
Telemetría, modelos de estado, vistas por audiencia y alertas accionables.
Automatizar para obtener eficiencia
Seleccionar flujos valiosos, diseñar para automatización y tratarla como dependencia crítica.
Adoptar prácticas de implementación seguras
IaC, canalizaciones coherentes, cambios pequeños, exposición progresiva y recuperación.
El resumen exportado afirma que hay “seis principios”, pero el módulo nombra los cinco anteriores, al igual que la documentación actual de Microsoft. Se trata de una incoherencia de conteo, no de un sexto principio ausente.
Resumen del tema
Estudia los cinco principios explícitos y cómo cultura, estándares, observabilidad, automatización y entrega se refuerzan.
4. Adopta la cultura DevOps en el proyecto de RR. HH. de Contoso
RR. HH. de Contoso planea una aplicación de línea de negocio para uso interno. Antes del diseño y la implementación, desarrollo, pruebas y operaciones deben trabajar por una misión común orientada al cliente, sin aislar conocimiento, herramientas ni responsabilidad.
DevOps es una comunidad de prácticas, no solo un producto. La responsabilidad compartida hace que el equipo sea dueño del rendimiento y la confiabilidad donde se ejecute la aplicación. Desarrollo incluye a operaciones en el bucle de comentarios; operaciones devuelve evidencia de producción y recursos útiles.
Resumen del tema
Construye DevOps sobre propósito común, propiedad compartida, comunicación transparente y responsabilidad por todo el ciclo.
5. Colabora mediante sistemas comunes y rutas de escalación
Los tres equipos técnicos mezclaban Slack, ,, Excel y repositorios separados. La fragmentación ocultaba el estado de entornos, trabajo, documentos y procedimientos. Líderes y patrocinadores estandarizan para backlog, repositorio y canalización, y para comunicación.
Un backlog compartido alinea funciones y correcciones; una ubicación común facilita encontrar la escalación. En la comprobación, la ventaja es la coordinación: las herramientas comunes mantienen informados a los equipos y reducen fallos de comunicación; no eliminan supervisión, automatización ni controles de seguridad.
Los sistemas comunes ofrecen una vista operativa sin borrar especialidades.
Resumen del tema
Estandariza colaboración y seguimiento para que todos vean prioridades, estado de entornos y orientación de escalación.
6. Crea aprendizaje continuo sin culpa
Mantén especificaciones, procedimientos, planes de incidente y retrospectivas en una wiki accesible de . Tras incidentes y ciclos de desarrollo, realiza revisiones sin culpa que examinen condiciones del sistema y decisiones del proceso.
Usa experimentos económicos, pruebas de concepto y pruebas A/B. Contoso prueba propuestas de experiencia con usuarios reales, documenta resultados, acelera la incorporación de profesionales y celebra avances. En la pregunta, una revisión sin culpa después de incidentes fomenta aprendizaje y experimentación.
Resumen del tema
Convierte incidentes, experimentos y trabajo terminado en conocimiento compartido y mejoras concretas.
7. Codifica procedimientos de desarrollo y operaciones
Los estándares deben abarcar trabajo rutinario, procesos excepcionales, simulacros de emergencia y recuperación, herramientas, supervisión, capacitación, comunicación con partes interesadas y divulgaciones a clientes. Registra las razones y valida los estándares con regularidad.
Contoso acuerda formato, nombres, tratamiento de errores, control de versiones y seguridad y los aplica mediante revisiones y herramientas. Operaciones amplía la documentación diaria y de diagnóstico. Métricas de muestran el efecto a la dirección. Como sí existía falta de estandarización, la respuesta de verdadero o falso es verdadera.
Los procedimientos escalan cuando el equipo documenta, practica, mide y revisa.
Resumen del tema
Documenta y ensaya el trabajo normal y de emergencia y usa evidencia para mantener los estándares vigentes.
8. Establece estándares para Contoso Ticketing
Una startup en crecimiento usa para integraciones e incorporación de clientes, pero no tiene un método formal. Más proyectos y personas produjeron comunicación confusa, reuniones débiles, ciclos irregulares, retrasos y presión directiva.
Los estándares adecuados deben acelerar el trayecto del código a las pruebas, no crear ceremonia sin valor. Alinean equipo y partes interesadas sobre roles, expectativas, criterios de finalización, calidad y trabajo técnico prioritario.
Resumen del tema
Elige estructura suficiente para mejorar flujo, calidad y alineación sin sobrecargar a un equipo pequeño.
9. Adopta un método del sector y un backlog compartido
Contoso adopta Scrum con roles, eventos, artefactos, reglas, revisiones frecuentes, sprints cortos y un único backlog. mantiene ese backlog, muestra prioridades y riesgos y favorece una entrega coherente.
Un método conocido define ritmo y responsabilidades; las revisiones de hitos detectan problemas pronto. En la pregunta, —no Excel, ni — es la herramienta indicada para mantener el backlog.
Un método compartido conecta planificación con entrega controlada.
Resumen del tema
Usa un método adecuado, un backlog priorizado, ciclos cortos de comentarios y roles explícitos.
10. Desplaza las pruebas a la izquierda y preserva el artefacto
Inicia el control de calidad pronto e incluye funcionalidad, rendimiento, seguridad, facilidad de uso, infraestructura, configuración y datos en cada plan. Automatiza comprobaciones rutinarias y mantén el artefacto inmutable al cruzar entornos y puertas.
Contoso registra casos, datos y resultados en e incorpora controles en las canalizaciones antes de promocionar. Así reduce diferencias, fallos, errores, retrabajo y frustración. La estrategia correcta es probar pronto y a menudo, no dejar todo el control de calidad para el final.
Resumen del tema
Prueba comportamiento funcional y no funcional pronto, promociona el mismo artefacto y automatiza puertas de confianza.
11. Mide la eficiencia y los resultados de desarrollo
Mide si los cambios funcionan. Sigue tendencias de defectos, actualizaciones fallidas, plazo de entrega, duración del bucle de comentarios, previsibilidad y resultados del cliente. Contoso usa informes de para velocidad, flujo acumulado, creación y resolución de errores y tiempo desde código hasta producción.
Los paneles de y amplían el análisis. La respuesta es que Contoso usó informes de para comparar mejoras en el tiempo; tiempos aislados, encuestas o valoraciones no muestran todo el sistema.
Resumen del tema
Usa tendencias de entrega y calidad para asignar esfuerzo y demostrar qué cambios mejoran el flujo.
12. Evoluciona las operaciones de Contoso Real Estate con observabilidad
La aplicación interna usa ,,, y . La observabilidad debe apoyar mantenimiento proactivo, calidad, seguridad, capacidad y decisiones del producto.
El modelado de estado combina señales en una condición comprensible y ayuda a actuar antes de que la degradación se convierta en incidente. La supervisión eficaz desplaza tiempo de la reacción a la mejora de experiencia.
Resumen del tema
Diseña observabilidad para explicar el estado y orientar acciones técnicas y empresariales.
13. Correlaciona telemetría en todas las capas
Páginas de búsqueda vacías coinciden con tiempos de espera de conexión, pero registros aislados no prueban causalidad. El equipo amplía instrumentación con hora, contexto de búsqueda, cliente e identidad, respetando privacidad y control de acceso.
La correlación revela tiempos de espera de consultas no tratados en la actualización. Después diseña rastreo distribuido completo con OpenTelemetry. En la comprobación, la supervisión más profunda de la aplicación identifica la causa raíz.
La correlación transforma señales separadas en una narración del incidente.
Resumen del tema
Instrumenta recorridos críticos coherentemente y correlaciona capas para conectar síntomas con causas.
14. Crea paneles para audiencias específicas
Un área de trabajo de Analytics centraliza datos, pero no los vuelve útiles automáticamente. Crea vistas situacionales para partes interesadas con estado, usuarios, búsquedas, reservas, objetivos y tendencias. Para operadores, ofrece paneles y libros con detalles y desglose para diagnóstico, incidentes y supervisión diaria.
Actualiza vistas con frecuencia y conserva el detalle adecuado. La respuesta correcta es un panel específico para cada equipo que necesita datos, no uno universal ni uno para cada persona.
Una base de evidencia puede sustentar varias vistas orientadas a decisiones.
Resumen del tema
Adapta visualizaciones a decisiones y audiencias sin perder una base de telemetría común y gobernada.
15. Haz que las alertas sean accionables y proactivas
La fatiga aparece con avisos redundantes, vagos, de baja prioridad o enviados a las personas equivocadas. Conserva señales que requieran acción, incluye gravedad y contexto, agrupa evidencia, alinea umbrales con objetivos y dirige cada alerta a un responsable.
Contoso elimina ruido y avisa pronto de una degradación sostenida de consultas para intervenir antes de una interrupción. Luego evalúa respuestas automatizadas. Las alertas no deben ser principalmente informativas; la afirmación es falsa.
Una alerta útil inicia una respuesta en vez de crear otra cola de investigación.
Resumen del tema
Notifica cuando se espera una acción, aporta contexto y gravedad y detecta degradación antes del fallo total.
16. Automatiza con intención en Contoso University
La aplicación educativa usa ,,, y . El trabajo manual frecuente consume tiempo, crea variación y amplía riesgo. La automatización debe retirar esfuerzo repetitivo y preservar el juicio humano para decisiones complejas.
Automatizar ahorra tiempo, esfuerzo y costo y mejora precisión y confiabilidad. Pero no automatices desperdicio: simplifica o elimina el flujo innecesario y después automatiza lo restante.
Resumen del tema
Usa automatización para eliminar trabajo repetitivo y errores, no para perpetuar procesos sin valor.
17. Clasifica flujos por valor antes de automatizar
Inventaría flujos y evalúa complejidad, esfuerzo, frecuencia, precisión, puntualidad, vida útil, riesgo y retorno. Compara comprar una herramienta con desarrollar y mantener una solución. La documentación ayuda, pero no es factor de clasificación en el escenario y es la respuesta excluida.
Contoso prioriza aprovisionamiento de cuentas, restablecimiento de contraseñas y desaprovisionamiento porque son frecuentes y basados en reglas. La capacidad recuperada libera mejoras de mayor valor.
La automatización comienza por selección y simplificación.
Resumen del tema
Automatiza trabajo duradero, frecuente y basado en reglas después de eliminar pasos innecesarios y comparar comprar con construir.
18. Diseña componentes que puedan automatizarse
La preparación para automatización es una propiedad arquitectónica. Una interfaz dinámica con campos inestables resulta difícil de probar. Contoso asigna identificadores únicos, usa semántico y etiquetas, admite teclado y crea componentes accesibles que las herramientas pueden localizar.
Los casos automatizados entran en la suite diaria para comprobar cada compilación. El escenario se resuelve modificando componentes de interfaz, no abandonando la automatización ni reescribiendo pruebas frágiles.
Resumen del tema
Expón interfaces estables y semántica accesible para lograr automatización confiable en vez de frágil.
19. Trata la automatización como dependencia de producción
La automatización debe crecer con la carga y cumplir los mismos estándares de confiabilidad, seguridad, rendimiento, costo y operación. Scripts sin documentación, mal control de errores, propiedad dispersa y credenciales ocultas crean deuda y rutas de fallo.
Contoso reemplaza un script lento que carga la base de pruebas. La nueva versión anonimiza y enmascara datos, controla errores, mantiene rendimiento y sigue las prácticas de la aplicación. La respuesta es que la automatización debe cumplir todos los pilares de Well-Architected .
Resumen del tema
Trata la automatización como código crítico: seguro, observable, probado, documentado, escalable y mantenido con la carga.
20. Adopta implementación segura para Contoso Air
La aplicación de reservas usa ,,, y . Una cadena automatizada y modular debe implementar código, configuración, infraestructura y artefactos de forma coherente en todos los entornos.
Pruebas, supervisión, control de versiones, trazabilidad y acciones compensatorias reducen el efecto de condiciones inesperadas. La entrega segura nace antes de producción, no después del fallo.
Resumen del tema
Crea una cadena repetible con barreras y recuperación para todo tipo de cambio.
21. Implementa infraestructura y configuración mediante código
Usa infraestructura como código declarativa para el estado repetible y listo para producción. Prefiere capas modulares alineadas con el ciclo de vida sin abstracción innecesaria. Herramientas estándar reducen variación, revelan desviación y colocan la infraestructura en revisión, pruebas e historial.
Contoso mueve configuraciones a archivos por entorno en control de código, guarda secretos en un almacén por entorno, registra cambios, prueba configuración en la canalización y planea reversión automática. El principio de la pregunta es automatizar todas las implementaciones mediante canalizaciones.
La cadena vuelve repetible el estado deseado y trazable cada ejecución.
Resumen del tema
Versiona infraestructura y configuración declarativas, protege secretos, prueba cambios y automatiza recuperación.
22. Publica actualizaciones pequeñas con una cadencia regular
Grandes versiones trimestrales combinan demasiadas variables, amplían el , dificultan validación y hacen estresante la reversión. Cambios pequeños y relacionados son más fáciles de comprender, probar, observar, corregir o revertir.
Contoso sustituye grandes lanzamientos cada tres o cuatro meses por actualizaciones frecuentes probadas en entornos inferiores. Mejoran calidad, confianza, moral y plazo. La opción recomendada es implementación pequeña y frecuente.
Resumen del tema
Reduce el tamaño del lote para validar, diagnosticar y recuperar cada versión con más facilidad.
23. Usa exposición progresiva y pruebas de compatibilidad
Comienza con pocas instancias o usuarios, observa señales técnicas y de soporte y amplía solo con evidencia aceptable. Comprueba compatibilidad hacia atrás y adelante para que versiones distintas coexistan durante el despliegue.
Contoso usa marcas de características para seleccionar la primera audiencia, amplía por etapas y devuelve casos de soporte a decisiones y preguntas frecuentes. Esa es la respuesta del escenario. Blue-green y canary también controlan exposición, pero el caso usa marcas.
La exposición crece al mismo ritmo que la confianza.
Resumen del tema
Limita el impacto inicial, observa comportamiento real, conserva compatibilidad y mantén desactivación o reversión rápida.
24. Equilibra las compensaciones de Excelencia operativa
Estándares, telemetría, entornos de prueba, automatización, almacenes de marcas y capacidad paralela elevan costo y complejidad. Datos de observabilidad e identidades de automatización amplían la superficie de seguridad. Demasiado proceso retrasa; muy poco crea variación y heroísmo frágil.
Dimensiona controles según riesgo y madurez. Reutiliza plantillas aprobadas, comparte especialistas, gobierna telemetría sensible, mantén capas fundamentales estables y mide el efecto en clientes y rendimiento de entrega.
Resumen del tema
Invierte en controles en proporción al riesgo y confirma que reducen fallos y costo de recuperación.
25. Revisa el ciclo operativo completo
Cultura: propósito común, responsabilidad compartida, herramientas comunes, aprendizaje sin culpa y procedimientos explícitos.
Desarrollo: método adecuado, backlog único, pruebas amplias y tempranas, artefactos inmutables y métricas de entrega.
Observabilidad: modelado de estado, telemetría correlacionada, paneles por audiencia y alertas proactivas accionables.
Automatización: selección de flujos, interfaces preparadas e ingeniería con calidad de producción.
Entrega: IaC declarativa, un método de canalización, cambios pequeños, exposición progresiva, compatibilidad y recuperación.
Juntas, estas prácticas ayudan al equipo a elegir el trabajo correcto, ejecutarlo bien y resolver colectivamente los problemas adecuados. Operaciones fluidas y repetibles mantienen previsibilidad durante cambios y respaldan directivas y regulaciones.