Preparación para la Certificación Microsoft AZ-104
Planes de Servicio de Aplicaciones: precios y escalado
Elige un plan de Servicio de Aplicaciones según la carga, comprende el límite compartido de capacidad y facturación y escala aplicaciones web manualmente, con reglas, horarios o tráfico HTTP.
Tiempo de estudio sugerido: 70 minutos • Nivel intermedio • Reescritura original basada en el módulo proporcionado de Microsoft Learn y contrastada con la documentación vigente de Servicio de Aplicaciones
Por João Ricardo Dutra••Contenido original completo
1. Asocia un sitio hotelero previsible a un plan elástico
Una cadena hotelera usa un sitio para reservas y consultas. El tráfico crece de forma previsible durante vacaciones y disminuye en otras épocas. El escalado debe conservar la respuesta en el pico y retirar recursos inactivos cuando baja la demanda. El administrador debe elegir el nivel de precios correcto del plan de y saber escalarlo.
Se requieren conocimientos básicos de escalado y rendimiento y familiaridad con Microsoft Azure Portal. El foco de AZ-104 es qué controla el plan, cómo los niveles cambian recursos y precio, cuándo compartir o separar planes y cómo se diferencian el escalado manual, por reglas, por programación y orientado por tráfico .
El plan es el límite de proceso, características, escalado y facturación de una aplicación de .
2. Trata el plan como el límite de una granja de servidores
Un plan de define los recursos de proceso donde se ejecutan una o más aplicaciones. Se parece a una granja administrada: al crear el plan en una región se asigna allí un grupo, y cada aplicación del plan lo usa. administra los hosts y tú eliges capacidad y nivel.
Configuraciones que define el plan.
Configuración
Qué controla
Consecuencia
Sistema operativo
Trabajadores Windows o Linux.
Entornos, contenedores y SKU disponibles dependen de la elección inicial.
Región
Ubicación del proceso.
Las aplicaciones se ejecutan allí; usa otro plan para otra geografía.
Nivel de precios / SKU
Hardware, características, límites y precio.
Dominios, , ranuras, copias, escalado y aislamiento cambian por nivel.
Número de instancias
Cantidad de trabajadores.
El escalado horizontal manual o automático cambia este valor.
Tamaño de instancia
CPU, memoria y almacenamiento remoto por trabajador.
El escalado vertical cambia SKU/nivel y capacidad por instancia.
En niveles dedicados, una aplicación suele ejecutarse en todos los trabajadores. Aplicaciones, ranuras, , diagnósticos y copias compiten por CPU y memoria. Agregar una aplicación no crea capacidad gratuita porque el plan ya exista.
Las aplicaciones de un plan comparten capacidad y, con del plan, normalmente escalan juntas.
3. Comparte para ser eficiente; separa para controlar
Comparte cuando las aplicaciones usan el mismo sistema y región, tienen ciclos compatibles y pueden competir por los mismos trabajadores.
Mide CPU, memoria, almacenamiento, red y concurrencia disponibles antes de agregar una aplicación. Sobrecargar el plan puede interrumpir aplicaciones nuevas y existentes.
Crea otro plan para una carga intensiva, escalado independiente, otra región o sistema, o mayor aislamiento operativo y de rendimiento.
Cuenta cada ranura activa como otra aplicación que compite por los recursos.
El proceso dedicado está dedicado al plan, no a cada aplicación. Si una aplicación ruidosa perjudica a otra, ampliar el plan puede ocultar el problema y elevar el coste de todas. Un plan propio restablece límites separados de capacidad, escalado y facturación.
4. Elige la categoría antes del SKU exacto
Categorías actuales y finalidad.
Categoría
Niveles
Proceso y uso
Proceso compartido
Free y Shared
Cuotas de CPU en trabajadores compartidos con otros clientes; sin escalado horizontal; solo desarrollo y pruebas; sin financiero.
Proceso dedicado
Basic, Standard, Premium, Premium V2, V3 y V4
Trabajadores dedicados al plan y compartidos por sus aplicaciones. Los niveles altos agregan capacidad, escala, ranuras, copias y funciones.
Aislado
Isolated V2 en Environment v3
Trabajadores dedicados en una red virtual dedicada, con aislamiento de red y mayor escala.
Límites importantes para los escenarios; compruébalos antes de implementar.
Característica
Free / Shared
Basic
Standard
Premium
Isolated
Máximo normal de instancias
1 compartida
3
10
20 en v1; 30 en v2-v4
100 por plan; hasta 200 totales en el entorno v3
Ranuras por aplicación
0
0
5
20
20
Escalado automático de
No
No
Sí
Sí
Sí
Copias personalizadas programadas
No
Hasta 12/día
Hasta 12/día
Hasta 50/día
Hasta 50/día
La exportación describe Premium V3 como nivel Premium actual, lo recomienda para implementaciones nuevas y menciona SKU estándar y optimizados para memoria con SSD. El catálogo vigente también contiene Premium V4. Selecciona con datos reales de CPU, memoria, almacenamiento, funciones, región, disponibilidad y coste.
Basic sirve para aplicaciones de poco tráfico sin avanzado ni ranuras, pero aporta trabajadores dedicados y equilibrio integrado; en Linux admite . Standard es la base habitual de producción si importan reglas y ranuras. Premium aumenta rendimiento, densidad y escala. Isolated V2 sirve para cargas críticas aisladas en Environment.
Escala verticalmente para obtener capacidad y funciones, no solo otra etiqueta de precio.
5. Comprende el límite completo de facturación
El SKU y el número de trabajadores son los costes principales. En Shared, cada aplicación paga su cuota de CPU. En Basic y superiores se factura cada instancia sin importar cuántas aplicaciones la usen. En Isolated V2 se facturan trabajadores y el entorno puede añadir un coste mínimo. ,, Traffic Manager, supervisión, dominios, certificados y transferencia pueden cobrar por separado.
Consolidar aplicaciones compatibles puede ahorrar al usar los mismos trabajadores pagados.
Más aplicaciones no aumentan el precio inmediatamente, pero la contención puede exigir un SKU mayor o más trabajadores.
Usa calculadora de precios, presupuestos, alertas, previsiones de Cost Management y métricas; no memorices precios.
Reduce instancias inactivas. Para una base Premium duradera y previsible, evalúa planes de ahorro o reservas frente al uso.
Free, Shared y descuentos de desarrollo sirven para no producción, pero no aportan con respaldo financiero.
En el portal, busca Planes de , crea uno y abre Explorar planes de precios. Compara CPU, memoria, almacenamiento, máximo de instancias, ranuras, copias, redundancia de zona, sistema, región y contenedores en conjunto.
6. Separa escalado vertical de horizontal
Los dos ejes.
Operación
Qué cambia
Cuándo usar
Escalar o reducir verticalmente
Nivel o tamaño del trabajador: CPU, memoria, almacenamiento y funciones.
Una instancia necesita más potencia o la aplicación necesita dominio, , ranuras o .
Escalar o reducir horizontalmente
Número de trabajadores que ejecutan las aplicaciones.
Tráfico o concurrencia exige paralelismo y la aplicación funciona en múltiples instancias.
Una ruta didáctica empieza en Free, pasa a Shared para personalizado, Basic para enlace , Standard para ranuras y después un tamaño mayor o Premium para más proceso. Se puede invertir cuando ya no hacen falta las funciones. La matriz cambia, así que valida la disponibilidad actual.
El cambio suele tardar segundos y no exige modificar código ni volver a implementar, pero afecta a todas las aplicaciones. Las aplicaciones sin estado escalan mejor; sesiones y archivos deben residir en servicios compartidos. Dependencias como y se escalan por separado.
El vertical cambia cada trabajador; el horizontal cambia la cantidad.
7. Configura en el plan
El escalado automático de ajusta el número de instancias mediante reglas y horarios. Una configuración contiene perfiles; cada perfil define límites y reglas. Cada regla combina un desencadenador con una acción de aumento o reducción. Como el objetivo es el plan, sus aplicaciones normalmente escalan juntas.
Elementos de diseño del módulo.
Elemento
Objetivo
Elección segura
Mínimo
Capacidad conservada sin carga.
Mantén la aplicación en ejecución y la redundancia necesaria.
Máximo
Techo de coste y capacidad.
Deja margen respetando nivel, cuota, presupuesto y back-end.
Predeterminado
Alternativa si faltan métricas y capacidad inicial del perfil.
Valor seguro entre mínimo y máximo.
Métrica
Responde a tiempo de CPU, respuesta media, solicitudes u otras señales.
Elige Promedio, Mínimo, Máximo o Total deliberadamente y usa ventana sostenida y espera.
Tiempo
Cambia antes de demanda diaria, semanal, estacional o por fecha.
Define zona horaria. Sábado a las 08:00 es una regla temporal.
Notificación
Correo o ante un evento.
Avisa de acciones correctas y fallidas y revisa el historial.
Combina siempre aumento y reducción. Sin aumento, la carga alta degrada la aplicación; sin reducción, la carga baja mantiene coste innecesario. Usa umbrales distintos, ventanas adecuadas y tiempo de espera para evitar oscilaciones. Una regla no supera máximo, límite del nivel, cuota ni capacidad del back-end.
Las reglas deciden cuándo; los límites deciden hasta dónde.
8. Distingue del escalado automático por
Dos modelos de automatización.
Capacidad
de
Escalado automático de
Señal
Métricas, señales personalizadas y horarios.
Tráfico y observaciones de plataforma.
Ámbito
Todo el plan.
Configuración por aplicación web con ráfaga máxima del plan.
Reglas
Tú defines umbrales, acciones, perfiles y horarios.
La plataforma decide sin reglas personalizadas.
Capacidad caliente
Sin modelo especial siempre listo o precalentado.
Mínimo siempre listo y búfer precalentado reducen arranque frío.
Niveles actuales
Standard y superiores.
Premium V2, V3 y V4.
Uso idóneo
Lógica personalizada, varias métricas, CPU, memoria, colas o horarios.
Tráfico imprevisible, menos reglas y límites distintos por aplicación.
El módulo también lo denomina escalado elástico. Permite un máximo por aplicación para que el front-end no sobrecargue una base de datos más lenta. La ráfaga máxima puede llegar a 30 en Premium compatible; el máximo por aplicación debe caber. No admite tráfico de ranuras y solo un método debe estar activo.
Admite aplicaciones Windows y Linux, como código o contenedor. Desactiva afinidad ARR para diseño sin estado, supervisa AutomaticScalingInstanceCount e incluye trabajadores activos y precalentados en costes. La Comprobación de estado de es compatible.
Elige por señal y control, no por nombres similares.
9. Evaluación del módulo explicada
Respuestas de las tres preguntas.
Pregunta
Respuesta correcta
Motivo
¿Más CPU, memoria o disco sin agregar VM?
Escalar verticalmente.
Cambiar nivel o tamaño eleva capacidad por instancia; el horizontal agrega instancias.
¿Qué plan admite diez ranuras?
Premium V3 P1V3.
Basic no tiene y Standard admite cinco; Premium admite hasta 20.
¿Evento el sábado a las 08:00?
Regla basada en tiempo.
El desencadenador es un horario, no una métrica.
10. Revisión resumida de todos los temas
Versiones breves para recordar.
Tema
Recuerda
Escenario
Atiende el pico hotelero y reduce coste fuera de temporada.
Plan
Define SO, región, SKU, tamaño, cantidad, funciones, escalado y facturación.
Compartir
Aplicaciones y ranuras compiten; consolida solo si acepta contención y escalado conjunto.
Aislar
Otro plan para carga pesada, escala independiente, otro SO/región o límite propio.
Compartidos
Free y Shared son para prueba, con cuota, sin expansión ni financiero.
Dedicados
Basic a Premium V4 dedican trabajadores al plan; crecen funciones y límites.
Isolated V2
Se ejecuta en Environment v3 para red dedicada y gran escala.
Precio
Paga principalmente SKU y número; dependencias y extras pueden cobrar aparte.
Vertical
Cambia nivel o tamaño para CPU, memoria, almacenamiento o funciones.
Horizontal
Cambia cantidad; externaliza estado y escala dependencias.
Reglas del plan requieren mínimo/predeterminado/máximo, dos sentidos, estadística, espera y avisos.
Automático
Premium V2-V4 usa tráfico, límites por aplicación y trabajadores siempre listos y precalentados.
11. Práctica y recursos actuales
Decide qué aplicaciones con tráfico y regiones diferentes pueden compartir plan.
Elige nivel para desarrollo, producción con diez ranuras y carga crítica aislada.
Diseña reglas para pico de CPU y campaña del sábado a las 08:00, con límites, predeterminado, aviso y espera.
Explica por qué escalar solo la web puede sobrecargar .
Pide a Microsoft Copilot comparar planes y direcciones y comprueba la documentación actual.