Planes de Servicio de Aplicaciones: precios y escalado
Volver a la ruta AZ-104
AZ-104Capítulo 23

Preparación para la Certificación Microsoft AZ-104

Planes de Servicio de Aplicaciones: precios y escalado

Elige un plan de Servicio de Aplicaciones según la carga, comprende el límite compartido de capacidad y facturación y escala aplicaciones web manualmente, con reglas, horarios o tráfico HTTP.

Tiempo de estudio sugerido: 70 minutos • Nivel intermedio • Reescritura original basada en el módulo proporcionado de Microsoft Learn y contrastada con la documentación vigente de Servicio de Aplicaciones

Escudo neón de administrador de Azure rodeado de máquinas virtuales, redes, almacenamiento, identidad, gobernanza, supervisión, copias de seguridad e infraestructura como código

1. Asocia un sitio hotelero previsible a un plan elástico

Una cadena hotelera usa un sitio para reservas y consultas. El tráfico crece de forma previsible durante vacaciones y disminuye en otras épocas. El escalado debe conservar la respuesta en el pico y retirar recursos inactivos cuando baja la demanda. El administrador debe elegir el nivel de precios correcto del plan de y saber escalarlo.

Se requieren conocimientos básicos de escalado y rendimiento y familiaridad con Microsoft Azure Portal. El foco de AZ-104 es qué controla el plan, cómo los niveles cambian recursos y precio, cuándo compartir o separar planes y cómo se diferencian el escalado manual, por reglas, por programación y orientado por tráfico .

Flujo desde requisitos hasta plan, nivel de precios, escalado y supervisión.
El plan es el límite de proceso, características, escalado y facturación de una aplicación de .

2. Trata el plan como el límite de una granja de servidores

Un plan de define los recursos de proceso donde se ejecutan una o más aplicaciones. Se parece a una granja administrada: al crear el plan en una región se asigna allí un grupo, y cada aplicación del plan lo usa. administra los hosts y tú eliges capacidad y nivel.

Configuraciones que define el plan.
ConfiguraciónQué controlaConsecuencia
Sistema operativoTrabajadores Windows o Linux.Entornos, contenedores y SKU disponibles dependen de la elección inicial.
RegiónUbicación del proceso.Las aplicaciones se ejecutan allí; usa otro plan para otra geografía.
Nivel de precios / SKUHardware, características, límites y precio.Dominios, , ranuras, copias, escalado y aislamiento cambian por nivel.
Número de instanciasCantidad de trabajadores.El escalado horizontal manual o automático cambia este valor.
Tamaño de instanciaCPU, memoria y almacenamiento remoto por trabajador.El escalado vertical cambia SKU/nivel y capacidad por instancia.

En niveles dedicados, una aplicación suele ejecutarse en todos los trabajadores. Aplicaciones, ranuras, , diagnósticos y copias compiten por CPU y memoria. Agregar una aplicación no crea capacidad gratuita porque el plan ya exista.

Tres aplicaciones web comparten todos los trabajadores y una aplicación aislada usa otro plan.
Las aplicaciones de un plan comparten capacidad y, con del plan, normalmente escalan juntas.

3. Comparte para ser eficiente; separa para controlar

  • Comparte cuando las aplicaciones usan el mismo sistema y región, tienen ciclos compatibles y pueden competir por los mismos trabajadores.
  • Mide CPU, memoria, almacenamiento, red y concurrencia disponibles antes de agregar una aplicación. Sobrecargar el plan puede interrumpir aplicaciones nuevas y existentes.
  • Crea otro plan para una carga intensiva, escalado independiente, otra región o sistema, o mayor aislamiento operativo y de rendimiento.
  • Cuenta cada ranura activa como otra aplicación que compite por los recursos.

El proceso dedicado está dedicado al plan, no a cada aplicación. Si una aplicación ruidosa perjudica a otra, ampliar el plan puede ocultar el problema y elevar el coste de todas. Un plan propio restablece límites separados de capacidad, escalado y facturación.

4. Elige la categoría antes del SKU exacto

Categorías actuales y finalidad.
CategoríaNivelesProceso y uso
Proceso compartidoFree y SharedCuotas de CPU en trabajadores compartidos con otros clientes; sin escalado horizontal; solo desarrollo y pruebas; sin financiero.
Proceso dedicadoBasic, Standard, Premium, Premium V2, V3 y V4Trabajadores dedicados al plan y compartidos por sus aplicaciones. Los niveles altos agregan capacidad, escala, ranuras, copias y funciones.
AisladoIsolated V2 en Environment v3Trabajadores dedicados en una red virtual dedicada, con aislamiento de red y mayor escala.
Límites importantes para los escenarios; compruébalos antes de implementar.
CaracterísticaFree / SharedBasicStandardPremiumIsolated
Máximo normal de instancias1 compartida31020 en v1; 30 en v2-v4100 por plan; hasta 200 totales en el entorno v3
Ranuras por aplicación0052020
Escalado automático de NoNo
Copias personalizadas programadasNoHasta 12/díaHasta 12/díaHasta 50/díaHasta 50/día

La exportación describe Premium V3 como nivel Premium actual, lo recomienda para implementaciones nuevas y menciona SKU estándar y optimizados para memoria con SSD. El catálogo vigente también contiene Premium V4. Selecciona con datos reales de CPU, memoria, almacenamiento, funciones, región, disponibilidad y coste.

Basic sirve para aplicaciones de poco tráfico sin avanzado ni ranuras, pero aporta trabajadores dedicados y equilibrio integrado; en Linux admite . Standard es la base habitual de producción si importan reglas y ranuras. Premium aumenta rendimiento, densidad y escala. Isolated V2 sirve para cargas críticas aisladas en Environment.

Escalera desde proceso compartido de pruebas hasta niveles dedicados y red aislada.
Escala verticalmente para obtener capacidad y funciones, no solo otra etiqueta de precio.

5. Comprende el límite completo de facturación

El SKU y el número de trabajadores son los costes principales. En Shared, cada aplicación paga su cuota de CPU. En Basic y superiores se factura cada instancia sin importar cuántas aplicaciones la usen. En Isolated V2 se facturan trabajadores y el entorno puede añadir un coste mínimo. , , Traffic Manager, supervisión, dominios, certificados y transferencia pueden cobrar por separado.

  • Consolidar aplicaciones compatibles puede ahorrar al usar los mismos trabajadores pagados.
  • Más aplicaciones no aumentan el precio inmediatamente, pero la contención puede exigir un SKU mayor o más trabajadores.
  • Usa calculadora de precios, presupuestos, alertas, previsiones de Cost Management y métricas; no memorices precios.
  • Reduce instancias inactivas. Para una base Premium duradera y previsible, evalúa planes de ahorro o reservas frente al uso.
  • Free, Shared y descuentos de desarrollo sirven para no producción, pero no aportan con respaldo financiero.

En el portal, busca Planes de , crea uno y abre Explorar planes de precios. Compara CPU, memoria, almacenamiento, máximo de instancias, ranuras, copias, redundancia de zona, sistema, región y contenedores en conjunto.

6. Separa escalado vertical de horizontal

Los dos ejes.
OperaciónQué cambiaCuándo usar
Escalar o reducir verticalmenteNivel o tamaño del trabajador: CPU, memoria, almacenamiento y funciones.Una instancia necesita más potencia o la aplicación necesita dominio, , ranuras o .
Escalar o reducir horizontalmenteNúmero de trabajadores que ejecutan las aplicaciones.Tráfico o concurrencia exige paralelismo y la aplicación funciona en múltiples instancias.

Una ruta didáctica empieza en Free, pasa a Shared para personalizado, Basic para enlace , Standard para ranuras y después un tamaño mayor o Premium para más proceso. Se puede invertir cuando ya no hacen falta las funciones. La matriz cambia, así que valida la disponibilidad actual.

El cambio suele tardar segundos y no exige modificar código ni volver a implementar, pero afecta a todas las aplicaciones. Las aplicaciones sin estado escalan mejor; sesiones y archivos deben residir en servicios compartidos. Dependencias como y se escalan por separado.

Escalado vertical del nivel frente a agregar trabajadores horizontalmente.
El vertical cambia cada trabajador; el horizontal cambia la cantidad.

7. Configura en el plan

El escalado automático de ajusta el número de instancias mediante reglas y horarios. Una configuración contiene perfiles; cada perfil define límites y reglas. Cada regla combina un desencadenador con una acción de aumento o reducción. Como el objetivo es el plan, sus aplicaciones normalmente escalan juntas.

Elementos de diseño del módulo.
ElementoObjetivoElección segura
MínimoCapacidad conservada sin carga.Mantén la aplicación en ejecución y la redundancia necesaria.
MáximoTecho de coste y capacidad.Deja margen respetando nivel, cuota, presupuesto y back-end.
PredeterminadoAlternativa si faltan métricas y capacidad inicial del perfil.Valor seguro entre mínimo y máximo.
MétricaResponde a tiempo de CPU, respuesta media, solicitudes u otras señales.Elige Promedio, Mínimo, Máximo o Total deliberadamente y usa ventana sostenida y espera.
TiempoCambia antes de demanda diaria, semanal, estacional o por fecha.Define zona horaria. Sábado a las 08:00 es una regla temporal.
NotificaciónCorreo o ante un evento.Avisa de acciones correctas y fallidas y revisa el historial.

Combina siempre aumento y reducción. Sin aumento, la carga alta degrada la aplicación; sin reducción, la carga baja mantiene coste innecesario. Usa umbrales distintos, ventanas adecuadas y tiempo de espera para evitar oscilaciones. Una regla no supera máximo, límite del nivel, cuota ni capacidad del back-end.

Perfiles evalúan reglas de métrica y horario entre mínimo, predeterminado y máximo.
Las reglas deciden cuándo; los límites deciden hasta dónde.

8. Distingue del escalado automático por

Dos modelos de automatización.
Capacidad de Escalado automático de
SeñalMétricas, señales personalizadas y horarios.Tráfico y observaciones de plataforma.
ÁmbitoTodo el plan.Configuración por aplicación web con ráfaga máxima del plan.
ReglasTú defines umbrales, acciones, perfiles y horarios.La plataforma decide sin reglas personalizadas.
Capacidad calienteSin modelo especial siempre listo o precalentado.Mínimo siempre listo y búfer precalentado reducen arranque frío.
Niveles actualesStandard y superiores.Premium V2, V3 y V4.
Uso idóneoLógica personalizada, varias métricas, CPU, memoria, colas o horarios.Tráfico imprevisible, menos reglas y límites distintos por aplicación.

El módulo también lo denomina escalado elástico. Permite un máximo por aplicación para que el front-end no sobrecargue una base de datos más lenta. La ráfaga máxima puede llegar a 30 en Premium compatible; el máximo por aplicación debe caber. No admite tráfico de ranuras y solo un método debe estar activo.

Admite aplicaciones Windows y Linux, como código o contenedor. Desactiva afinidad ARR para diseño sin estado, supervisa AutomaticScalingInstanceCount e incluye trabajadores activos y precalentados en costes. La Comprobación de estado de es compatible.

Decisión entre escalado manual, autoscale con reglas y escalado por tráfico HTTP.
Elige por señal y control, no por nombres similares.

9. Evaluación del módulo explicada

Respuestas de las tres preguntas.
PreguntaRespuesta correctaMotivo
¿Más CPU, memoria o disco sin agregar VM?Escalar verticalmente.Cambiar nivel o tamaño eleva capacidad por instancia; el horizontal agrega instancias.
¿Qué plan admite diez ranuras?Premium V3 P1V3.Basic no tiene y Standard admite cinco; Premium admite hasta 20.
¿Evento el sábado a las 08:00?Regla basada en tiempo.El desencadenador es un horario, no una métrica.

10. Revisión resumida de todos los temas

Versiones breves para recordar.
TemaRecuerda
EscenarioAtiende el pico hotelero y reduce coste fuera de temporada.
PlanDefine SO, región, SKU, tamaño, cantidad, funciones, escalado y facturación.
CompartirAplicaciones y ranuras compiten; consolida solo si acepta contención y escalado conjunto.
AislarOtro plan para carga pesada, escala independiente, otro SO/región o límite propio.
CompartidosFree y Shared son para prueba, con cuota, sin expansión ni financiero.
DedicadosBasic a Premium V4 dedican trabajadores al plan; crecen funciones y límites.
Isolated V2Se ejecuta en Environment v3 para red dedicada y gran escala.
PrecioPaga principalmente SKU y número; dependencias y extras pueden cobrar aparte.
VerticalCambia nivel o tamaño para CPU, memoria, almacenamiento o funciones.
HorizontalCambia cantidad; externaliza estado y escala dependencias.
Reglas del plan requieren mínimo/predeterminado/máximo, dos sentidos, estadística, espera y avisos.
Automático Premium V2-V4 usa tráfico, límites por aplicación y trabajadores siempre listos y precalentados.

11. Práctica y recursos actuales

  • Decide qué aplicaciones con tráfico y regiones diferentes pueden compartir plan.
  • Elige nivel para desarrollo, producción con diez ranuras y carga crítica aislada.
  • Diseña reglas para pico de CPU y campaña del sábado a las 08:00, con límites, predeterminado, aviso y espera.
  • Explica por qué escalar solo la web puede sobrecargar .
  • Pide a Microsoft Copilot comparar planes y direcciones y comprueba la documentación actual.