Planos do Serviço de Aplicativo: preços e dimensionamento
Voltar para a trilha AZ-104
AZ-104Capítulo 23

Estudo para a Certificação Microsoft AZ-104

Planos do Serviço de Aplicativo: preços e dimensionamento

Escolha um plano do Serviço de Aplicativo com base na carga, compreenda o limite compartilhado de capacidade e cobrança e dimensione aplicações Web com opções manuais, regras, agendas ou tráfego HTTP.

Tempo de estudo sugerido: 70 minutos • Nível intermediário • Reescrita autoral baseada no módulo fornecido do Microsoft Learn e conferida com a documentação vigente do Serviço de Aplicativo

Escudo neon de administrador do Azure cercado por máquinas virtuais, redes, armazenamento, identidade, governança, monitoramento, backup e infraestrutura como código

1. Associe um site de hotel previsível a um plano elástico

Uma rede de hotéis usa um site para reservas e consulta de hospedagens. O tráfego cresce de forma previsível nos feriados e diminui em outras épocas. O dimensionamento deve preservar a capacidade de resposta no pico e retirar recursos ociosos quando a demanda cair. O administrador precisa escolher a camada de preço adequada do plano do e saber dimensioná-lo.

Os pré-requisitos são fundamentos de dimensionamento e desempenho e familiaridade com o . O foco da AZ-104 é entender o que o plano controla, como as camadas mudam recursos e preço, quando compartilhar ou separar planos e como diferenciar escala manual, por regras, por agenda e orientada por tráfego .

Fluxo dos requisitos da aplicação ao plano, camada de preço, dimensionamento e monitoramento.
O plano é o limite de computação, recursos, dimensionamento e cobrança da aplicação do .

2. Trate o plano como o limite de um farm de servidores

Um plano do define os recursos computacionais nos quais uma ou mais aplicações executam. Ele se parece com um farm gerenciado: criar o plano em uma região aloca ali um pool, e todas as aplicações atribuídas usam esse pool. O administra os hosts; você escolhe capacidade e camada.

Configurações definidas pelo plano.
ConfiguraçãoO que controlaConsequência
Sistema operacionalTrabalhadores Windows ou Linux.Runtimes, contêineres e SKUs disponíveis dependem da escolha feita na criação.
RegiãoLocal da computação do plano.As aplicações do plano executam ali; use outro plano para outra geografia.
Camada de preço / SKUFamília de hardware, recursos, limites e preço.Domínios, , , backups, dimensionamento e isolamento variam por camada.
Quantidade de instânciasNúmero de trabalhadores que atendem o plano.O dimensionamento horizontal manual ou automático altera esse número.
Tamanho das instânciasCPU, memória e armazenamento remoto por trabalhador.O dimensionamento vertical troca SKU/camada e capacidade por instância.

Nas camadas dedicadas, uma aplicação normalmente executa em todos os trabalhadores configurados. Aplicações, , , diagnóstico e backups disputam CPU e memória. Acrescentar uma aplicação, portanto, não cria capacidade grátis só porque o plano já existe.

Três aplicações Web compartilham todos os trabalhadores de um plano, e uma aplicação isolada usa outro plano.
Aplicações de um plano compartilham capacidade e, no do plano, normalmente dimensionam juntas.

3. Compartilhe para eficiência; separe para controle

  • Compartilhe quando as aplicações usam o mesmo sistema operacional e região, têm expectativas compatíveis de ciclo de vida e podem disputar os mesmos trabalhadores com segurança.
  • Meça CPU, memória, armazenamento, rede e concorrência restantes antes de adicionar uma aplicação. Sobrecarregar o plano pode indisponibilizar aplicações novas e existentes.
  • Crie outro plano para aplicação intensiva, escala independente, região ou sistema operacional diferente, ou maior isolamento operacional e de desempenho.
  • Conte cada slot de implantação ativo como outra aplicação competindo pelos recursos.

Computação dedicada é dedicada ao plano, não a cada aplicação. Se uma aplicação ruidosa prejudicar outra, aumentar o plano pode apenas esconder o problema e elevar o custo de todas. Levar a carga para um plano próprio recria limites separados de capacidade, escala e cobrança.

4. Escolha a categoria antes do SKU exato

Categorias atuais e finalidade.
CategoriaCamadasComputação e uso
Computação compartilhadaFree e SharedCotas de CPU em trabalhadores compartilhados com outros clientes; sem expansão; apenas desenvolvimento e teste; sem financeiro.
Computação dedicadaBasic, Standard, Premium, Premium V2, V3 e V4Trabalhadores dedicados ao plano, compartilhados por suas aplicações. Camadas superiores adicionam capacidade, escala, , backups e recursos.
IsoladaIsolated V2 em Ambiente do v3Trabalhadores dedicados em rede virtual dedicada, com isolamento de rede e maior envelope de escala.
Limites relevantes aos cenários; confira novamente antes de implantar.
RecursoFree / SharedBasicStandardPremiumIsolated
Máximo normal de instâncias1 compartilhada31020 na v1; 30 na v2-v4100 por plano; até 200 no total do Ambiente v3
por aplicação0052020
Dimensionamento automático do NãoNãoSimSimSim
Backups personalizados agendadosNãoAté 12/diaAté 12/diaAté 50/diaAté 50/dia

O export chama Premium V3 de camada Premium atual, recomenda-a para novas implantações e descreve SKUs padrão e otimizados para memória com SSD. Hoje o catálogo também inclui Premium V4. Selecione usando CPU, memória, armazenamento, recursos, região, disponibilidade e custo reais, não apenas o nome mais novo.

Basic atende aplicações de menor tráfego que dispensam avançado e , mas oferece trabalhadores dedicados e balanceamento integrado; no Linux, também aceita . Standard é a base comum de produção quando regras e importam. Premium aumenta desempenho, densidade e escala. Isolated V2 atende cargas críticas isoladas em um Ambiente do .

Escada de camadas desde computação compartilhada para teste até camadas dedicadas e rede isolada.
Dimensione verticalmente para obter capacidade e recursos, não apenas uma etiqueta de preço diferente.

5. Entenda o limite completo de cobrança

O SKU e a quantidade de trabalhadores são os principais custos. Em Shared, cada aplicação paga pela cota de CPU. Em Basic e superiores, cada instância do plano é cobrada independentemente do número de aplicações. Em Isolated V2, os trabalhadores são cobrados e o ambiente pode gerar custo mínimo próprio. , do , Traffic Manager, monitoramento, domínios, certificados e transferência podem cobrar separadamente.

  • Consolidar aplicações compatíveis pode economizar porque elas usam os mesmos trabalhadores pagos.
  • Mais aplicações não aumentam imediatamente o preço, mas a contenção pode exigir SKU maior ou mais instâncias.
  • Use calculadora de preços, orçamentos, alertas, previsões do Cost Management e métricas; não memorize um valor.
  • Reduza instâncias ociosas. Para uma base Premium previsível e duradoura, avalie planos de economia ou reservas contra o uso real.
  • Free, Shared e descontos de desenvolvimento servem à não produção, mas não oferecem respaldado financeiramente.

No portal, pesquise Planos do , crie um plano e escolha Explorar planos de preços. Compare CPU, memória, armazenamento, máximo de instâncias, , backups, redundância de zona, sistema operacional, disponibilidade regional e contêineres em conjunto.

6. Separe dimensionamento vertical de horizontal

Os dois eixos.
OperaçãoO que mudaQuando usar
Aumentar ou reduzir verticalmenteCamada de preço ou tamanho do trabalhador: CPU, memória, armazenamento e recursos.Uma instância precisa de mais potência ou a aplicação precisa de domínio, , ou .
Expandir ou reduzir horizontalmenteQuantidade de trabalhadores que executam as aplicações.Tráfego ou concorrência exigem paralelismo e a aplicação funciona corretamente em várias instâncias.

Um caminho didático começa em Free, passa a Shared por nome personalizado, Basic por associação , Standard por e depois usa tamanho maior ou Premium por mais computação. O processo pode ser invertido quando os recursos deixam de ser necessários. Como a matriz muda, valide a disponibilidade atual em vez de tratar essa sequência como regra permanente.

Uma alteração de escala costuma levar segundos e não exige modificar código nem reimplantar, mas afeta todas as aplicações do plano. Aplicações sem estado são mais seguras para expansão; sessão e uploads devem ficar em serviços compartilhados. Dependências como e do dimensionam separadamente.

Dimensionamento vertical da camada contrastado com adição horizontal de trabalhadores.
O vertical muda cada trabalhador; o horizontal muda a quantidade.

7. Configure o do plano

O dimensionamento automático do ajusta a quantidade de instâncias por regras e agendas. A configuração possui perfis; cada perfil define limites e regras. Cada regra contém gatilho e ação de expansão ou redução. Como o alvo é o plano, suas aplicações normalmente dimensionam juntas.

Elementos de projeto do módulo.
ElementoObjetivoEscolha segura
MínimoCapacidade mantida mesmo sem carga.Mantenha a aplicação executando e a redundância necessária.
MáximoTeto de custo e capacidade.Deixe margem, mas respeite camada, cota, orçamento e capacidade do back-end.
PadrãoFallback quando métricas não estão disponíveis e capacidade inicial do perfil.Escolha um valor seguro entre mínimo e máximo.
Gatilho de métricaResponde a tempo de CPU, resposta média, solicitações ou outros sinais.Escolha Média, Mínimo, Máximo ou Total conscientemente e use janela sustentada e cooldown.
Gatilho de tempoMuda antes de demanda diária, semanal, sazonal ou por data.Defina fuso horário. Sábado às 08:00 é regra baseada em tempo.
NotificaçãoE-mail ou diante de evento de escala.Avise sobre ações bem-sucedidas e falhas e acompanhe o histórico.

Sempre combine expansão e redução. Sem expansão, a carga alta pode degradar ou derrubar a aplicação; sem redução, a carga baixa mantém custo excessivo. Use limites diferentes, janelas adequadas e cooldown para evitar oscilação. Regra para crescer não supera máximo, limite da camada, cota nem back-end.

Perfis avaliam regras de métrica e agenda entre mínimo, padrão e máximo.
Regras decidem quando agir; limites do perfil decidem até onde ir.

8. Diferencie de escala automática por

Dois modelos de automação.
Capacidade do Dimensionamento automático do
SinalMétricas, sinais personalizados e agendas.Tráfego de entrada e observações da plataforma.
EscopoTodo o plano.Configuração por aplicação Web, com máximo de intermitência no plano.
RegrasVocê define limites, ações, perfis e agendas.A plataforma decide sem regras personalizadas.
Capacidade aquecidaSem modelo especial de sempre prontas ou pré-aquecidas.Mínimo sempre pronto e pré-aquecido reduzem partida fria.
Camadas atuaisStandard e superiores.Premium V2, V3 e V4.
Melhor usoLógica personalizada, várias métricas, CPU, memória, filas ou agenda.Tráfego imprevisível, menos regras e limites diferentes por aplicação.

O módulo também chama essa opção de dimensionamento elástico. Ela define máximo por aplicação para impedir que o front-end sobrecarregue um banco mais lento. O máximo de intermitência pode chegar a 30 em planos Premium compatíveis; o máximo da aplicação cabe dentro dele. Não há suporte para tráfego de e apenas um método deve ficar ativo no plano.

O recurso aceita aplicações Windows e Linux, em código ou contêiner. Desative a afinidade ARR em um projeto sem estado, acompanhe AutomaticScalingInstanceCount e inclua instâncias ativas e pré-aquecidas nas decisões de custo. A Verificação de Integridade do é compatível.

Decisão entre escala manual, autoscale por regras e dimensionamento por tráfego HTTP.
Escolha pelo sinal e pelo modelo de controle, não pelos nomes parecidos.

9. Avaliação do módulo explicada

Respostas das três questões.
PerguntaResposta corretaJustificativa
Mais CPU, memória ou disco sem adicionar VMs?Aumentar verticalmente.Trocar camada ou tamanho eleva a capacidade por instância; expansão horizontal adiciona instâncias.
Qual plano listado aceita dez ?Premium V3 P1V3.Basic não possui e Standard admite cinco; Premium admite até 20.
Disparar evento sábado às 08:00?Regra baseada em tempo.O gatilho é uma agenda em determinado fuso, não uma métrica.

10. Revisão resumida de todos os tópicos

Versões curtas para memorização.
TópicoLembre-se
CenárioAtenda o pico previsível do hotel e reduza o custo fora dele.
PlanoDefine SO, região, SKU, tamanho, quantidade, recursos, escala e cobrança.
CompartilhamentoAplicações e disputam trabalhadores; consolide apenas se contenção e escala conjunta forem aceitáveis.
IsolamentoUse outro plano para carga pesada, escala independente, outro SO/região ou limite próprio.
Camadas compartilhadasFree e Shared são para teste, com cota, sem expansão e sem financeiro.
Camadas dedicadasBasic a Premium V4 dedicam trabalhadores ao plano; recursos e limites crescem.
Isolated V2Executa em Ambiente do v3 para rede dedicada e grande escala.
PreçoPague principalmente SKU e quantidade; dependências e complementos podem cobrar à parte.
VerticalTroque camada ou tamanho para CPU, memória, armazenamento ou recursos.
HorizontalTroque a quantidade; externalize estado e dimensione dependências.
Regras do plano exigem mínimo/padrão/máximo, dois sentidos, estatística, cooldown e notificações.
Automático por Premium V2-V4 usa tráfego, limites por aplicação, instâncias sempre prontas e pré-aquecidas.

11. Prática e recursos atuais

  • Dadas três aplicações com tráfego e regiões diferentes, decida quais podem compartilhar plano.
  • Escolha camada para desenvolvimento, produção com dez e carga crítica isolada por rede.
  • Projete regras para pico inesperado de CPU e campanha sábado às 08:00, incluindo limites, padrão, notificação e cooldown.
  • Explique por que dimensionar só a Web pode sobrecarregar .
  • Peça ao Microsoft Copilot para comparar planos e direções de escala e valide na documentação atual.