Azure e Microsoft Foundry: aplicações, agentes e endpoints
Voltar para a trilha AI-901
AI-901Capítulo 7

Estudo para a Certificação Microsoft AI-901

Azure e Microsoft Foundry: aplicações, agentes e endpoints

Infraestrutura de nuvem, segurança, hospedagem, dados, modelos, projetos, aplicações clientes, REST e SDKs

Tempo de estudo sugerido: 45 minutos • Nível iniciante • Conteúdo reescrito a partir dos objetivos do Microsoft Learn

Escudo neon Microsoft Certified AI-901 Azure AI Fundamentals cercado por símbolos de IA generativa, visão, fala, nuvem e agentes

1. Aplicações de IA e inferência

Inteligência artificial descreve sistemas capazes de realizar tarefas normalmente associadas à inteligência humana, como raciocinar, resolver problemas, perceber o ambiente e compreender linguagem. Uma aplicação de IA incorpora técnicas de visão, fala, extração de informações ou outras áreas para entender entradas, aprender padrões e produzir respostas mais adaptáveis que as de um programa tradicional.

O motor dessa aplicação é um modelo de aprendizado de máquina: um sistema matemático treinado para reconhecer padrões e prever ou gerar saídas. Quando recebe um dado novo, o modelo aplica o que aprendeu; esse uso do modelo treinado é chamado inferência.

  • Aplicações orientadas por modelo processam entradas e retornam texto, imagens, decisões ou outros resultados.
  • Elas são dinâmicas: retreinamento ou ajuste fino pode melhorar o comportamento ao longo do tempo.
  • Na saúde, analisam radiografias e ressonâncias; em finanças, detectam fraude em transações; no varejo, personalizam recomendações.
  • Na manufatura, antecipam falhas de equipamentos; na educação, adaptam conteúdo, ritmo e feedback ao estudante.

O modelo não forma a solução inteira. Uma aplicação empresarial também precisa de segurança, rede, hospedagem, armazenamento, lógica e interface. fornece essa infraestrutura, e concentra os recursos de desenvolvimento e operação de IA.

2. e as quatro categorias fundamentais

é uma plataforma de nuvem: um conjunto de serviços consumidos pela internet, sem que a organização precise comprar e manter todo o hardware físico. Aplicações modernas podem executar código, armazenar dados e crescer em datacenters globais com segurança e confiabilidade.

Quatro categorias centrais do Azure: computação, armazenamento, rede e serviços de aplicativo.
As categorias trabalham juntas para sustentar aplicações e agentes de IA.
Categorias centrais do .
CategoriaFunção
ComputaçãoExecuta programas e cargas de trabalho em capacidade que pode aumentar ou diminuir.
Mantém arquivos, bancos de dados, imagens, backups e outros dados acessíveis.
RedeConecta recursos entre si, à internet e ao ambiente da organização com eficiência e segurança.
Serviços de AplicativoOferece plataformas prontas para criar, hospedar e executar aplicações sem administrar os servidores subjacentes.

3. Tenant, assinatura, grupo de recursos e recurso

A administração do segue uma hierarquia. O tenant é o espaço isolado da organização na nuvem Microsoft e contém identidades, usuários, grupos e políticas. Uma empresa que adota ou recebe esse ambiente dedicado.

Dentro do tenant, cada assinatura funciona como contêiner de cobrança e limite de custos, cotas e acesso. Um tenant pode ter várias assinaturas. Cada assinatura contém grupos de recursos, que organizam ativos relacionados e permitem aplicar permissões e políticas em conjunto.

Um recurso é um objeto individual, como uma conta de armazenamento, banco de dados ou recurso do Foundry. Ele possui tipo, nome e ID exclusivos, configurações e controles de acesso opcionais. O tipo, como Microsoft./storageAccounts, define capacidades e comportamento; região, camada de desempenho, permissões e segurança são escolhas de configuração.

Hierarquia aninhada de tenant, assinatura, grupo de recursos e recursos.
A estrutura separa responsabilidades, organiza custos e simplifica governança, políticas, monitoramento e automação.

4. Portal do e implantação programática

O , disponível em portal..com, centraliza a administração dos serviços. Nele é possível criar e configurar recursos, acompanhar uso, desempenho e integridade, controlar identidades, funções e políticas, analisar custos e abrir experiências especializadas como .

Captura original da página inicial do portal do Microsoft Azure.
A captura real do portal foi preservada em PNG.
Captura original de um recurso do Microsoft Foundry no portal do Microsoft Azure.
Cada recurso pode ser aberto no painel Todos os recursos para consultar e alterar suas propriedades.

A mesma infraestrutura pode ser criada com código, , scripts e modelos. A implantação programática reproduz ambientes, reduz erros manuais e torna configurações complexas mais rápidas, confiáveis e fáceis de manter.

5. Segurança, identidade, rede e segredos

Segurança e conectividade formam a base de uma aplicação de IA. oferece identidade, controle de acesso e isolamento de rede por padrão. autentica pessoas e serviços, enquanto o limita quem pode acessar implantações de modelos, recursos e dados.

Segredo é qualquer valor confidencial que concede acesso, como chave de , cadeia de conexão, ou senha. Uma chave costuma ser uma sequência aleatória usada para autenticar a chamada a um . Esses valores devem ficar no , não no código nem em um repositório GitHub.

Aplicação usando identidade gerenciada para obter uma chave no Cofre de Chaves e chamar um endpoint.
A aplicação recupera o segredo em tempo de execução e o utiliza para autenticar a solicitação.
  1. A aplicação chama o do modelo.
  2. A solicitação apresenta uma chave ou .
  3. A chave fica armazenada como segredo no .
  4. Uma permite recuperá-la com segurança em tempo de execução.

O conjunto de proteção inclui identidade, segredos, dados, conformidade, detecção de ameaças, monitoramento e firewalls. Os serviços de rede mantêm comunicação privada, eficiente e confiável em ambientes de nuvem e híbridos.

6. Hospedagem e escalabilidade

Uma aplicação executa em um host. Na nuvem, esse host pode ser uma Máquina Virtual que fornece CPU, memória e rede. Para cargas em contêiner, o orquestra grandes conjuntos de contêineres. O hospeda aplicações web, e trabalhos em segundo plano, acelerando a entrega sem exigir administração direta de toda a infraestrutura.

Escalar significa ajustar a capacidade manual ou automaticamente. Escala horizontal adiciona ou remove instâncias, isto é, cópias simultâneas da aplicação. Escala vertical aumenta ou reduz CPU e memória de uma instância. pode reagir a utilização de CPU, quantidade de solicitações ou métricas personalizadas.

Comparação entre escala horizontal e vertical para aplicações hospedadas.
e oferecem caminhos diferentes para hospedar e dimensionar cargas.

7. de dados para aplicações de IA

Aplicações de IA mantêm dados com finalidades distintas: treinamento, entradas de inferência em tempo real, previsões e respostas, estado de usuários, configurações, e telemetria, além de informações de autenticação e autorização.

Persistência permite aprender, operar, personalizar, analisar, melhorar a qualidade e depurar. O atende cargas críticas; armazena dados distribuídos globalmente em tempo real; oferece uma base relacional escalável para soluções inteligentes.

Tipos de dados de IA ligados a três opções de banco de dados do Azure.
A escolha do armazenamento depende do formato, da escala, da distribuição e da consistência necessárias.

8. como plataforma unificada

é uma plataforma como serviço empresarial para criar, implantar e administrar aplicações e agentes de IA. Ela reúne modelos, orquestração de agentes, monitoramento, governança, infraestrutura de produção e segurança em uma experiência unificada.

Desenvolvedores podem escolher modelos, construir agentes, conectá-los a ferramentas e integrar conhecimento corporativo pelo IQ do Foundry. O resultado aproveita computação, rede, identidade e segurança do .

Microsoft Foundry reunindo modelos, agentes, ferramentas e conhecimento sobre serviços do Azure.
A plataforma organiza ativos e capacidades de IA sem substituir a infraestrutura do .

9. Catálogo de modelos, implantação e governança

O oferece milhares de modelos próprios, de parceiros e de código aberto. Entre os exemplos estão a família GPT-5 hospedada no — GPT-5, GPT-5-mini, GPT-5-nano, GPT-5-chat e GPT-5.2-chat — e modelos da Anthropic, como Claude Opus 4.6/4.5 e Sonnet, além de Mistral, Cohere, Meta LLaMA, DeepSeek, Grok da xAI, Black Forest Labs e modelos controlados do Hugging Face.

Playgrounds e placares permitem comparar alternativas antes da implantação. O ciclo inclui escolha de região, tipos Standard, Provisionado e , controle de versão, governança de IA Responsável e .

Captura original do catálogo e dos detalhes de um modelo no Microsoft Foundry.
O catálogo permite explorar, comparar e implantar modelos.

10. Agentes, Ferramentas Foundry e IQ do Foundry

A abordagem orientada a agentes permite criar sistemas capazes de raciocinar, chamar ferramentas, consultar dados e automatizar fluxos. O Serviço de Agente do Foundry coordena mensagens, execução de ferramentas, segurança e observabilidade. Fluxos low-code e code-first podem formar sistemas multiagentes ligados a documentos, conjuntos de dados, índices e sistemas externos como e .

Ferramentas Foundry oferecem mais de uma dezena de capacidades. analisa imagens; resume e classifica texto ou extrai frases-chave; converte voz e texto; processa documentos. Elas podem ser usadas isoladamente ou em conjunto em aplicações web e móveis.

O IQ do Foundry cria uma camada de conhecimento com permissões sobre , SharePoint, OneLake e web pública. Ele automatiza indexação, divisão em trechos, embeddings e . A recuperação agêntica divide perguntas em subconsultas, pesquisa fontes em paralelo e devolve evidências com citações, respeitando permissões e rótulos de confidencialidade do .

11. Recursos, projetos e portal do Foundry

Um recurso do Foundry é o recurso que fornece hospedagem de modelos, Serviço de Agente do Foundry, governança de implantação, observabilidade, limites de segurança, cotas e controles operacionais. Dentro dele, projetos funcionam como espaços de trabalho para agentes, avaliações, arquivos, conjuntos de dados, índices vetoriais, fluxos, conexões e configurações específicas.

Uma equipe pode compartilhar um recurso e separar casos de uso em vários projetos. O recurso pode ser criado pelo , pelo portal do ou programaticamente.

Um recurso do Foundry contendo vários projetos e ativos.
O recurso define a plataforma e os limites; cada projeto organiza uma solução específica.
Captura original da página inicial do novo portal do Microsoft Foundry.
O novo portal concentra modelos, agentes e operações; a interface clássica continua disponível para outros tipos de recurso.
Captura original do início rápido e do assistente Ask AI no Microsoft Foundry.
Ask AI ajuda com documentação, modelos, implantação, cotas, monitoramento e avaliações; ações sobre recursos são apresentadas para revisão.

O novo portal busca simplificar aplicações multiagentes; somente projetos do Foundry aparecem nessa experiência, e o usuário pode alternar para a interface clássica. Ask AI usa subagentes especializados para responder, diagnosticar, comparar modelos e auxiliar tarefas.

12. Do Playground à aplicação cliente

  1. Entrar no portal do com uma assinatura e criar um projeto.
  2. Escolher um modelo no Catálogo de Modelos e implantá-lo.
  3. Testar prompts, respostas e parâmetros no Playground.
  4. Usar a implantação configurada em uma aplicação cliente própria.
Captura original de um modelo testado no Playground do Microsoft Foundry.
O Playground permite experimentar o comportamento antes de integrar o .

A aplicação cliente é o programa com que a pessoa interage no navegador, telefone, computador ou linha de comando. Ela apresenta a interface, coleta texto, voz ou imagens, forma o prompt ou requisição, envia ao e exibe o resultado.

O servidor é a implantação do modelo. Ele recebe o prompt, executa inferência, aplica instruções de sistema, segurança e contexto e retorna texto, imagem, áudio ou estruturado. A lógica cliente processa e transforma o resultado para a experiência final.

Cliente enviando uma requisição ao endpoint do modelo e recebendo uma resposta.
A interação cliente-servidor separa interface e lógica da execução do modelo.

13. , e SDKs

Modelos e agentes hospedados no Foundry são consumidos como pela internet. Um é o endereço exclusivo que serve de entrada ao serviço. Interfaces definem os formatos aceitos. O acesso exige chave de ou que confirme credenciais válidas do .

de projeto manipulam o projeto e seus recursos; de modelo recebem prompts para uma implantação. A página de detalhes do Playground informa o endereço e as credenciais necessárias.

Captura original da página de detalhes de uma implantação e de seu endpoint.
de projeto e modelo conectam aplicações aos recursos hospedados.
curl -X POST https://SEU-RECURSO.services.ai.azure.com/api/projects/SEU-PROJETO/openai/responses?api-version=2025-11-15-preview \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $AUTH_TOKEN" \
  -d '{"model":"gpt-4.1-mini","input":"O que é uma aplicação de IA?"}'

A requisição possui cabeçalhos com autenticação e formato e um corpo com o prompt. A resposta também traz cabeçalhos e , incluindo status, modelo, função assistant e conteúdo de saída. Desenvolvedores podem chamar diretamente, mas SDKs de Python, JavaScript e C# abstraem a criação dessas solicitações.

14. Exercício e avaliação

No exercício, o estudante cria e explora um projeto do , examina modelos generativos e ferramentas como fala e conecta uma aplicação cliente ao projeto para executar cargas comuns. É necessária uma assinatura ; uma nova conta pode incluir créditos iniciais por 30 dias.

Perguntas reescritas

  1. IA e ML são sinônimos, ou IA é o objetivo amplo enquanto ML aprende padrões de dados para alcançá-lo?
  2. funciona separado do , substitui o ou usa seus recursos de computação, rede, identidade e segurança?
  3. Qual relação correta existe entre , chave, segredo e ?
  4. A aplicação cliente hospeda o modelo ou é o programa que coleta entrada, chama o e apresenta a resposta?

Gabarito comentado

  • IA é o objetivo abrangente; aprendizado de máquina é uma abordagem baseada em dados usada para construí-la.
  • Foundry é executado sobre e utiliza sua infraestrutura e seus recursos.
  • O é a da implantação; a chave autentica a chamada e deve ser protegida como segredo no .
  • O cliente é a aplicação web, móvel, desktop ou CLI que envia a solicitação e mostra o resultado.

15. Resumo do capítulo

  • Modelos realizam inferência, mas aplicações de IA também dependem de segurança, rede, computação, dados, lógica e interface.
  • organiza recursos por tenant, assinatura, grupo de recursos e recurso e permite gestão visual ou programática.
  • reúne modelos, agentes, ferramentas, conhecimento, monitoramento e governança sobre o .
  • Recursos fornecem a plataforma; projetos organizam ativos e casos de uso.
  • Clientes chamam protegidos e podem usar SDKs para simplificar a integração.
  • A combinação de infraestrutura escalável, controles empresariais e catálogo pronto acelera aplicações generativas e agentes responsáveis.