Azure e Microsoft Foundry: aplicações, agentes e endpoints
Infraestrutura de nuvem, segurança, hospedagem, dados, modelos, projetos, aplicações clientes, REST e SDKs
Tempo de estudo sugerido: 45 minutos • Nível iniciante • Conteúdo reescrito a partir dos objetivos do Microsoft Learn
Por João Ricardo Dutra••Conteúdo autoral completo
1. Aplicações de IA e inferência
Inteligência artificial descreve sistemas capazes de realizar tarefas normalmente associadas à inteligência humana, como raciocinar, resolver problemas, perceber o ambiente e compreender linguagem. Uma aplicação de IA incorpora técnicas de visão, fala, extração de informações ou outras áreas para entender entradas, aprender padrões e produzir respostas mais adaptáveis que as de um programa tradicional.
O motor dessa aplicação é um modelo de aprendizado de máquina: um sistema matemático treinado para reconhecer padrões e prever ou gerar saídas. Quando recebe um dado novo, o modelo aplica o que aprendeu; esse uso do modelo treinado é chamado inferência.
Aplicações orientadas por modelo processam entradas e retornam texto, imagens, decisões ou outros resultados.
Elas são dinâmicas: retreinamento ou ajuste fino pode melhorar o comportamento ao longo do tempo.
Na saúde, analisam radiografias e ressonâncias; em finanças, detectam fraude em transações; no varejo, personalizam recomendações.
Na manufatura, antecipam falhas de equipamentos; na educação, adaptam conteúdo, ritmo e feedback ao estudante.
O modelo não forma a solução inteira. Uma aplicação empresarial também precisa de segurança, rede, hospedagem, armazenamento, lógica e interface. fornece essa infraestrutura, e concentra os recursos de desenvolvimento e operação de IA.
2. e as quatro categorias fundamentais
é uma plataforma de nuvem: um conjunto de serviços consumidos pela internet, sem que a organização precise comprar e manter todo o hardware físico. Aplicações modernas podem executar código, armazenar dados e crescer em datacenters globais com segurança e confiabilidade.
As categorias trabalham juntas para sustentar aplicações e agentes de IA.
Categorias centrais do .
Categoria
Função
Computação
Executa programas e cargas de trabalho em capacidade que pode aumentar ou diminuir.
Mantém arquivos, bancos de dados, imagens, backups e outros dados acessíveis.
Rede
Conecta recursos entre si, à internet e ao ambiente da organização com eficiência e segurança.
Serviços de Aplicativo
Oferece plataformas prontas para criar, hospedar e executar aplicações sem administrar os servidores subjacentes.
3. Tenant, assinatura, grupo de recursos e recurso
A administração do segue uma hierarquia. O tenant é o espaço isolado da organização na nuvem Microsoft e contém identidades, usuários, grupos e políticas. Uma empresa que adota ou recebe esse ambiente dedicado.
Dentro do tenant, cada assinatura funciona como contêiner de cobrança e limite de custos, cotas e acesso. Um tenant pode ter várias assinaturas. Cada assinatura contém grupos de recursos, que organizam ativos relacionados e permitem aplicar permissões e políticas em conjunto.
Um recurso é um objeto individual, como uma conta de armazenamento, banco de dados ou recurso do Foundry. Ele possui tipo, nome e ID exclusivos, configurações e controles de acesso opcionais. O tipo, como Microsoft./storageAccounts, define capacidades e comportamento; região, camada de desempenho, permissões e segurança são escolhas de configuração.
A estrutura separa responsabilidades, organiza custos e simplifica governança, políticas, monitoramento e automação.
4. Portal do e implantação programática
O , disponível em portal..com, centraliza a administração dos serviços. Nele é possível criar e configurar recursos, acompanhar uso, desempenho e integridade, controlar identidades, funções e políticas, analisar custos e abrir experiências especializadas como .
A captura real do portal foi preservada em PNG.Cada recurso pode ser aberto no painel Todos os recursos para consultar e alterar suas propriedades.
A mesma infraestrutura pode ser criada com código, , scripts e modelos. A implantação programática reproduz ambientes, reduz erros manuais e torna configurações complexas mais rápidas, confiáveis e fáceis de manter.
5. Segurança, identidade, rede e segredos
Segurança e conectividade formam a base de uma aplicação de IA. oferece identidade, controle de acesso e isolamento de rede por padrão. autentica pessoas e serviços, enquanto o limita quem pode acessar implantações de modelos, recursos e dados.
Segredo é qualquer valor confidencial que concede acesso, como chave de , cadeia de conexão, ou senha. Uma chave costuma ser uma sequência aleatória usada para autenticar a chamada a um . Esses valores devem ficar no , não no código nem em um repositório GitHub.
A aplicação recupera o segredo em tempo de execução e o utiliza para autenticar a solicitação.
A aplicação chama o do modelo.
A solicitação apresenta uma chave ou .
A chave fica armazenada como segredo no .
Uma permite recuperá-la com segurança em tempo de execução.
O conjunto de proteção inclui identidade, segredos, dados, conformidade, detecção de ameaças, monitoramento e firewalls. Os serviços de rede mantêm comunicação privada, eficiente e confiável em ambientes de nuvem e híbridos.
6. Hospedagem e escalabilidade
Uma aplicação executa em um host. Na nuvem, esse host pode ser uma Máquina Virtual que fornece CPU, memória e rede. Para cargas em contêiner, o orquestra grandes conjuntos de contêineres. O hospeda aplicações web, e trabalhos em segundo plano, acelerando a entrega sem exigir administração direta de toda a infraestrutura.
Escalar significa ajustar a capacidade manual ou automaticamente. Escala horizontal adiciona ou remove instâncias, isto é, cópias simultâneas da aplicação. Escala vertical aumenta ou reduz CPU e memória de uma instância. pode reagir a utilização de CPU, quantidade de solicitações ou métricas personalizadas.
e oferecem caminhos diferentes para hospedar e dimensionar cargas.
7. de dados para aplicações de IA
Aplicações de IA mantêm dados com finalidades distintas: treinamento, entradas de inferência em tempo real, previsões e respostas, estado de usuários, configurações, e telemetria, além de informações de autenticação e autorização.
Persistência permite aprender, operar, personalizar, analisar, melhorar a qualidade e depurar. O atende cargas críticas; armazena dados distribuídos globalmente em tempo real; oferece uma base relacional escalável para soluções inteligentes.
A escolha do armazenamento depende do formato, da escala, da distribuição e da consistência necessárias.
8. como plataforma unificada
é uma plataforma como serviço empresarial para criar, implantar e administrar aplicações e agentes de IA. Ela reúne modelos, orquestração de agentes, monitoramento, governança, infraestrutura de produção e segurança em uma experiência unificada.
Desenvolvedores podem escolher modelos, construir agentes, conectá-los a ferramentas e integrar conhecimento corporativo pelo IQ do Foundry. O resultado aproveita computação, rede, identidade e segurança do .
A plataforma organiza ativos e capacidades de IA sem substituir a infraestrutura do .
9. Catálogo de modelos, implantação e governança
O oferece milhares de modelos próprios, de parceiros e de código aberto. Entre os exemplos estão a família GPT-5 hospedada no — GPT-5, GPT-5-mini, GPT-5-nano, GPT-5-chat e GPT-5.2-chat — e modelos da Anthropic, como Claude Opus 4.6/4.5 e Sonnet, além de Mistral, Cohere, Meta LLaMA, DeepSeek, Grok da xAI, Black Forest Labs e modelos controlados do Hugging Face.
Playgrounds e placares permitem comparar alternativas antes da implantação. O ciclo inclui escolha de região, tipos Standard, Provisionado e , controle de versão, governança de IA Responsável e .
O catálogo permite explorar, comparar e implantar modelos.
10. Agentes, Ferramentas Foundry e IQ do Foundry
A abordagem orientada a agentes permite criar sistemas capazes de raciocinar, chamar ferramentas, consultar dados e automatizar fluxos. O Serviço de Agente do Foundry coordena mensagens, execução de ferramentas, segurança e observabilidade. Fluxos low-code e code-first podem formar sistemas multiagentes ligados a documentos, conjuntos de dados, índices e sistemas externos como e .
Ferramentas Foundry oferecem mais de uma dezena de capacidades. analisa imagens; resume e classifica texto ou extrai frases-chave; converte voz e texto; processa documentos. Elas podem ser usadas isoladamente ou em conjunto em aplicações web e móveis.
O IQ do Foundry cria uma camada de conhecimento com permissões sobre , SharePoint, OneLake e web pública. Ele automatiza indexação, divisão em trechos, embeddings e . A recuperação agêntica divide perguntas em subconsultas, pesquisa fontes em paralelo e devolve evidências com citações, respeitando permissões e rótulos de confidencialidade do .
11. Recursos, projetos e portal do Foundry
Um recurso do Foundry é o recurso que fornece hospedagem de modelos, Serviço de Agente do Foundry, governança de implantação, observabilidade, limites de segurança, cotas e controles operacionais. Dentro dele, projetos funcionam como espaços de trabalho para agentes, avaliações, arquivos, conjuntos de dados, índices vetoriais, fluxos, conexões e configurações específicas.
Uma equipe pode compartilhar um recurso e separar casos de uso em vários projetos. O recurso pode ser criado pelo , pelo portal do ou programaticamente.
O recurso define a plataforma e os limites; cada projeto organiza uma solução específica.O novo portal concentra modelos, agentes e operações; a interface clássica continua disponível para outros tipos de recurso.Ask AI ajuda com documentação, modelos, implantação, cotas, monitoramento e avaliações; ações sobre recursos são apresentadas para revisão.
O novo portal busca simplificar aplicações multiagentes; somente projetos do Foundry aparecem nessa experiência, e o usuário pode alternar para a interface clássica. Ask AI usa subagentes especializados para responder, diagnosticar, comparar modelos e auxiliar tarefas.
12. Do Playground à aplicação cliente
Entrar no portal do com uma assinatura e criar um projeto.
Escolher um modelo no Catálogo de Modelos e implantá-lo.
Testar prompts, respostas e parâmetros no Playground.
Usar a implantação configurada em uma aplicação cliente própria.
O Playground permite experimentar o comportamento antes de integrar o .
A aplicação cliente é o programa com que a pessoa interage no navegador, telefone, computador ou linha de comando. Ela apresenta a interface, coleta texto, voz ou imagens, forma o prompt ou requisição, envia ao e exibe o resultado.
O servidor é a implantação do modelo. Ele recebe o prompt, executa inferência, aplica instruções de sistema, segurança e contexto e retorna texto, imagem, áudio ou estruturado. A lógica cliente processa e transforma o resultado para a experiência final.
A interação cliente-servidor separa interface e lógica da execução do modelo.
13. , e SDKs
Modelos e agentes hospedados no Foundry são consumidos como pela internet. Um é o endereço exclusivo que serve de entrada ao serviço. Interfaces definem os formatos aceitos. O acesso exige chave de ou que confirme credenciais válidas do .
de projeto manipulam o projeto e seus recursos; de modelo recebem prompts para uma implantação. A página de detalhes do Playground informa o endereço e as credenciais necessárias.
de projeto e modelo conectam aplicações aos recursos hospedados.
curl -X POST https://SEU-RECURSO.services.ai.azure.com/api/projects/SEU-PROJETO/openai/responses?api-version=2025-11-15-preview \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AUTH_TOKEN" \
-d '{"model":"gpt-4.1-mini","input":"O que é uma aplicação de IA?"}'
A requisição possui cabeçalhos com autenticação e formato e um corpo com o prompt. A resposta também traz cabeçalhos e , incluindo status, modelo, função assistant e conteúdo de saída. Desenvolvedores podem chamar diretamente, mas SDKs de Python, JavaScript e C# abstraem a criação dessas solicitações.
14. Exercício e avaliação
No exercício, o estudante cria e explora um projeto do , examina modelos generativos e ferramentas como fala e conecta uma aplicação cliente ao projeto para executar cargas comuns. É necessária uma assinatura ; uma nova conta pode incluir créditos iniciais por 30 dias.