Implante o template AI Inference Starter Kit
Implante o template AI Inference Starter Kit pelo Azion Console, depois atualize a função que ele instala e gerencie a aplicação que ele cria.
Você pode implantar o template AI Inference Starter Kit e gerenciar o que ele cria pelo Azion Console. O template cria uma aplicação com uma função e um domínio, e a função serve um endpoint compatível com OpenAI.
O guia Primeiros passos com AI Inference cobre a mesma implantação e acrescenta uma primeira requisição ao modelo.
Pré-requisitos
O template usa Application Accelerator, Functions e AI Inference, que podem gerar custos de uso. Para conhecer os valores, consulte Preços.
Implante o template
Para criar a aplicação, a função e o domínio a partir de um único template:
Acesse Azion Console e selecione + Create.
Selecione o template AI Inference Starter Kit.
Insira um nome para a aplicação.
Selecione Deploy.
Uma janela mostra os logs da implantação enquanto ela é executada. Quando ela termina, a página mostra informações sobre a aplicação e as opções para continuar.
A aplicação responde em um Workload Domain na forma xxxxxxxxxx.map.azionedge.net/ e serve um endpoint compatível com OpenAI nesse domínio. Para conhecer o caminho que uma requisição percorre do domínio até o modelo, consulte a arquitetura de Adicionar funcionalidades de IA a aplicações existentes.
Atualize a função
A função que o template instala contém a chamada ao modelo, e a página dela tem três abas:
- Main Settings renomeia a função e altera as configurações básicas dela.
- Code contém o código da função.
- Arguments define os argumentos que a função usa.
Para alterar a função:
Acesse Azion Console > Products menu > Functions.
Selecione a função que tem o mesmo nome da aplicação. A lista está em ordem alfabética, e a barra de busca a filtra apenas por Function Name.
Abra a aba que contém a configuração que você quer alterar.
Selecione Save.
A função tem as alterações que você salvou. Para conhecer todas as configurações que uma função tem, consulte Functions.
A aba Code abre em uma função pronta para ser executada. Ela recebe uma requisição POST, chama o modelo e retorna a resposta. A chamada abaixo define stream como false, então o modelo retorna a resposta inteira:
O modelo responde com uma entrada em choices, e o texto gerado fica em choices[0].message.content:
Este exemplo chama o modelo Qwen3. Para chamar outro modelo, altere o primeiro argumento de Azion.AI.run para o id dele, listado em Modelos de AI. O corpo também aceita stream, que transmite a resposta em vez de retorná-la inteira. Para conhecer todos os campos que o corpo aceita, consulte Invocação de modelos.
Antes de alterar a chamada, leia Boas práticas do AI Inference para conhecer os padrões de requisição que Azion recomenda, e Limites do AI Inference para conhecer as condições em que Azion encerra um modelo.
Gerencie a aplicação
A página da aplicação contém todas as configurações que a implantação criou, e você pode alterar qualquer uma delas. Para abri-la:
Acesse Azion Console > Products menu > Applications.
Selecione a aplicação que tem o nome que você inseriu durante a implantação. A lista está em ordem alfabética, e a barra de busca a filtra apenas por Application Name.
A página da aplicação abre nas configurações que você pode ajustar. Para saber o que cada configuração faz, consulte Primeiros passos com Applications.