Chame um modelo no AI Inference a partir de uma function
Chame um modelo de chat no AI Inference a partir de uma function com Azion.AI.run e devolva a resposta do modelo à requisição que chegou à function.
Você chama um modelo de chat no AI Inference a partir de uma function com o binding Azion.AI.run, pelo Azion Console ou pela Azion CLI. Para transformar texto em vetores com um modelo de embedding, consulte Gere embeddings de documentos em uma tabela vetorial com AI Inference.
A function envia um id de modelo e um body de requisição, espera o modelo e lê o texto gerado na resposta. A Azion não emite credencial para a chamada, então qualquer verificação de quem pode chegar ao modelo é código na function, antes da chamada.
Pré-requisitos
- Uma aplicação com o Application Accelerator ativado, que o behavior Run Function exige. Para criar uma, consulte Primeiros passos com Applications.
- O id do modelo a chamar, copiado da página dele em Modelos de AI. Os ids não seguem uma única forma, então um id derivado do nome do modelo pode estar errado.
- A Azion CLI instalada e autorizada, para o procedimento pela CLI.
Com azion dev, Azion.AI é undefined, e uma chamada a Azion.AI.run lança TypeError: Cannot read properties of undefined (reading 'run'). Teste a chamada quando a function estiver rodando na aplicação.
Os exemplos chamam Qwen/Qwen3-30B-A3B-Instruct-2507-FP8 a partir de uma function chamada ai-chat, em POST /api/chat de www.example.com. Substitua-os pelos seus valores.
Crie a function que chama o modelo
Azion.AI.run recebe o id do modelo como primeiro argumento e o body da requisição como segundo, sem um campo model. O body exige messages, e cada mensagem carrega um role system, user ou assistant. max_tokens limita o que o modelo gera, e stream: false devolve a resposta inteira.
A function recusa um prompt vazio antes da chamada, porque cada chamada executa o modelo. Ela lê o texto com optional chaining em todos os níveis, então uma resposta sem algum nível resulta em undefined, e a function responde 502 em vez de falhar dentro da leitura:
Para criar a function pelo Azion Console:
Acesse Azion Console > Products Menu > Libraries > Functions.
Digite ai-chat.
A function é salva e fica disponível para ser instanciada em uma aplicação.
A conta tem uma function ai-chat que envia cada prompt ao modelo e devolve a resposta do modelo.
Execute a function e leia a resposta
A function roda quando uma instância dela está na aplicação e uma regra seleciona essa instância. Crie a instância como Primeiros passos com Functions descreve, com o nome ai-chat. Crie a regra como Execute uma função em um caminho e reverta-o descreve, com o caminho /api/chat e o método POST. Regras novas podem levar alguns minutos para se propagar.
Para enviar um prompt à function:
A function devolve o objeto chat.completion do modelo. O texto gerado fica em choices[0].message.content:
usage.prompt_tokens conta os tokens lidos da requisição, e usage.total_tokens soma a eles os tokens gerados. Leia os dois depois de uma mudança no prompt para ver o que a mudança consome. Uma requisição com prompt vazio responde 400 e não executa nenhum modelo.
Um POST para /api/chat devolve uma resposta que o modelo gerou no AI Inference.