Resuma texto com AI Inference e armazene o resumo em cache
Resuma um texto com um modelo do catálogo do AI Inference a partir de uma function e devolva o mesmo resumo da Cache API para o mesmo texto.
Você resume um texto com um modelo do catálogo do AI Inference a partir de uma function e armazena cada resumo com a Cache API sob o SHA-256 do texto, então um texto repetido é respondido sem nenhuma chamada ao modelo. Para chamar um modelo de chat sem cache, consulte Chame um modelo no AI Inference a partir de uma function.
Pré-requisitos
- Uma aplicação com o Application Accelerator ativado, que o behavior Run Function exige. Para criar uma, consulte Primeiros passos com Applications.
- O id do modelo a chamar, copiado da página dele em Modelos de AI.
A Cache API não é definida no azion dev, então teste a function depois que ela estiver em execução na aplicação.
Os exemplos usam /api/summarize para a rota, ai-summarize para a function e a sua instância e www.example.com para o domínio em que a sua aplicação responde. Substitua-os pelos seus valores.
Crie a function de resumo
A function recusa um texto ausente com 400 e um texto com mais de 20.000 caracteres com 413 antes de qualquer chamada ao modelo. Ela procura o SHA-256 do texto no cache ai-summarize, chama o modelo quando não encontra e armazena o resumo por um dia.
Crie uma function chamada ai-summarize com este código:
Para criar a function e a sua instância, siga Primeiros passos com Functions com o nome ai-summarize e dê à instância na sua aplicação o nome ai-summarize, sem Args.
A aplicação tem uma instância ai-summarize que retorna o resumo de um texto, a partir do cache quando o mesmo texto foi resumido no último dia.
O caso de uso Adicionar funcionalidades de IA a aplicações existentes usa os valores deste exemplo.
Execute a function na rota
A regra corresponde exatamente a /api/summarize, então nenhum outro caminho da sua aplicação executa a function, e é executada na Request Phase, porque a function produz a resposta inteira.
Crie a regra como mostra Adicione a regra que executa a função, com o nome ai - summarize, o critério ${uri} is equal /api/summarize e o behavior Run Function selecionando a instância ai-summarize.
Um POST para /api/summarize no seu domínio executa a function, e todos os outros caminhos mantêm as regras que tinham. Uma regra nova leva alguns minutos para se propagar.
Confirme que a rota retorna um resumo
Para enviar um texto à rota:
A resposta traz x-summary-cache: miss e um corpo JSON com summary. Envie a mesma requisição de novo: a resposta traz x-summary-cache: hit e o mesmo summary. Envie {"text":""}: a resposta é 400 com text is required, que a function retorna antes da chamada ao modelo.
A rota retorna o resumo de um texto e responde o mesmo texto a partir do cache por um dia.
Estas verificações confirmam o caso de uso Adicionar funcionalidades de IA a aplicações existentes.
No caso de uso Adicionar funcionalidades de IA a aplicações existentes, espere:
- A rota é executada apenas no seu caminho. Qualquer outro caminho da sua aplicação responde como respondia antes de a regra existir.