# Modelos de AI

[AI Inference](/pt-br/documentacao/plataforma/ai-inference/) executa os modelos desta página. Você seleciona um modelo pelo id, uma string à qual o modelo responde, e não pelo nome sob o qual ele aparece listado. Cada linha do catálogo carrega esse id ao lado das capacidades que a página do modelo declara para si. Para conhecer o corpo da requisição em que o id viaja, consulte [Invocação de modelos](/pt-br/documentacao/plataforma/ai-inference/invocacao-de-modelos/).

## Catálogo de modelos

Cada linha é um modelo, e o nome do modelo leva à página do modelo, que traz um exemplo de requisição. A coluna Categoria indica LLM para um large language model, VLM para um vision language model, Embedding ou Reranker. Um traço significa que a página do modelo não declara valor para aquela capacidade.

| Modelo                                                                                          | Categoria | Entrada        | Comprimento de contexto | Tamanho         | Chamada de ferramentas | LoRA | Id do modelo                                       |
| ----------------------------------------------------------------------------------------------- | --------- | -------------- | ----------------------- | --------------- | ---------------------- | ---- | -------------------------------------------------- |
| [Mistral 3 Small (24B AWQ)](/pt-br/documentacao/plataforma/ai-inference/mistral-3-small/)       | LLM       | Texto          | 32k tokens              | 24B parâmetros  | Sim                    | Não  | `casperhansen-mistral-small-24b-instruct-2501-awq` |
| [BAAI/bge-reranker-v2-m3](/pt-br/documentacao/plataforma/ai-inference/baai-bge-reranker-v2-m3/) | Reranker  | Texto          | 8k tokens               | 568M parâmetros | —                      | Não  | `baai-bge-reranker-v2-m3`                          |
| [InternVL3](/pt-br/documentacao/plataforma/ai-inference/internvl3/)                             | VLM       | Texto e imagem | 16k tokens              | 1B parâmetros   | Não                    | Não  | `opengvlab-internvl3-1b-instruct`                  |
| [Qwen2.5 VL AWQ 3B](/pt-br/documentacao/plataforma/ai-inference/qwen-2-5-vl-3b/)                | VLM       | Texto e imagem | 32k tokens              | 3B parâmetros   | Sim                    | Sim  | `qwen-qwen25-vl-3b-instruct-awq`                   |
| [Qwen2.5 VL AWQ 7B](/pt-br/documentacao/plataforma/ai-inference/qwen-2-5-vl-7b/)                | VLM       | Texto e imagem | 32k tokens              | 7B parâmetros   | Sim                    | Sim  | `qwen-qwen25-vl-7b-instruct-awq`                   |
| [Qwen3 30B A3B Instruct 2507 FP8](/pt-br/documentacao/plataforma/ai-inference/qwen3-30ba3b/)    | LLM       | Texto          | 64k tokens              | 30B parâmetros  | Sim                    | Sim  | `Qwen/Qwen3-30B-A3B-Instruct-2507-FP8`             |
| [Qwen3 Embedding 4B](/pt-br/documentacao/plataforma/ai-inference/qwen3-embedding-4b/)           | Embedding | Texto          | 32k tokens              | 4B parâmetros   | —                      | —    | `Qwen/Qwen3-Embedding-4B`                          |
| [Nanonets-OCR-s](/pt-br/documentacao/plataforma/ai-inference/nanonets-ocr-s/)                   | —         | Texto e imagem | 32k tokens              | —               | —                      | —    | `nanonets/Nanonets-OCR-s`                          |
| [GPT-OSS 20B](/pt-br/documentacao/plataforma/ai-inference/gpt-oss-20b/)                         | LLM       | Texto          | 131k tokens             | 20B parâmetros  | Sim                    | Não  | `gpt-oss-20b`                                      |

---

## Ids de modelo

Um id de modelo é a string que seleciona o modelo: o primeiro argumento de `Azion.AI.run` dentro de uma [função](/pt-br/documentacao/plataforma/functions/) e o campo `model` do corpo de uma requisição HTTP. Os ids não compartilham uma forma única. Alguns são minúsculos e separados por hífen, sem barra, e outros carregam um prefixo de publicador e capitalização mista. Copie um id da tabela caractere por caractere, em vez de derivá-lo do nome do modelo.

---

## Recursos relacionados

- [Invocação de modelos](/pt-br/documentacao/plataforma/ai-inference/invocacao-de-modelos.md): O corpo da requisição em que um id viaja e as duas interfaces que o carregam.
- [AI Inference](/pt-br/documentacao/plataforma/ai-inference.md): O produto que executa os modelos deste catálogo.
- [LoRA Fine-Tune](/pt-br/documentacao/plataforma/ai-inference/lora-fine-tune.md): A extensão do AI Inference por trás da coluna LoRA.
- [Vector Search](/pt-br/documentacao/plataforma/sql-database/vector-search.md): Onde os vetores que um modelo de embedding retorna são armazenados e consultados.
- [Functions](/pt-br/documentacao/plataforma/functions.md): O produto cujo binding de runtime recebe os ids desta tabela.
- [Glossário](/pt-br/documentacao/plataforma/ai-inference/glossario.md): Onde id de modelo, LoRA Fine-Tune e o restante do vocabulário do AI Inference são definidos.
