# LoRA Fine-Tune

Low-Rank Adaptation (LoRA) adapta um modelo a uma tarefa com o treinamento de um conjunto pequeno de pesos adicionais, em vez de retreinar o modelo inteiro. **LoRA Fine-Tune** aplica esse método a modelos suportados na infraestrutura da Azion, como uma extensão de [AI Inference](/pt-br/documentacao/plataforma/ai-inference/). LoRA se aplica a alguns modelos e não a outros, e a página de cada modelo declara qual é o caso.

## Modelos suportados

A tabela lista todos os modelos que AI Inference executa, com o que a própria página do modelo declara sobre LoRA. Sim e Não repetem essa declaração. Um traço significa que a página não declara valor, o que não é o mesmo que um Não.

| Modelo                                                                                          | Suporta LoRA |
| ----------------------------------------------------------------------------------------------- | ------------ |
| [Mistral 3 Small (24B AWQ)](/pt-br/documentacao/plataforma/ai-inference/mistral-3-small/)       | Não          |
| [BAAI/bge-reranker-v2-m3](/pt-br/documentacao/plataforma/ai-inference/baai-bge-reranker-v2-m3/) | Não          |
| [InternVL3](/pt-br/documentacao/plataforma/ai-inference/internvl3/)                             | Não          |
| [Qwen2.5 VL AWQ 3B](/pt-br/documentacao/plataforma/ai-inference/qwen-2-5-vl-3b/)                | Sim          |
| [Qwen2.5 VL AWQ 7B](/pt-br/documentacao/plataforma/ai-inference/qwen-2-5-vl-7b/)                | Sim          |
| [Qwen3 30B A3B Instruct 2507 FP8](/pt-br/documentacao/plataforma/ai-inference/qwen3-30ba3b/)    | Sim          |
| [Qwen3 Embedding 4B](/pt-br/documentacao/plataforma/ai-inference/qwen3-embedding-4b/)           | —            |
| [Nanonets-OCR-s](/pt-br/documentacao/plataforma/ai-inference/nanonets-ocr-s/)                   | —            |
| [GPT-OSS 20B](/pt-br/documentacao/plataforma/ai-inference/gpt-oss-20b/)                         | Não          |

Para conhecer a categoria, o id, o comprimento do contexto e os tipos de entrada de um modelo desta tabela, consulte [Modelos de AI](/pt-br/documentacao/plataforma/ai-inference/modelos/).

---

## Relação com AI Inference

LoRA Fine-Tune é um produto próprio da Azion, e o produto que ele estende é AI Inference. AI Inference suporta LoRA por meio de um add-on, e a adaptação é executada na infraestrutura da Azion, sem infraestrutura para você provisionar ou gerenciar. Você é responsável pelos dados de treinamento, pelas entradas e saídas do modelo e pela licença de terceiros do modelo que você adapta.

---

## Métricas de cobrança

LoRA Fine-Tune é cobrado por duas métricas, Compute Time e Requests, e é medido separadamente de AI Inference. Compute Time é a duração da execução ativa em horas multiplicada pela memória alocada em gigabytes, expressa em GB-hora. Para conhecer a tarifa cobrada por cada métrica, consulte [Preços](/pt-br/documentacao/fundamentos/precos/#lora-fine-tune), que traz uma seção própria para LoRA Fine-Tune.

---

## Recursos relacionados

- [Modelos de AI](/pt-br/documentacao/plataforma/ai-inference/modelos.md): A categoria, o id, o comprimento do contexto e os tipos de entrada de todos os modelos que AI Inference executa.
- [AI Inference](/pt-br/documentacao/plataforma/ai-inference.md): O produto que LoRA Fine-Tune estende e que executa os modelos.
- [Como AI Inference funciona](/pt-br/documentacao/plataforma/ai-inference/como-funciona.md): O que executa um modelo e onde termina a parte da Azion em uma chamada de modelo.
- [Invocação de modelos](/pt-br/documentacao/plataforma/ai-inference/invocacao-de-modelos.md): O corpo da requisição e o binding pelos quais uma chamada a um modelo viaja.
- [Preços](/pt-br/documentacao/fundamentos/precos.md#lora-fine-tune): A tarifa cobrada pelo Compute Time e pelos Requests de LoRA Fine-Tune.
- [Suporte](/pt-br/documentacao/suporte.md): Onde perguntar o que esta página não declara sobre adaptar um modelo.
