# InternVL3

**InternVL3** é um vision language model com 1 bilhão de parâmetros, construído para tarefas que incluem agentes GUI, análise de imagem industrial e percepção de visão 3D. Ele lê texto e imagens e retorna texto. [AI Inference](/pt-br/documentacao/plataforma/ai-inference/) executa o modelo sob o id `opengvlab-internvl3-1b-instruct`.

## Detalhes do modelo

O id do modelo é a string que seleciona este modelo, e é o primeiro argumento que `Azion.AI.run` recebe. O repositório no HuggingFace contém o model card.

| Detalhe                        | Valor                                                                                     |
| ------------------------------ | ----------------------------------------------------------------------------------------- |
| Nome do modelo                 | InternVL3                                                                                 |
| Versão                         | Instruct 1B                                                                               |
| Categoria do modelo            | Vision-Language Model (VLM)                                                               |
| Id do modelo                   | `opengvlab-internvl3-1b-instruct`                                                         |
| Tamanho                        | 1B parâmetros                                                                             |
| Modelo no HuggingFace          | [OpenGVLab/InternVL3-1B-Instruct](https://huggingface.co/OpenGVLab/InternVL3-1B-Instruct) |
| Endpoint compatível com OpenAI | [OpenAI Chat API](https://developers.openai.com/api/reference/overview)                   |
| Licença                        | [Apache 2.0](https://choosealicense.com/licenses/apache-2.0/)                             |

## Capacidades

Estes valores pertencem ao modelo e não fazem parte do corpo da requisição. Para os campos que toda requisição de chat aceita, com seus tipos, padrões e limites, consulte [Invocação de modelos](/pt-br/documentacao/plataforma/ai-inference/invocacao-de-modelos/).

| Capacidade              | Valor          |
| ----------------------- | -------------- |
| Dados de entrada        | Texto e imagem |
| Comprimento de contexto | 16k tokens     |
| Chamada de ferramentas  | Não            |
| Suporta LoRA            | Não            |

---

## Uso

Uma [função](/pt-br/documentacao/plataforma/functions/) invoca o modelo com `Azion.AI.run`, passando o id como primeiro argumento e um corpo de requisição compatível com OpenAI como segundo. Os exemplos abaixo usam esse binding. Para enviar o mesmo corpo ao endpoint HTTP compatível com OpenAI, consulte [Invocação de modelos](/pt-br/documentacao/plataforma/ai-inference/invocacao-de-modelos/).

### Chat completion

Uma requisição de texto carrega uma mensagem de sistema e uma mensagem de usuário, cada uma com o seu conteúdo em uma string:

```ts
const modelResponse = await Azion.AI.run("opengvlab-internvl3-1b-instruct", {
  "stream": false,
  "messages": [
    { "role": "system", "content": "You are a helpful assistant." },
    { "role": "user", "content": "Name the European capitals." }
  ]
})
```

O modelo responde com uma entrada em `choices`, e o texto gerado fica em `choices[0].message.content`.

### Entrada multimodal

Uma imagem vai no mesmo array `messages` que o texto. A mensagem do usuário recebe o seu `content` como um array de partes em vez de uma string, e cada parte indica o seu `type` e carrega o campo que esse tipo usa:

```ts
const modelResponse = await Azion.AI.run("opengvlab-internvl3-1b-instruct", {
  "stream": false,
  "messages": [
    { "role": "system", "content": "You are a helpful assistant." },
    {
      "role": "user",
      "content": [
        { "type": "text", "text": "What is in this image?" },
        { "type": "image_url", "image_url": { "url": "https://example.com/image.jpg" } }
      ]
    }
  ]
})
```

O modelo lê a imagem naquela URL e responde sobre ela em `choices[0].message.content`. Para uma descrição campo a campo das partes que um array `content` aceita, consulte [Invocação de modelos](/pt-br/documentacao/plataforma/ai-inference/invocacao-de-modelos/).

---

## Recursos relacionados

- [Invocação de modelos](/pt-br/documentacao/plataforma/ai-inference/invocacao-de-modelos.md): Todos os campos que um corpo de requisição aceita, incluindo as partes de conteúdo que uma mensagem multimodal carrega.
- [Modelos de AI](/pt-br/documentacao/plataforma/ai-inference/modelos.md): Os outros modelos que AI Inference executa, e quais deles também leem imagens.
- [AI Inference](/pt-br/documentacao/plataforma/ai-inference.md): O produto que executa este modelo.
- [Functions](/pt-br/documentacao/plataforma/functions.md): O produto cujo runtime contém o binding que os exemplos desta página chamam.
- [Limites do AI Inference](/pt-br/documentacao/plataforma/ai-inference/limites.md): As condições em que Azion encerra ou desprovisiona um modelo.
- [Glossário](/pt-br/documentacao/plataforma/ai-inference/glossario.md): Onde id de modelo, comprimento de contexto e o restante do vocabulário do AI Inference são definidos.
