BAAI/bge-reranker-v2-m3
Ranqueie documentos em relação a uma consulta com BAAI/bge-reranker-v2-m3, um reranker multilíngue com 568M de parâmetros e 8k tokens de contexto.
BAAI/bge-reranker-v2-m3 é um modelo reranker multilíngue com 568 milhões de parâmetros. Ele lê uma consulta e um conjunto de textos e retorna uma pontuação de relevância para cada texto em relação a essa consulta. AI Inference executa o modelo sob o id baai-bge-reranker-v2-m3.
Detalhes do modelo
O id do modelo é a string que uma chamada passa para selecionar este modelo. O repositório no HuggingFace contém o model card.
| Detalhe | Valor |
|---|---|
| Nome do modelo | BAAI/bge-reranker-v2-m3 |
| Versão | Original |
| Categoria do modelo | Reranker |
| Id do modelo | baai-bge-reranker-v2-m3 |
| Tamanho | 568M parâmetros |
| Modelo no HuggingFace | BAAI/bge-reranker-v2-m3 |
| Licença | Apache 2.0 |
Capacidades
Estes valores descrevem o modelo e não são campos do corpo da requisição. Para os campos que uma requisição de reranking carrega, e seus tipos, consulte Invocação de modelos.
| Capacidade | Valor |
|---|---|
| Dados de entrada | Texto |
| Comprimento de contexto | 8k tokens |
| Suporta LoRA | Não |
Uso
Uma função invoca o modelo com Azion.AI.run, passando o id como primeiro argumento e o corpo da requisição como segundo. Este modelo não recebe um array messages: cada uma das duas operações abaixo tem o seu próprio corpo. Para enviar o mesmo corpo por HTTP, consulte Invocação de modelos.
Reranking
Uma requisição de reranking carrega a query e os documents a serem ranqueados em relação a ela:
O modelo retorna um array results ordenado do maior relevance_score para o menor, com uma entrada por documento, cada uma carregando a posição que o documento ocupava na requisição e o seu texto:
Pontuação
Uma requisição de pontuação carrega text_1 e o array text_2 que o modelo pontua em relação a ele:
A resposta carrega o mesmo array results, com uma entrada e uma relevance_score para cada texto em text_2.