Source: https://docs.aivax.net/pt-br/docs/rag/reflex.html

# Reflex

Reflex é a busca sem coleção da AIVAX para RAG. Envie uma consulta junto com strings de documentos candidatos e receba os itens mais relevantes em ordem classificada — sem indexação, armazenamento ou manutenção de uma coleção RAG primeiro.

Reflex é o ranqueador padrão do [endpoint de reranking](https://docs.aivax.net/pt-br/docs/rag/reranking.md) autônomo: chamar esse endpoint sem um `model` seleciona o Reflex. Esta página cobre quando usar o Reflex; aquela página cobre a preparação de candidatos e a comparação de ranqueadores em profundidade.

Use o Reflex quando sua aplicação já possui os documentos candidatos, o conjunto de candidatos muda com frequência ou você deseja uma etapa de recuperação sem indexação e armazenamento de coleção. Use a [Busca Semântica](https://docs.aivax.net/pt-br/docs/rag/semantic-search.md) quando a AIVAX deve armazenar, indexar e buscar uma base de conhecimento persistente ou restringir um corpus que é grande demais para ser submetido como candidatos em cada requisição.

## Reflex ou Busca Semântica?

| Escolha Reflex quando... | Escolha Busca Semântica quando... |
| --- | --- |
| Sua aplicação já possui as strings de documentos candidatos. | Os documentos devem estar em coleções AIVAX gerenciadas. |
| Você precisa de recuperação imediatamente, sem uma etapa de indexação. | A base de conhecimento é persistente e pesquisada repetidamente. |
| O conjunto de candidatos é dinâmico ou específico da requisição. | O corpus é grande demais para ser submetido como candidatos em cada requisição. |
| Você quer ranqueamento sem coleção. | Você quer filtragem de coleção, metadados armazenados, referências de documentos e recuperação gerenciada. |

Reflex devolve candidatos de texto classificados; ele não gera uma resposta. Passe os documentos selecionados para o modelo de linguagem ou AI Gateway como contexto RAG.

## Usar Reflex

Chame a API de reranking com uma consulta e os documentos candidatos que sua aplicação deseja comparar. Os resultados são retornados em ordem de relevância e mantêm a posição de entrada necessária para associá-los aos dados da sua aplicação.

Use documentos candidatos concisos e focados. O reranking pode melhorar a ordem deles, mas não pode recuperar informações que não foram incluídas nos candidatos. Se o documento esperado estiver consistentemente ausente, melhore a seleção de candidatos, a segmentação ou a formulação da consulta antes de ajustar o ranqueador.

Reflex aceita até 10.000 documentos candidatos por requisição e devolve no máximo 200 resultados classificados. Se o seu pool de candidatos exceder 10.000 documentos, reduza‑o primeiro — com pré‑filtragem lexical, um ranqueamento de primeira passagem barato ou recuperação de coleção — e deixe o Reflex ordenar a lista curta.

Para a solicitação, resposta, autenticação e contrato de erro suportados, use a Referência da API:

[API endpoint reference](https://inference.aivax.net/apidocs?embed=iframe&embed-endpoint=Rerank%20documents)

## Usar Reflex com RAG

Reflex também é o reranker padrão após a AIVAX recuperar candidatos de coleções RAG. Neste fluxo, ele pode melhorar a ordem dos candidatos recuperados, mas não pode recuperar um documento que a etapa de recuperação não selecionou. Se documentos relevantes estiverem consistentemente ausentes, ajuste a recuperação, a segmentação, a formulação da consulta ou a quantidade de candidatos antes de ajustar o reranking.

Free, Pro e Max incluem uma cota diária de reranking para o Reflex, compartilhada entre chamadas autônomas e reranking RAG. Entradas em cache e não em cache consomem essa cota. É separado da cota de embeddings RAG e do limite de tempo de processamento; outros rerankers são cobrados normalmente. Para capacidade relativa do plano e regras de cobertura, veja [Planos e Limites](https://docs.aivax.net/pt-br/docs/limits.md#included-daily-subscription-allowances).
