Esta página foi traduzida automaticamente do inglês e pode estar desatualizada. Leia o original
Reflex
Reflex é a busca sem coleção da AIVAX para RAG. Envie uma consulta junto com strings de documentos candidatos e receba os itens mais relevantes em ordem classificada — sem indexação, armazenamento ou manutenção de uma coleção RAG primeiro.
Reflex é o ranqueador padrão do endpoint de reranking autônomo: chamar esse endpoint sem um model seleciona o Reflex. Esta página cobre quando usar o Reflex; aquela página cobre a preparação de candidatos e a comparação de ranqueadores em profundidade.
Use o Reflex quando sua aplicação já possui os documentos candidatos, o conjunto de candidatos muda com frequência ou você deseja uma etapa de recuperação sem indexação e armazenamento de coleção. Use a Busca Semântica quando a AIVAX deve armazenar, indexar e buscar uma base de conhecimento persistente ou restringir um corpus que é grande demais para ser submetido como candidatos em cada requisição.
Reflex ou Busca Semântica? #
| Escolha Reflex quando… | Escolha Busca Semântica quando… |
|---|---|
| Sua aplicação já possui as strings de documentos candidatos. | Os documentos devem estar em coleções AIVAX gerenciadas. |
| Você precisa de recuperação imediatamente, sem uma etapa de indexação. | A base de conhecimento é persistente e pesquisada repetidamente. |
| O conjunto de candidatos é dinâmico ou específico da requisição. | O corpus é grande demais para ser submetido como candidatos em cada requisição. |
| Você quer ranqueamento sem coleção. | Você quer filtragem de coleção, metadados armazenados, referências de documentos e recuperação gerenciada. |
Reflex devolve candidatos de texto classificados; ele não gera uma resposta. Passe os documentos selecionados para o modelo de linguagem ou AI Gateway como contexto RAG.
Usar Reflex #
Chame a API de reranking com uma consulta e os documentos candidatos que sua aplicação deseja comparar. Os resultados são retornados em ordem de relevância e mantêm a posição de entrada necessária para associá-los aos dados da sua aplicação.
Use documentos candidatos concisos e focados. O reranking pode melhorar a ordem deles, mas não pode recuperar informações que não foram incluídas nos candidatos. Se o documento esperado estiver consistentemente ausente, melhore a seleção de candidatos, a segmentação ou a formulação da consulta antes de ajustar o ranqueador.
Reflex aceita até 10.000 documentos candidatos por requisição e devolve no máximo 200 resultados classificados. Se o seu pool de candidatos exceder 10.000 documentos, reduza‑o primeiro — com pré‑filtragem lexical, um ranqueamento de primeira passagem barato ou recuperação de coleção — e deixe o Reflex ordenar a lista curta.
Para a solicitação, resposta, autenticação e contrato de erro suportados, use a Referência da API:
Usar Reflex com RAG #
Reflex também é o reranker padrão após a AIVAX recuperar candidatos de coleções RAG. Neste fluxo, ele pode melhorar a ordem dos candidatos recuperados, mas não pode recuperar um documento que a etapa de recuperação não selecionou. Se documentos relevantes estiverem consistentemente ausentes, ajuste a recuperação, a segmentação, a formulação da consulta ou a quantidade de candidatos antes de ajustar o reranking.
Free, Pro e Max incluem uma cota diária de reranking para o Reflex, compartilhada entre chamadas autônomas e reranking RAG. Entradas em cache e não em cache consomem essa cota. É separado da cota de embeddings RAG e do limite de tempo de processamento; outros rerankers são cobrados normalmente. Para capacidade relativa do plano e regras de cobertura, veja Planos e Limites.
